Пример алертов#
Для мониторинга состояния и оперативного реагирования на критические события настраиваются алерты (например, в Prometheus). Они позволяют отслеживать такие параметры, как использование памяти, доступность шардов, производительность запросов и объем данных. Алерты интегрируются с системами оповещения и могут отображаться (например, в Grafana) для визуализации состояния кластера.
Пример конфигурации алертов:
groups:
- name: qdrant-alerts
rules:
- alert: HighMemoryUsage
expr: process_resident_memory_bytes / 1024^2 > 4096 # > 4 ГБ
for: 5m
labels:
severity: warning
annotations:
summary: "High memory usage in Qdrant ({{ $value }} MB)"
description: "Memory usage exceeded 4 GB for 5 minutes."
- alert: UnavailableShards
expr: sum(qdrant_shard_unavailable) > 0
labels:
severity: critical
annotations:
summary: "Unavailable shards detected ({{ $value }})"
description: "Some shards are down in Qdrant cluster."
Ключевые метрики для алертов:
qdrant_shard_unavailable: количество недоступных шардов.process_resident_memory_bytes: использование RAM.qdrant_collection_points_total: количество векторов в коллекции.qdrant_grpc_requests_duration_seconds: задержка gRPC-запросов.