Пример алертов#

Для мониторинга состояния и оперативного реагирования на критические события настраиваются алерты (например, в Prometheus). Они позволяют отслеживать такие параметры, как использование памяти, доступность шардов, производительность запросов и объем данных. Алерты интегрируются с системами оповещения и могут отображаться (например, в Grafana) для визуализации состояния кластера.

Пример конфигурации алертов:

 groups:
- name: qdrant-alerts
  rules:
  - alert: HighMemoryUsage
    expr: process_resident_memory_bytes / 1024^2 > 4096  # > 4 ГБ
    for: 5m
    labels:
      severity: warning
    annotations:
      summary: "High memory usage in Qdrant ({{ $value }} MB)"
      description: "Memory usage exceeded 4 GB for 5 minutes."

  - alert: UnavailableShards
    expr: sum(qdrant_shard_unavailable) > 0
    labels:
      severity: critical
    annotations:
      summary: "Unavailable shards detected ({{ $value }})"
      description: "Some shards are down in Qdrant cluster."

Ключевые метрики для алертов:

  • qdrant_shard_unavailable: количество недоступных шардов.

  • process_resident_memory_bytes: использование RAM.

  • qdrant_collection_points_total: количество векторов в коллекции.

  • qdrant_grpc_requests_duration_seconds: задержка gRPC-запросов.