Einführung von umfassendem Monitoring & Observability in Zilliz Cloud
Bei Zilliz setzen wir uns dafür ein, unseren Nutzern die Tools bereitzustellen, die sie benötigen, um leistungsstarke Vektordatenbank-Anwendungen zu erstellen und zu betreiben. In den vergangenen Monaten haben unsere Engineering-Teams an einer Vielzahl von Monitoring- und Observability-Funktionen gearbeitet, und wir freuen uns, sie Ihnen heute vorzustellen. Diese leistungsstarke Ergänzung unserer Plattform ermöglicht es Nutzern, die Performance ihrer Cluster zu überwachen, benutzerdefinierte Warnmeldungen einzurichten und schnell auf potenzielle Probleme zu reagieren.
Cluster-Metriken: Einblick in die Performance Ihrer Vektordatenbank
Unser neues Metrics-Dashboard bietet einen umfassenden Überblick über die Performance Ihres Clusters in mehreren zentralen Bereichen:
5 Ressourcenmetriken: Überwachen Sie CPU-Auslastung, Speichernutzung und Speicherverbrauch.
9 Performance-Metriken: Verfolgen Sie Abfragen pro Sekunde (QPS), Vektoren pro Sekunde (VPS) und Latenz für Lese- und Schreibvorgänge.
4 Datenmetriken: Überwachen Sie die Anzahl Ihrer Collections, die Anzahl der Entitäten und geladene Entitäten.
Diese Metriken sind über ein intuitives Dashboard verfügbar, mit dem Sie benutzerdefinierte Zeiträume für detaillierte Analysen auswählen können.
cluster metrics screenshot.png
Abbildung 1: Screenshots der Zilliz Cloud Monitoring-Metriken
Anpassbare Warnmeldungen: Potenziellen Problemen einen Schritt voraus
Zur Ergänzung unserer Metriken haben wir zwei Arten von Warnmeldungen eingeführt:
- 5 Organisations-Warnmeldungen: Konzentrieren sich auf abrechnungsbezogene Themen wie Ablauf der Kreditkarte, kostenloses Guthaben und Nutzungskosten.
Figure 2- Screenshot of Organization Alerts .png
Abbildung 2: Screenshot der Organisations-Warnmeldungen
- 34 Projekt-Warnmeldungen: Überwachen operative Aspekte Ihrer Cluster, einschließlich CU-Nutzung, QPS-Schwellenwerte, Latenzprobleme und Anfrageanomalien.
Figure 3- Screenshot of Project Alerts.png
Abbildung 3: Screenshot der Projekt-Warnmeldungen
Unser Warnmeldesystem verfügt über vordefinierte Ziele und Bedingungen, ermöglicht aber auch umfangreiche Anpassungen. Sie können Schwellenwerte und Zeitdauern festlegen und aus verschiedenen Schweregraden wählen, um die Warnmeldungen auf Ihre spezifischen Anforderungen abzustimmen.
Hauptfunktionen unseres Metriken- und Warnmeldesystems
Unser neues Monitoring- & Observability-System wurde entwickelt, um Ihnen umfassende Einblicke in Ihre Zilliz Cloud-Cluster zu geben. Das können Sie erwarten:
Echtzeit-Monitoring ermöglicht es Ihnen, minutengenaue Einblicke in die Performance Ihres Clusters zu erhalten. Dieses unmittelbare Feedback erlaubt es Ihnen, Performance-Probleme schnell zu erkennen und darauf zu reagieren, sobald sie auftreten.
Wir haben Anpassbare Dashboards implementiert, mit denen Sie Ihre Ansicht so zuschneiden können, dass sie sich auf die Metriken konzentriert, die für Ihren Anwendungsfall am wichtigsten sind. Ganz gleich, ob Sie sich hauptsächlich mit Abfrage-Performance, Ressourcennutzung oder Datenwachstum befassen, Sie können Ihr Dashboard so konfigurieren, dass diese zentralen Bereiche hervorgehoben werden.
Unser System zur Flexiblen Warnmeldungskonfiguration ermöglicht es Ihnen, Warnmeldungen mit benutzerdefinierten Schwellenwerten und Zeitdauern einzurichten. Diese granulare Kontrolle hilft Ihnen, potenzielle Probleme frühzeitig zu erkennen und ermöglicht ein proaktives Management Ihrer Cluster.
Damit Sie keine wichtige Benachrichtigung verpassen, haben wir Mehrere Benachrichtigungskanäle integriert. Sie können Warnmeldungen per E-Mail, PagerDuty, Slack oder Webhook-Integrationen erhalten, wodurch sich diese Benachrichtigungen einfach in Ihren bestehenden Workflow und Ihre Monitoring-Systeme integrieren lassen.
Schließlich bietet unser System Zugriff auf Historische Daten, mit denen Sie Performance-Trends im Zeitverlauf analysieren können. Diese Funktion ist entscheidend für langfristige Optimierung, Kapazitätsplanung und das Verständnis der Auswirkungen von Änderungen an Ihrem System.
Diese Funktionen arbeiten zusammen, um eine robuste Monitoring- und Observability-Lösung bereitzustellen, die Sie dabei unterstützt, die optimale Performance Ihrer Zilliz Cloud-Cluster aufrechtzuerhalten.
Erste Schritte
Unsere Monitoring- & Observability-Funktionen sind so konzipiert, dass sie in Ihrer Zilliz Cloud-Konsole leicht zugänglich sind. So können Sie diese Tools nutzen:
Zugriff auf Metriken: Navigieren Sie in Ihrer Cluster-Ansicht zum Tab „Metrics“, um detaillierte Leistungsdaten zu erkunden.
Einrichten von Alerts: Besuchen Sie die Seiten „Organization Alerts“ oder „Project Alerts“, um Ihre Alert-Einstellungen zu konfigurieren und zu verwalten.
Ausführliche Informationen zu unseren Monitoring- & Observability-Funktionen, einschließlich Schritt-für-Schritt-Anleitungen und Best Practices, finden Sie auf unserer Dokumentationsseite. Diese Ressourcen helfen Ihnen, diese leistungsstarken Tools optimal zu nutzen und Ihr Zilliz Cloud-Erlebnis zu optimieren.
Was kommt als Nächstes?
Wir arbeiten kontinuierlich daran, unser Metrik- und Alert-System zu verbessern. Hier ist ein Einblick in unsere Roadmap:
Alert-Vorlagen: Wir entwickeln Vorlagen für eine schnelle Einrichtung und einfache Anwendung auf mehrere Alerts, um den Alert-Konfigurationsprozess zu optimieren.
Pod-Ressourcenmetriken: Künftige Metriken werden detaillierte Informationen auf Pod-Ebene enthalten, wie CPU-Auslastung, Speicherauslastung und Netzwerkfluss.
Erweiterte Metriken für Datenoperationen: Wir erweitern unsere Metriken, um tiefere Einblicke in Ihre Datenoperationen zu bieten, einschließlich Metriken zu indizierten Entitäten, Cluster-Verbindungsmetriken und mehr.
Integrationen von Drittanbietern: Zur Unterstützung fortschrittlicher Monitoring-Setups entwickeln wir Integrationen mit den beliebten Monitoring-Plattformen Datadog und Prometheus.
Diese kommenden Funktionen bieten noch granularere Kontrolle und Einblicke in Ihre Zilliz Cloud-Cluster, sodass Sie die Leistung optimieren und effektiver auf Probleme reagieren können. Um mehr über die neue Metrics and Alerts-Funktion von Zilliz Cloud zu erfahren, nehmen Sie am 3. Oktober an unserem Release-Deep-Dive-Webinar teil.
Wir freuen uns darauf, diese Verbesserungen in den kommenden Monaten einzuführen. Ihr Feedback ist entscheidend für die Weiterentwicklung von Zilliz Cloud. Teilen Sie uns Ihre Meinung über Discord mit oder kontaktieren Sie unser Support-Team.
Wir freuen uns darauf, von Ihnen zu hören, während Sie diese neuen Monitoring- & Observability-Funktionen erkunden.
Weiterlesen

Why Not All VectorDBs Are Agent-Ready
Explore why choosing the right vector database is critical for scaling AI agents, and why traditional solutions fall short in production.

Announcing the General Availability of Zilliz Cloud BYOC on Google Cloud Platform
Zilliz Cloud BYOC on GCP offers enterprise vector search with full data sovereignty and seamless integration.

DeepSeek Always Busy? Deploy It Locally with Milvus in Just 10 Minutes—No More Waiting!
Learn how to set up DeepSeek-R1 on your local machine using Ollama, AnythingLLM, and Milvus in just 10 minutes. Bypass busy servers and enhance AI responses with custom data.


