Nouveau pour Zilliz Cloud : des performances multipliées par 10 et des fonctionnalités d’entreprise améliorées
Les bases de données vectorielles atteignent leur plein potentiel alors que de plus en plus d’entreprises déploient des applications d’IA en production, mais cette évolution apporte de nouveaux défis en matière de performances, d’échelle et de gestion. La version actuelle de Zilliz Cloud relève ces défis de front avec notre nouveau moteur de recherche vectorielle Cardinal et une suite de fonctionnalités prêtes pour l’entreprise.
Franchir la barrière des performances avec Cardinal
Cardinal, notre nouveau moteur de recherche vectorielle qui offre un gain de performances de 10X dans les environnements de production, est au cœur de cette version. Il ne s’agit pas seulement de vitesse brute : nous avons repensé la manière dont la recherche vectorielle doit fonctionner à grande échelle.
Cardinal introduit AutoIndex, qui ajuste automatiquement la configuration de votre index en fonction des caractéristiques des données et de la configuration matérielle—plus besoin de réglages manuels ni de compromis sur les performances. Le système s’adapte en continu pour offrir des performances de recherche optimales, permettant aux équipes de développement de se concentrer sur la création de fonctionnalités plutôt que sur la gestion de l’infrastructure.
Sous le capot, Cardinal utilise une approche d’optimisation en trois couches. La couche algorithmique combine des approches avancées basées sur IVF et sur les graphes, tout en maintenant une haute précision même avec des résultats filtrés. La couche d’ingénierie met en œuvre une allocation mémoire spécialisée et le multi-threading pour des gains de performances concrets. Au niveau le plus bas, les optimisations du noyau pour les plateformes x86 et ARM permettent d’obtenir jusqu’à 3X d’accélération par rapport aux implémentations standard.
Des fonctionnalités prêtes pour la production à l’échelle de l’entreprise
Alors que les bases de données vectorielles deviennent une infrastructure critique pour les applications d’IA, nous avons renforcé les capacités d’entreprise de Zilliz Cloud sur tous les plans.
Multi-replica devient GA
Notre fonctionnalité multi-replica est désormais généralement disponible, offrant des améliorations linéaires du QPS à mesure que vous ajoutez des réplicas. Pour les applications à fort trafic, les requêtes sont automatiquement distribuées entre les réplicas, réduisant la latence et améliorant l’efficacité. Le système distribue également les réplicas entre les zones de disponibilité, garantissant un fonctionnement continu même en cas de panne de zone.
Améliorations de l’infrastructure
Nous avons augmenté de 50% la capacité de nos unités de calcul optimisées pour les performances, qui prennent désormais en charge jusqu’à 1,5 million de vecteurs par CU (à 768 dimensions). Pour les déploiements à grande échelle, cela se traduit par une réduction des coûts d’environ 30%.
Observabilité renforcée
L’intégration avec Prometheus permet une surveillance en temps réel des métriques système. Nous avons mis en place 41 alertes couvrant 26 métriques, allant de la santé de l’infrastructure aux opérations sur les données. Cette surveillance complète garantit que les équipes peuvent gérer de manière proactive leur infrastructure de recherche vectorielle.
Migration des données simplifiée
Nous avons ajouté des voies de migration depuis Qdrant et Pinecone Serverless afin de soutenir l’écosystème en pleine croissance. Le processus de migration préserve l’intégrité de vos données tout en vous permettant d’utiliser les capacités renforcées de Zilliz Cloud.
Authentification et présence mondiale
La sécurité rencontre la simplicité avec notre nouveau système d’authentification basé sur Auth0, prenant en charge l’email, l’authentification GitHub/Google et le SSO d’entreprise via Okta. Nous avons également étendu notre présence mondiale avec une nouvelle région AWS Tokyo, portant notre total à 12 régions dans le monde.
Améliorations de l’expérience développeur
Au-delà des améliorations techniques, nous avons entièrement repensé l’expérience développeur. La nouvelle console web offre des outils de visualisation améliorés et des workflows simplifiés. Nous avons également remanié notre système de paiement avec des cycles de facturation étendus pour les workflows d’entreprise, des notifications automatisées et une visibilité détaillée des coûts grâce à des factures détaillées.
Premiers pas
Ces fonctionnalités sont disponibles dès maintenant sur tous les déploiements Zilliz Cloud. Explorez-les avec notre offre gratuite (aucune carte bancaire requise), ou essayez notre essai entreprise de 30 jours avec jusqu’à $200 de crédits. Abonnez-vous via n’importe quelle marketplace cloud et recevez un crédit supplémentaire de $100.
Pour une documentation détaillée et des guides de migration, consultez notre documentation.
Continuer à lire

What Is a Vector Lakebase?
A Vector Lakebase is a unified, lake-native data architecture for AI that combines vector-database-grade serving with open lake storage, reusable lake-level indexes, and a shared semantic layer.

Zilliz Cloud Delivers Better Performance and Lower Costs with Arm Neoverse-based AWS Graviton
Zilliz Cloud adopts Arm-based AWS Graviton3 CPUs to cut costs, speed up AI vector search, and power billion-scale RAG and semantic search workloads.

Building RAG Pipelines for Real-Time Data with Cloudera and Milvus
explore how Cloudera can be integrated with Milvus to effectively implement some of the key functionalities of RAG pipelines.


