Zilliz Cloud offre de meilleures performances et des coûts réduits avec AWS Graviton basé sur Arm Neoverse
Avec l’évolution de l’infrastructure cloud pour soutenir la croissance exponentielle de l’IA, Zilliz Cloud —la base de données vectorielle entièrement gérée construite sur Milvus —exploite des processeurs basés sur Arm Neoverse pour offrir une rentabilité et des performances inégalées pour les charges de travail d’IA à l’échelle de l’entreprise. Cet article de blog explore comment Zilliz Cloud est passé des processeurs x86 aux processeurs Arm pour les charges de travail intensives en calcul, réduisant les coûts opérationnels et permettant la recherche vectorielle à l’échelle du milliard pour les charges de travail d’IA critiques, telles que le RAG et la recherche multimodale.
Zilliz Cloud : base de données vectorielle entièrement gérée pour les charges de travail de production
Zilliz Cloud est une base de données vectorielle entièrement gérée conçue pour les applications d’IA en production, offrant une recherche vectorielle à grande échelle à faible coût. Construite sur Milvus open source, elle prend en charge jusqu’à 100 milliards de vecteurs dans des données non structurées (images, texte, audio) avec une recherche de similarité vectorielle à latence inférieure à 20 ms, ce qui la rend idéale pour des applications comme le RAG, les agents IA, la recherche visuelle, les systèmes de recommandation et la détection d’anomalies. Les principales fonctionnalités de Zilliz Cloud incluent AutoIndex, qui sélectionne dynamiquement les stratégies d’indexation optimales pour une précision de recherche élevée sans réglage manuel, un moteur d’indexation Cardinal qui permet une recherche 10 fois plus rapide que Milvus open source, et la prise en charge de la récupération hybride qui combine la recherche vectorielle dense et la recherche en texte intégral pour de meilleurs résultats.
Principaux avantages de Zilliz Cloud
Haute performance : Capable de servir des données vectorielles à l’échelle du milliard avec des milliers de QPS. Choix flexible de types de clusters pour atteindre un équilibre entre latence, précision et coût
Évolutivité : Évolue horizontalement pour gérer jusqu’à 100 milliards de vecteurs grâce à l’architecture distribuée native cloud
Rentabilité : Réduit les coûts d’infrastructure de 70 % via la quantification binaire RaBitQ, les optimisations d’index vectoriel et le stockage hiérarchisé
Facilité d’utilisation : Simplifie le déploiement et les opérations avec AutoIndex et un service entièrement géré
Sécurité et Fiabilité** :** Offre une sécurité de niveau entreprise et un SLA de disponibilité de 99,95 %
Comprendre les bases de données vectorielles
Les bases de données vectorielles sont spécialisées dans le stockage de vecteurs de grande dimension générés par des modèles d’embedding. Ces vecteurs permettent la recherche sémantique via la recherche approximative des plus proches voisins, ce qui est essentiel pour les workflows d’IA en traitement du langage naturel, vision par ordinateur et systèmes de recommandation. En gérant l’indexation en temps réel et les requêtes multimodales, les bases de données vectorielles répondent aux défis liés à la gestion efficace des données non structurées. Zilliz Cloud exploite ces capacités pour alimenter des applications d’IA avec une latence inférieure à 20 ms, garantissant de hautes performances pour les charges de travail de production.
Le rôle de Milvus
Milvus, la base de données vectorielle open source la plus populaire avec plus de 36 000 étoiles sur GitHub, constitue le fondement de Zilliz Cloud grâce à son architecture évolutive native cloud. Sa conception distribuée permet à Zilliz Cloud d’évoluer horizontalement sur des milliards de vecteurs tout en maintenant une faible latence, permettant une gestion efficace d’ensembles de données massifs.
À partir de Milvus 2.3, la prise en charge des processeurs Arm est ajoutée, ainsi que des images Docker officielles pour Arm64, simplifiant l’installation et le déploiement sur des plateformes économiques et économes en énergie. L’exécution de Milvus sur des processeurs Arm offre un gain de performance de 20 % par rapport au x86 traditionnel, ce qui se traduit par des requêtes plus rapides pour les applications qui reposent sur une recherche et une récupération vectorielles rapides.
Parcours vers les processeurs basés sur Arm
L’adoption par Zilliz Cloud des processeurs AWS Graviton3 basés sur Arm marque une avancée stratégique en matière de performance et de rentabilité des charges de travail d’IA. Les processeurs AWS Graviton3, propulsés par l’architecture Arm Neoverse, exploitent la prise en charge des instructions SVE et BFloat16 pour offrir des performances et une efficacité supérieures. Ces améliorations architecturales incluent également des unités vectorielles plus larges et une pile logicielle améliorée, faisant de Graviton3 un choix idéal pour les tâches GenAI comme la recherche sémantique et les pipelines RAG qui nécessitent des opérations vectorielles à haut débit et un traitement en temps réel.
Le coût constitue un obstacle majeur à l’adoption de la recherche IA à grande échelle dans les entreprises. Pour y remédier, Zilliz Cloud a mis en œuvre de nombreuses optimisations d’ingénierie qui réduisent considérablement les coûts et améliorent l’efficacité, rendant la recherche vectorielle plus accessible à ses clients, même à l’échelle du milliard.
Depuis qu’elle a découvert la puissance de calcul avancée et la conception d’instructions optimisée pour les opérations vectorielles, l’équipe de Zilliz Cloud a travaillé en étroite collaboration avec les équipes d’Arm et d’AWS afin de migrer les charges de travail d’indexation intensives en calcul vers AWS Graviton3.
L’un des avantages les plus notables de l’adoption des processeurs AWS Graviton3 est l’augmentation substantielle des performances et de la rentabilité. Plus précisément, Zilliz Cloud a observé :
Performance de construction d’index : La performance de construction d’index a augmenté de 50 % par rapport à l’implémentation x86, accélérant considérablement l’indexation vectorielle, une opération critique lors de l’ingestion des données pour accélérer les requêtes au moment de la récupération. Cette amélioration permet un traitement des données plus rapide et une gestion plus efficace des jeux de données vectorielles à l’échelle du milliard.
Opérations de recherche : Les opérations de recherche ont enregistré un gain d’efficacité de 10 % par rapport à x86, ce qui se traduit par une exécution plus rapide des résultats de requête et une récupération des données plus réactive. Cette amélioration permet une navigation plus fluide dans de grands jeux de données, garantissant que les utilisateurs peuvent localiser rapidement des enregistrements précis ou explorer de vastes volumes d’informations.
Au-delà des gains de performance, l’adoption d’instances cloud basées sur AWS Graviton3 a réduit les coûts opérationnels de Zilliz Cloud de 10 %, grâce à l’efficacité énergétique des processeurs et à leur avantage en matière de rapport prix-performance par rapport aux instances x86. Cette mise à niveau s’inscrit dans la mission de Zilliz Cloud, qui consiste à fournir des solutions hautes performances et rentables pour les applications d’IA. En exploitant les processeurs AWS Graviton3, Zilliz Cloud renforce sa capacité à gérer des charges de travail GenAI exigeantes tout en réduisant le coût total de possession.
"L’architecture d’AWS Graviton basée sur Arm Neoverse offre une solution rentable et écoénergétique pour la recherche vectorielle à très grande échelle en production, garantissant que les entreprises peuvent accroître l’adoption de la recherche IA sans compromettre les performances," a déclaré James Luan, VP of Engineering chez Zilliz. "En intégrant la conception innovante d’Arm, Zilliz Cloud permet aux organisations de faire évoluer leurs applications d’IA avec une plus grande efficacité, tout en maintenant les hautes performances nécessaires pour rester compétitives."
Conclusion
L’intégration par Zilliz Cloud des processeurs AWS Graviton3 basés sur Arm offre un avantage concurrentiel dans l’infrastructure d’IA, en combinant évolutivité et performances optimisées en termes de coûts pour les charges de travail critiques. En tirant parti de son architecture de calcul améliorée et de son efficacité énergétique, la plateforme accélère les déploiements IA/ML grâce à une construction d’index plus rapide, des capacités de recherche accélérées et des coûts d’infrastructure réduits. Alors que les organisations accordent une priorité croissante aux solutions évolutives et rentables pour les charges de travail pilotées par l’IA, l’adoption par Zilliz Cloud d’une technologie de calcul haute performance et économique garantit qu’elle demeure un leader dans la fourniture de services cloud innovants et efficaces. Cette approche tournée vers l’avenir permet aux clients de relever des défis complexes liés aux données tout en conservant leur agilité dans un paysage technologique de plus en plus complexe et en constante évolution.
Consultez le Arm Developer Hub pour découvrir des outils éprouvés, des démos et des guides étape par étape afin de donner un coup d’accélérateur à vos applications d’IA sur l’architecture Arm.
Prêt à révolutionner la recherche sémantique ? Explorez notre tutoriel sur la création d’une application optimisée par RAG à l’aide de Zilliz Cloud sur des serveurs basés sur Arm.
Migrez en toute simplicité avec Arm Cloud Migration – votre raccourci pour améliorer l’efficacité et optimiser les performances sur Arm.
Continuer à lire

Selecting the Right ETL Tools for Unstructured Data to Prepare for AI
Learn the right ETL tools for unstructured data to power AI. Explore key challenges, tool comparisons, and integrations with Milvus for vector search.

Vector Databases vs. Graph Databases
Use a vector database for AI-powered similarity search; use a graph database for complex relationship-based queries and network analysis.

Vector Databases vs. Hierarchical Databases
Use a vector database for AI-powered similarity search; use a hierarchical database for organizing data in parent-child relationships with efficient top-down access patterns.



