Novedades de Zilliz Cloud: aumento del rendimiento de 10X y funciones empresariales mejoradas
Las bases de datos vectoriales están alcanzando su madurez a medida que más empresas llevan aplicaciones de IA a producción, pero este cambio trae nuevos desafíos en torno al rendimiento, la escala y la gestión. El lanzamiento de hoy de Zilliz Cloud aborda estos desafíos de frente con nuestro nuevo motor de búsqueda vectorial Cardinal y un conjunto de funciones listas para empresas.
Rompiendo la barrera del rendimiento con Cardinal
Cardinal, nuestro nuevo motor de búsqueda vectorial que ofrece un aumento de rendimiento de 10 veces en entornos de producción, está en el centro de este lanzamiento. No se trata solo de velocidad bruta: hemos reinventado cómo debería funcionar la búsqueda vectorial a escala.
Cardinal introduce AutoIndex, que ajusta automáticamente la configuración de tu índice en función de las características de los datos y la configuración del hardware: se acabaron los ajustes manuales o las concesiones de rendimiento. El sistema se adapta continuamente para ofrecer un rendimiento de búsqueda óptimo, permitiendo que los equipos de desarrollo se centren en crear funciones en lugar de gestionar infraestructura.
Bajo el capó, Cardinal emplea un enfoque de optimización de tres capas. La capa de algoritmos combina enfoques avanzados basados en IVF y en grafos, manteniendo una alta precisión incluso con resultados filtrados. La capa de ingeniería implementa asignación de memoria especializada y multihilo para obtener mejoras de rendimiento en el mundo real. En el nivel más bajo, las optimizaciones del kernel para plataformas x86 y ARM logran una aceleración de hasta 3 veces respecto a las implementaciones estándar.
Funciones listas para producción a escala empresarial
A medida que las bases de datos vectoriales se convierten en infraestructura crítica para las aplicaciones de IA, hemos mejorado las capacidades empresariales de Zilliz Cloud en todos los ámbitos.
Multi-réplica pasa a disponibilidad general
Nuestra función multi-réplica ya está disponible de forma general, ofreciendo mejoras lineales de QPS a medida que añades réplicas. Para aplicaciones de alto tráfico, las consultas se distribuyen automáticamente entre las réplicas, reduciendo la latencia y mejorando la eficiencia. El sistema también distribuye las réplicas entre zonas de disponibilidad, garantizando una operación continua incluso durante interrupciones de zona.
Mejoras de infraestructura
Hemos aumentado la capacidad de nuestras unidades de cómputo optimizadas para rendimiento en un 50%, y ahora admiten hasta 1,5 millones de vectores por CU (a 768 dimensiones). Para implementaciones a gran escala, esto se traduce en una reducción de costos de aproximadamente el 30%.
Observabilidad mejorada
La integración con Prometheus permite el monitoreo en tiempo real de las métricas del sistema. Hemos implementado 41 alertas en 26 métricas que cubren todo, desde la salud de la infraestructura hasta las operaciones de datos. Este monitoreo integral garantiza que los equipos puedan gestionar proactivamente su infraestructura de búsqueda vectorial.
Migración de datos simplificada
Hemos añadido rutas de migración desde Qdrant y Pinecone Serverless para apoyar el ecosistema en crecimiento. El proceso de migración preserva la integridad de tus datos al tiempo que te permite usar las capacidades mejoradas de Zilliz Cloud.
Autenticación y presencia global
La seguridad se combina con la comodidad gracias a nuestro nuevo sistema de autenticación basado en Auth0, que admite correo electrónico, autenticación con GitHub/Google y SSO empresarial a través de Okta. También hemos ampliado nuestra presencia global con una nueva región de AWS en Tokio, elevando nuestro total a 12 regiones en todo el mundo.
Mejoras en la experiencia del desarrollador
Más allá de las mejoras técnicas, hemos renovado la experiencia del desarrollador. La nueva consola web proporciona herramientas de visualización mejoradas y flujos de trabajo optimizados. También hemos rediseñado nuestro sistema de pagos con ciclos de facturación extendidos para flujos de trabajo empresariales, notificaciones automatizadas y visibilidad detallada de costos mediante facturas desglosadas.
Primeros pasos
Estas funciones ya están disponibles en todas las implementaciones de Zilliz Cloud. Explora con nuestro nivel gratuito (no se requiere tarjeta de crédito), o prueba nuestra versión de prueba empresarial de 30 días con hasta $200 en créditos. Suscríbete a través de cualquier marketplace en la nube y recibe un crédito adicional de $100.
Para obtener documentación detallada y guías de migración, visita nuestra documentación.
Sigue leyendo

8 Latest RAG Advancements Every Developer Should Know
Explore eight advanced RAG variants that can solve real problems you might be facing: slow retrieval, poor context understanding, multimodal data handling, and resource optimization.

How to Use Anthropic MCP Server with Milvus
MCP + Milvus: Streamline AI agent development with standardized data access, eliminating integration hassles while enhancing context and flexibility.

DeepRAG: Thinking to Retrieval Step by Step for Large Language Models
Discover DeepRAG, an advanced retrieval-augmented generation (RAG) model that improves LLM accuracy by retrieving only essential data through step-by-step reasoning.


