Stefan Webb: Por que entrei para a Zilliz
Olá! Sou Stefan, um recém-nomeado Developer Advocate na Zilliz, criadora do Milvus—o principal banco de dados vetorial open-source. Você pode se perguntar: "O que um Developer Advocate faz?" Em termos simples, ajudamos desenvolvedores de software a ter sucesso com tecnologias específicas por diversos meios, incluindo palestras públicas, criação de conteúdo e engajamento direto com a comunidade.
Neste post, gostaria de compartilhar minha jornada até me tornar Developer Advocate na Zilliz.
Depois de concluir meus estudos de pós-graduação, passei mais de três anos na indústria como Applied ML Researcher na Meta e no Twitter, onde tive a sorte de trabalhar com equipes excepcionais. No entanto, em novembro de 2022, minha trajetória profissional mudou inesperadamente. Como muitas outras pessoas, fiquei impressionado com o ChatGPT quando foi lançado. Foi a primeira vez desde a minha juventude que fiquei verdadeiramente maravilhado com um avanço tecnológico—algo que me lembrou os saltos dos gráficos EGA de 16 cores para VGA de 256 cores e depois para SVGA de 16 milhões de cores.
Minha pesquisa de Ph.D. se concentrou na interseção entre Estatística Bayesiana e Deep Learning, com forte ênfase em Modelos de IA Generativa Profunda. Na época, word2vec para embeddings de palavras e RNNs para modelagem de linguagem eram considerados o estado da arte. Fiquei surpreso ao ver o quanto a modelagem de linguagem e imagem havia avançado rapidamente nos poucos anos desde que deixei a academia.
Inspirado por esses avanços, decidi mergulhar no novo cenário da IA Generativa, explorando LLMs, geração de texto para imagem, engenharia de prompts, fine-tuning e RAG, para citar alguns. Ao longo de 2023, refleti sobre como redirecionar minha carreira para a IA Generativa, experimentando uma ideia de produto para consumidores e assessorando fundadores de startups e investidores em finanças.
Ao refletir, percebi que os aspectos de que mais gostava em minhas funções anteriores eram as interações presenciais e o engajamento com a comunidade, especialmente no desenvolvimento e gerenciamento de software open-source e no compartilhamento de conhecimento sobre novas tecnologias. Eu adorava fazer palestras sobre ideias de pesquisa emergentes e interagir com a comunidade open-source. Descobrir que existiam funções dedicadas a essas atividades em um campo profundamente técnico foi revelador.
Por que a Zilliz, especificamente? No centro da revolução da IA Generativa está a necessidade crítica de armazenamento e recuperação de dados eficientes e escaláveis—um desafio que os bancos de dados vetoriais estão em posição única para resolver. A Zilliz, por meio de seu banco de dados vetorial open-source Milvus, está democratizando essa tecnologia poderosa, que antes era domínio exclusivo dos gigantes da tecnologia. Como o banco de dados vetorial open-source mais amplamente adotado, o Milvus oferece um conjunto robusto de recursos que está se mostrando inestimável em diversos setores.
Estou animado para contribuir com o crescimento da comunidade open-source do Milvus, aproveitando minha paixão pelo compartilhamento de conhecimento e pelo desenvolvimento open-source. Se você ou sua empresa tiverem interesse em colaboração, entre em contato comigo pelo LinkedIn. Além disso, sou o novo anfitrião dos nossos encontros de Dados Não Estruturados regulares em San Francisco e no South Bay e adoraria ver você lá e saber mais sobre o que você está construindo. Espero ver você lá!
Continue lendo

Proactive Monitoring for Vector Database: Zilliz Cloud Integrates with Datadog
we're excited to announce Zilliz Cloud's integration with Datadog, enabling comprehensive monitoring and observability for your vectorDB deployments.

Why Deepseek is Waking up AI Giants Like OpenAI And Why You Should Care
Discover how DeepSeek R1's open-source AI model with superior reasoning capabilities and lower costs is disrupting the AI landscape and challenging tech giants like OpenAI.

Vector Databases vs. Hierarchical Databases
Use a vector database for AI-powered similarity search; use a hierarchical database for organizing data in parent-child relationships with efficient top-down access patterns.



