Stefan Webb: Por que entrei para a Zilliz
Olá! Sou Stefan, um recém-nomeado Developer Advocate na Zilliz, criadora do Milvus—o principal banco de dados vetorial open-source. Você pode se perguntar: "O que um Developer Advocate faz?" Em termos simples, ajudamos desenvolvedores de software a ter sucesso com tecnologias específicas por diversos meios, incluindo palestras públicas, criação de conteúdo e engajamento direto com a comunidade.
Neste post, gostaria de compartilhar minha jornada até me tornar Developer Advocate na Zilliz.
Depois de concluir meus estudos de pós-graduação, passei mais de três anos na indústria como Applied ML Researcher na Meta e no Twitter, onde tive a sorte de trabalhar com equipes excepcionais. No entanto, em novembro de 2022, minha trajetória profissional mudou inesperadamente. Como muitas outras pessoas, fiquei impressionado com o ChatGPT quando foi lançado. Foi a primeira vez desde a minha juventude que fiquei verdadeiramente maravilhado com um avanço tecnológico—algo que me lembrou os saltos dos gráficos EGA de 16 cores para VGA de 256 cores e depois para SVGA de 16 milhões de cores.
Minha pesquisa de Ph.D. se concentrou na interseção entre Estatística Bayesiana e Deep Learning, com forte ênfase em Modelos de IA Generativa Profunda. Na época, word2vec para embeddings de palavras e RNNs para modelagem de linguagem eram considerados o estado da arte. Fiquei surpreso ao ver o quanto a modelagem de linguagem e imagem havia avançado rapidamente nos poucos anos desde que deixei a academia.
Inspirado por esses avanços, decidi mergulhar no novo cenário da IA Generativa, explorando LLMs, geração de texto para imagem, engenharia de prompts, fine-tuning e RAG, para citar alguns. Ao longo de 2023, refleti sobre como redirecionar minha carreira para a IA Generativa, experimentando uma ideia de produto para consumidores e assessorando fundadores de startups e investidores em finanças.
Ao refletir, percebi que os aspectos de que mais gostava em minhas funções anteriores eram as interações presenciais e o engajamento com a comunidade, especialmente no desenvolvimento e gerenciamento de software open-source e no compartilhamento de conhecimento sobre novas tecnologias. Eu adorava fazer palestras sobre ideias de pesquisa emergentes e interagir com a comunidade open-source. Descobrir que existiam funções dedicadas a essas atividades em um campo profundamente técnico foi revelador.
Por que a Zilliz, especificamente? No centro da revolução da IA Generativa está a necessidade crítica de armazenamento e recuperação de dados eficientes e escaláveis—um desafio que os bancos de dados vetoriais estão em posição única para resolver. A Zilliz, por meio de seu banco de dados vetorial open-source Milvus, está democratizando essa tecnologia poderosa, que antes era domínio exclusivo dos gigantes da tecnologia. Como o banco de dados vetorial open-source mais amplamente adotado, o Milvus oferece um conjunto robusto de recursos que está se mostrando inestimável em diversos setores.
Estou animado para contribuir com o crescimento da comunidade open-source do Milvus, aproveitando minha paixão pelo compartilhamento de conhecimento e pelo desenvolvimento open-source. Se você ou sua empresa tiverem interesse em colaboração, entre em contato comigo pelo LinkedIn. Além disso, sou o novo anfitrião dos nossos encontros de Dados Não Estruturados regulares em San Francisco e no South Bay e adoraria ver você lá e saber mais sobre o que você está construindo. Espero ver você lá!
Continue lendo

Context Engineering Strategies for AI Agents: A Developer’s Guide
Learn practical context engineering strategies for AI agents. Explore frameworks, tools, and techniques to improve reliability, efficiency, and cost.

Vector Databases vs. Key-Value Databases
Use a vector database for AI-powered similarity search; use a key-value database for high-throughput, low-latency simple data lookups.

DeepRAG: Thinking to Retrieval Step by Step for Large Language Models
Discover DeepRAG, an advanced retrieval-augmented generation (RAG) model that improves LLM accuracy by retrieving only essential data through step-by-step reasoning.



