Perché Deepseek sta risvegliando i giganti dell'IA come OpenAI e perché dovrebbe importarti
DeepSeek R1 non è semplicemente un altro modello di IA, è stato il motivo per cui le azioni di Nvidia sono scese del 17%, per cui Meta ha istituito quattro war room per studiarlo, per cui il Presidente Trump lo ha definito un campanello d’allarme, e per cui Sam Altman è stato costretto ad affrontare la questione pubblicamente. La sua ascesa ha acceso dibattiti sul controllo dell’IA, sulla perturbazione del mercato e sulla sicurezza nazionale, spingendo le aziende tecnologiche a riesaminare le proprie strategie.
L’emergere di DeepSeek R1 mette in discussione l’attuale modello di business dell’IA, in cui le aziende applicano tariffe elevate per l’accesso a strumenti avanzati. Quando gli sviluppatori possono implementare l’IA per la programmazione, il ragionamento e l’automazione senza fare affidamento su infrastrutture costose, il panorama competitivo può cambiare in modo significativo.
Non si tratta solo di una questione aziendale; riguarda chi controlla il futuro dell’IA. Con le preoccupazioni sui rischi per la sicurezza nazionale sollevate da funzionari statunitensi, DeepSeek R1 costringe aziende come OpenAI e Google ad affrontare una nuova realtà. DeepSeek R1 è un punto di svolta per l’IA o solo un’altra tendenza passeggera? Diamo un’occhiata più da vicino.
Che cos’è DeepSeek R1?
Figura: Screenshot della dashboard di DeepSeek
DeepSeek R1 è un large language model creato da DeepSeek AI, progettato per attività che richiedono programmazione precisa, ragionamento matematico e risoluzione strutturata dei problemi. È stato addestrato su 14,8 trilioni di token utilizzando dataset come CodeCorpus-30M, articoli matematici di arXiv e testo web multilingue. Questo addestramento specifico lo aiuta ad affrontare sfide nello sviluppo software, nella ricerca scientifica e nell’automazione tecnica.
Esistono due versioni di questo modello. La prima, nota come DeepSeek-R1-Zero, è stata sviluppata utilizzando esclusivamente il reinforcement learning, un tipo di machine learning in cui un agente impara a prendere decisioni interagendo con un ambiente. L’agente compie azioni e riceve feedback sotto forma di ricompense o penalità. L’obiettivo è che l’agente massimizzi la ricompensa totale nel tempo imparando quali azioni portano ai risultati migliori. Questo gli ha conferito forti capacità di ragionamento, ma ha anche portato a problemi come output ripetitivi e mescolanza di lingue. Per risolvere questi problemi, DeepSeek R1 è stato creato aggiungendo dati preparatori prima della fase di reinforcement learning, migliorando chiarezza e ragionamento.
È stato rilasciato come modello open-source sotto licenza MIT, quindi chiunque, dagli sviluppatori ai ricercatori, può usarlo, modificarlo e implementarlo senza restrizioni. Questo approccio rende DeepSeek R1 un’opzione pratica per applicazioni in cui accuratezza ed efficienza nelle attività tecniche sono fondamentali.
Come funziona DeepSeek R1
DeepSeek R1 è costruito su un’architettura Mixture-of-Experts (MoE). In termini semplici, sebbene il modello abbia 671 miliardi di parametri, numeri che regola durante l’apprendimento, solo 37 miliardi vengono utilizzati ogni volta che elabora un’attività. Una rete di gating leggera agisce come un decisore, scegliendo quali sottoreti specializzate debbano gestire l’input. Ciò significa che il modello utilizza solo le risorse di cui ha bisogno, riducendo la domanda computazionale complessiva.
Durante l'addestramento, il modello è partito dalla versione chiamata DeepSeek-R1-Zero che, come abbiamo visto in precedenza, è stata addestrata esclusivamente con apprendimento per rinforzo. In questa fase, il modello ha imparato ricevendo ricompense per la generazione di risposte ponderate e passo dopo passo, indicate come ragionamento chain-of-thought. Tuttavia, questo metodo ha portato a risposte ripetitive e output in lingue miste. Per migliorare la chiarezza, gli sviluppatori hanno introdotto una fase di cold-start con fine-tuning supervisionato utilizzando esempi di chain-of-thought scelti con cura. Successivamente, il modello è stato sottoposto a due ulteriori cicli di apprendimento per rinforzo utilizzando Group Relative Policy Optimization (GRPO). In GRPO, il modello genera diverse risposte per lo stesso input, le confronta e riceve ricompense per le risposte più chiare e accurate. Gli output migliori vengono quindi scelti tramite rejection sampling e utilizzati per un ulteriore fine-tuning.
DeepSeek R1 incorpora anche diverse tecniche di efficienza:
Multi-Head Latent Attention (MLA): Questa tecnica comprime le strutture dati interne (matrici key-value) in vettori latenti più piccoli, riducendo la memoria richiesta durante l'elaborazione.
FP8 Mixed Precision Training: Utilizzando numeri in virgola mobile a 8 bit per molti calcoli invece di numeri a precisione più elevata, il modello riduce il consumo di memoria e accelera l'elaborazione.
Dynamic Token Inflation and Soft Token Merging: Questi metodi ottimizzano l'elaborazione del testo unendo token che contengono informazioni ridondanti e ripristinando successivamente i dettagli chiave, il che aiuta a ridurre la quantità di dati elaborati senza perdere contesto importante.
Nel complesso, questi approcci consentono a DeepSeek R1 di funzionare in modo affidabile su compiti complessi come il ragionamento matematico e il debugging del codice, mantenendo bassi i costi computazionali e le spese di addestramento significativamente inferiori a quelle di modelli come GPT-4.
Capacità chiave di DeepSeek R1
DeepSeek R1 è stato progettato per eccellere nei compiti tecnici e le sue prestazioni sono evidenti in molteplici benchmark e applicazioni. Ecco i suoi principali punti di forza:
Ragionamento matematico: DeepSeek R1 offre prestazioni impressionanti nelle sfide matematiche. Sul benchmark MATH-500, raggiunge un tasso di superamento del 97,3%, e sul benchmark AIME 2024, raggiunge il 79,8% pass@1. Questi risultati mostrano che il modello può gestire problemi matematici complessi con un elevato livello di accuratezza.
Coding e debugging: Nei compiti di coding, il modello dimostra una forte competenza. Detiene un rating Codeforces di 2029, collocandosi nel 96,3° percentile tra i partecipanti umani. La sua accuratezza nel debugging è di circa il 90%, il che significa che identifica e corregge in modo affidabile problemi di codice in scenari reali.
Ragionamento strutturato e logico: DeepSeek R1 è costruito per generare un ragionamento chiaro e passo dopo passo quando affronta i problemi. Questa capacità si riflette nelle sue prestazioni costanti nei compiti di problem-solving strutturato, in cui il modello scompone sfide complesse in parti comprensibili. Dai un'occhiata a come scompone questa sfida.
Figura: DeepSeek scompone passo dopo passo il design del sistema di ricerca vettoriale Milvus
Come puoi vedere, DeepSeek inizia scomponendo il compito passo dopo passo, spiegando che Milvus è un database vettoriale open-source ottimizzato per dati ad alta dimensionalità. Menziona l'obiettivo di gestire in modo efficiente dataset su larga scala, in particolare per motori di raccomandazione che utilizzano embedding vettoriali per trovare elementi simili. DeepSeek identifica anche che questi embedding provengono spesso da modelli come reti neurali e utilizza un sistema di raccomandazione di film come esempio. Questo screenshot non mostra l'intera fase di ragionamento, ma puoi utilizzare lo stesso prompt su DeepSeek per vedere come ragiona fino all'implementazione.
- Comprensione multilingue: Il modello è stato addestrato su testi web multilingue, consentendogli di elaborare e rispondere a query in diverse lingue. Questa ampia capacità linguistica lo rende utile per applicazioni globali in cui sono necessarie risposte precise e logiche.
- Preparazione dei dati: Inizia raccogliendo tutti i documenti pertinenti, come pagine FAQ, articoli di supporto e manuali tecnici. Suddividi questi documenti in parti più piccole e coerenti, come singole coppie domanda-risposta. Questa segmentazione garantisce che ogni porzione di testo sia focalizzata e possa essere facilmente recuperata in seguito. modelli linguistici di grandi dimensioni.
DeepSeek R1 vs. OpenAI o1 vs. Claude 3.5 Sonnet
DeepSeek R1 si distingue rispetto a modelli come OpenAI o1 e Claude 3.5 Sonnet, non solo in termini di prestazioni ma anche di costo e accessibilità. La tabella seguente riassume le metriche chiave:
| Metrica | DeepSeek R1 | **OpenAI o1****** | Claude 3.5 Sonnet |
| Valutazione Codeforces | 2029 (96,3° percentile) | 2061 (89° percentile) | Non indicato ufficialmente |
| Accuratezza del debugging | 90% | 80% | 75% |
| MATH-500 Pass@1 | 97,3% | 96,4% | Inferiore a DeepSeek R1 |
| SWE-bench Verified (Risolti) | 49,2% | 48,9% | 50,8% |
| LiveCodeBench (Pass@1-COT) | 65,9% | 63,4% | 33,8% |
| Aider-Polyglot (Accuratezza) | 53,3% | 61,7% | 45,3% |
| Prezzi (Token di input) | ~$0,14 per milione di token | ~$15 per milione di token | ~$3 per milione di token |
| Prezzi (Token di output) | ~$2,19 per milione di token | ~$60 per milione di token | ~$15 per milione di token |
| Licenza | Open-source (MIT) | Proprietario | Proprietario |
| Finestra di contesto | 128K token | 200K token | 200K token |
DeepSeek R1 si difende bene su diversi benchmark tecnici. Raggiunge un solido rating Codeforces, che deriva da competizioni di programmazione competitiva, e mostra quanto bene un modello possa gestire sfide di coding. Eccelle anche nell’accuratezza del debugging. Nel ragionamento matematico, raggiunge un tasso di superamento del 97,3% su MATH-500, leggermente superiore a OpenAI o1. Inoltre, le sue prestazioni su SWE-bench (valuta la capacità degli LLM di risolvere problemi software reali presentando loro problemi GitHub effettivi e le corrispondenti codebase) e LiveCodeBench(fornisce una valutazione dinamica e priva di contaminazioni incorporando continuamente nuovi problemi da piattaforme come LeetCode, AtCoder e Codeforces) riflettono una capacità affidabile e costante di risolvere compiti complessi.
Un vantaggio chiave è la sua efficienza in termini di costi. I costi di input di DeepSeek R1 sono bassi fino a ~$0.14 per milione di token, rispetto alle tariffe molto più elevate di OpenAI o1. Anche il prezzo dei token di output è significativamente inferiore. Questi benefici economici si aggiungono alla sua natura open-source sotto licenza MIT, che offre agli utenti una flessibilità non disponibile con i modelli proprietari offerti da OpenAI o1 e Claude 3.5 Sonnet.
Con una finestra di contesto leggermente più piccola, pari a 128K token rispetto ai 200K token degli altri, DeepSeek R1 è ottimizzato per attività tecniche senza sacrificare molto in termini di prestazioni. Questo confronto mostra che DeepSeek R1 offre una combinazione convincente di prestazioni elevate, efficienza dei costi e accessibilità aperta, una combinazione che potrebbe rimodellare il modo in cui gli strumenti di AI avanzata vengono implementati nei campi tecnici.
Integrazione di DeepSeek con Milvus
Le prestazioni tecniche e l’efficienza dei costi di DeepSeek R1 lo rendono un buon candidato per applicazioni reali di Retrieval-Augmented Generation quando abbinato a un database vettoriale capace. Uno di questi database è Milvus, progettato per gestire miliardi di vettori con bassa latenza e throughput elevato, grazie al supporto per l’accelerazione GPU e a tecniche di indicizzazione avanzate come HNSW e IVF. Queste capacità rendono Milvus perfetto per recuperare rapidamente il contesto più pertinente per una query, che DeepSeek R1 utilizza poi per generare risposte informate.
Considera un portale di assistenza clienti per un prodotto software complesso che ospita FAQ estese e documentazione tecnica. Ecco come puoi costruire una pipeline di Retrieval-Augmented Generation (RAG) usando Milvus e DeepSeek R1:
Preparazione dei dati: Inizia raccogliendo tutti i documenti rilevanti, come pagine FAQ, articoli di supporto e manuali tecnici. Suddividi questi documenti in parti più piccole e coerenti, come singole coppie domanda-risposta. Questa segmentazione garantisce che ogni porzione di testo sia focalizzata e possa essere recuperata facilmente in seguito.
Generazione degli embedding: Converti ogni segmento di testo in un vettore numerico noto come embedding utilizzando un modello di embedding. Questi embedding catturano il significato semantico del testo, consentendo confronti di similarità efficaci. Nel nostro esempio, ogni segmento di FAQ viene trasformato in un embedding che rappresenta accuratamente il suo contenuto.
Inserimento dei dati in Milvus: Configura una collection Milvus specificando parametri chiave come la dimensione del vettore e la metrica di distanza scelta (ad esempio, inner product). Inserisci gli embedding generati insieme al testo associato nella collection, creando un indice ricercabile dei tuoi documenti.
Elaborazione della query: Quando un cliente pone una query, per esempio, Come posso reimpostare la password del mio account?, converti questa query in un embedding utilizzando lo stesso modello usato per i documenti. Garantire che sia gli embedding della query sia quelli dei documenti si trovino nello stesso spazio vettoriale è fondamentale per un matching accurato.
Recupero: Usa Milvus per cercare nella collection con l’embedding della query e recuperare i segmenti di documento più pertinenti. Milvus identifica rapidamente i testi più simili, fornendo il contesto rilevante necessario per rispondere accuratamente alla query.
Generazione della risposta con DeepSeek R1: Combina i segmenti recuperati in un contesto coerente e invialo, insieme alla query originale, a DeepSeek R1 tramite la sua API in stile OpenAI. Il modello genera quindi una risposta dettagliata e consapevole del contesto che incorpora le informazioni provenienti dai documenti recuperati.
Presentazione della risposta: Infine, consegna la risposta generata al cliente. La risposta riflette sia la query specifica sia i dati contestuali rilevanti, garantendo che la risposta sia accurata e utile.
Questa integrazione sfrutta la ricerca vettoriale efficiente di Milvus e la generazione linguistica precisa di DeepSeek R1 per creare una pipeline RAG robusta e scalabile. Offre una soluzione potente per applicazioni come l’assistenza clienti, la gestione della conoscenza e la risoluzione di problemi tecnici, trasformando il modo in cui le informazioni vengono accessibili e distribuite.
Perché DeepSeek R1 sta spaventando i giganti dell’AI
DeepSeek R1 sta costringendo le aziende consolidate a riesaminare le proprie strategie. I leader del settore stanno ora affrontando la possibilità che un modello con elevate capacità tecniche e bassi costi operativi possa sconvolgere i flussi di ricavi tradizionali basati su hardware costoso e costi di abbonamento. Questo cambiamento sta spingendo le aziende a riconsiderare i propri investimenti nella ricerca e i piani a lungo termine mentre si preparano a uno scenario in cui l’AI avanzata potrebbe essere accessibile senza pesanti barriere finanziarie.
Gli effetti a catena si estendono oltre i bilanci aziendali. Le aziende proprietarie stanno ora esplorando approcci alternativi e adattando le proprie strategie di prodotto, mentre cresce la preoccupazione che l’adozione diffusa di tali modelli possa portare a una significativa riallocazione delle risorse in tutto il settore tecnologico. Ciò ha innescato un’ondata di cambiamenti strategici, con alcune aziende che avviano revisioni interne dei propri modelli di sviluppo dell’AI e delle strutture di prezzo.
Inoltre, le implicazioni arrivano fino alla sfera politica. Regolatori e funzionari governativi stanno prestando attenzione, poiché la disponibilità aperta di strumenti di AI ad alte prestazioni solleva interrogativi sulla sicurezza nazionale e sulla leadership tecnologica globale. Questo dibattito sul controllo e sull’accesso all’AI avanzata sta intensificando le discussioni sulle future normative e sull’equilibrio di potere nel mondo tecnologico, evidenziando come modelli come DeepSeek R1 potrebbero rimodellare il settore su più livelli.
Perché dovrebbe interessarti?
Per sviluppatori, aziende e persino utenti comuni, le implicazioni di DeepSeek R1 vanno ben oltre i benchmark tecnici. La sua disponibilità open-source e i bassi costi operativi aprono nuove opportunità di innovazione e personalizzazione che in precedenza erano bloccate da tariffe elevate e restrizioni proprietarie.
Gli sviluppatori ora hanno la possibilità di creare e personalizzare soluzioni di IA senza aspettare un’API commerciale o essere limitati dai termini di licenza. Questa libertà significa maggiore sperimentazione, iterazione più rapida sulle idee e la possibilità di creare strumenti che rispondono direttamente a esigenze di nicchia. La capacità di modificare e distribuire un modello linguistico ad alte prestazioni può portare a scoperte in aree come l’automazione, il supporto tecnico e persino le applicazioni creative.
Per le aziende, il costo inferiore di distribuzione è una svolta. Le aziende possono integrare funzionalità avanzate di IA nei propri flussi di lavoro senza il peso di hardware costoso o costi di abbonamento. Ciò potrebbe tradursi in operazioni più efficienti, una riduzione delle spese generali e, in definitiva, un vantaggio competitivo nei rispettivi mercati. Man mano che le organizzazioni adottano queste soluzioni convenienti, le dinamiche complessive del mercato potrebbero cambiare, portando a una maggiore innovazione e a barriere all’ingresso più basse.
Anche i responsabili delle politiche e la società nel suo complesso dovrebbero prestare attenzione. La diffusione di un’IA accessibile e ad alte prestazioni solleva importanti questioni sulla sicurezza dei dati, sulla regolamentazione e sull’equilibrio del potere tecnologico su scala globale. Con strumenti di IA avanzati non più confinati a poche grandi aziende, le discussioni sull’uso etico, sulla responsabilità e sulla sicurezza nazionale diventano sempre più rilevanti. Questo accesso più ampio ha il potenziale per democratizzare la tecnologia, ma richiede anche un’attenta considerazione su come gestire e regolamentare strumenti così potenti.
In breve, che tu sia uno sviluppatore che cerca di spingere oltre i confini dell’IA, un’azienda che punta a semplificare le operazioni o un responsabile delle politiche incaricato di garantire un uso sicuro ed equo della tecnologia, l’emergere di DeepSeek R1 potrebbe avere un impatto significativo sul panorama futuro dell’intelligenza artificiale.
Conclusione
DeepSeek R1 sta cambiando il modo in cui pensiamo e utilizziamo l’IA. Le sue solide prestazioni nelle attività tecniche, i bassi costi operativi e l’accesso aperto lo rendono una seria alternativa ai modelli proprietari e costosi. Questo modello ha stabilito nuove aspettative, offrendo sia output di alta qualità sia un approccio più accessibile all’IA avanzata. Integrandosi con strumenti come Milvus, DeepSeek R1 dimostra il proprio valore nelle applicazioni del mondo reale: dal supporto clienti alla gestione della conoscenza. Mentre aziende e regolatori rivalutano controllo e innovazione nell’IA, DeepSeek R1 si distingue come un modello che potrebbe plasmare il futuro della tecnologia e aprire nuove strade per sviluppatori e aziende.
Ulteriori risorse
https://arxiv.org/pdf/2402.03300
https://arxiv.org/abs/2502.07864
https://arxiv.org/pdf/2310.18313
https://milvus.io/docs/build_RAG_with_milvus_and_deepseek.md
Continua a leggere

The Real Bottlenecks in Autonomous Driving — And How AI Infrastructure Can Solve Them
Autonomous driving faces a data bottleneck. Learn how AI-native vector databases like Zilliz solve scale, cost, and insight challenges across AV pipelines.

Demystifying the Milvus Sizing Tool
Explore how to use the Sizing Tool to select the optimal configuration for your Milvus deployment.

Introducing DeepSearcher: A Local Open Source Deep Research
In contrast to OpenAI’s Deep Research, this example ran locally, using only open-source models and tools like Milvus and LangChain.


