Intelligenza artificiale

DeepSeek: Un arrivo volatile e precoce dell’IA commercializzata?

mm
Aggiungi Securities.io alle tue fonti preferite su Google
Informativa: Securities.io può ricevere un compenso quando utilizzi link a prodotti da noi recensiti. Ciò non influenza le nostre valutazioni editoriali. Non siamo un consulente finanziario registrato; queste non sono raccomandazioni di investimento. Leggi la nostra informativa sulle affiliazioni.

DeepSeek che sconvolge il panorama dell’IA

Per chi non era al corrente e ha controllato i mercati finanziari lunedì 27th gennaio 2025, la domanda probabilmente era: “Cosa è successo?” L’apparente ascesa inarrestabile del prezzo delle azioni Nvidia (NVDA ) – fino a poco tempo fa – è stata interrotta da una brusca caduta del 18% in un solo giorno.

Con una perdita di capitalizzazione di mercato di 560 miliardi di dollari, mai un’azienda ha perso così tanto valore in un giorno. Inoltre, gli investitori di Nvidia probabilmente si stanno abituando all’estrema volatilità del titolo, che ha registrato 8 delle 10 più grandi cadute giornaliere.

Il fattore scatenante è stato il rilascio di DeepSeek, un LLM (Large Language Model) prodotto in Cina che rivaleggia con i migliori prodotti di OpenAI e di altre importanti aziende di IA in termini di prestazioni. Tuttavia è open‑source e offre l’accesso a un prezzo molto basso. Si afferma inoltre che sia stato sviluppato con soli 6 milioni di dollari come “progetto secondario” di un hedge fund quantitativo.

Se vero, ciò potrebbe ribaltare la narrazione secondo cui lo sviluppo dell’IA richiede enormi risorse computazionali e richiede miliardi, se non trilioni, di dollari per i data center IA. Come leader dell’hardware per IA, non sorprende che Nvidia sia stata la più colpita dal panico degli investitori.

Con la polvere che si è un po’ posata, esaminiamo cosa può realmente fare DeepSeek e cosa potrebbe fare presto il settore cinese dell’IA.

Contesto di DeepSeek

High‑Flyer

DeepSeek è stato sviluppato da un hedge fund cinese di trading finanziario / quantitativo, High‑Flyer, fondato da Liang Wenfeng.

Liang ha 40 anni e ha iniziato lavorando nella visione artificiale. Ha fondato High‑Flyer nel 2015, nei suoi trent’anni, pionierando l’uso dell’IA nelle strategie di trading, sfruttando il machine learning. Il fondo ora gestisce 8 miliardi di dollari di asset.

Di solito molto discreto, Liang è stato visto seduto accanto al Premier cinese Li Qiang (il secondo membro più alto del Comitato Permanente del Politburo del Partito Comunista Cinese) a un incontro sulla tecnologia IA a Pechino il 20 gennaio 2025.

Va notato che nella confusione iniziale e a causa delle rare apparizioni pubbliche di Liang, molti media hanno usato la foto di una persona con lo stesso nome, ma completamente estranea a DeepSeek, e che lavora come interior designer.

“Not Liang Wenfeng” – Fonte: Business Day

DeepSeek

Nel 2021, Liang Wenfeng ha acquistato circa 10.000 chip H800 di Nvidia, prima dell’imposizione delle sanzioni statunitensi, per avviare quello che sarebbe diventato DeepSeek, e ha coinvolto i migliori ricercatori di AI di High‑Flyer nel progetto.

I chip H800 sono, relativamente, chip a bassa prestazione rispetto ai più avanzati H100 e B200, con un consumo energetico tre volte superiore.

DeepSeek afferma di aver addestrato il proprio modello DeepSeek V3 in meno di 2 mesi, per 5,58 milioni di dollari. Quindi, sebbene ciò non includa realmente il costo dei 10.000 chip H800, risulta comunque di diversi ordini di grandezza più economico rispetto a qualsiasi altro LLM fino ad ora.

In effetti, questo renderebbe l’addestramento di DeepSeek V3 più economico del solo stipendio dei leader dei team IA presso OpenAI, Meta, Microsoft (MSFT ), Google, ecc.

Prestazioni di DeepSeek

Unita al basso costo di sviluppo, ciò che ha sorpreso analisti e investitori è stato che le prestazioni di DeepSeek sono simili o forse addirittura superiori al modello più recente e migliore di OpenAI e di altre importanti aziende IA, incluso il appena rilasciato e acclamato come potenziale AGI o3.

Fonte: GitHub

La reazione immediata è stata sospettare un gioco sporco e che i tempi e i costi di sviluppo fossero falsi (ulteriori dettagli più avanti).

In ogni caso, è probabile che il metodo di DeepSeek sia 10‑100 volte più efficiente rispetto a quanto l’industria dell’IA abbia fatto finora.

Il colpo di grazia all’industria americana dell’IA è stato il prezzo di DeepSeek. Con token molto al di sotto di 1 $, rappresenta circa il 3‑5 % del prezzo di tutti i suoi concorrenti.

“Abbiamo ridotto i prezzi perché, innanzitutto, esplorando strutture di modello di nuova generazione, i nostri costi sono diminuiti; in secondo luogo, crediamo che sia l’IA sia i servizi API debbano essere accessibili e a prezzi contenuti per tutti.”
Liang Wenfeng

Tempismo Perfetto

Il lancio di grande impatto di DeepSeek V3 è stato, ovviamente, ben coordinato dall’azienda per massimizzare l’effetto.

È arrivato pochi giorni dopo l’annuncio del Presidente Trump del “Project Stargate”, un’iniziativa da 500 miliardi di dollari per costruire 20 mega‑data center IA, guidata da SoftBank (SFTBY ), OpenAI e Oracle (ORCL ).

Mentre i mercati erano in panico, il Presidente degli Stati Uniti sembra per lo più impassibile.

“Se potessi farlo più economico, se potessi farlo [per] meno [e] ottenere lo stesso risultato finale. Penso che sia una cosa buona per noi.”

Ha anche dichiarato di non essere preoccupato per la svolta, aggiungendo che gli Stati Uniti rimarranno un attore dominante nel settore.

Fonte: BBC

Dopo i LLM, Generazione di Immagini

Il risultato ottenuto da DeepSeek nei LLM, ora intende replicarlo nella generazione di immagini IA con il rilascio di Janus‑Pro‑7B.

Sebbene ci siano dibattiti sul fatto che sia davvero pari a Midjourney, DALL‑E e altri generatori di immagini, è comunque impressionante.

E se seguirà lo schema di DeepSeek v3 LLM, è probabile che sia notevolmente efficiente.

Gli Effetti Immediati

Impatto sull’Industria dell’IA

Mentre ha preso d’assalto l’industria dell’IA, DeepSeek ha avuto alcune conseguenze immediate:

  • Turbolenza di mercato: il prezzo delle azioni Nvidia e l’intero Nasdaq sono crollati quando i mercati hanno compreso l’implicazione di potenzialmente sprecare centinaia di miliardi di dollari in hardware IA (vedi sotto per ulteriori discussioni su questo tema).
  • Accelerazione della corsa all’IA: mentre la Cina passa da essere considerata irrilevante secondo i magnati tecnologici statunitensi di pochi mesi fa, ora si avvia una nuova corsa all’IA attraverso l’Oceano Pacifico.
  • Successo da un giorno all’altro: DeepSeek è quasi immediatamente diventata l’app più scaricata nell’App Store.
  • Test offline: molte persone stanno anche testando come possa funzionare localmente sui loro computer domestici di fascia alta, poiché i requisiti di calcolo sembrano enormemente inferiori rispetto ai LLM precedenti.

Danni collaterali

I danni causati da DeepSeek non si sono limitati alle immagini e ai potenziali profitti futuri delle aziende americane di IA e tecnologia.

Ad esempio, le innovative aziende nucleari previste per costituire il nucleo dell’approvvigionamento energetico dei data center IA su scala megawatt sono state colpite ancora più duramente: il 27th gennaio 2025, lo sviluppatore di SMR Nuscale (SMR ) è sceso del 27,5 % e il minatore di uranio Cameco è sceso del 15 %.

Un’altra vittima collaterale sono le azioni tecnologiche non statunitensi. Le azioni tecnologiche giapponesi come Advantest, fornitore di Nvidia, sono cadute dell’8,6 % e le azioni di SoftBank sono scese dell’8,3 %. Nel frattempo, il produttore olandese di chip ASML è sceso del 6,5 %.

Come ha fatto DeepSeek?

Ancora Nessuna Risposta Definitiva

Questo è ovviamente un tema ancora molto dibattuto poco tempo dopo il rilascio. Possiamo discutere diversi punti di vista una volta considerati alcuni fatti noti.

Il primo fatto è che, indipendentemente da come sia arrivato, DeepSeek V3 è potente quanto le migliori IA rilasciate finora.

Forse più importante, essendo open‑source, molte persone stanno già testando e confermando che richiede molto meno potenza di calcolo.

“DeepSeek R1 è una delle scoperte più sorprendenti e impressionanti che abbia mai visto – e, essendo open‑source, un dono profondo al mondo.”
Marc Andreessen

Quindi non dovrebbe essere liquidato come semplice “hype” o il risultato di qualche cospirazione del governo cinese.

Questa è anche l’opinione di rispettati protagonisti della Silicon Valley come Marc Andreessen e Chamath Palihapitiya.

“Costruire modelli IA è una trappola finanziaria (…) L’Open Source è il chiaro vincitore.

Le IA proprietarie saranno costrette a mantenere segreti i loro migliori modelli e a venderli alle imprese O A provare a creare qualche incredibile app consumer con essi.

Chamath Palihapitiya

Un’intervista a Liang Wenfeng da luglio 2024, data subito dopo il rilascio di DeepSeek V2, può anche darci qualche spunto.

Un Approccio Differente

La prima possibile spiegazione è che DeepSeek abbia semplicemente adottato una strategia diversa per lo sviluppo dell’IA.

Un fattore chiave è che si tratta di un progetto interno dell’azienda di Liang Wenfeng, non di un’impresa finanziata da VC. A questo proposito, ricorda un po’ i primi giorni di Tesla (TSLA ) e SpaceX (SPCX ), basandosi sul denaro di Elon Musk.

Questa differenza ha portato DeepSeek a concentrarsi sullo sviluppo della propria struttura di modello, invece di copiare Llama per produrre rapidamente applicazioni.

“Il nostro obiettivo è l’AGI (Intelligenza Artificiale Generale), il che richiede di esplorare nuove strutture di modello per ottenere capacità superiori con risorse limitate. Questa è ricerca fondamentale per la scalabilità. Oltre all’architettura, abbiamo studiato la curazione dei dati e il ragionamento simile a quello umano – tutto riflesso nei nostri modelli.”
Liang Wenfeng

Questo si riflette anche nella cultura aziendale, meno focalizzata sul profitto, poiché questo è il “lavoro” dell’hedge fund High‑Flyer. Invece, l’innovazione stessa è l’obiettivo dichiarato.

“Per tre decenni, abbiamo enfatizzato il profitto rispetto all’innovazione. L’innovazione non è puramente guidata dal business; richiede curiosità e ambizione creativa. Siamo incatenati da vecchie abitudini, ma è una fase.

Le aziende statunitensi più redditizie a lungo termine sono i giganti tecnologici costruiti su R&D a lungo termine.

Liang Wenfeng

Da questa prospettiva, la cultura di DeepSeek potrebbe essere un vantaggio duraturo e rappresenta una critica severa alla maggior parte dei leader di pensiero dell’IA.

“Crediamo che l’IA cinese non possa rimanere un follower per sempre. Spesso diciamo che c’è un divario di uno o due anni tra l’IA cinese e quella americana, ma il vero divario è tra originalità e imitazione. Se questo non cambia, la Cina sarà sempre un follower. Alcune esplorazioni sono inevitabili.”
Liang Wenfeng

L’Evoluzione Naturale della Tecnologia IA

Un’altra opzione è semplicemente che, man mano che più ricercatori sviluppano competenze nella creazione di IA, le innovazioni continuano a spingere il campo in avanti. Ciò che DeepSeek ha raggiunto, qualche startup IA improvvisata era destinata a fare un giorno con il maturare della tecnologia. E a causa delle sanzioni che limitano l’accesso a chip avanzati, le aziende cinesi di IA sono le prime a concentrarsi sul fare di più con meno.

Potrebbe anche essere considerato come la superiorità a lungo termine del software open‑source rispetto a sistemi chiusi e a scopo di lucro che cercano di massimizzare il profitto creando monopoli.

Questo punto di vista non riflette bene i centinaia di miliardi di dollari che le grandi aziende tecnologiche avevano pianificato di spendere solo nel 2025.

Quindi sarebbe meno un’accusa della superiorità di DeepSeek e più della burocratizzazione delle ex aziende tecnologiche innovative, sia cinesi che americane.

 Una Cospirazione

Probabilmente inevitabile nel contesto della intensa competizione tra grandi potenze tra Occidente ed Eurasia (Russia / Cina / Iran), molti sono stati rapidi a vedere in DeepSeek un’operazione ostile straniera contro la parte più competitiva dell’economia statunitense.

Una teoria della cospirazione facilmente respingibile è che sia semplicemente una copia delle IA occidentali o che falsifichi le sue prestazioni, poiché è già confermata in modo indipendente. Poiché DeepSeek è un software open‑source, è anche piuttosto illogico attaccarlo come spyware o come strumento censurato dal PCC, dato che chiunque può distribuirlo e modificarlo liberamente.

Tuttavia, un punto valido è che DeepSeek potrebbe aver avuto accesso a chip più avanzati, ufficialmente sanzionati e vietati all’esportazione verso la Cina. Se fosse così, avrebbe senso che l’azienda non lo ammettesse pubblicamente e mentisse al riguardo.

Una possibilità è un supporto nascosto dal governo, dal finanziamento diretto all’accesso a grandi cluster di chip H100 Nvidia di contrabbando per l’addestramento dell’IA. Sappiamo, ad esempio, che molti chip vengono venduti a Singapore e probabilmente rivenduti alla Cina.

“I laboratori cinesi hanno più H100 di quanto la gente pensi. La mia comprensione è che DeepSeek abbia circa 50.000 H100, di cui non possono parlare, ovviamente, perché è contro i controlli di esportazione che gli Stati Uniti hanno in atto.”
Alexandr Wang, CEO di Scale AI

Un’altra contestazione è il costo dell’addestramento, che non è stato verificato in modo indipendente.

Un’ultima possibilità è che DeepSeek, indipendentemente da qualsiasi cospirazione geopolitica, abbia scommesso massicciamente contro le azioni di Nvidia prima di rilasciare le sue affermazioni straordinarie. High‑Flyer è comunque un hedge fund, sebbene ciò possa essere considerato manipolazione di mercato e quindi una mossa rischiosa.

Prime Considerazioni

L’IA è un campo che si evolve incredibilmente rapidamente, e DeepSeek ha già cambiato le regole del gioco in alcuni modi importanti:

  • Ora disponiamo di un nuovo metodo per generare LLM ultra‑efficienti e probabilmente modelli IA in generale.
  • L’IA open‑source ha una concreta possibilità di competere contro il modello più chiuso promosso da (ironico) OpenAI.
  • La competizione tra USA e Cina nell’IA sta diventando ancora più intensa.
  • Le sanzioni sull’esportazione di chip IA avanzati verso la Cina sono un fallimento, sia perché DeepSeek li ha comunque ottenuti, sia perché non ne aveva bisogno.
    • In secondo piano, Huawei è probabilmente anche un serio concorrente nel fornire a DeepSeek più chip.
    • Questo potrebbe non fermare alcuni dal continuare a provare.

“Il fatto che DeepSeek sia riuscita a costruire R1 illustra l’impatto ritardato del fallimento dei controlli all’esportazione di ottobre 2022. Ma molto presto, vivremo il successo dei controlli all’esportazione di ottobre 2023.”
Greg Allen, direttore del Wadhwani AI Centre presso il Centre for Strategic and International Studies.

Dimentica DeepSeek, Che Dire della Vendetta di TikTok?

Un’importante notizia è stata trascurata nelle analisi in preda al panico e nelle teorie della cospirazione intorno a DeepSeek.

Un’altra azienda cinese, creatrice di TikTok ByteDance, ha rilasciato Doubao‑1.5‑pro il 24th gennaio – la sua risposta a ChatGPT‑4o.

È anche molto più economico rispetto ai concorrenti americani, 5 volte più economico del modello di DeepSeek e più di 200 volte meno costoso del GPT‑4o di OpenAI.

“Il nuovo Doubao 1.5 Pro utilizza un approccio più efficiente per addestrare il suo modello IA, che ByteDance afferma aiuti a bilanciare le prestazioni del sistema con costi più bassi.

Ciò è ottenuto attraverso un design che combina sia l’addestramento sia l’uso in tempo reale del modello, ottimizzandolo per risultati migliori mantenendo bassi i costi dell’infrastruttura.


Fonte: Financial Express

Questo modello supera anche i modelli leader di OpenAI, Anthropic e Alibaba.

Se questo è il risultato di uno sforzo indipendente, dimostrerebbe che la carenza di chip ha, se non altro, costretto le aziende cinesi a competere sull’efficienza, rivelando un certo livello di compiacenza nelle aziende IA americane, inondate da apparentemente denaro e potenza di calcolo illimitati.

Non è nemmeno improbabile che ByteDance, dopo mesi di lotta per evitare un divieto o una vendita forzata di TikTok negli USA, abbia cercato modi per competere e reagire.

Altri Modelli Cinesi

Con due aziende che ora sembrano schiacciare il mercato IA sul prezzo per prestazioni simili, l’attenzione probabilmente si sposterà anche verso altri modelli IA cinesi. Questo potrebbe includere:

Guardandolo da una prospettiva a volo d’uccello invece di concentrarsi su DeepSeek, sembra più un’ondata di nuovi e migliorati modelli IA dalla Cina, piuttosto che un attacco a sorpresa di DeepSeek da solo, come spesso viene descritto.

Conclusione

Man mano che la guerra dell’IA si intensifica, non è più così chiaro che l’accesso a finanziamenti e la rapida scalata della potenza di calcolo saranno l’unico fattore determinante.

Non è nemmeno chiaro quanto il settore sarà realmente redditizio alla fine, se i prezzi dei token LLM possono crollare di 50‑200 volte da un giorno all’altro per le stesse prestazioni. Tuttavia, ciò non dovrebbe scatenare una reazione eccessiva. In definitiva, un’IA più economica e più efficiente significa anche un’IA che sarà massivamente adottata e onnipresente.

Ciò significherà anche che la domanda finale di chip IA rimarrà probabilmente alta, anche se leggermente inferiore alle previsioni iniziali.

Altrettanto importante, LLM diffusi e ultra‑economici accessibili tramite open source significano una data di arrivo anticipata per qualsiasi effetto che l’IA dovrebbe avere sui mercati del lavoro, sulla produttività, sulla manifattura, sull’istruzione, sul commercio internazionale, ecc.

Jonathan è un ex ricercatore biochimico che ha lavorato nell'analisi genetica e nelle sperimentazioni cliniche. Ora è un analista di titoli e scrittore finanziario con un focus su innovazione, cicli di mercato e geopolitica nella sua pubblicazione 'The Eurasian Century'.