Kunstmatige intelligentie

DeepSeek: Een volatiele en vroege aankomst van gecommercialiseerde AI?

mm
Voeg Securities.io toe aan je voorkeursbronnen op Google
Toelichting: Securities.io kan een vergoeding ontvangen wanneer u links naar beoordeelde producten gebruikt. Dit beïnvloedt onze redactionele beoordelingen niet. Wij zijn geen geregistreerd beleggingsadviseur; dit is geen beleggingsadvies. Lees onze affiliateverklaring.

DeepSeek verwoest het AI-landschap

Voor iedereen die de financiële markten op maandag 27th januari 2025 niet heeft gevolgd, was de vraag waarschijnlijk: “Wat is er gebeurd?” De ogenschijnlijk onstuitbare stijging van de Nvidia (NVDA ) ‑aandelenprijs – tot nu toe – werd onderbroken door een brute daling van 18 % in slechts één dag.

Met een marktkapitalisatieverlies van $560 miljard heeft nog nooit een enkel bedrijf zoveel waarde in één dag verloren. Bovendien raken Nvidia‑beleggers waarschijnlijk gewend aan de extreme volatiliteit van het aandeel, dat 8 van de 10 grootste eenmalige dalingen heeft veroorzaakt.

De aanleiding was de release van DeepSeek, een in China gemaakte LLM (Large Language Model) die qua prestaties concurreert met de beste producten van OpenAI en andere toonaangevende AI‑bedrijven. Het verschil is dat hij open‑source is en voor een zeer lage prijs toegankelijk wordt gemaakt. Er wordt bovendien beweerd dat hij is ontwikkeld met slechts $6 miljoen als een “nevenproject” van een kwantitatieve hedge‑fund.

Als dit waar is, zou het het verhaal kunnen ondermijnen dat het ontwikkelen van AI extreem rekenintensief is en miljarden, zo niet triljoenen, aan AI‑datacenters vereist. Als leider op het gebied van AI‑hardware is het dan niet verrassend dat Nvidia het hardst werd getroffen door paniek onder beleggers.

Nu de stof zich iets heeft laten zakken, laten we bekijken wat DeepSeek daadwerkelijk kan doen en wat de Chinese AI‑industrie binnenkort nog meer zou kunnen doen.

DeepSeek‑achtergrond

High-Flyer

DeepSeek werd ontwikkeld door een Chinees financieel handels‑/kwantitatief hedge‑fund, High-Flyer, opgericht door Liang Wenfeng.

Liang is 40 jaar oud en werkte aanvankelijk in machine‑vision. Hij richtte High‑Flyer op in 2015, toen hij in de dertig was, en was een pionier in het gebruik van AI in handelsstrategieën, met behulp van machine learning. Het fonds beheert nu $8 miljard aan activa.

Meestal zeer discreet, werd Liang gezien naast de Chinese premier Li Qiang (het tweede lid van het Politburo‑staandcomité van de Chinese Communistische Partij) tijdens een bijeenkomst over AI‑technologie in Peking op 20 januari 2025.

Het moet worden opgemerkt dat in de aanvankelijke verwarring en vanwege Liang’s zeldzame publieke optredens, veel media een foto gebruikten van iemand met dezelfde naam, maar volledig niet gerelateerd aan DeepSeek, en die werkt als interieurontwerper.

“Niet Liang Wenfeng” – Bron: Business Day

DeepSeek

In 2021 kocht Liang Wenfeng ongeveer 10.000 H800 Nvidia‑chips, voordat de Amerikaanse sancties ingingen, om te starten wat DeepSeek zou worden, en bracht top‑onderzoekers van High‑Flyer AI naar het project.

De H800‑chips zijn relatief gezien low‑performance chips vergeleken met de meer geavanceerde H100 en B200, met drievoudig het stroomverbruik.

DeepSeek beweert dat hij zijn DeepSeek V3‑model in minder dan 2 maanden heeft getraind, voor $5,58 miljoen. Hoewel dit niet echt de kosten van de 10.000 H800‑chips omvat, is het nog steeds meerdere orders van grootte goedkoper dan alle andere LLM’s tot nu toe.

In feite zou de training van DeepSeek V3 goedkoper zijn dan alleen het salaris van de leiders van AI‑teams bij OpenAI, Meta, Microsoft (MSFT ), Google, enz.

DeepSeek-prestaties

Gecombineerd met de lage ontwikkelingskosten, was wat analisten en beleggers verbaasde dat de prestaties van DeepSeek vergelijkbaar zijn met, of misschien zelfs superieur aan, het nieuwste en beste model van OpenAI en andere top‑AI‑bedrijven, inclusief de net uitgebracht en geprezen als potentiële AGI o3.

Bron: GitHub

De onmiddellijke reactie was de verdenking van oneerlijke praktijken en dat de tijd- en ontwikkelingskosten nep waren (meer hierover hieronder).

Maar hoe dan ook, is het waarschijnlijk dat de methode van DeepSeek 10‑100 x efficiënter is dan wat de AI‑industrie tot nu toe heeft gedaan.

De extra schop onder de Amerikaanse AI‑industrie was de prijs van DeepSeek. Met tokens veel lager dan $1, is het ongeveer 3 %‑5 % van de prijs van al haar concurrenten.

“Wij hebben de prijzen verlaagd omdat, ten eerste, tijdens het verkennen van next‑generation modelstructuren, onze kosten daalden; ten tweede geloven we dat zowel AI‑ als API‑diensten betaalbaar en toegankelijk voor iedereen moeten zijn.”

Liang Wenfeng

Perfecte timing

De impactvolle lancering van DeepSeek V3 was, uiteraard, goed gecoördineerd door het bedrijf voor maximaal effect.

Het kwam slechts enkele dagen na de aankondiging door president Trump van “Project Stargate”, een initiatief van $500 miljard om 20 AI‑mega‑datacenters te bouwen, geleid door SoftBank (SFTBY ), OpenAI, en Oracle (ORCL ).

Terwijl de markten in paniek raakten, lijkt de Amerikaanse president grotendeels onverschrokken.

“Als je het goedkoper kunt doen, als je het [voor] minder kunt doen [en] hetzelfde eindresultaat kunt bereiken. Ik denk dat dat goed voor ons is.”

Hij zei ook dat hij zich geen zorgen maakte over de doorbraak, en voegde toe dat de VS een dominante speler in het veld zal blijven.

Bron: BBC

Na LLM, beeldgeneratie

De prestatie die DeepSeek heeft behaald met LLM, wil nu worden herhaald met AI‑beeldgeneratie en de release van Janus‑Pro‑7B.

Hoewel er discussie bestaat of het daadwerkelijk even goed is als Midjourney, DALL‑E en andere beeldgeneratoren, is het desondanks indrukwekkend.

En als het het patroon van DeepSeek v3 LLM volgt, zal het waarschijnlijk opmerkelijk efficiënt zijn.

De onmiddellijke effecten

Impact op de AI‑industrie

Terwijl het de AI‑industrie stormachtig innam, had DeepSeek een aantal onmiddellijke gevolgen:

  • Marktturbulentie: De Nvidia‑aandelenprijs en de hele Nasdaq crashten toen de markten de implicatie beseften van het mogelijk verspillen van honderden miljarden dollars aan AI‑hardware (zie hieronder voor verdere bespreking van dit onderwerp).
  • Versnelling van de AI‑race: Nu China zich beweegt van het worden afgedaan en “irrelevant” volgens Amerikaanse tech‑moguls enkele maanden geleden, is er nu een nieuwe AI‑race over de Grote Oceaan.
  • Overnachtingssucces: DeepSeek is vrijwel onmiddellijk de meest gedownloade app in de App Store geworden.
  • Offline testen: Veel mensen testen ook hoe het lokaal op hun high‑end thuiscomputer kan draaien, aangezien de rekeneisen veel lager lijken dan bij eerdere LLM’s.

Collateral schade

De schade veroorzaakt door DeepSeek was niet beperkt tot het imago en de potentiële toekomstige winsten van Amerikaanse AI‑ en technologiebedrijven.

Bijvoorbeeld, innovatieve nucleaire bedrijven die de kern van de energievoorziening voor megawatt‑schaal AI‑datacenters zouden vormen, werden nog harder getroffen: op 27th januari 2025 was SMR‑ontwikkelaar Nuscale (SMR ) met 27,5 % gedaald en uraniummijnbouwer Cameco met 15 %.

Een ander collateral slachtoffer zijn niet‑Amerikaanse tech‑aandelen. Japanse tech‑aandelen zoals Advantest, een leverancier van Nvidia, daalden ook 8,6 % en Softbank‑aandelen daalden 8,3 %. Ondertussen daalde de Nederlandse chip‑producent ASML ook 6,5 %.

Hoe heeft DeepSeek het voor elkaar gekregen?

Nog geen definitief antwoord

Dit is uiteraard een nog fel bediscussieerd onderwerp zo kort na de release. We kunnen een paar verschillende gezichtspunten bespreken zodra we een paar bekende feiten in overweging nemen.

Het eerste feit is dat, ongeacht hoe het daar kwam, DeepSeek V3 net zo krachtig is als de beste AI die tot nu toe is uitgebracht.

Misschien nog belangrijker, aangezien het open‑source is, testen en bevestigen veel mensen al dat het veel minder rekenkracht vereist.

“DeepSeek R1 is een van de meest verbazingwekkende en indrukwekkende doorbraken die ik ooit heb gezien – en als open‑source een diepgaand geschenk aan de wereld.”

Marc Andreessen

Het moet dus niet worden afgedaan als alleen “hype” of het resultaat van een samenzwering door de Chinese regering. Dit is ook de mening van gerespecteerde Silicon‑Valley zwaargewichten zoals Marc Andreessen en Chamath Palihapitiya.

“AI‑modelbouw is een geldval (…) Open source is de duidelijke winnaar.

Gesloten‑source AI’s zullen gedwongen worden hun beste modellen geheim te houden en aan ondernemingen te verkopen OF proberen er een ongelooflijke consumentenapp van te maken.

Chamath Palihapitiya

Een interview met Liang Wenfeng uit juli 2024, gegeven net na de release van DeepSeek V2, kan ons ook wat inzichten geven.

Een andere aanpak

De eerste mogelijke verklaring is dat DeepSeek gewoon een andere strategie voor AI‑ontwikkeling heeft gevolgd.

Een belangrijke factor hierbij is dat dit een intern project is van het bedrijf van Liang Wenfeng, geen door VC’s gefinancierde onderneming. In dat opzicht doet het een beetje denken aan de beginjaren van Tesla (TSLA ) en SpaceX (SPCX ), die leunen op het eigen geld van Elon Musk.

Dit verschil bracht DeepSeek een focus op het ontwikkelen van haar eigen modelstructuur, in plaats van Llama te kopiëren om snel applicaties te produceren.

“Ons doel is AGI (Artificial General Intelligence), wat vereist dat we nieuwe modelstructuren verkennen om superieure capaciteiten te bereiken binnen beperkte middelen. Dit is fundamenteel onderzoek voor opschaling. Naast architectuur hebben we data‑curatie en mensachtig redeneren bestudeerd – alles terug te zien in onze modellen.”

Liang Wenfeng

Dit komt ook tot uiting in de bedrijfscultuur, minder gericht op winst, aangezien dit de “taak” is van het High‑Flyer hedge‑fund. In plaats daarvan is innovatie zelf het verklaarde doel.

“Al drie decennia benadrukken we winst boven innovatie. Innovatie is niet puur zakelijk gedreven; het vereist nieuwsgierigheid en creatieve ambitie. We zijn geketend door oude gewoonten, maar dit is een fase.

De meest duurzaam winstgevende Amerikaanse bedrijven zijn tech‑reuzen gebouwd op langetermijn‑R&D.

Liang Wenfeng

Vanuit dit perspectief zou de DeepSeek‑cultuur een duurzaam voordeel kunnen zijn, en het vormt een berispende kritiek op de meeste AI‑denkleiders.

“We geloven dat de AI van China niet voor altijd een volger kan blijven. Vaak zeggen we dat er een één‑ of twee‑jaar kloof bestaat tussen Chinese en Amerikaanse AI, maar de echte kloof ligt tussen originaliteit en imitatie. Als dit niet verandert, zal China altijd een volger blijven. Sommige verkenningen zijn onvermijdelijk.”

Liang Wenfeng

De natuurlijke evolutie van AI‑technologie

Een andere mogelijkheid is simpelweg dat naarmate meer onderzoekers vaardigheden ontwikkelen in het creëren van AI, innovaties het veld blijven voortstuwen. Wat DeepSeek heeft bereikt, zou een scrappy AI‑startup op een dag onvermijdelijk doen naarmate de technologie rijpt. En door sancties die de toegang tot geavanceerde chips beperken, zijn Chinese AI‑bedrijven de eersten die zich richten op meer doen met minder.

Het kan ook worden gezien als de langetermijnsuperioriteit van open‑source software ten opzichte van gesloten, winstoogmerkende systemen die proberen de winst te maximaliseren door monopolies te creëren.

Dit standpunt weerspiegelt evenmin goed de honderden miljarden dollars die Big Tech‑bedrijven alleen al in 2025 van plan waren uit te geven.

Het zou dus minder een aanklacht tegen de superioriteit van DeepSeek zijn, en meer een aanklacht tegen de bureaucratisering van voorheen innovatieve Big Tech‑bedrijven, zowel Chinees als Amerikaans.

 Een samenzwering

Waarschijnlijk onvermijdelijk in de context van de intense rivaliteit tussen grootmachten tussen het Westen en Eurazië (Rusland / China / Iran), waren velen snel geneigd DeepSeek te zien als een buitenlandse vijandige operatie tegen het meest competitieve deel van de Amerikaanse economie.

Een duidelijk af te wijzen samenzweringstheorie is dat het simpelweg een kopie is van westerse AI’s of dat de prestaties nep zijn, aangezien dit al onafhankelijk is bevestigd. Omdat DeepSeek open‑source software is, is het ook nogal onlogisch om het aan te vallen als spyware of als een door de CCP gecensureerd hulpmiddel, aangezien letterlijk iedereen het kan inzetten en vrij kan aanpassen.

Echter, een geldig punt is dat DeepSeek toegang zou kunnen hebben gekregen tot meer geavanceerde chips, officieel gesanctioneerd en verboden om naar China te exporteren. Als dat het geval is, zou het logisch zijn dat het bedrijf dit publiekelijk niet toegeeft en erover liegt.

Een mogelijkheid is verborgen steun van de overheid, van directe financiering tot het geven van toegang tot grote clusters van gesmokkelde H100 Nvidia‑chips voor de training van de AI. We weten bijvoorbeeld dat er veel chips aan Singapore worden verkocht en waarschijnlijk daarna aan China worden doorverkocht.

“De Chinese laboratoria hebben meer H100’s dan men denkt. Mijn begrip is dat DeepSeek ongeveer 50.000 H100’s heeft, waar ze uiteraard niet over kunnen praten, omdat het tegen de exportcontroles van de VS ingaat.”

Alexandr Wang, CEO of training data provider Scale AI

Een ander punt van discussie is de trainingskosten, die niet onafhankelijk zijn geverifieerd.

Een laatste mogelijkheid is dat DeepSeek, onafhankelijk van elke geopolitieke samenzwering, massaal tegen de Nvidia‑aandelen heeft ingezet voordat de opvallende claims werden vrijgegeven. High‑Flyer is tenslotte een hedge‑fund, hoewel dit als marktmanipulatie kan worden beschouwd en daarom een riskante zet is.

Eerste inzichten

AI is een veld dat zich ongelooflijk snel ontwikkelt, en DeepSeek heeft het spel al op een paar belangrijke manieren veranderd:

  • We hebben nu een nieuwe methode om ultra‑efficiënte LLM’s en waarschijnlijk AI‑modellen in het algemeen te genereren.
  • Open‑source AI heeft een solide kans tegen het meer gesloten model gepromoot door (ironisch genaamde) OpenAI.
  • De concurrentie tussen de VS en China op het gebied van AI wordt nog intenser.
  • Sancties op de export van geavanceerde AI‑chips naar China zijn een mislukking, hetzij omdat DeepSeek ze toch heeft verkregen, hetzij omdat ze ze helemaal niet nodig hadden.
    • Op de achtergrond zal Huawei waarschijnlijk ook een serieuze concurrent zijn in het leveren van meer chips aan DeepSeek.
    • Dit zal sommigen misschien niet weerhouden om het nog te proberen.

“Het feit dat DeepSeek erin slaagde R1 te bouwen, illustreert de achterblijvende impact van de mislukking van de exportcontroles van oktober 2022. Maar heel snel zullen we de successen van de exportcontroles van oktober 2023 meemaken.”

Mr Greg Allen, director of the Wadhwani AI Centre at the Centre for Strategic and International Studies.

Vergeet DeepSeek, wat met TikTok‑wraak?

Een belangrijk nieuwsfeit is gemist in de paniekerige analyses en samenzweringstheorieën rond DeepSeek.

Een ander Chinees bedrijf, TikTok‑maker ByteDance, bracht op 24th januari Doubao‑1.5‑pro uit – haar eigen reactie op ChatGPT‑4o.

Het is ook veel goedkoper dan de Amerikaanse tegenhangers, 5 x goedkoper dan het model van DeepSeek en meer dan 200 x minder duur dan OpenAI’s GPT‑4o.

“De nieuwe Doubao 1.5 Pro gebruikt een efficiëntere aanpak voor het trainen van haar AI‑model, wat ByteDance zegt te helpen de systeemprestaties in balans te houden met lagere kosten.”

Dit wordt bereikt door een ontwerp dat zowel training als realtime gebruik van het model combineert, waardoor het geoptimaliseerd wordt voor betere resultaten terwijl de infrastructuurkosten laag blijven.

Bron: Financial Express

This model also beats the leading models from OpenAI, Anthropic, and Alibaba.

Als dit het resultaat is van een onafhankelijke inspanning, zou het bewijzen dat het chiptekort Chinese bedrijven heeft gedwongen te concurreren op efficiëntie, wat een bepaald niveau van zelfgenoegzaamheid bij Amerikaanse AI‑bedrijven onthult, die overspoeld zijn met ogenschijnlijk onbeperkte cash en rekenkracht.

Het is ook niet onwaarschijnlijk dat ByteDance, na maanden van strijd om een verbod of een gedwongen verkoop van TikTok in de VS te vermijden, naar manieren heeft gezocht om te concurreren en terug te vechten.

Andere Chinese modellen

Met nu twee bedrijven die de AI‑markt lijken te verpletteren op prijs voor vergelijkbare prestaties, zal de aandacht waarschijnlijk ook naar andere Chinese AI‑modellen gaan. Dit zou kunnen omvatten:

Als je het vanuit een vogelperspectief bekijkt in plaats van gefocust op DeepSeek, lijkt dit meer een stroom van nieuwe, verbeterde AI‑modellen uit China te zijn, dan een verrassingsaanval van alleen DeepSeek, zoals het nu vaak wordt beschreven.

Conclusie

Naarmate de AI‑oorlog intensifieert, is het niet langer zo duidelijk dat toegang tot financiering en het snel opschalen van rekenkracht de enige bepalende factor zal zijn.

Het is ook onduidelijk hoe winstgevend de sector uiteindelijk zal zijn, als de prijzen voor LLM‑tokens met 50‑200 x kunnen kelderen gedurende één nacht voor dezelfde prestaties. Dit zou echter geen te sterke reactie moeten uitlokken. Uiteindelijk betekent goedkopere en efficiëntere AI ook dat AI massaal zal worden geadopteerd en alomtegenwoordig zal zijn.

Dit betekent ook dat de uiteindelijke vraag naar AI‑chips waarschijnlijk hoog zal blijven, zelfs als deze iets lager is dan aanvankelijk voorspeld.

Even even belangrijker betekent de brede beschikbaarheid van ultra‑goedkope LLM’s via open‑source dat de verwachte effecten van AI op arbeidsmarkten, productiviteit, productie, onderwijs, internationale handel, enz. eerder zullen aankomen.

Jonathan is een voormalig biochemisch onderzoeker die werkzaam was in genetische analyse en klinische proeven. Hij is nu een aandelenanalist en financieel schrijver met een focus op innovatie, marktcycli en geopolitiek in zijn publicatie 'The Eurasian Century'.