Artipisyal na Intelihensiya

DeepSeek: Isang Magulo at Maagang Pagdating ng Komodipikadong AI?

mm
Idagdag ang Securities.io sa mga gusto mong mapagkunan sa Google
Pagsisiwalat: Maaaring tumanggap ang Securities.io ng kabayaran kapag gumamit ka ng mga link sa produktong sinuri namin. Hindi nito naaapektuhan ang aming editoryal na pagsusuri. Hindi kami rehistradong tagapayo sa pamumuhunan; hindi ito payo sa pamumuhunan. Basahin ang aming pagsisiwalat sa affiliate.

DeepSeek Nagwawasak sa Tanawin ng AI

Para sa sinumang hindi nakabantay na tumingin sa mga pamilihang pinansyal noong Lunes, 27th Enero 2025, malamang na ang tanong ay, “Ano ang nangyari?” Ang tila hindi mapigil na pag-akyat ng presyo ng stock ng Nvidia (NVDA ) – hanggang ngayon – ay naputol ng isang brutal na pagbagsak ng 18% sa loob lamang ng isang araw.

Sa pagkawala ng market cap na $560 B, wala pang isang kumpanya ang nawalan ng ganitong halaga sa isang araw. Sa katunayan, marahil nasasanayan na ng mga mamumuhunan ng Nvidia ang matinding volatility ng stock, na nagdala ng 8 sa 10 pinakamalalaking pagbagsak sa isang araw.

Pinagmulan: Visual Capitalist

Ang trigger ay ang paglabas ng DeepSeek, isang LLM (Large Language Model) na gawa sa Tsina na katumbas ng mga pinakamahusay na produkto ng OpenAI at iba pang nangungunang kumpanya ng AI pagdating sa performance. Maliban na ito ay open-source at nagbibigay ng access sa napakababang presyo. Sinabi rin na ito ay binuo gamit lamang ang $6 M bilang isang “side project” ng isang quantitative hedge fund.

Kung totoo, maaaring baligtarin nito ang naratibo na ang pag-develop ng AI ay lubhang compute‑intensive at mangangailangan ng bilyon‑bilyon, kung hindi trilyon, sa mga AI data center. Bilang pinuno ng AI hardware, hindi nakakagulat na ang Nvidia ang pinakaapektado nang mag-panic ang mga mamumuhunan.

Sa pag-alis ng alikabok, tingnan natin kung ano talaga ang kayang gawin ng DeepSeek, at kung ano pa ang maaaring gawin ng industriya ng AI sa Tsina sa lalong madaling panahon.

DeepSeek Background

High-Flyer

Ang DeepSeek ay binuo ng isang Chinese financial trading / quantitative hedge fund, High-Flyer, na itinatag ni Liang Wenfeng.

Si Liang ay 40 taong gulang at unang nagtrabaho sa machine vision. Itinatag niya ang High‑Flyer noong 2015, sa kanyang 30s, na nanguna sa paggamit ng AI sa mga estratehiya sa trading, gamit ang machine learning. Ang pondo ay ngayon namamahala ng $8 B na assets.

Kadalasang napaka-discreet, nakita si Liang na nakaupo sa tabi ng Chinese Premier Li Qiang (ang pangalawang ranggo sa Politburo Standing Committee ng Chinese Communist Party) sa isang pulong tungkol sa AI technology sa Beijing noong Enero 20, 2025.

Pinagmulan: Nigel D’Souza

Dapat ituro na sa unang kalituhan at dahil sa bihirang pampublikong paglabas ni Liang, maraming media outlet ang gumamit ng larawan ng isang tao na may parehong pangalan, ngunit walang kinalaman sa DeepSeek, at nagtatrabaho bilang interior designer.

“Hindi si Liang Wenfeng” – Pinagmulan: Business Day

DeepSeek

Noong 2021, binili ni Liang Wenfeng ang humigit‑kumulang 10,000 H800 Nvidia chips, bago pa man dumating ang US sanctions, upang ilunsad ang magiging DeepSeek, at dinala ang mga nangungunang mananaliksik ng High‑Flyer AI sa proyektong ito.

Ang mga H800 chip ay, kung ikukumpara, mababang‑performance na chips kumpara sa mas advanced na H100 at B200, na may tatlong beses na mas mataas na konsumo ng kuryente.

Pinagmulan: Technical City

Ang DeepSeek ay nagsasabing na-train ang DeepSeek V3 model sa loob ng mas mababa sa 2 buwan, para sa $5.58 M. Kaya bagaman hindi nito isinasama ang gastos ng 10,000 H800 chips, ito ay ilang order ng magnitude pa rin mas mura kaysa sa anumang ibang LLM hanggang ngayon.

Sa katunayan, ginagawa nitong mas mura ang training ng DeepSeek V3 kaysa sa suweldo lamang ng mga pinuno ng AI teams sa OpenAI, Meta, Microsoft (MSFT ), Google, atbp.

DeepSeek Performances

Kasama ang mababang presyo ng development, ang ikinagulat ng mga analyst at mamumuhunan ay ang performance ng DeepSeek na halos kapantay o maaaring mas mahusay pa kaysa sa pinakabagong at pinakamahusay na modelo ng OpenAI at iba pang nangungunang kumpanya ng AI, kasama ang kamakailan lamang inilabas at pinupuri bilang potensyal na AGI o3.

Pinagmulan: GitHub

Ang unang reaksyon ay ang hinalaang may foul play at na peke ang oras at gastos sa development (mas marami pa rito sa ibaba).

Ngunit anumang mangyari, malamang na ang pamamaraan ng DeepSeek ay 10‑100x na mas epektibo kaysa sa ginagawa ng industriya ng AI hanggang ngayon.

Ang karagdagang suntok sa American AI industry ay ang presyo ng DeepSeek. Sa mga token na mas mababa sa $1, ito ay nasa 3%‑5% lamang ng presyo ng lahat ng kakompetensya nito.

Pinagmulan: Jason Clarck

“Binaba namin ang mga presyo dahil, una, habang ini‑explore ang susunod‑henerasyon na mga istruktura ng modelo, bumaba ang aming mga gastos; pang‑dalawa, naniniwala kami na dapat maging abot‑kaya at accessible ang AI at mga serbisyo ng API para sa lahat.”

Liang Wenfeng

Perfect Timing

Ang makabuluhang paglunsad ng DeepSeek V3 ay, malinaw, ay maayos na na‑coordinate ng kumpanya para sa pinakamalaking epekto.

Ito ay dumating ilang araw lamang matapos ang anunsyo ni Pangulong Trump ng “Project Stargate”, isang $500 B na inisyatiba upang magtayo ng 20 AI mega‑data center, pinamumunuan ng SoftBank (SFTBY ), OpenAI, at Oracle (ORCL ).

Habang nag‑panic ang mga merkado, tila hindi gaanong apektado ang US President.

“Kung magagawa mo ito nang mas mura, kung magagawa mo ito [para] sa mas mababa [at] makamit ang parehong resulta. Sa tingin ko, maganda ito para sa atin.”

Sinabi rin niyang hindi siya nababahala sa breakthrough, idinagdag na mananatiling dominanteng manlalaro ang US sa larangang ito.

Pinagmulan: BBC

After LLM, Image Generation

Ang tagumpay na nakuha ng DeepSeek sa LLM, ngayon ay tinitingnan na nitong ulitin sa AI image generation at ang paglabas ng Janus‑Pro‑7B.

Pinagmulan: Hugging Face

Bagaman may debate kung ito ay kasing ganda nga ng Midjourney, DALL‑E, at iba pang image generator, ito ay kahanga‑hang pa rin.

At kung susundin nito ang pattern ng DeepSeek v3 LLM, malamang na ito ay magiging kamangha‑manghang epektibo.

The Immediate Effects

Impact On The AI Industry

Habang kinukuha ng AI industry ang bagyo, nagkaroon ng ilang agarang kahihinatnan ang DeepSeek:

  • Pagkakagulo sa merkado: Bumagsak ang presyo ng stock ng Nvidia at ang buong Nasdaq nang mapagtanto ng mga merkado ang implikasyon ng posibleng pagsasayang daan‑daang bilyong dolyar sa AI hardware (tingnan sa ibaba para sa karagdagang talakayan).
  • Pagpabilis ng AI race: Habang ang China ay lumalayo na sa pagiging “irrelevant” ayon sa mga US tech mogul ilang buwan na ang nakalipas, isang bagong AI race na ngayon ay nagaganap sa kabila ng Pacific Ocean.
  • Biglaang Tagumpay: Halos agad na naging pinakamaraming na‑download na app sa App Store ang DeepSeek.
  • Offline Testing: Maraming tao rin ang sumusubok kung paano ito mapapatakbo nang lokal sa kanilang high‑end na home computer, dahil ang pangangailangan sa computing ay tila napakalaki ang pagkakaiba kumpara sa mga naunang LLM.

Collateral damages

Ang pinsalang dulot ng DeepSeek ay hindi lamang limitado sa imahe at posibleng hinaharap na kita ng mga Amerikanong AI at tech company.

Halimbawa, ang mga makabagong nuclear company na inaasahang magiging core ng power supply sa megawatt‑scale na AI data center ay mas lalong naapektuhan: noong 27th Enero 2025, ang SMR developer Nuscale (SMR ) ay bumaba ng 27.5% at ang uranium miner na Cameco ay bumaba ng 15%.

Isa pang collateral victim ay ang mga non‑US tech stocks. Ang mga Japanese tech stock tulad ng Advantest, isang supplier ng Nvidia, ay bumaba rin ng 8.6% at ang stock ng Softbank ay bumaba ng 8.3%. Samantala, ang Dutch chip‑producing manufacturer na ASML ay bumaba rin ng 6.5%.

How Did DeepSeek Manage It?

No Definitive Answer Yet

Ito ay malinaw na isang mainit na pinagdedebatehan kaya’t kakaunti pa lamang ang nakalipas mula nang ilabas. Maaari nating talakayin ang ilang magkaibang pananaw kapag isinasaalang‑alang ang ilang kilalang katotohanan.

Ang unang katotohanan ay kahit papaano, ang DeepSeek V3 ay kasing lakas ng pinakamahusay na AI na nailabas hanggang ngayon.

Marahil mas mahalaga, dahil ito ay open‑source, maraming tao na ang sumusubok at kinukumpirma na ito ay nangangailangan ng mas kaunting computing power.

Ang DeepSeek R1 ay isa sa mga pinaka kamangha‑manghang breakthrough na aking nakita – at bilang open source, isang napakalaking regalo sa mundo.

Marc Andreessen

Kaya hindi dapat ito ituring na “hype” lamang o resulta ng isang konspirasyon ng pamahalaang Tsino. Ito rin ang opinyon ng mga respetadong heavyweight sa Silicon Valley tulad nina Marc Andreessen at Chamath Palihapitiya.

Ang pagbuo ng AI model ay isang perang bitag (…) Ang Open Source ang malinaw na panalo.

Ang mga closed source AI ay mapipilitang itago ang kanilang pinakamahusay na modelo at ibenta ito sa mga enterprise O subukang lumikha ng isang kamangha‑manghang consumer app gamit ito.

Chamath Palihapitiya

Isang panayam kay Liang Wenfeng noong Hulyo 2024, na ibinigay kaagad pagkatapos ng paglabas ng DeepSeek V2, ay maaari ring magbigay ng ilang insight.

A Different Approach

Ang unang posibleng paliwanag ay ang DeepSeek ay gumamit lamang ng ibang estratehiya sa pag‑develop ng AI.

Isang susi rito ay ito ay isang internal na proyekto ng kumpanya ni Liang Wenfeng, hindi isang VC‑funded na negosyo. Sa puntong iyon, ito ay medyo kahawig ng mga unang araw ng Tesla (TSLA ) at SpaceX (SPCX ), na umaasa sa sariling pera ni Elon Musk.

Ang pagkakaibang ito ay nagdala sa DeepSeek ng pokus sa pag‑develop ng sarili nitong istruktura ng modelo, sa halip na kopyahin ang Llama para mabilis na makagawa ng mga aplikasyon.

“Ang aming layunin ay AGI (Artificial General Intelligence), na nangangailangan sa amin na mag‑explore ng mga bagong istruktura ng modelo upang makamit ang mas mataas na kakayahan sa limitadong resources. Ito ay foundational research para sa scaling up. Higit pa sa arkitektura, pinag‑aralan namin ang data curation at human‑like reasoning—lahat ay nasasalamin sa aming mga modelo.”

Liang Wenfeng

Ito rin ay nasasalamin sa kultura ng kumpanya, na mas kaunti ang pokus sa kita, dahil ito ay “trabaho” ng High‑Flyer hedge fund. Sa halip, ang inobasyon mismo ang iniaangkin na layunin.

“Sa loob ng tatlong dekada, binigyang-diin namin ang kita higit sa inobasyon. Ang inobasyon ay hindi puro negosyo; ito ay nangangailangan ng curiosity at creative ambition. Nakahigpit kami sa mga lumang gawi, pero ito ay isang yugto.

Ang pinaka‑matagal na kumikitang mga kumpanya sa US ay mga tech giant na binuo sa pang‑matagalang R&D.”

Liang Wenfeng

Mula sa perspektibong ito, maaaring ang kultura ng DeepSeek ay isang matibay na kalamangan, at ito ay kumakatawan sa isang matinding kritisismo sa karamihan ng AI thought leaders.

“Naniniwala kami na ang AI ng China ay hindi maaaring manatiling tagasunod magpakailanman. Madalas naming sinasabi na may isang‑dalawang taong agwat sa pagitan ng Chinese at American AI, pero ang tunay na agwat ay nasa pagitan ng orihinalidad at imitasyon. Kung hindi ito magbabago, palagiang magiging tagasunod ang China. May ilang eksplorasyon na hindi maiiwasan.”

Liang Wenfeng

The Natural Evolution Of AI Tech

Isa pang opsyon ay simpleng dahil habang dumarami ang mga mananaliksik na nagde‑develop ng kakayahan sa paglikha ng AI, patuloy na itinutulak ng mga inobasyon ang larangan pasulong. Ang naabot ng DeepSeek, maaaring isang scrappy AI startup lamang ang makakagawa balang araw habang ang teknolohiya ay nag‑mature. At dahil sa mga sanction na naglilimita sa access sa advanced chips, ang mga Chinese AI company ang unang nag‑focus sa paggawa ng higit gamit ang mas kaunting resources.

Maaari rin itong ituring bilang pang‑matagalang kalamangan ng open‑source software laban sa closed, for‑profit na mga sistema na naglalayong i‑maximize ang kita sa pamamagitan ng monopolyo.

Ang pananaw na ito ay hindi rin nagpapakita ng napakagandang larawan sa daan‑daang bilyong dolyar na plano ng mga Big Tech company na gastusin lamang sa 2025.

Kaya ito ay hindi gaanong pagbatikos sa pagiging mas superior ng DeepSeek, kundi mas sa burukrasya ng dating inobatibong mga Big Tech company, kapwa Chinese at American.

 A Conspiracy

Marahil ay hindi maiiwasan sa konteksto ng matinding kompetisyon ng mga Great Powers sa pagitan ng Kanluran at Eurasia (Russia / China / Iran), marami ang mabilis na nakakita sa DeepSeek bilang isang banyagang hostile operation laban sa pinaka‑kompetitibong bahagi ng ekonomiya ng US.

Isang madaling balewaleng conspiracy theory ay na ito ay simpleng kopya ng Western AI o peke ang performance nito, dahil ito ay na‑confirm na nang independent. Bilang isang open‑source software, hindi rin ito lohikal na atakihin bilang spyware o tool na censored ng CCP, dahil sinumang tao ay maaaring i‑deploy at baguhin ito nang malaya.

Gayunpaman, isang valid na punto ay maaaring nakakuha ang DeepSeek ng access sa mas advanced na chips, na opisyal na sinadya at ipinagbabawal na i‑export sa China. Kung ganoon, makatuwiran na hindi ito inamin ng kumpanya at nagsinungaling tungkol dito.

Isang posibilidad ay nakatagong suporta mula sa gobyerno, mula sa direktang pondo hanggang sa pagbibigay ng access sa malalaking cluster ng smuggled na H100 Nvidia chips para sa training ng AI. Alam natin halimbawa na maraming chips ang ibinibenta sa Singapore, at malamang na muling ibinebenta sa China.

“Mas marami ang H100 sa mga Chinese lab kaysa iniisip ng mga tao. Ayon sa aking pagkaunawa, may humigit‑kumulang 50,000 H100 ang DeepSeek, na hindi nila maaaring pag-usapan, malinaw, dahil ito ay laban sa export controls na ipinatupad ng US.”

Alexandr Wang, CEO ng training data provider Scale AI

Isa pang pagtatalo ay ang gastos sa training, na hindi pa na‑verify nang independent.

Isang huling posibilidad ay ang DeepSeek, nang hiwalay mula sa anumang geopolitical conspiracy, ay maaaring nag‑bet nang malaki laban sa stock ng Nvidia bago ilabas ang kanilang kahanga‑hang mga claim. Ang High‑Flyer ay isang hedge fund pa rin, bagaman ito ay maaaring ituring na market manipulation at kaya’t isang mapanganib na galaw.

First Takeaways

Ang AI ay isang larangan na napakabilis ang pag‑evolve, at ang DeepSeek ay nagbago na ng laro sa ilang mahahalagang paraan:

  • Mayroon na tayong bagong pamamaraan upang lumikha ng ultra‑efficient na LLM at marahil AI models sa pangkalahatan.
  • Ang open‑source AI ay may solidong pagkakataon laban sa mas closed na modelo na pinopromote ng (ironically named) OpenAI.
  • Ang kompetisyon sa pagitan ng USA at China sa AI ay nagiging mas matindi.
  • Ang mga sanction sa pag‑export ng advanced AI chips sa China ay isang kabiguan, alinman dahil nakuha pa rin ng DeepSeek ang mga ito, o dahil hindi naman nila ito kailangan.
    • Sa likod, malamang na ang Huawei ay magiging seryosong contender sa pagbibigay ng mas marami pang chips sa DeepSeek.
    • Maaaring hindi nito mapigilan ang ilan na subukang gawin pa rin ito.

“Ang katotohanang nagawa ng DeepSeek na buuin ang R1 ay nagpapakita ng pagka‑huli ng epekto ng kabiguan ng Oktubre 2022 export controls. Ngunit napakabilis, mamumuhay tayo sa tagumpay ng Oktubre 2023 export controls.

Mr Greg Allen, director ng Wadhwani AI Centre sa Centre for Strategic and International Studies.

Forget DeepSeek, What About TikTok Revenge?

May isang mahalagang balita na napalampas sa mga nag‑panic na analisis at conspiracy theory na nakapalibot sa DeepSeek.

Isa pang Chinese company, ang TikTok creator na ByteDance, ay nag‑release ng Doubao‑1.5‑pro noong Enero 24th – ang kanilang sariling tugon sa ChatGPT‑4o.

Ito rin ay mas mura kumpara sa mga Amerikanong katapat, 5x mas mura kaysa sa modelo ng DeepSeek at higit sa 200x mas mura kaysa sa GPT‑4o ng OpenAI.

Ang bagong Doubao 1.5 Pro ay gumagamit ng mas epektibong pamamaraan sa pag‑train ng AI model nito, na sinasabi ng ByteDance na tumutulong ito na balansehin ang performance ng system sa mas mababang gastos.

Na‑achieve ito sa pamamagitan ng disenyo na pinagsasama ang training at real‑time na paggamit ng modelo, na nag‑optimize nito para sa mas maganda na resulta habang pinapababa ang gastos sa infrastructure.

Pinagmulan: Financial Express

Ang modelong ito ay tinalo rin ang leading models mula sa OpenAI, Anthropic, at Alibaba.

Pinagmulan: AI Entrepreneur

Kung ito ay resulta ng independent effort, magpapatunay ito na ang chip shortage ay nag‑pilit sa mga Chinese company na mag‑kompetisyon sa efficiency, na nag‑reveal ng isang antas ng complacency sa mga Amerikanong AI company, na puno ng tila walang limitasyong cash at computing power.

Hindi rin malabong ang ByteDance, matapos ang mga buwan ng pakikipaglaban upang iwasan ang ban o sapilitang pagbebenta ng TikTok sa US, ay naghanap ng mga paraan upang makipag‑kompetisyon at mag‑reklamo.

Other Chinese Models

Sa dalawang kumpanya na ngayon ay tila binabagsak ang AI market sa presyo para sa magkatulad na performance, malamang na tututok din ang atensyon sa iba pang Chinese AI models. Maaaring kabilang dito:

Sa pagtingin mula sa isang bird‑eye view sa halip na mag‑focus lamang sa DeepSeek, ito ay tila mas maraming bagong, pinahusay na AI models mula sa China, kaysa isang sorpresa na strike lamang ng DeepSeek, gaya ng madalas na inilalarawan ngayon.

Conclusion

Habang lumalalim ang AI war, hindi na malinaw na ang access sa pondo at mabilis na pag‑scale ng compute power ay magiging nag-iisang factor na magtatakda ng tagumpay.

Hindi rin malinaw kung gaano kakita ang sektor sa huli, kung ang presyo ng LLM tokens ay maaaring bumagsak ng 50‑200x overnight para sa parehong performance. Gayunpaman, hindi dapat ito magdulot ng sobrang reaksyon. Sa huli, ang mas mura at mas epektibong AI ay nangangahulugang AI na magiging malawak na ginagamit at omnipresent.

Ibig sabihin nito ay ang panghuli na demand para sa AI chips ay malamang na mananatiling mataas, kahit na bahagyang mas mababa kaysa sa orihinal na forecast.

Ganun din, ang malawak at ultra‑cheap na LLMs na accessible sa pamamagitan ng open source ay nangangahulugang maagang pagdating ng anumang epekto na inaasahang idudulot ng AI sa job markets, productivity, manufacturing, edukasyon, international trade, atbp.

Si Jonathan ay dating mananaliksik na biochemist na nagtrabaho sa pagsusuri ng henetika at mga klinikal na pagsubok. Siya ngayon ay isang stock analyst at manunulat sa pananalapi na nakatuon sa inobasyon, mga siklo ng merkado, at heopolitika sa kanyang publikasyon 'The Eurasian Century'.