Januarja 2025 je kitajsko zagonsko podjetje za AI DeepSeek izdalo svoj model sklepanja DeepSeek-R1 — in v enem tednu pretreslo ves tehnološki svet. Po zmogljivosti je ta kitajski model AI primerljiv s ChatGPT podjetja OpenAI, vendar so bili stroški razvoja korenito drugačni. Medtem ko poraba OpenAI sega v stotine milijonov dolarjev, naj bi DeepSeek za učenje porabil le $5.6 million. Poleg tega DeepSeek ni uporabljal najnaprednejših čipov AI podjetja Nvidia — ameriški izvozni nadzor prepoveduje njihovo prodajo Kitajski — temveč njihove okrnjene različice. To je odprlo neprijetno vprašanje: ali so astronomski proračuni ameriških podjetij za AI upravičeni, če je mogoče na Kitajskem tako izdelati zmogljivo in poceni AI?
DeepSeek-R1 in OpenAI na kratko
Preden se poglobimo v podrobnosti, sledi primerjava, ki prikazuje, zakaj je bil izid DeepSeek tako nenavaden v primerjavi z uveljavljenim vodilnim podjetjem na trgu AI.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Prijavljeni stroški učenja | Približno $5.6 million | Stotine milijonov dolarjev |
| Strojna oprema | Nvidia H800 — izvozu skladni, okrnjeni čipi | Nvidia H100 — vrhunski čipi AI |
| Dostop do modela | Odprte uteži in koda, brezplačno za prenos ter spreminjanje | Lastniški model, samo API in naročnina |
| App Store (konec januarja 2025) | Št. 1 med brezplačnimi aplikacijami v ZDA in na Kitajskem | Prehitel ga je DeepSeek |
| Filtriranje odgovorov | Državna cenzura politično občutljivih tem | Politiko vsebin določa podjetje |
DeepSeek sesuje trg: Nvidia izgubi $600 billion
Odziv borze je bil takojšen. Delnice družbe Nvidia, največjega svetovnega dobavitelja čipov AI, so v enem dnevu strmoglavile za 17 %, kar je izbrisalo približno $600 billion tržne vrednosti — največjo enodnevno izgubo katerega koli podjetja v zgodovini ameriškega borznega trga. Nasdaq 100, ki vključuje največja tehnološka podjetja, je izgubil skoraj $1 trillion v enem najpomembnejših tehnoloških zlomov zadnjih let.
Tvegani kapitalist, inženir in izumitelj Marc Andreessen je dogodek označil za »Sputnikov trenutek« AI ter ga primerjal z izstrelitvijo prvega sovjetskega satelita leta 1957. Takrat je svet spoznal, da je ZSSR v vesoljski tekmi prehitela Združene države. Kitajska je zdaj naredila podoben preskok v umetni inteligenci in Zahod prisilila, da prizna, da tehnološka premoč ni več njegova izključna prednost.
Skrivnost uspeha DeepSeek: poceni čipi, odprta koda in viralna aplikacija
Uspeh DeepSeek pojasnjujejo trije dejavniki. Prvič, podjetju je uspelo drastično znižati stroške učenja AI: medtem ko OpenAI za razvoj svojih modelov porabi stotine milijonov, je DeepSeek primerljivo raven zmogljivosti dosegel za le $5.6 million. To je bilo mogoče, ker je namesto zmogljivih procesorjev H100, na katere se zanašajo konkurenti, uporabil cenovno dostopnejše čipe Nvidia H800. Optimizirani algoritmi so DeepSeek nato omogočili visoko učinkovitost z bistveno manj računske moči.
Druga prednost je bila odločitev DeepSeek, da svojo umetno inteligenco ponudi kot odprto kodo z objavo uteži modela in kode. To pomeni, da lahko tehnologijo vsakdo prenese, prilagodi ali izboljša — kar je posebej privlačno za podjetja, raziskovalce in zagonska podjetja, ki si lastniške AI v velikem obsegu ne morejo privoščiti.
Tretji dejavnik hitrega vzpona DeepSeek je bila takojšnja in izjemna priljubljenost med končnimi uporabniki. V nekaj dneh je klepetalna aplikacija DeepSeek postala največkrat prenesena brezplačna aplikacija v Apple App Store tako v ZDA kot na Kitajskem ter prehitela ChatGPT.
Obtožbe o destilaciji in ameriške sankcije za čipe
OpenAI in Microsoft sta začela preiskavo, saj sumita, da je DeepSeek za učenje svojega modela uporabil njuno tehnologijo. Po njunih navedbah naj bi se DeepSeek zanašal na destilacijo znanja — metodo, pri kateri en model AI posnema drugega, da prevzame njegov slog odgovorov in sklepanja. Če bi se to dokazalo, bi DeepSeek lahko imel resne pravne težave.
Tu so tudi ameriške sankcije proti Kitajski. Peking trenutno ne more kupovati najnaprednejših čipov Nvidia, strožji izvozni nadzor pa bi lahko oviral kitajska prizadevanja za razvoj naslednje generacije modelov AI. Vendar dejstvo, da je DeepSeek prišel tako daleč, kaže, kako samozadostna je kitajska tehnološka industrija že postala.
Kljub obtožbam je CEO OpenAI Sam Altman priznal, da je DeepSeek močan tekmec, in dejal, da je kitajski model impresiven, zlasti glede na razmeroma nizke stroške.
Kaj šok DeepSeek pomeni za industrijo AI
DeepSeek bo verjetno spremenil ustaljeni pogled na to, kakšna naj bi bila AI in koliko naj bi stala. Do nedavna je veljalo, da gradnja zmogljivih velikih jezikovnih modelov zahteva ogromne naložbe in izjemno zapleteno infrastrukturo s tisoči najsodobnejših čipov. Kitajsko podjetje je pokazalo, da so primerljivi rezultati dosegljivi z veliko manj viri. To postavlja pod vprašaj tradicionalne prakse panoge in glavne akterje sili v ponovno presojo strategije.
Ta uspeh lahko spremeni tudi razmerje moči v tehnološki tekmi. Še nedavno je Kitajska v AI veljala za avtsajderja; zdaj zaostaja le nekaj let, če sploh. Ker je ameriški predsednik Donald Trump začutil nevarnost zaostanka, je napovedal pobudo Stargate — program v vrednosti do $500 billion, namenjen krepitvi položaja ameriških razvijalcev AI.
Tudi OpenAI je začel zniževati cene svojih storitev, da bi obdržal uporabnike. Če bo DeepSeek še naprej izdajal odprtokodne rešitve AI, ki skoraj brez stroškov tekmujejo z vodilnimi na trgu, bo pritisk na celotno panogo le še naraščal.
Druga plat DeepSeek: cenzura in dvomi o stroških
Kitajska AI pa še zdaleč ni brez pomanjkljivosti. Odgovori DeepSeek so filtrirani v skladu z državno cenzuro — klepetalnik noče odgovarjati na vprašanja o Xi Jinpingu ali Tajvanu. Nekateri analitiki dvomijo tudi o prijavljenih stroških razvoja in menijo, da je kitajska vlada projekt morda prikrito subvencionirala z elektriko, plačami in računskimi viri. To je sicer težko preveriti.
Obstaja tudi vprašanje podatkov. Aplikacija DeepSeek uporabniške podatke shranjuje na strežnikih na Kitajskem, zaradi česar so regulatorji v več državah storitev že podrobneje preučili — kar opominja, da lahko poceni model AI prinaša lastne stroške skladnosti.
Kaj sledi za DeepSeek in tekmo AI?
DeepSeek je že prelomil pravila igre. Vodilna svetovna IT-podjetja bodo odslej morala igrati po drugačnih pravilih. Tehnološka tekma se bo nadaljevala — z naložbami v obsegu Stargate na eni strani in odprtokodnimi modeli na drugi — morda pa res stojimo na pragu nove dobe dostopne umetne inteligence ali zgolj na začetku intenzivnega tekmovanja med Združenimi državami in Kitajsko na področju visokih tehnologij.
Kaj to pomeni za zagonska podjetja in ustanovitelje
Cenejša AI z odprtimi utežmi znižuje oviro za razvoj izdelkov AI: majhna ekipa lahko zdaj vrhunski model poganja na lastni infrastrukturi, namesto da plačuje za lastniški dostop. Slabost je, da pravna in regulativna vprašanja — varstvo podatkov, filtriranje vsebin, licenčni pogoji — postanejo odgovornost ustanovitelja.
Eesti Firma zagotavlja korporativno in pravno podporo za projekte AI ter podjetjem pomaga slediti nenehno spreminjajočemu se tehnološkemu in regulativnemu okolju. Za strokovno svetovanje in podporo nas lahko kontaktirate.
Pogosto zastavljena vprašanja
DeepSeek-R1 je veliki jezikovni model, osredotočen na sklepanje, ki ga je kitajsko zagonsko podjetje DeepSeek izdalo januarja 2025. Deluje na ravni, primerljivi z modeli za ChatGPT podjetja OpenAI, vendar je njegovo učenje veliko cenejše, uteži pa so objavljene pod odprto licenco.
Vlagatelji so se zbali, da bo povpraševanje po najdražji strojni opremi Nvidia manjše od pričakovanega, če je mogoče vrhunski model AI naučiti na cenejših, omejenih čipih za nekaj milijonov dolarjev. Delnice so v enem dnevu padle za 17 % in izbrisale približno $600 billion tržne vrednosti.
Uteži modela in koda so javno dostopne, zato lahko razvijalci model sami prenesejo, zaženejo in dodatno učijo. Podatki za učenje niso bili objavljeni, zato ga je natančneje opisati kot model z odprtimi utežmi.
DeepSeek je navedel, da je končni postopek učenja stal približno $5.6 million. Nekateri analitiki opozarjajo, da ta znesek ne vključuje raziskav, prejšnjih poskusov in nakupov strojne opreme, zato so bili skupni stroški programa verjetno precej višji.
Da — odprta licenca omogoča komercialno uporabo, model pa je mogoče gostiti na lastni infrastrukturi ali infrastrukturi evropskega oblaka. Podjetja morajo pred uvedbo še vedno oceniti varstvo podatkov, filtriranje vsebin in pogoje licence.