2025. gada janvārī Ķīnas MI jaunuzņēmums DeepSeek izlaida savu spriešanas modeli DeepSeek-R1 — un nedēļas laikā tas satricināja visu tehnoloģiju pasauli. Veiktspējas ziņā šis Ķīnas MI modelis ir līdzvērtīgs OpenAI ChatGPT, taču izstrādes izmaksas būtiski atšķīrās. Kamēr OpenAI izdevumi sasniedz simtiem miljonu dolāru, DeepSeek apmācībai, kā ziņots, iztērēja tikai $5.6 miljonus. Turklāt DeepSeek neizmantoja Nvidia modernākās MI mikroshēmas — ASV eksporta kontrole aizliedz tās pārdot Ķīnai — bet gan to ierobežotās versijas. Tas radīja neērtu jautājumu: ja Ķīnā šādi iespējams izveidot jaudīgu un lētu MI, vai Amerikas MI uzņēmumu astronomiskie budžeti ir pamatoti?
DeepSeek-R1 un OpenAI īsā salīdzinājumā
Pirms pievērsties detaļām, šeit ir salīdzinājums, kas parāda, ar ko DeepSeek laišana tirgū bija tik neparasta salīdzinājumā ar nostiprināto MI tirgus līderi.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Paziņotās apmācības izmaksas | Aptuveni $5.6 miljoni | Simtiem miljonu dolāru |
| Aparatūra | Nvidia H800 — eksportam atbilstošas, ierobežotas mikroshēmas | Nvidia H100 — augstākās klases MI mikroshēmas |
| Piekļuve modelim | Atvērtie svari un kods, bez maksas lejupielādējami un modificējami | Slēgts risinājums, tikai API un abonements |
| App Store (2025. gada janvāra beigās) | 1. vieta bezmaksas lietotņu reitingā ASV un Ķīnā | To apsteidza DeepSeek |
| Atbilžu filtrēšana | Valsts cenzūra politiski jutīgās tēmās | Satura politiku nosaka uzņēmums |
DeepSeek sagrauj tirgu: Nvidia zaudē $600 miljardus
Akciju tirgus reakcija bija tūlītēja. Nvidia, pasaulē lielākais MI mikroshēmu piegādātājs, vienā dienā piedzīvoja akciju cenas kritumu par 17%, zaudējot aptuveni $600 miljardus tirgus vērtības — lielāko vienas dienas zaudējumu jebkura uzņēmuma ASV akciju tirgus vēsturē. Nasdaq 100, kurā ietilpst lielākie tehnoloģiju uzņēmumi, zaudēja gandrīz $1 triljonu vienā no nozīmīgākajiem tehnoloģiju sektora kritumiem pēdējos gados.
Riska kapitālists, inženieris un izgudrotājs Marks Andrisens šo notikumu nosauca par MI “Sputnik brīdi”, salīdzinot to ar Padomju Savienības pirmā satelīta palaišanu 1957. gadā. Toreiz pasaule saprata, ka PSRS kosmosa sacensībā ir apsteigusi Amerikas Savienotās Valstis. Tagad Ķīna ir veikusi līdzīgu lēcienu mākslīgā intelekta jomā, liekot Rietumiem atzīt, ka tehnoloģiskais pārākums vairs nav to ekskluzīvā priekšrocība.
DeepSeek panākumu noslēpums: lētas mikroshēmas, atvērtais kods un virāla lietotne
DeepSeek panākumus skaidro trīs faktori. Pirmkārt, uzņēmumam izdevās būtiski samazināt MI apmācības izmaksas: kamēr OpenAI savu modeļu izstrādei tērē simtiem miljonu, DeepSeek sasniedza salīdzināmu veiktspējas līmeni tikai par $5.6 miljoniem. Tas bija iespējams, jo uzņēmums konkurentu izmantoto augstākās klases H100 procesoru vietā izmantoja pieejamākās Nvidia H800 mikroshēmas. Optimizēti algoritmi savukārt ļāva DeepSeek saglabāt augstu efektivitāti ar ievērojami mazāku skaitļošanas jaudu.
Otra priekšrocība bija DeepSeek lēmums padarīt savu mākslīgo intelektu par atvērtā koda risinājumu, publicējot modeļa svarus un kodu. Tas nozīmē, ka ikviens var tehnoloģiju lejupielādēt, pielāgot vai uzlabot — īpaši pievilcīgi tas ir uzņēmumiem, pētniekiem un jaunuzņēmumiem, kuri nevar atļauties slēgtus MI risinājumus lielā mērogā.
Trešais DeepSeek straujās izaugsmes faktors bija tā tūlītējā un milzīgā popularitāte gala lietotāju vidū. Dažu dienu laikā DeepSeek tērzēšanas robota lietotne kļuva par visvairāk lejupielādēto bezmaksas lietotni Apple App Store gan ASV, gan Ķīnā, apsteidzot ChatGPT.
Apsūdzības par destilāciju un ASV mikroshēmu sankcijas
OpenAI un Microsoft sāka izmeklēšanu, aizdomās turot DeepSeek par savas tehnoloģijas izmantošanu modeļa apmācībai. Pēc to teiktā, DeepSeek, iespējams, izmantoja zināšanu destilāciju — metodi, kurā viens MI modelis atdarina citu, lai pārņemtu tā atbilžu stilu un spriešanas veidu. Ja tas tiks pierādīts, DeepSeek varētu saskarties ar nopietnām juridiskām problēmām.
Jāņem vērā arī ASV sankcijas pret Ķīnu. Pekina pašlaik nevar iegādāties Nvidia modernākās mikroshēmas, un stingrāka eksporta kontrole varētu kavēt Ķīnas centienus izstrādāt nākamās paaudzes MI modeļus. Tomēr fakts, ka DeepSeek ir ticis tik tālu, parāda, cik pašpietiekama Ķīnas tehnoloģiju nozare jau ir kļuvusi.
Neraugoties uz apsūdzībām, OpenAI CEO Sems Altmens atzina, ka DeepSeek ir spēcīgs konkurents, un norādīja, ka Ķīnas modelis ir iespaidīgs, īpaši ņemot vērā tā samērā zemās izmaksas.
Ko DeepSeek radītais satricinājums nozīmē MI nozarei
DeepSeek, visticamāk, apgāzīs līdzšinējo priekšstatu par to, kādam jābūt MI un cik tam jāmaksā. Vēl nesen tika pieņemts, ka jaudīgu lielo valodas modeļu izveidei vajadzīgas milzīgas investīcijas un ļoti sarežģīta infrastruktūra ar tūkstošiem modernāko mikroshēmu. Ķīnas uzņēmums ir parādījis, ka salīdzināmus rezultātus var sasniegt ar daudz mazākiem resursiem. Tas apstrīd nozares tradicionālo praksi un liek lielākajiem spēlētājiem pārvērtēt savu stratēģiju.
Šie panākumi var arī mainīt spēku samēru tehnoloģiju sacensībā. Vēl nesen Ķīna tika uzskatīta par MI autsaideri; tagad tā, ja vispār, atpaliek vien par dažiem gadiem. Bažījoties par atpalikšanu, ASV prezidents Donalds Tramps paziņoja par Stargate iniciatīvu — programmu līdz $500 miljardu vērtībā, kuras mērķis ir stiprināt Amerikas MI izstrādātāju pozīcijas.
Arī OpenAI ir sākusi samazināt savu pakalpojumu cenas, cenšoties noturēt lietotājus. Ja DeepSeek turpinās izlaist atvērtā koda MI risinājumus, kas gandrīz bez maksas konkurē ar tirgus līderiem, spiediens uz visu nozari tikai pieaugs.
DeepSeek otra puse: cenzūra un šaubas par izmaksām
Tomēr Ķīnas MI nebūt nav nevainojams. DeepSeek atbildes tiek filtrētas saskaņā ar valsts cenzūru — tērzēšanas robots atsakās atbildēt uz jautājumiem par Sji Dzjiņpinu vai Taivānu. Daži analītiķi apšauba arī paziņotās izstrādes izmaksas, pieļaujot, ka Ķīnas valdība varētu būt slepeni subsidējusi projekta elektroenerģiju, algas un skaitļošanas resursus. Taču to ir grūti pārbaudīt.
Pastāv arī datu jautājums. DeepSeek lietotne glabā lietotāju datus serveros Ķīnā, un tas jau licis vairāku valstu regulatoriem rūpīgāk izvērtēt pakalpojumu — atgādinot, ka lētam MI modelim var būt arī savas atbilstības izmaksas.
Kas gaida DeepSeek un MI sacensību?
DeepSeek jau ir mainījis spēles noteikumus. Turpmāk pasaules vadošajiem IT uzņēmumiem būs jāspēlē pēc citiem noteikumiem. Tehnoloģiju sacensība turpināsies — vienā pusē ar Stargate mēroga investīcijām, otrā ar atvērtā koda modeļiem — un, iespējams, mēs patiešām stāvam uz jauna pieejama mākslīgā intelekta laikmeta sliekšņa vai tikai augsto tehnoloģiju sīvas cīņas sākumā starp ASV un Ķīnu.
Ko tas nozīmē jaunuzņēmumiem un dibinātājiem
Lētāks MI ar atvērtiem svariem pazemina slieksni MI produktu izveidei: neliela komanda tagad var darbināt augstākās klases modeli savā infrastruktūrā, nevis maksāt par slēgtu piekļuvi. Taču pretī juridiskā un regulatīvā puse — datu aizsardzība, satura filtrēšana, licences nosacījumi — kļūst par dibinātāja atbildību.
Eesti Firma sniedz korporatīvo un juridisko atbalstu MI projektiem un palīdz uzņēmumiem sekot līdzi pastāvīgi mainīgajai tehnoloģiskajai un regulatīvajai videi. Sazinieties ar mums, lai saņemtu profesionālu konsultāciju un atbalstu.
Biežāk uzdotie jautājumi
DeepSeek-R1 ir uz spriešanu orientēts lielais valodas modelis, ko Ķīnas jaunuzņēmums DeepSeek izlaida 2025. gada janvārī. Tā veiktspēja ir salīdzināma ar modeļiem, kas nodrošina OpenAI ChatGPT, taču tā apmācība bija daudz lētāka, un tā svari ir publicēti ar atvērtu licenci.
Investori baidījās, ka gadījumā, ja augstākās klases MI modeli var apmācīt ar lētākām, ierobežotām mikroshēmām par dažiem miljoniem dolāru, pieprasījums pēc Nvidia dārgākās aparatūras varētu būt mazāks, nekā gaidīts. Akciju cena vienā dienā kritās par 17%, dzēšot aptuveni $600 miljardus tirgus vērtības.
Modeļa svari un kods ir publiski pieejami, tādēļ izstrādātāji var modeli paši lejupielādēt, darbināt un pielāgot. Taču apmācības dati nav publicēti, tāpēc precīzāk to saukt par modeli ar atvērtiem svariem.
DeepSeek ziņoja, ka pēdējās apmācības sesijas izmaksas bija aptuveni $5.6 miljoni. Daži analītiķi norāda, ka šajā summā nav iekļauti pētījumi, agrākie eksperimenti un aparatūras iegāde, tādēļ programmas kopējās izmaksas, visticamāk, bija ievērojami augstākas.
Jā — atvērtā licence atļauj komerciālu izmantošanu, un modeli var mitināt savā vai Eiropas mākoņinfrastruktūrā. Pirms ieviešanas uzņēmumiem tomēr jāizvērtē datu aizsardzība, satura filtrēšana un licences noteikumi.