a computer chip with the letter a on top of it

DeepSeek-R1: kaip Kinijos AI modelis sukrėtė technologijų pasaulį

Pigesnis už ChatGPT, nemokamai parsisiunčiamas, Pekino filtruojamas: ką steigėjai turi žinoti apie DeepSeek istoriją – nuo išpopuliarėjusios programėlės iki kaltinimų dėl distiliavimo.

2025 m. sausį Kinijos AI startuolis DeepSeek pristatė savo samprotavimo modelį DeepSeek-R1 — ir per savaitę sukrėtė visą technologijų pasaulį. Pagal našumą šis Kinijos AI modelis prilygsta OpenAI ChatGPT, tačiau kūrimo išlaidos radikaliai skyrėsi. Kol OpenAI išlaidos siekia šimtus milijonų dolerių, pranešama, kad DeepSeek mokymui išleido vos $5.6 million. Be to, DeepSeek nenaudojo pažangiausių Nvidia AI lustų — JAV eksporto kontrolė draudžia juos parduoti Kinijai — o tik ribotų galimybių jų versijas. Tai iškėlė nepatogų klausimą: jei Kinijoje taip galima sukurti galingą ir pigų AI, ar astronominiai Amerikos AI įmonių biudžetai yra pagrįsti?

Trumpai: DeepSeek-R1 ir OpenAI

Prieš nagrinėjant detales, pateikiame palyginimą, parodantį, kuo DeepSeek pristatymas taip išsiskyrė iš nusistovėjusio AI rinkos lyderio.

DeepSeek-R1 OpenAI
Nurodyta mokymo kaina Apie $5.6 million Šimtai milijonų dolerių
Aparatinė įranga Nvidia H800 — eksportui tinkami, ribotų galimybių lustai Nvidia H100 — aukščiausios klasės AI lustai
Prieiga prie modelio Atviri svoriai ir kodas, nemokamai parsisiunčiami bei keičiami Nuosavybinis modelis, tik API ir prenumerata
App Store (2025 m. sausio pabaiga) Nr. 1 nemokama programėlė JAV ir Kinijoje Aplenkta DeepSeek
Atsakymų filtravimas Valstybinė cenzūra politiškai jautriomis temomis Turinio politiką nustato bendrovė

DeepSeek sukrėtė rinką: Nvidia prarado $600 billion

Akcijų rinkos reakcija buvo momentinė. Nvidia, didžiausios pasaulyje AI lustų tiekėjos, akcijos per vieną dieną krito 17 %, ir bendrovės rinkos vertė sumažėjo maždaug $600 billion — tai didžiausias vienos dienos nuostolis JAV akcijų rinkos istorijoje. Nasdaq 100, į kurį įeina didžiausios technologijų įmonės, per vieną reikšmingiausių pastarųjų metų technologijų sektoriaus griūčių prarado beveik $1 trillion.

Rizikos kapitalo investuotojas, inžinierius ir išradėjas Marcas Andreessenas tai pavadino AI „Sputnik momentu“, palygindamas įvykį su pirmojo Sovietų Sąjungos palydovo paleidimu 1957 m. Tuomet pasaulis suprato, kad SSRS kosmoso lenktynėse aplenkė Jungtines Valstijas. Dabar Kinija padarė panašų šuolį dirbtinio intelekto srityje ir privertė Vakarus pripažinti, kad technologinis pranašumas nebėra vien jų išskirtinis privalumas.

DeepSeek sėkmės paslaptis: pigūs lustai, atvirasis kodas ir išpopuliarėjusi programėlė

DeepSeek sėkmę paaiškina trys veiksniai. Pirma, bendrovei pavyko smarkiai sumažinti AI mokymo kainą: kol OpenAI savo modeliams kurti išleidžia šimtus milijonų, DeepSeek pasiekė panašų našumą vos už $5.6 million. Tai tapo įmanoma, nes bendrovė vietoj konkurentų naudojamų aukščiausios klasės H100 procesorių rinkosi prieinamesnius Nvidia H800 lustus. Optimizuoti algoritmai leido DeepSeek išlaikyti didelį efektyvumą naudojant gerokai mažiau skaičiavimo galios.

Antrasis pranašumas buvo DeepSeek sprendimas paskelbti savo dirbtinio intelekto modelio svorius ir kodą kaip atvirąjį kodą. Tai reiškia, kad technologiją gali parsisiųsti, pritaikyti ar patobulinti bet kas — ypač tai patrauklu įmonėms, tyrėjams ir startuoliams, kurie negali sau leisti didelio masto nuosavybinio AI.

Trečiasis spartaus DeepSeek iškilimo veiksnys buvo greitas ir milžiniškas populiarumas tarp galutinių vartotojų. Per kelias dienas DeepSeek pokalbių roboto programėlė tapo labiausiai parsisiunčiama nemokama programėle Apple App Store tiek JAV, tiek Kinijoje ir aplenkė ChatGPT.

Kaltinimai dėl distiliavimo ir JAV lustų sankcijos

OpenAI ir Microsoft pradėjo tyrimą, įtardamos, kad DeepSeek savo modeliui mokyti panaudojo jų technologiją. Jų teigimu, DeepSeek galėjo remtis žinių distiliavimu — metodu, kai vienas AI modelis imituoja kitą, kad perimtų jo atsakymų stilių ir samprotavimą. Jei tai būtų įrodyta, DeepSeek galėtų susidurti su rimtomis teisinėmis problemomis.

Taip pat svarbios JAV sankcijos Kinijai. Pekinas šiuo metu negali įsigyti pažangiausių Nvidia lustų, o griežtesnė eksporto kontrolė galėtų trukdyti Kinijos pastangoms kurti naujos kartos AI modelius. Vis dėlto tai, kad DeepSeek pasiekė tiek daug, rodo, kiek savarankiška jau tapo Kinijos technologijų pramonė.

Nepaisydamas kaltinimų, OpenAI CEO Samas Altmanas pripažino, kad DeepSeek yra stiprus konkurentas, ir teigė, jog Kinijos modelis daro įspūdį, ypač atsižvelgiant į palyginti mažą jo kainą.

Ką DeepSeek sukrėtimas reiškia AI pramonei

DeepSeek veikiausiai pakeis nusistovėjusį supratimą, koks turėtų būti AI ir kiek jis turėtų kainuoti. Dar neseniai buvo manoma, kad galingiems didiesiems kalbos modeliams kurti reikia milžiniškų investicijų ir itin sudėtingos infrastruktūros su tūkstančiais naujausių lustų. Kinijos bendrovė parodė, kad panašių rezultatų galima pasiekti turint gerokai mažiau išteklių. Tai kvestionuoja įprastą pramonės praktiką ir verčia svarbiausius rinkos dalyvius iš naujo įvertinti savo strategiją.

Ši sėkmė gali pakeisti ir jėgų pusiausvyrą technologinėse lenktynėse. Dar neseniai Kinija AI srityje buvo laikoma atsilikėle; dabar, jei apskritai atsilieka, tai tik keliais metais. Bijodamas atsilikti, JAV prezidentas Donaldas Trumpas paskelbė Stargate iniciatyvą — iki $500 billion vertės programą, skirtą sustiprinti Amerikos AI kūrėjų pozicijas.

OpenAI taip pat pradėjo mažinti savo paslaugų kainas, siekdama išlaikyti vartotojus. Jei DeepSeek ir toliau leis atvirojo kodo AI sprendimus, kurie beveik be sąnaudų konkuruoja su rinkos lyderiais, spaudimas visai pramonei tik didės.

Kita DeepSeek pusė: cenzūra ir abejonės dėl kainos

Tačiau Kinijos AI toli gražu nėra nepriekaištingas. DeepSeek atsakymai filtruojami pagal valstybinės cenzūros reikalavimus — pokalbių robotas atsisako atsakyti į klausimus apie Xi Jinpingą ar Taivaną. Kai kurie analitikai taip pat abejoja nurodytomis kūrimo sąnaudomis ir teigia, kad Kinijos vyriausybė galėjo tyliai subsidijuoti projekto elektrą, atlyginimus ir skaičiavimo išteklius. Vis dėlto tai patikrinti sunku.

Taip pat kyla duomenų klausimas. DeepSeek programėlė vartotojų duomenis saugo Kinijoje esančiuose serveriuose, todėl kelių šalių reguliuotojai jau pradėjo atidžiau vertinti šią paslaugą. Tai primena, kad pigus AI modelis gali turėti savų atitikties išlaidų.

Kas laukia DeepSeek ir AI lenktynių?

DeepSeek jau pakeitė žaidimo taisykles. Nuo šiol pirmaujančios pasaulio IT bendrovės turės žaisti pagal kitokias taisykles. Technologinės lenktynės tęsis — vienoje pusėje bus Stargate masto investicijos, kitoje — atvirojo kodo modeliai. Galbūt iš tiesų stovime prie naujos prieinamo dirbtinio intelekto eros slenksčio, o gal tik intensyvios Jungtinių Valstijų ir Kinijos konkurencijos aukštųjų technologijų srityje pradžioje.

Ką tai reiškia startuoliams ir jų steigėjams

Pigesnis AI su atvirais svoriais sumažina kliūtis kurti AI produktus: maža komanda dabar gali paleisti aukščiausios klasės modelį savo infrastruktūroje, užuot mokėjusi už nuosavybinę prieigą. Kita medalio pusė — teisinė ir reguliacinė atsakomybė už duomenų apsaugą, turinio filtravimą ir licencijos sąlygas tenka steigėjui.

Eesti Firma teikia korporacinę ir teisinę pagalbą AI projektams bei padeda įmonėms neatsilikti nuo nuolat besikeičiančios technologinės ir reguliacinės aplinkos. Susisiekite su mumis dėl profesionalios konsultacijos ir pagalbos.

Dažniausiai užduodami klausimai

Šį vadovą parengė „Eesti Firma“ komanda, įskaitant Teisininkas ir reguliavimo patarėjas Patrik Asevičius. Jis skirtas tik informaciniams tikslams. Joks pateiktas turinys nėra teisinė, mokesčių ar investavimo konsultacija. Nors publikavimo metu buvo dedamos visos pastangos informacijai užtikrinti, įstatymai ir teisės aktai gali keistis. Dėl individualios teisinės pagalbos kreipkitės tiesiogiai į „Eesti Firma“.