2025 januárjában a kínai AI-startup, a DeepSeek kiadta DeepSeek-R1 következtetési modelljét — amely egy héten belül megrázta az egész techvilágot. Teljesítményben ez a kínai AI-modell felveszi a versenyt az OpenAI ChatGPT-jével, a fejlesztési költségük azonban gyökeresen eltért. Míg az OpenAI több száz millió dollárt költ, a DeepSeek állítólag mindössze 5,6 millió dollárt fordított a betanításra. Ráadásul a DeepSeek nem az Nvidia legfejlettebb AI-chipjeit használta — az amerikai exportkorlátozások tiltják azok kínai értékesítését —, hanem azok korlátozott változatait. Ez kellemetlen kérdést vetett fel: ha Kínában így is lehet nagy teljesítményű, olcsó AI-t építeni, indokoltak-e az amerikai AI-cégek csillagászati költségvetései?
DeepSeek-R1 és OpenAI röviden
Mielőtt részletesebben belemennénk, íme egy összehasonlítás arról, mi tette a DeepSeek megjelenését ennyire szokatlanná az AI-piac bevett vezetőjéhez képest.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Bejelentett betanítási költség | Körülbelül 5,6 millió dollár | Több száz millió dollár |
| Hardver | Nvidia H800 — exportkompatibilis, korlátozott chipek | Nvidia H100 — csúcskategóriás AI-chipek |
| Modell-hozzáférés | Nyilvános súlyok és kód, ingyen letölthető és módosítható | Zárt, csak API-n és előfizetéssel érhető el |
| App Store (2025. január vége) | 1. helyezett ingyenes app az USA-ban és Kínában | A DeepSeek megelőzte |
| Válaszok szűrése | Állami cenzúra politikailag érzékeny témákban | A tartalmi szabályzatot a vállalat határozza meg |
A DeepSeek megrázza a piacot: az Nvidia 600 milliárd dollárt veszít
A tőzsdei reakció azonnali volt. Az AI-chipek világelső szállítója, az Nvidia részvényei egyetlen nap alatt 17%-ot zuhantak, ami mintegy 600 milliárd dollár piaci értéket törölt el — ez az amerikai tőzsdetörténet legnagyobb egynapos vállalati vesztesége volt. A legnagyobb technológiai cégeket tömörítő Nasdaq 100 közel 1 billió dollárt veszített a közelmúlt egyik legjelentősebb technológiai zuhanásában.
Marc Andreessen kockázati tőkés, mérnök és feltaláló az AI „Szputnyik-pillanatának” nevezte az eseményt, a Szovjetunió első műholdjának 1957-es felbocsátásához hasonlítva azt. Akkor a világ ráébredt, hogy a Szovjetunió megelőzte az Egyesült Államokat az űrversenyben. Kína most hasonló ugrást tett a mesterséges intelligenciában, és ezzel a Nyugatnak el kellett ismernie: a technológiai fölény már nem kizárólagos előnye.
A DeepSeek sikerének titka: olcsó chipek, nyílt forráskód és virális app
A DeepSeek sikerét három tényező magyarázza. Először is, a vállalat drámaian csökkenteni tudta az AI betanításának költségét: míg az OpenAI több száz milliót költ modelljei fejlesztésére, a DeepSeek mindössze 5,6 millió dollárért ért el összehasonlítható teljesítményt. Ez azért volt lehetséges, mert a versenytársak által használt csúcskategóriás H100 processzorok helyett kedvezőbb árú Nvidia H800 chipeket alkalmazott. Az optimalizált algoritmusok pedig jóval kisebb számítási kapacitás mellett is magas hatékonyságot biztosítottak.
A második előny az volt, hogy a DeepSeek a modellsúlyok és a kód közzétételével nyílt forráskódúvá tette mesterséges intelligenciáját. Ez azt jelenti, hogy bárki letöltheti, átalakíthatja vagy továbbfejlesztheti a technológiát — ami különösen vonzó azoknak a vállalkozásoknak, kutatóknak és startupoknak, amelyek nem engedhetik meg maguknak a zárt AI széles körű használatát.
A DeepSeek gyors felemelkedésének harmadik tényezője a végfelhasználók körében elért azonnali, óriási népszerűsége volt. A DeepSeek chatbotalkalmazás napokon belül az Apple App Store legtöbbet letöltött ingyenes alkalmazásává vált az USA-ban és Kínában is, megelőzve a ChatGPT-t.
Desztillációs vádak és amerikai chipszankciók
Az OpenAI és a Microsoft vizsgálatot indított, mert azt gyanították, hogy a DeepSeek az ő technológiájukat használta modellje betanításához. Szerintük a DeepSeek állítólag tudásdesztillációra támaszkodott — arra a módszerre, amelyben az egyik AI-modell egy másikat utánoz, hogy átvegye válaszadási és következtetési stílusát. Ha ez bebizonyosodik, a DeepSeek súlyos jogi következményekkel nézhet szembe.
Ott vannak továbbá az Egyesült Államok Kínával szembeni szankciói. Peking jelenleg nem vásárolhatja meg az Nvidia legfejlettebb chipjeit, és a szigorúbb exportkorlátozások akadályozhatják Kína következő generációs AI-modellek fejlesztésére irányuló törekvéseit. Az, hogy a DeepSeek eddig jutott, mégis azt mutatja, mennyire önellátóvá vált már a kínai technológiai ipar.
A vádak ellenére az OpenAI CEO-ja, Sam Altman elismerte, hogy a DeepSeek erős versenytárs, és lenyűgözőnek nevezte a kínai modellt, különösen viszonylag alacsony költsége miatt.
Mit jelent a DeepSeek-sokk az AI-iparágnak?
A DeepSeek valószínűleg felülírja az AI-ról és annak költségéről alkotott bevett képet. Egészen a közelmúltig úgy vélték, hogy az erős nagy nyelvi modellek építéséhez hatalmas befektetésre és több ezer korszerű chipből álló, rendkívül összetett infrastruktúrára van szükség. A kínai cég megmutatta, hogy hasonló eredmények jóval kevesebb erőforrással is elérhetők. Ez megkérdőjelezi az iparág hagyományos gyakorlatát, és a nagy szereplőket stratégiájuk újraértékelésére készteti.
Ez a siker a technológiai verseny erőviszonyait is átrendezheti. Nemrég még Kínát kívülállónak tekintették az AI területén; most legfeljebb néhány év lemaradásban van. Donald Trump amerikai elnök, érezve a lemaradás veszélyét, bejelentette a Stargate kezdeményezést — egy akár 500 milliárd dollár értékű programot, amely az amerikai AI-fejlesztők pozícióját hivatott erősíteni.
Az OpenAI is csökkenteni kezdte szolgáltatásai árait, hogy megtartsa felhasználóit. Ha a DeepSeek továbbra is olyan nyílt forráskódú AI-megoldásokat ad ki, amelyek szinte költségmentesen versenyeznek a piacvezetőkkel, az egész iparágra nehezedő nyomás csak fokozódik.
A DeepSeek másik oldala: cenzúra és költségekkel kapcsolatos kételyek
A kínai AI azonban korántsem hibátlan. A DeepSeek válaszait az állami cenzúrának megfelelően szűrik — a chatbot nem válaszol Hszi Csin-pinggel vagy Tajvannal kapcsolatos kérdésekre. Egyes elemzők a bejelentett fejlesztési költségeket is megkérdőjelezik, arra utalva, hogy a kínai kormány csendben támogathatta a projekt villamosenergia-, bér- és számítási erőforrásait. Ezt azonban nehéz ellenőrizni.
Az adatok kérdése is felmerül. A DeepSeek alkalmazás a felhasználói adatokat kínai szervereken tárolja, ami több ország szabályozóit is arra késztette, hogy közelebbről megvizsgálják a szolgáltatást — emlékeztetve arra, hogy egy olcsó AI-modellnek is lehetnek saját megfelelési költségei.
Mi következik a DeepSeek és az AI-verseny számára?
A DeepSeek már felrúgta a játékszabályokat. Mostantól a világ vezető IT-vállalatainak más szabályok szerint kell játszaniuk. A technológiai verseny folytatódik — az egyik oldalon Stargate-léptékű befektetésekkel, a másikon nyílt forráskódú modellekkel —, és valóban a hozzáférhető mesterséges intelligencia új korszakának küszöbén állhatunk, vagy csupán az Egyesült Államok és Kína csúcstechnológiai versengésének kezdetén.
Mit jelent ez a startupoknak és alapítóknak?
Az olcsóbb, nyílt súlyú AI csökkenti az AI-termékek fejlesztésének belépési küszöbét: egy kis csapat immár saját infrastruktúrán futtathat csúcskategóriás modellt a zárt hozzáférésért való fizetés helyett. A kompromisszum az, hogy a jogi és szabályozási oldal — adatvédelem, tartalomszűrés, licencfeltételek — az alapító felelősségévé válik.
Az Eesti Firma vállalati és jogi támogatást nyújt AI-projektekhez, és segít a vállalkozásoknak lépést tartani a folyamatosan változó technológiai és szabályozási környezettel. Professzionális konzultációért és támogatásért bátran forduljon hozzánk.
Gyakran ismételt kérdések
A DeepSeek-R1 egy következtetésközpontú nagy nyelvi modell, amelyet a kínai DeepSeek startup adott ki 2025 januárjában. Az OpenAI ChatGPT-je mögött álló modellekével összevethető teljesítményt nyújt, miközben betanítása sokkal olcsóbb volt, súlyait pedig nyílt licenc alatt tették közzé.
A befektetők attól tartottak, hogy ha egy csúcskategóriás AI-modell olcsóbb, korlátozott chipeken néhány millió dollárból betanítható, az Nvidia legdrágább hardverei iránti kereslet a vártnál alacsonyabb lehet. A részvények egy nap alatt 17%-ot estek, mintegy 600 milliárd dollár piaci értéket eltörölve.
A modellsúlyok és a kód nyilvánosan elérhetők, így a fejlesztők maguk is letölthetik, futtathatják és finomhangolhatják a modellt. A betanítási adatokat azonban nem tették közzé, ezért pontosabb nyílt súlyú modellként leírni.
A DeepSeek szerint a végső betanítási futtatás körülbelül 5,6 millió dollárba került. Egyes elemzők rámutatnak, hogy ez az összeg nem tartalmazza a kutatást, a korábbi kísérleteket és a hardvervásárlásokat, így a program teljes költsége valószínűleg jóval magasabb volt.
Igen — a nyílt licenc engedélyezi a kereskedelmi felhasználást, a modell pedig saját vagy európai felhőinfrastruktúrán is hosztolható. A vállalatoknak bevezetés előtt továbbra is értékelniük kell az adatvédelmet, a tartalomszűrést és a licenc feltételeit.