Tammikuussa 2025 kiinalainen AI-startup DeepSeek julkaisi päättelymallinsa DeepSeek-R1 — ja viikossa se ravisteli koko teknologia-alaa. Suorituskyvyltään tämä kiinalainen AI-malli on samalla tasolla kuin OpenAI:n ChatGPT, mutta kehityskustannukset olivat täysin eri luokkaa. OpenAI:n kulujen noustessa satoihin miljooniin dollareihin DeepSeek käytti koulutukseen tiettävästi vain 5,6 miljoonaa dollaria. Lisäksi DeepSeek ei käyttänyt Nvidian kehittyneimpiä AI-siruja — Yhdysvaltain vientirajoitukset estävät niiden myynnin Kiinaan — vaan niiden rajoitettuja versioita. Tämä herätti kiusallisen kysymyksen: jos Kiinassa voidaan rakentaa näin tehokas ja edullinen AI, ovatko amerikkalaisten AI-yhtiöiden tähtitieteelliset budjetit perusteltuja?
DeepSeek-R1 ja OpenAI yhdellä silmäyksellä
Ennen yksityiskohtiin siirtymistä tässä on rinnakkainen vertailu siitä, mikä teki DeepSeekin julkaisusta niin poikkeuksellisen verrattuna AI-markkinoiden vakiintuneeseen johtajaan.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Ilmoitettu koulutuskustannus | Noin 5,6 miljoonaa dollaria | Satoja miljoonia dollareita |
| Laitteisto | Nvidia H800 — vientisääntöjen mukaiset, rajoitetut sirut | Nvidia H100 — huipputason AI-sirut |
| Mallin saatavuus | Avoimet painot ja koodi, ladattavissa ja muokattavissa maksutta | Suljettu, vain API:n ja tilauksen kautta |
| App Store (tammikuun lopussa 2025) | Maksuttomien sovellusten ykkönen Yhdysvalloissa ja Kiinassa | DeepSeek ohitti sen |
| Vastausten suodatus | Valtiollinen sensuuri poliittisesti arkaluonteisissa aiheissa | Yhtiön määrittämä sisältöpolitiikka |
DeepSeek romahdutti markkinat: Nvidia menetti 600 miljardia dollaria
Osakemarkkinoiden reaktio oli välitön. Maailman suurimman AI-sirujen toimittajan Nvidian osake putosi yhdessä päivässä 17 %, mikä pyyhki pois noin 600 miljardia dollaria markkina-arvosta — suurimman yhden päivän tappion minkään yhtiön historiassa Yhdysvaltain osakemarkkinoilla. Suurimmista teknologiayhtiöistä koostuva Nasdaq 100 menetti lähes biljoona dollaria eräässä viime vuosien merkittävimmistä teknologiaosakkeiden romahduksista.
Pääomasijoittaja, insinööri ja keksijä Marc Andreessen kutsui tapahtumaa AI:n Sputnik-hetkeksi verraten sitä Neuvostoliiton ensimmäisen satelliitin laukaisuun vuonna 1957. Tuolloin maailma ymmärsi, että Neuvostoliitto oli ohittanut Yhdysvallat avaruuskilvassa. Nyt Kiina on ottanut vastaavan harppauksen tekoälyssä ja pakottanut lännen myöntämään, ettei teknologinen ylivoima ole enää vain sen etu.
DeepSeekin menestyksen salaisuus: edulliset sirut, avoin lähdekoodi ja viraalisovellus
DeepSeekin menestyksen selittää kolme tekijää. Ensinnäkin yhtiö onnistui pienentämään AI:n koulutuskustannuksia dramaattisesti: kun OpenAI käyttää malliensa kehittämiseen satoja miljoonia, DeepSeek saavutti vastaavan suorituskyvyn vain 5,6 miljoonalla dollarilla. Tämä oli mahdollista, koska yhtiö käytti kilpailijoidensa suosimien huippuluokan H100-prosessorien sijasta edullisempia Nvidia H800 -siruja. Optimoidut algoritmit mahdollistivat suuren tehokkuuden huomattavasti pienemmällä laskentateholla.
Toinen etu oli DeepSeekin päätös julkaista tekoälynsä avoimena lähdekoodina mallin painojen ja koodin kera. Tämä tarkoittaa, että kuka tahansa voi ladata, mukauttaa tai parantaa teknologiaa — mikä on erityisen houkuttelevaa yrityksille, tutkijoille ja startupeille, joilla ei ole varaa suljettuun AI:hin laajassa mittakaavassa.
Kolmas DeepSeekin nopean nousun tekijä oli sen välitön ja valtava suosio loppukäyttäjien keskuudessa. Muutamassa päivässä DeepSeekin chatbot-sovelluksesta tuli Apple App Storen ladatuin maksuton sovellus sekä Yhdysvalloissa että Kiinassa, ja se ohitti ChatGPT:n.
Väitteet tislaamisesta ja Yhdysvaltain sirupakotteet
OpenAI ja Microsoft käynnistivät tutkinnan epäiltyään DeepSeekin käyttäneen niiden teknologiaa mallinsa kouluttamiseen. Niiden mukaan DeepSeek saattoi hyödyntää tiedon tislaamista — menetelmää, jossa yksi AI-malli jäljittelee toista omaksuakseen sen vastaustyylin ja päättelyn. Jos väite todistetaan, DeepSeek voi joutua vakaviin oikeudellisiin vaikeuksiin.
Lisäksi ovat Yhdysvaltain Kiinaan kohdistamat pakotteet. Peking ei tällä hetkellä voi ostaa Nvidian kehittyneimpiä siruja, ja tiukemmat vientirajoitukset voivat vaikeuttaa Kiinan pyrkimyksiä kehittää seuraavan sukupolven AI-malleja. Silti se, että DeepSeek on päässyt näin pitkälle, osoittaa kiinalaisen teknologiateollisuuden jo saavuttamaa omavaraisuutta.
Syytöksistä huolimatta OpenAI:n CEO Sam Altman myönsi DeepSeekin olevan vahva kilpailija ja totesi kiinalaisen mallin olevan vaikuttava, erityisesti sen suhteellisen alhaisen hinnan vuoksi.
Mitä DeepSeekin shokki merkitsee AI-alalle
DeepSeek todennäköisesti mullistaa vakiintuneen käsityksen siitä, millaista AI:n tulisi olla ja mitä sen pitäisi maksaa. Vielä äskettäin oletettiin, että tehokkaiden suurten kielimallien rakentaminen vaatii valtavia investointeja ja erittäin monimutkaisen infrastruktuurin, johon kuuluu tuhansia uusimman sukupolven siruja. Kiinalaisyhtiö on osoittanut, että vastaavia tuloksia voi saavuttaa huomattavasti pienemmillä resursseilla. Tämä haastaa alan perinteiset käytännöt ja pakottaa suuret toimijat arvioimaan strategiansa uudelleen.
Menestys voi myös muuttaa teknologisen kilpailun voimasuhteita. Ei kauan sitten Kiinaa pidettiin AI:n ulkopuolisena toimijana; nyt se on korkeintaan muutaman vuoden jäljessä. Jäämisen uhkaa tunteva Yhdysvaltain presidentti Donald Trump ilmoitti Stargate-aloitteesta — jopa 500 miljardin dollarin ohjelmasta, jonka tavoitteena on vahvistaa amerikkalaisten AI-kehittäjien asemaa.
Myös OpenAI on alkanut laskea palvelujensa hintoja säilyttääkseen käyttäjänsä. Jos DeepSeek jatkaa lähes maksutta markkinajohtajien kanssa kilpailevien, avoimen lähdekoodin AI-ratkaisujen julkaisemista, paine koko alaa kohtaan vain kasvaa.
DeepSeekin toinen puoli: sensuuri ja epäilyt kustannuksista
Kiinalainen AI ei kuitenkaan ole virheetön. DeepSeekin vastauksia suodatetaan valtiollisen sensuurin mukaisesti — chatbot kieltäytyy vastaamasta Xi Jinpingiä tai Taiwania koskeviin kysymyksiin. Jotkut analyytikot epäilevät myös ilmoitettuja kehityskustannuksia ja esittävät, että Kiinan valtio on voinut tukea hanketta huomaamattomasti sähkön, palkkojen ja laskentaresurssien osalta. Tämän todentaminen on kuitenkin vaikeaa.
Myös data herättää kysymyksiä. DeepSeek-sovellus tallentaa käyttäjätietoja Kiinassa sijaitseville palvelimille, minkä vuoksi useiden maiden sääntelyviranomaiset ovat jo tarkastelleet palvelua lähemmin — muistutuksena siitä, että edulliseen AI-malliin voi liittyä omia vaatimustenmukaisuuskustannuksia.
Mitä seuraavaksi DeepSeekille ja AI-kilpailulle?
DeepSeek on jo muuttanut pelin sääntöjä. Tästä lähtien maailman johtavien IT-yhtiöiden on toimittava uusien sääntöjen mukaan. Teknologinen kilpailu jatkuu — toisella puolella Stargate-mittakaavan investoinnit ja toisella avoimen lähdekoodin mallit — ja saatamme todella olla saavutettavan tekoälyn uuden aikakauden kynnyksellä tai vasta Yhdysvaltain ja Kiinan välisen, korkean teknologian kiivaan kilpailun alussa.
Mitä tämä merkitsee startupeille ja perustajille
Edullisempi, avoimilla painoilla toimiva AI madaltaa AI-tuotteiden rakentamisen kynnystä: pieni tiimi voi nyt käyttää huipputason mallia omassa infrastruktuurissaan sen sijaan, että maksaisi suljetusta pääsystä. Vastapainona oikeudelliset ja sääntelyyn liittyvät asiat — tietosuoja, sisällön suodatus ja lisenssiehdot — ovat perustajan vastuulla.
Eesti Firma tarjoaa AI-hankkeille yritys- ja oikeudellista tukea sekä auttaa yrityksiä pysymään mukana jatkuvasti muuttuvassa teknologisessa ja sääntely-ympäristössä. Ota meihin yhteyttä saadaksesi asiantuntevaa neuvontaa ja tukea.
Usein kysytyt kysymykset
DeepSeek-R1 on päättelyyn keskittyvä suuri kielimalli, jonka kiinalainen startup DeepSeek julkaisi tammikuussa 2025. Sen suorituskyky on verrattavissa OpenAI:n ChatGPT:n taustalla oleviin malleihin, mutta sen kouluttaminen on ollut huomattavasti halvempaa, ja sen painot on julkaistu avoimella lisenssillä.
Sijoittajat pelkäsivät, että jos huipputason AI-malli voidaan kouluttaa edullisemmilla, rajoitetuilla siruilla muutamalla miljoonalla dollarilla, Nvidian kalleimpien laitteiden kysyntä voi jäädä odotettua pienemmäksi. Osake putosi yhdessä päivässä 17 %, mikä pyyhki pois noin 600 miljardia dollaria markkina-arvosta.
Mallin painot ja koodi ovat julkisesti saatavilla, joten kehittäjät voivat ladata, ajaa ja hienosäätää mallia itse. Koulutusdataa ei kuitenkaan ole julkaistu, joten tarkempi kuvaus on avoimilla painoilla toimiva malli.
DeepSeek ilmoitti lopullisen koulutusajon maksaneen noin 5,6 miljoonaa dollaria. Jotkut analyytikot huomauttavat, että luku ei sisällä tutkimusta, aiempia kokeita eikä laitteistohankintoja, joten ohjelman kokonaiskustannus oli todennäköisesti paljon suurempi.
Kyllä — avoin lisenssi sallii kaupallisen käytön, ja mallia voi isännöidä omassa infrastruktuurissa tai eurooppalaisessa pilvipalvelussa. Yritysten on silti arvioitava tietosuoja, sisällön suodatus ja lisenssiehdot ennen käyttöönottoa.