През януари 2025 г. китайският AI стартъп DeepSeek пусна своя модел за разсъждение DeepSeek-R1 — и за седмица той разтърси целия технологичен свят. По показатели този китайски AI модел е наравно с ChatGPT на OpenAI, но цената на разработването му е коренно различна. Докато разходите на OpenAI възлизат на стотици милиони долари, DeepSeek според съобщенията е похарчил едва $5.6 million за обучението. Освен това DeepSeek не използва най-модерните AI чипове на Nvidia — американският износен контрол забранява продажбата им в Китай — а техни орязани версии. Това постави неудобния въпрос: ако в Китай може да се създаде мощен и евтин AI по този начин, оправдани ли са астрономическите бюджети на американските AI компании?
DeepSeek-R1 срещу OpenAI накратко
Преди да навлезем в подробности, ето сравнение на причините, поради които пускането на DeepSeek бе толкова необичайно спрямо утвърдения лидер на AI пазара.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Обявена цена на обучението | Около $5.6 million | Стотици милиони долари |
| Хардуер | Nvidia H800 — чипове с ограничения, съобразени с износните правила | Nvidia H100 — AI чипове от най-висок клас |
| Достъп до модела | Отворени тегла и код, безплатни за изтегляне и промяна | Собствен модел, само чрез API и абонамент |
| App Store (края на януари 2025 г.) | № 1 безплатно приложение в САЩ и Китай | Изпреварен от DeepSeek |
| Филтриране на отговорите | Държавна цензура по политически чувствителни теми | Политика за съдържанието, определена от компанията |
DeepSeek срина пазара: Nvidia загуби $600 billion
Реакцията на фондовия пазар бе незабавна. Nvidia, най-големият световен доставчик на AI чипове, видя как акциите ѝ се сринаха със 17% за един ден, заличавайки приблизително $600 billion пазарна стойност — най-голямата еднодневна загуба на която и да е компания в историята на американския фондов пазар. Nasdaq 100, който включва най-големите технологични компании, загуби почти $1 trillion при един от най-значимите технологични сривове през последните години.
Инвеститорът в рисков капитал, инженер и изобретател Марк Андрийсън нарече това „моментът Sputnik“ за AI, сравнявайки събитието с изстрелването на първия съветски спътник през 1957 г. Тогава светът осъзнава, че СССР е изпреварил Съединените щати в космическата надпревара. Сега Китай направи подобен скок в изкуствения интелект, принуждавайки Запада да признае, че технологичното превъзходство вече не е негово изключително предимство.
Тайната на успеха на DeepSeek: евтини чипове, отворен код и вирусно приложение
Три фактора обясняват успеха на DeepSeek. Първо, компанията успя рязко да намали цената за обучение на AI: докато OpenAI харчи стотици милиони за разработването на моделите си, DeepSeek постигна сравнимо ниво на производителност само за $5.6 million. Това бе възможно, защото компанията използва по-достъпните чипове Nvidia H800 вместо високия клас процесори H100, на които разчитат конкурентите ѝ. Оптимизираните алгоритми позволиха на DeepSeek да запази висока ефективност с много по-малка изчислителна мощност.
Второто предимство бе решението на DeepSeek да направи своя изкуствен интелект с отворен код, като публикува теглата на модела и кода. Това означава, че всеки може да изтегли, адаптира или подобри технологията — особено привлекателно за предприятия, изследователи и стартъпи, които не могат да си позволят собственически AI в голям мащаб.
Третият фактор за бързия възход на DeepSeek бе мигновената му огромна популярност сред крайните потребители. За дни приложението за чатбота DeepSeek стана най-изтегляното безплатно приложение в Apple App Store както в САЩ, така и в Китай, изпреварвайки ChatGPT.
Обвинения в дестилация и американски санкции за чипове
OpenAI и Microsoft започнаха разследване със съмнения, че DeepSeek е използвал тяхната технология за обучението на своя модел. Според тях DeepSeek вероятно е разчитал на дестилация на знания — метод, при който един AI модел имитира друг, за да възприеме стила му на отговори и разсъждение. Ако това бъде доказано, DeepSeek може да се изправи пред сериозни правни проблеми.
Следват и американските санкции срещу Китай. Пекин понастоящем не може да купува най-модерните чипове на Nvidia, а по-строгият износен контрол може да възпрепятства усилията на Китай да разработи следващото поколение AI модели. Фактът, че DeepSeek е стигнал дотук, обаче показва колко самостоятелна вече е станала китайската технологична индустрия.
Въпреки обвиненията CEO на OpenAI Сам Алтман призна, че DeepSeek е силен конкурент, и заяви, че китайският модел е впечатляващ, особено предвид сравнително ниската му цена.
Какво означава шокът от DeepSeek за AI индустрията
DeepSeek вероятно ще преобърне утвърдената представа какъв трябва да бъде AI и колко трябва да струва. Доскоро се приемаше, че изграждането на мощни големи езикови модели изисква огромни инвестиции и изключително сложна инфраструктура с хиляди най-съвременни чипове. Китайската компания показа, че сравними резултати могат да се постигнат с много по-малко ресурси. Това оспорва традиционните практики в индустрията и принуждава големите играчи да преосмислят стратегията си.
Този успех може също да промени баланса на силите в технологичната надпревара. Неотдавна Китай бе смятан за аутсайдер в AI; сега той изостава само с няколко години, ако изобщо изостава. Усещайки заплахата да изостанат, президентът на САЩ Доналд Тръмп обяви инициативата Stargate — програма на стойност до $500 billion, насочена към укрепване на позициите на американските AI разработчици.
OpenAI също започна да намалява цените на услугите си в стремеж да задържи потребителите. Ако DeepSeek продължи да пуска AI решения с отворен код, които се конкурират с пазарните лидери почти без разходи, натискът върху цялата индустрия само ще нараства.
Другата страна на DeepSeek: цензура и съмнения за разходите
Китайският AI обаче далеч не е безупречен. Отговорите на DeepSeek се филтрират в съответствие с държавната цензура — чатботът отказва да отговаря на въпроси за Си Дзинпин или Тайван. Някои анализатори поставят под въпрос и обявените разходи за разработване, предполагайки, че китайското правителство може тихомълком да е субсидирало електроенергията, заплатите и изчислителните ресурси за проекта. Това обаче е трудно за проверка.
Съществува и въпросът за данните. Приложението DeepSeek съхранява потребителски данни на сървъри в Китай, което вече накара регулаторите в няколко държави да разгледат услугата по-внимателно — напомняне, че евтиният AI модел може да носи и свои разходи за съответствие.
Какво следва за DeepSeek и AI надпреварата?
DeepSeek вече промени правилата на играта. Оттук нататък водещите IT компании в света ще трябва да играят по други правила. Технологичната надпревара ще продължи — с инвестиции от мащаба на Stargate от едната страна и модели с отворен код от другата — и може би наистина сме на прага на нова ера на достъпен изкуствен интелект, или просто в началото на ожесточено съревнование между Съединените щати и Китай във високите технологии.
Какво означава това за стартъпите и основателите
По-евтиният AI с отворени тегла намалява бариерата за създаване на AI продукти: малък екип вече може да използва модел от най-висок клас в собствената си инфраструктура, вместо да плаща за собственически достъп. Компромисът е, че правната и регулаторната страна — защита на данните, филтриране на съдържание, лицензионни условия — става отговорност на основателя.
Eesti Firma предоставя корпоративна и правна подкрепа за AI проекти и помага на бизнеса да бъде в крак с непрекъснато променящата се технологична и регулаторна среда. Свържете се с нас за професионална консултация и подкрепа.
Често задавани въпроси
DeepSeek-R1 е голям езиков модел, фокусиран върху разсъжденията, пуснат от китайския стартъп DeepSeek през януари 2025 г. Той се представя на ниво, сравнимо с моделите зад ChatGPT на OpenAI, но обучението му е значително по-евтино, а теглата му са публикувани под отворен лиценз.
Инвеститорите се опасяваха, че ако AI модел от най-висок клас може да бъде обучен с по-евтини чипове с ограничения за няколко милиона долара, търсенето на най-скъпия хардуер на Nvidia може да е по-ниско от очакваното. Акциите спаднаха със 17% за един ден, заличавайки приблизително $600 billion пазарна стойност.
Теглата на модела и кодът са публично достъпни, така че разработчиците могат сами да изтеглят, стартират и дообучават модела. Данните за обучението обаче не са публикувани, затова по-точно е той да се опише като модел с отворени тегла.
DeepSeek съобщава, че последният цикъл на обучение е струвал около $5.6 million. Някои анализатори отбелязват, че тази сума не включва изследванията, предишните експерименти и покупките на хардуер, така че общата цена на програмата вероятно е била много по-висока.
Да — отвореният лиценз позволява търговска употреба, а моделът може да бъде хостван във ваша собствена или европейска облачна инфраструктура. Компаниите все пак трябва да оценят защитата на данните, филтрирането на съдържание и лицензионните условия преди внедряването.