בינואר 2025 פרסמה חברת הסטארטאפ הסינית בתחום ה-AI DeepSeek את מודל ההסקה שלה, DeepSeek-R1 — ותוך שבוע הוא טלטל את כל עולם הטכנולוגיה. מבחינת ביצועים, מודל ה-AI הסיני משתווה ל-ChatGPT של OpenAI, אך עלות הפיתוח הייתה שונה באופן קיצוני. בעוד שהוצאותיה של OpenAI מסתכמות במאות מיליוני דולרים, לפי הדיווחים DeepSeek הוציאה רק $5.6 מיליון על האימון. יתרה מכך, DeepSeek לא השתמשה בשבבי ה-AI המתקדמים ביותר של Nvidia — בקרות היצוא של ארה״ב אוסרות למכור אותם לסין — אלא בגרסאות מוחלשות שלהם. הדבר העלה שאלה לא נוחה: אם אפשר לבנות כך בסין AI עוצמתי וזול, האם התקציבים האסטרונומיים של חברות ה-AI האמריקאיות מוצדקים?
DeepSeek-R1 מול OpenAI במבט מהיר
לפני שנצלול לפרטים, הנה השוואה זו לצד זו של הגורמים שהפכו את השקת DeepSeek לחריגה כל כך מול המובילה המבוססת בשוק ה-AI.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| עלות אימון מדווחת | כ-$5.6 מיליון | מאות מיליוני דולרים |
| חומרה | Nvidia H800 — שבבים מוחלשים התואמים להגבלות היצוא | Nvidia H100 — שבבי AI מהשורה הראשונה |
| גישה למודל | משקלים וקוד פתוחים, להורדה ולשינוי בחינם | קנייני, רק באמצעות API ומנוי |
| App Store (סוף ינואר 2025) | האפליקציה החינמית מספר 1 בארה״ב ובסין | נעקפה בידי DeepSeek |
| סינון תשובות | צנזורה מדינתית בנושאים רגישים פוליטית | מדיניות תוכן שנקבעת בידי החברה |
DeepSeek מפילה את השוק: Nvidia מאבדת $600 מיליארד
תגובת שוק המניות הייתה מיידית. מניית Nvidia, הספקית הגדולה בעולם של שבבי AI, צנחה ב-17% ביום אחד ומחקה כ-$600 מיליארד משווי השוק שלה — ההפסד היומי הגדול ביותר בתולדות שוק המניות האמריקאי עבור חברה כלשהי. מדד Nasdaq 100, הכולל את חברות הטכנולוגיה הגדולות ביותר, איבד כמעט $1 טריליון באחת ממפולות הטכנולוגיה המשמעותיות של השנים האחרונות.
משקיע ההון־סיכון, המהנדס והממציא מארק אנדריסן כינה זאת „רגע הספוטניק” של ה-AI, והשווה את האירוע לשיגור הלוויין הראשון של ברית המועצות ב-1957. אז העולם הבין שברית המועצות עקפה את ארצות הברית במרוץ לחלל. כעת סין ביצעה קפיצה דומה בבינה מלאכותית, ואילצה את המערב להכיר בכך שעליונות טכנולוגית אינה עוד יתרון בלעדי שלו.
הסוד להצלחת DeepSeek: שבבים זולים, קוד פתוח ואפליקציה ויראלית
שלושה גורמים מסבירים את הצלחת DeepSeek. ראשית, החברה הצליחה להפחית דרמטית את עלות אימון ה-AI: בעוד OpenAI מוציאה מאות מיליונים על פיתוח המודלים שלה, DeepSeek הגיעה לרמת ביצועים דומה תמורת $5.6 מיליון בלבד. הדבר התאפשר משום שהחברה השתמשה בשבבי Nvidia H800 הזולים יותר במקום במעבדי H100 המתקדמים, שעליהם מסתמכים מתחריה. אלגוריתמים ממוטבים אפשרו ל-DeepSeek לשמור על יעילות גבוהה עם כוח מחשוב נמוך בהרבה.
היתרון השני היה החלטת DeepSeek להפוך את הבינה המלאכותית שלה לקוד פתוח, באמצעות פרסום משקלי המודל והקוד. משמעות הדבר היא שכל אחד יכול להוריד, להתאים או לשפר את הטכנולוגיה — יתרון מושך במיוחד לעסקים, חוקרים וחברות סטארטאפ שאינם יכולים להרשות לעצמם AI קנייני בהיקף רחב.
הגורם השלישי לעלייתה המהירה של DeepSeek היה הפופולריות המיידית והעצומה שלה בקרב משתמשי קצה. בתוך ימים הפכה אפליקציית הצ׳אטבוט של DeepSeek לאפליקציה החינמית המורדת ביותר ב-Apple App Store בארה״ב ובסין, ועקפה את ChatGPT.
טענות לזיקוק מודלים וסנקציות השבבים של ארה״ב
OpenAI ו-Microsoft פתחו בחקירה, בחשד ש-DeepSeek השתמשה בטכנולוגיה שלהן כדי לאמן את המודל שלה. לטענתן, DeepSeek הסתמכה לכאורה על זיקוק ידע — שיטה שבה מודל AI אחד מחקה אחר כדי לאמץ את סגנון התשובות וההסקה שלו. אם הדבר יוכח, DeepSeek עלולה להיתקל בבעיות משפטיות חמורות.
ישנן גם הסנקציות האמריקאיות על סין. בייג׳ינג אינה יכולה כיום לרכוש את השבבים המתקדמים ביותר של Nvidia, ובקרות יצוא מחמירות יותר עשויות לפגוע במאמצי סין לפתח את הדור הבא של מודלי AI. עם זאת, עצם העובדה ש-DeepSeek הגיעה כה רחוק מעידה עד כמה תעשיית הטכנולוגיה הסינית כבר הפכה לעצמאית.
למרות ההאשמות, מנכ״ל OpenAI סם אלטמן הכיר בכך ש-DeepSeek היא מתחרה חזקה ואמר שהמודל הסיני מרשים, במיוחד לאור עלותו הנמוכה יחסית.
מה משמעות טלטלת DeepSeek עבור תעשיית ה-AI
DeepSeek צפויה לערער את התפיסה המקובלת לגבי אופיו של AI ועלותו. עד לאחרונה, ההנחה הייתה שבניית מודלי שפה גדולים ועוצמתיים מחייבת השקעה עצומה ותשתית מורכבת מאוד הכוללת אלפי שבבים חדישים. החברה הסינית הראתה שאפשר להשיג תוצאות דומות עם הרבה פחות משאבים. הדבר מאתגר את השיטות המסורתיות של התעשייה ומאלץ את השחקנים הגדולים לבחון מחדש את האסטרטגיה שלהם.
הצלחה זו עשויה גם לשנות את מאזן הכוחות במרוץ הטכנולוגי. לפני זמן לא רב סין נחשבה לשחקנית שולית בתחום ה-AI; כעת היא מפגרת רק בכמה שנים, אם בכלל. מתוך חשש להישאר מאחור, נשיא ארה״ב דונלד טראמפ הכריז על יוזמת Stargate — תוכנית בהיקף של עד $500 מיליארד, שנועדה לחזק את מעמדם של מפתחי AI אמריקאיים.
גם OpenAI החלה להפחית את מחירי שירותיה בניסיון לשמר משתמשים. אם DeepSeek תמשיך לפרסם פתרונות AI בקוד פתוח המתחרים במובילי השוק כמעט ללא עלות, הלחץ על התעשייה כולה רק יגבר.
הצד השני של DeepSeek: צנזורה וספקות לגבי העלות
אולם ה-AI הסיני רחוק מלהיות מושלם. תשובותיה של DeepSeek מסוננות בהתאם לצנזורה המדינתית — הצ׳אטבוט מסרב להשיב על שאלות על שי ג׳ינפינג או על טאיוואן. כמה אנליסטים מטילים ספק גם בעלויות הפיתוח המדווחות, ומציעים שממשלת סין סבסדה בחשאי חשמל, משכורות ומשאבי מחשוב לפרויקט. עם זאת, קשה לאמת זאת.
קיימת גם שאלת הנתונים. אפליקציית DeepSeek מאחסנת נתוני משתמשים בשרתים בסין, דבר שכבר הוביל רגולטורים בכמה מדינות לבחון את השירות מקרוב יותר — תזכורת לכך שמודל AI זול עלול לשאת עמו עלויות ציות משלו.
מה צפוי ל-DeepSeek ולמרוץ ה-AI?
DeepSeek כבר שברה את כללי המשחק. מעתה חברות ה-IT המובילות בעולם יצטרכו לפעול לפי כללים אחרים. המרוץ הטכנולוגי יימשך — עם השקעות בסדר גודל של Stargate מצד אחד ומודלים בקוד פתוח מצד אחר — וייתכן שאנו עומדים באמת בפתחה של תקופה חדשה של בינה מלאכותית נגישה, או רק בתחילתה של תחרות עזה בין ארצות הברית לסין בטכנולוגיה עילית.
מה זה אומר לסטארטאפים ולמייסדים
AI זול יותר עם משקלים פתוחים מוריד את חסם הכניסה לבניית מוצרי AI: צוות קטן יכול כעת להפעיל מודל מהשורה הראשונה על תשתית משלו במקום לשלם על גישה קניינית. התמורה היא שההיבט המשפטי והרגולטורי — הגנת נתונים, סינון תוכן ותנאי רישוי — הופך לאחריות המייסדים.
Eesti Firma מספקת תמיכה תאגידית ומשפטית לפרויקטי AI ומסייעת לעסקים לעמוד בקצב של סביבה טכנולוגית ורגולטורית המשתנה ללא הרף. נשמח אם תיצרו איתנו קשר לקבלת ייעוץ ותמיכה מקצועיים.
שאלות נפוצות
DeepSeek-R1 הוא מודל שפה גדול המתמקד בהסקה, שפורסם בידי הסטארטאפ הסיני DeepSeek בינואר 2025. ביצועיו דומים לאלה של המודלים שמאחורי ChatGPT של OpenAI, אך עלות אימונו נמוכה בהרבה, ומשקליו פורסמו ברישיון פתוח.
המשקיעים חששו שאם אפשר לאמן מודל AI מהשורה הראשונה על שבבים זולים ומוגבלים תמורת כמה מיליוני דולרים, הביקוש לחומרה היקרה ביותר של Nvidia עשוי להיות נמוך מהצפוי. המניה ירדה ב-17% ביום אחד ומחקה כ-$600 מיליארד משווי השוק.
משקלי המודל והקוד זמינים לציבור, ולכן מפתחים יכולים להוריד, להפעיל ולכוונן את המודל בעצמם. עם זאת, נתוני האימון לא פורסמו, ולכן מדויק יותר לתאר אותו כמודל בעל משקלים פתוחים.
DeepSeek דיווחה שעלות ריצת האימון הסופית הייתה כ-$5.6 מיליון. כמה אנליסטים מציינים שסכום זה אינו כולל מחקר, ניסויים קודמים ורכישת חומרה, ולכן העלות הכוללת של התוכנית הייתה כנראה גבוהה בהרבה.
כן — הרישיון הפתוח מאפשר שימוש מסחרי, ואפשר לארח את המודל בתשתית ענן עצמית או אירופית. חברות עדיין צריכות להעריך את הגנת הנתונים, סינון התוכן ותנאי הרישיון לפני ההטמעה.