中国公司 DeepSeek 最近推出了其 AI 模型 DeepSeek-R1,这一产品似乎震动了整个科技界。该 AI 的性能足以与 OpenAI 的 ChatGPT 模型相媲美,但两者的开发成本却有天壤之别。OpenAI 投入了数亿美元,而 DeepSeek 仅花费了 560 万美元。此外,DeepSeek 并未使用 Nvidia 最新的芯片——受美国制裁影响,这些芯片被禁止向中国销售——而是采用了其简化版本。这也引出了一个重要问题:如果来自中国的这款强大 AI 能以低得多的成本实现同样的成果,那么美国企业投入的巨额资金是否合理?
DeepSeek 引发市场暴跌
市场立即作出反应。全球最大的 AI 芯片供应商 Nvidia 股价在一天内暴跌 17%,市值蒸发 6000 亿美元。由大型科技公司组成的纳斯达克 100 指数损失近 1 万亿美元,成为近年来最严重的暴跌之一。
风险投资家、工程师兼发明家 Marc Andreessen 将这一事件与苏联在 1957 年发射首颗卫星相提并论。当时,世界意识到苏联已在太空竞赛中超越美国。如今,中国在 AI 领域实现了类似的飞跃,迫使西方承认,技术领先已不再是其独有的优势。
DeepSeek 成功背后的秘密
DeepSeek 的成功主要源于三个方面。首先,该公司大幅降低了训练成本。OpenAI 为开发 AI 投入数亿美元,而 DeepSeek 仅用 560 万美元就实现了同等水平的性能。这得益于该公司没有采用竞争对手所依赖的高端 H100 型号,而是使用了价格更低的 Nvidia H800 芯片。此外,经过优化的算法让 DeepSeek 能够以较低的算力保持高效率。
另一个重要优势是 DeepSeek 决定将其人工智能开源,把代码发布到公共领域。这意味着任何人都可以调整、修改或改进这项技术。对于企业、研究人员和初创公司而言,这一点尤其令人振奋。
推动 DeepSeek 迅速走红的第三个因素,是它在终端用户中瞬间获得了极高的人气。短短几天内,DeepSeek 应用就在美国和中国的 Apple App Store 中登上下载量榜首,超越了 ChatGPT。
指控与调查
OpenAI 和 Microsoft 已对此事展开调查,怀疑 DeepSeek 使用了它们的技术来训练自己的模型。据其称,DeepSeek 涉嫌采用知识蒸馏——一种让某个 AI 模型模仿另一个模型,从而学习其回答风格和逻辑的方法。如果这一指控得到证实,DeepSeek 将面临严重的法律问题。
此外,美国政府还对中国实施了更多制裁。目前,北京方面无法购买美国公司 Nvidia 最先进的芯片,而更严格的限制可能会阻碍中国继续开发新一代 AI 模型。然而,DeepSeek 至今仍成功实现了这一壮举,足以体现当今中国科技产业的高度自主性。
不过,尽管存在相关指控,OpenAI CEO Sam Altman 仍表示 DeepSeek 是一个强劲的竞争对手。这个中国模型以相对低廉的成本实现了出色表现,给他留下了深刻印象。
AI 行业的“深度探索”
DeepSeek 很可能会彻底改变人们对 AI 应有形态及其成本的全部认知。直到最近,人们仍普遍认为,打造强大的语言模型需要巨额投资,以及由数千枚尖端芯片构成的高度复杂基础设施。然而,这家中国公司证明,只需少得多的资源也能取得相当的成果。这一事实正在挑战行业的传统做法,并迫使主要市场参与者重新评估自己的战略。
这一成功或将改变科技竞赛中的力量平衡。不久前,中国还被视为 AI 领域的局外者,但如今与领先者的差距只剩几年。由于感受到落后的威胁,Donald Trump 已宣布启动 Stargate 计划——一项旨在加强美国 AI 开发者地位、规模达 5000 亿美元的项目。
近期,OpenAI 也开始下调其服务价格,这是该公司为留住用户而采取的紧急举措之一。如果 DeepSeek 继续推出几乎以零成本就能形成有力竞争的开源解决方案,必将引发更大的行业震荡。
硬币的另一面
不过,中国的 AI 远非完美无缺。其回答会经过过滤以符合国家审查要求——当被问及 Xi Jinping 或台湾相关问题时,该 AI 会拒绝回答。一些分析人士质疑其公布的开发成本;他们认为,政府很可能秘密补贴了该项目的电力、人员薪资和计算资源,但这一点很难得到证实。
接下来会怎样?
DeepSeek 已经打破了游戏规则。从现在起,全球领先的 IT 公司将不得不按照新的规则参与竞争。技术竞赛仍将继续,也许我们确实正站在普惠人工智能新时代的门槛上——又或许,这仅仅是美国与中国在高科技领域展开激烈竞争的开端。
Eesti Firma 为各类 AI 项目提供公司与法律支持,并协助企业紧跟不断变化的技术和监管环境。欢迎联系我们,获取专业咨询与支持!