a computer chip with the letter a on top of it

DeepSeek-R1:一款中国 AI 模型如何震动科技界

比 ChatGPT 更便宜、可免费下载、受北京审查:从爆红应用到蒸馏指控,创始人需要了解的 DeepSeek 故事。

2025 年 1 月,中国 AI 初创公司 DeepSeek 发布了其推理模型 DeepSeek-R1——短短一周内便震动了整个科技界。这款中国 AI 模型的性能可与 OpenAI 的 ChatGPT 媲美,但开发成本却截然不同。OpenAI 的投入高达数亿美元,而据报道,DeepSeek 的训练仅花费 560 万美元。更重要的是,DeepSeek 并未使用 Nvidia 最先进的 AI 芯片——美国出口管制禁止向中国出售这些芯片——而是采用了性能受限的版本。这引出了一个令人不安的问题:如果能以这种方式在中国打造强大而低成本的 AI,美国 AI 公司的天价预算是否合理?

DeepSeek-R1 与 OpenAI 对比一览

在深入细节之前,先通过并列比较看看:与既有的 AI 市场领导者相比,DeepSeek 的发布究竟有何不同寻常之处。

DeepSeek-R1 OpenAI
报告中的训练成本 约 560 万美元 数亿美元
硬件 Nvidia H800——符合出口规定的性能受限芯片 Nvidia H100——顶级 AI 芯片
模型获取方式 开放权重和代码,可免费下载及修改 专有模型,仅提供 API 和订阅服务
App Store(2025 年 1 月底) 美国和中国免费应用榜第 1 名 被 DeepSeek 超越
回答过滤 对政治敏感话题实施国家审查 内容政策由公司制定

DeepSeek 冲击市场:Nvidia 蒸发 6000 亿美元

股市反应立竿见影。全球最大的 AI 芯片供应商 Nvidia 股价单日暴跌 17%,市值蒸发约 6000 亿美元——这是美国股市历史上任何公司最大的单日市值损失。由最大科技公司组成的纳斯达克 100 指数也下跌近 1 万亿美元,成为近年来最严重的科技股暴跌之一。

风险投资家、工程师兼发明家马克·安德森称其为 AI 的“斯普特尼克时刻”,将这一事件比作 1957 年苏联发射首颗人造卫星。当时,世界意识到苏联已在太空竞赛中超越美国。如今,中国在人工智能领域实现了类似跃升,迫使西方承认技术优势不再是其独有的资本。

DeepSeek 成功的秘诀:低价芯片、开源与爆款应用

DeepSeek 的成功可归因于三个因素。首先,公司大幅降低了 AI 训练成本:OpenAI 为开发模型投入数亿美元,DeepSeek 却仅以 560 万美元实现了相近性能。这得益于该公司使用了价格更低的 Nvidia H800 芯片,而非竞争对手所依赖的高端 H100 处理器;经优化的算法则让 DeepSeek 能以少得多的算力维持高效率。

第二项优势是 DeepSeek 决定通过发布模型权重和代码,将其人工智能开源。这意味着任何人都能下载、调整或改进该技术——对于无力大规模使用专有 AI 的企业、研究人员和初创公司而言尤其有吸引力。

推动 DeepSeek 快速崛起的第三个因素,是它立即在终端用户中获得的巨大人气。数日内,DeepSeek 聊天机器人应用便成为美国和中国 Apple App Store 下载量最高的免费应用,超过了 ChatGPT。

蒸馏指控与美国芯片制裁

OpenAI 和 Microsoft 已展开调查,怀疑 DeepSeek 使用了其技术来训练模型。据两家公司称,DeepSeek 被指采用了知识蒸馏——一种让一个 AI 模仿另一个 AI,从而学习其回答风格和推理方式的方法。若获证实,DeepSeek 可能面临严重法律问题。

此外还有美国对中国的制裁。北京目前无法购买 Nvidia 最先进的芯片,更严格的出口管制可能阻碍中国开发下一代 AI 模型。不过,DeepSeek 能走到这一步,已表明中国科技产业具备相当程度的自主能力。

尽管存在这些指控,OpenAI CEO 萨姆·奥尔特曼仍承认 DeepSeek 是强劲竞争对手,并表示这款中国模型令人印象深刻,尤其考虑到其相对低廉的成本。

DeepSeek 冲击对 AI 行业意味着什么

DeepSeek 很可能会颠覆人们对 AI 应有形态及其成本的既有看法。直到不久前,业界仍认为,要构建强大的大语言模型,必须投入巨额资金,并建设由数千颗尖端芯片组成的高度复杂基础设施。这家中国公司证明,用少得多的资源也能取得相近成果。这挑战了行业传统做法,并迫使主要参与者重新评估战略。

这一成功还可能改变技术竞赛中的力量平衡。不久前,中国还被视为 AI 领域的局外者;如今,即便仍有差距,也仅落后数年。感受到落后的威胁后,美国总统唐纳德·特朗普宣布了 Stargate 倡议——一项规模最高达 5000 亿美元、旨在巩固美国 AI 开发者地位的计划。

OpenAI 也已开始下调服务价格以留住用户。若 DeepSeek 持续推出几乎零成本、可与市场领导者竞争的开源 AI 解决方案,整个行业面临的压力只会越来越大。

DeepSeek 的另一面:审查与成本疑云

不过,中国 AI 并非毫无缺陷。DeepSeek 的回答会按国家审查要求过滤——聊天机器人会拒绝回答有关习近平或台湾的问题。一些分析师也质疑其公布的开发成本,认为中国政府可能暗中补贴了该项目的电力、薪酬和计算资源;但这很难验证。

数据问题同样值得关注。DeepSeek 应用将用户数据存储在中国的服务器上,这已促使多个国家的监管机构更严格地审视该服务,也提醒人们:低价 AI 模型本身也可能带来合规成本。

DeepSeek 与 AI 竞赛的下一步是什么?

DeepSeek 已经打破了游戏规则。从现在起,全球领先的 IT 公司必须遵循不同的规则。技术竞赛仍将继续——一边是 Stargate 级别的投资,另一边是开源模型——我们或许确实正站在普惠人工智能新时代的门槛上,也可能只是见证了美国与中国在高科技领域激烈竞争的开端。

这对初创企业和创始人意味着什么

更低成本的开放权重 AI 降低了构建 AI 产品的门槛:小团队现在可在自有基础设施上运行顶级模型,无需为专有访问付费。相应的代价是,数据保护、内容过滤和许可条款等法律与监管事务将成为创始人的责任。

Eesti Firma 为 AI 项目提供公司及法律支持,帮助企业跟上不断变化的技术和监管环境。欢迎联系我们,获取专业咨询与支持。

常见问题

本指南由 Eesti Firma 团队编写,参与人员包括 律师兼监管顾问 帕特里克·阿塞维丘斯。本指南仅供参考,所提供的任何内容均不构成法律、税务或投资建议。我们已尽力确保发布时信息准确,但法律法规可能会发生变化。如需个性化法律协助,请直接联系 Eesti Firma。