Tháng 01.2025, startup AI Trung Quốc DeepSeek đã phát hành mô hình suy luận DeepSeek-R1 — và chỉ trong một tuần, mô hình này đã làm rung chuyển toàn bộ thế giới công nghệ. Về hiệu năng, mô hình AI Trung Quốc này ngang tầm với ChatGPT của OpenAI, nhưng chi phí phát triển lại khác biệt hoàn toàn. Trong khi chi tiêu của OpenAI lên tới hàng trăm triệu đô la, DeepSeek được cho là chỉ chi $5.6 million cho việc huấn luyện. Hơn nữa, DeepSeek không sử dụng chip AI tiên tiến nhất của Nvidia — các biện pháp kiểm soát xuất khẩu của Mỹ cấm bán chúng cho Trung Quốc — mà dùng các phiên bản bị cắt giảm. Điều này đặt ra một câu hỏi khó chịu: nếu AI mạnh mẽ, giá rẻ có thể được xây dựng theo cách này tại Trung Quốc, liệu các ngân sách khổng lồ của các công ty AI Mỹ có chính đáng?
So sánh nhanh DeepSeek-R1 và OpenAI
Trước khi đi vào chi tiết, dưới đây là so sánh song song về những điểm khiến việc ra mắt DeepSeek trở nên bất thường so với công ty dẫn đầu lâu năm của thị trường AI.
| DeepSeek-R1 | OpenAI | |
|---|---|---|
| Chi phí huấn luyện được báo cáo | Khoảng $5.6 million | Hàng trăm triệu đô la |
| Phần cứng | Nvidia H800 — chip cắt giảm, tuân thủ kiểm soát xuất khẩu | Nvidia H100 — chip AI cấp cao nhất |
| Quyền truy cập mô hình | Trọng số và mã nguồn mở, tải xuống và sửa đổi miễn phí | Độc quyền, chỉ qua API và gói thuê bao |
| App Store (cuối tháng 01.2025) | Ứng dụng miễn phí số 1 tại Mỹ và Trung Quốc | Bị DeepSeek vượt qua |
| Lọc câu trả lời | Kiểm duyệt nhà nước đối với các chủ đề nhạy cảm về chính trị | Chính sách nội dung do công ty đặt ra |
DeepSeek làm thị trường lao dốc: Nvidia mất $600 billion
Phản ứng của thị trường chứng khoán diễn ra ngay lập tức. Nvidia, nhà cung cấp chip AI lớn nhất thế giới, chứng kiến cổ phiếu giảm 17% chỉ trong một ngày, xóa khoảng $600 billion giá trị vốn hóa — mức mất giá trong một ngày lớn nhất của bất kỳ công ty nào trong lịch sử thị trường chứng khoán Mỹ. Nasdaq 100, gồm các công ty công nghệ lớn nhất, mất gần $1 trillion trong một trong những đợt sụt giảm công nghệ đáng kể nhất những năm gần đây.
Nhà đầu tư mạo hiểm, kỹ sư và nhà phát minh Marc Andreessen gọi đây là “khoảnh khắc Sputnik” của AI, so sánh sự kiện với vụ phóng vệ tinh đầu tiên của Liên Xô năm 1957. Khi đó, thế giới nhận ra rằng USSR đã vượt qua Hoa Kỳ trong cuộc đua không gian. Hiện nay, Trung Quốc đã có bước nhảy vọt tương tự trong trí tuệ nhân tạo, buộc phương Tây thừa nhận rằng ưu thế công nghệ không còn là lợi thế độc quyền của họ.
Bí quyết thành công của DeepSeek: chip rẻ, mã nguồn mở và ứng dụng lan truyền
Ba yếu tố giải thích thành công của DeepSeek. Thứ nhất, công ty đã giảm mạnh chi phí huấn luyện AI: trong khi OpenAI chi hàng trăm triệu để phát triển mô hình, DeepSeek đạt hiệu năng tương đương chỉ với $5.6 million. Điều này có thể thực hiện vì công ty dùng chip Nvidia H800 có giá phải chăng hơn thay cho bộ xử lý H100 cao cấp mà các đối thủ phụ thuộc. Các thuật toán được tối ưu hóa sau đó cho phép DeepSeek duy trì hiệu quả cao với năng lực tính toán thấp hơn nhiều.
Lợi thế thứ hai là quyết định mã nguồn mở trí tuệ nhân tạo của DeepSeek bằng cách công bố trọng số mô hình và mã nguồn. Điều đó có nghĩa là bất kỳ ai cũng có thể tải xuống, điều chỉnh hoặc cải tiến công nghệ — đặc biệt hấp dẫn với doanh nghiệp, nhà nghiên cứu và startup không đủ khả năng chi trả cho AI độc quyền ở quy mô lớn.
Yếu tố thứ ba đằng sau sự trỗi dậy nhanh chóng của DeepSeek là mức độ phổ biến tức thì và rất lớn đối với người dùng cuối. Chỉ trong vài ngày, ứng dụng chatbot DeepSeek đã trở thành ứng dụng miễn phí được tải xuống nhiều nhất trên Apple App Store ở cả Mỹ và Trung Quốc, vượt qua ChatGPT.
Cáo buộc chưng cất và lệnh trừng phạt chip của Mỹ
OpenAI và Microsoft đã mở cuộc điều tra vì nghi ngờ DeepSeek sử dụng công nghệ của họ để huấn luyện mô hình. Theo họ, DeepSeek bị cho là dựa vào chưng cất tri thức — phương pháp trong đó một mô hình AI bắt chước mô hình khác nhằm tiếp thu phong cách phản hồi và suy luận của mô hình đó. Nếu được chứng minh, DeepSeek có thể gặp rắc rối pháp lý nghiêm trọng.
Sau đó là các lệnh trừng phạt của Mỹ đối với Trung Quốc. Bắc Kinh hiện không thể mua các chip tiên tiến nhất từ Nvidia, và các biện pháp kiểm soát xuất khẩu nghiêm ngặt hơn có thể cản trở nỗ lực của Trung Quốc nhằm phát triển thế hệ mô hình AI tiếp theo. Tuy vậy, việc DeepSeek đã đi xa đến vậy cho thấy ngành công nghệ Trung Quốc đã trở nên tự chủ như thế nào.
Bất chấp các cáo buộc, CEO OpenAI Sam Altman thừa nhận DeepSeek là đối thủ mạnh và cho biết mô hình Trung Quốc này rất ấn tượng, đặc biệt xét đến chi phí tương đối thấp.
Cú sốc DeepSeek có ý nghĩa gì với ngành AI
DeepSeek có thể sẽ đảo lộn quan điểm hiện có về AI nên như thế nào và chi phí nên ở mức nào. Cho đến gần đây, người ta cho rằng việc xây dựng các mô hình ngôn ngữ lớn mạnh mẽ đòi hỏi đầu tư khổng lồ và hạ tầng cực kỳ phức tạp với hàng nghìn chip tối tân. Công ty Trung Quốc này đã cho thấy có thể đạt kết quả tương đương với ít nguồn lực hơn nhiều. Điều này thách thức thông lệ truyền thống của ngành và buộc các doanh nghiệp lớn phải đánh giá lại chiến lược.
Thành công này cũng có thể dịch chuyển cán cân quyền lực trong cuộc đua công nghệ. Không lâu trước đây, Trung Quốc bị xem là bên ngoài cuộc chơi AI; giờ đây, nếu có chậm hơn thì cũng chỉ vài năm. Cảm nhận nguy cơ tụt hậu, Tổng thống Mỹ Donald Trump đã công bố sáng kiến Stargate — chương trình trị giá lên đến $500 billion nhằm củng cố vị thế của các nhà phát triển AI Mỹ.
OpenAI cũng đã bắt đầu giảm giá dịch vụ nhằm giữ chân người dùng. Nếu DeepSeek tiếp tục phát hành các giải pháp AI mã nguồn mở cạnh tranh với các công ty dẫn đầu thị trường với chi phí gần như bằng không, áp lực lên toàn bộ ngành sẽ chỉ tăng lên.
Mặt khác của DeepSeek: kiểm duyệt và nghi vấn về chi phí
Tuy nhiên, AI Trung Quốc còn lâu mới hoàn hảo. Câu trả lời của DeepSeek được lọc theo kiểm duyệt nhà nước — chatbot từ chối trả lời các câu hỏi về Xi Jinping hoặc Đài Loan. Một số nhà phân tích cũng nghi ngờ chi phí phát triển được báo cáo, cho rằng chính phủ Trung Quốc có thể đã âm thầm trợ cấp điện, lương và tài nguyên tính toán cho dự án. Tuy nhiên, rất khó để xác minh điều này.
Còn có vấn đề dữ liệu. Ứng dụng DeepSeek lưu trữ dữ liệu người dùng trên máy chủ ở Trung Quốc, điều này đã khiến các cơ quan quản lý tại một số quốc gia xem xét kỹ hơn dịch vụ — lời nhắc rằng một mô hình AI rẻ có thể đi kèm chi phí tuân thủ riêng.
Điều gì tiếp theo cho DeepSeek và cuộc đua AI?
DeepSeek đã phá vỡ các quy tắc cuộc chơi. Từ nay, các công ty IT hàng đầu thế giới sẽ phải chơi theo những quy tắc khác. Cuộc đua công nghệ sẽ tiếp diễn — với đầu tư quy mô Stargate ở một bên và các mô hình mã nguồn mở ở bên kia — và chúng ta có thể thực sự đang đứng trước ngưỡng cửa của một kỷ nguyên mới về trí tuệ nhân tạo dễ tiếp cận, hoặc chỉ mới bắt đầu một cuộc cạnh tranh gay gắt giữa Hoa Kỳ và Trung Quốc trong lĩnh vực công nghệ cao.
Điều này có ý nghĩa gì với startup và nhà sáng lập
AI trọng số mở với chi phí thấp hơn làm giảm rào cản xây dựng sản phẩm AI: một nhóm nhỏ giờ đây có thể vận hành mô hình cấp cao trên hạ tầng riêng thay vì trả tiền cho quyền truy cập độc quyền. Đổi lại, khía cạnh pháp lý và quản lý — bảo vệ dữ liệu, lọc nội dung, điều khoản cấp phép — trở thành trách nhiệm của nhà sáng lập.
Eesti Firma cung cấp hỗ trợ doanh nghiệp và pháp lý cho các dự án AI, đồng thời giúp doanh nghiệp theo kịp môi trường công nghệ và quản lý không ngừng thay đổi. Hãy liên hệ với chúng tôi để được tư vấn và hỗ trợ chuyên nghiệp.
Câu hỏi thường gặp
DeepSeek-R1 là mô hình ngôn ngữ lớn tập trung vào suy luận, được startup Trung Quốc DeepSeek phát hành vào tháng 01.2025. Mô hình đạt hiệu năng tương đương các mô hình đứng sau ChatGPT của OpenAI nhưng chi phí huấn luyện thấp hơn nhiều, và trọng số của nó được công bố theo giấy phép mở.
Nhà đầu tư lo ngại rằng nếu một mô hình AI cấp cao có thể được huấn luyện trên chip rẻ hơn, bị hạn chế với chi phí vài triệu đô la, nhu cầu đối với phần cứng đắt nhất của Nvidia có thể thấp hơn dự kiến. Cổ phiếu đã giảm 17% trong một ngày, xóa khoảng $600 billion giá trị vốn hóa.
Trọng số mô hình và mã nguồn được công khai, vì vậy nhà phát triển có thể tự tải xuống, vận hành và tinh chỉnh mô hình. Tuy nhiên, dữ liệu huấn luyện chưa được phát hành, nên mô hình được mô tả chính xác hơn là mô hình trọng số mở.
DeepSeek báo cáo chi phí cho lần chạy huấn luyện cuối cùng khoảng $5.6 million. Một số nhà phân tích lưu ý rằng con số này không bao gồm nghiên cứu, các thử nghiệm trước đó và việc mua phần cứng, nên tổng chi phí chương trình có lẽ cao hơn nhiều.
Có — giấy phép mở cho phép sử dụng thương mại và mô hình có thể được lưu trữ trên hạ tầng đám mây của bạn hoặc tại châu Âu. Doanh nghiệp vẫn nên đánh giá việc bảo vệ dữ liệu, lọc nội dung và các điều khoản của giấy phép trước khi triển khai.