Điểm Chính
- Hạ tầng quá tải ngay lập tức: Mô hình Kimi K3 của Moonshot AI, ra mắt ngày 17 tháng 7 năm 2026, buộc phải tạm dừng đăng ký mới chỉ sau 72 giờ do nhu cầu tính toán vượt quá khả năng đáp ứng.
- Kiến trúc quy mô chưa từng có: Đây là mô hình open-weight đầu tiên trên thế giới thuộc lớp 2.800 tỷ tham số, dựa trên kiến trúc Mixture-of-Experts với 896 chuyên gia và cơ chế KDA.
- Cú sốc thị trường được định lượng: Trong ba phiên giao dịch, các cổ phiếu công nghệ toàn cầu đã mất 470 tỷ đô la vốn hóa, với mức sụt giảm mạnh tại Zhipu AI (-27%) và MiniMax (-16%).
Một bản phát hành làm sập chính hạ tầng của mình
Ngày 17 tháng 7 năm 2026, Moonshot AI tung ra thị trường Kimi K3, mô hình open-weight với 2.800 tỷ tham số. Nhu cầu sử dụng đã làm bão hòa toàn bộ năng lực tính toán sẵn có chỉ trong chưa đầy ba ngày, buộc công ty phải tạm dừng nhận đăng ký mới. Bình luận của Elon Musk trên X, một câu ngắn gọn "Impressive", càng khuếch đại tiếng vang truyền thông xung quanh sự kiện mà giới phân tích đã gọi là một bước ngoặt kỹ thuật.

Thông số kiến trúc: mật độ tính toán chạm giới hạn
Kimi K3 là mô hình open-weight đầu tiên thuộc lớp 3 nghìn tỷ tham số. Kiến trúc Mixture-of-Experts phân bổ tải xử lý cho 896 chuyên gia, trong khi cơ chế chú ý KDA (Kimi Dynamic Attention) tối ưu hóa khả năng suy luận dài hạn và các tác vụ tri thức chuyên sâu. Cửa sổ ngữ cảnh gốc đạt 1 triệu token, tích hợp sẵn khả năng hiểu hình ảnh. Trong các thử nghiệm nội bộ, mô hình đã thể hiện khả năng tự tối ưu hóa kernel GPU, tự xây dựng trình biên dịch GPU và tự thiết kế một con chip riêng cho kiến trúc của mình.
Vị trí trên các bảng đánh giá độc lập
Artificial Analysis chấm cho K3 điểm số 57 trên Intelligence Index, xếp thứ ba toàn cầu, sau Claude Fable 5 và GPT-5.6 Sol. Dữ liệu đáng chú ý nhất đến từ Frontend Code Arena, nơi K3 đạt 1.679 điểm, vượt qua 1.631 điểm của Claude Fable 5 và 1.618 điểm của GPT-5.6 Sol. Trên Program Bench, K3 ghi nhận 77,8 điểm, cao hơn mức 77,6 của GPT-5.6 Sol. Trên ba chỉ số độc lập, mô hình vượt qua hoặc ngang bằng trình độ hàng đầu hiện tại ở ít nhất hai hạng mục.

Điểm khác biệt cấu trúc so với "khoảnh khắc DeepSeek" trước đây
So sánh với DeepSeek R1 hồi tháng 1 năm 2025 chỉ đúng ở khía cạnh tác động truyền thông. DeepSeek từng chứng minh rằng hiệu năng đỉnh cao có thể đạt được với chi phí huấn luyện 5,6 triệu đô la. K3 lại đi theo hướng ngược lại: một lượt suy luận đơn lẻ đòi hỏi khoảng 1,4 TB bộ nhớ ngay cả sau khi lượng tử hóa, một yêu cầu hạ tầng loại trừ hoàn toàn cách hiểu theo hướng hiệu quả triệt để. Chi phí API, ở mức 100 nhân dân tệ cho mỗi triệu token đầu ra, cao hơn hơn 16 lần so với mức 6 nhân dân tệ của DeepSeek V4-Pro, dù vẫn thấp hơn khoảng một nửa so với GPT-5.6 Sol và bằng một phần ba so với Claude Fable 5.
Cú sốc lan truyền đến thị trường chứng khoán
Phản ứng của thị trường diễn ra tức thì và có thể đo lường được. Zhipu AI và MiniMax lần lượt mất 27% và 16% giá trị tại Hồng Kông. Nasdaq giảm khoảng 1%, với lực bán tập trung vào Nvidia và Intel. Tổng hợp qua ba phiên giao dịch cho thấy mức thiệt hại lên tới 470 tỷ đô la vốn hóa của các cổ phiếu công nghệ toàn cầu. Bernstein gọi sự kiện này là "một cú home run", trong khi Morgan Stanley nhận định các mô hình mở của Trung Quốc hiện đang bám sát nhịp độ với những mức tiên tiến nhất của ngành. Ion Stoica thuộc UC Berkeley định lượng mức thu hẹp khoảng cách công nghệ: từ 6-9 tháng xuống còn 2-3 tháng so với trình độ tiên tiến nhất toàn cầu.

Nút thắt cổ chai vẫn là năng lực tính toán
Khả năng mở rộng vận hành của K3 vẫn bị ràng buộc bởi mức độ sẵn có của hạ tầng tính toán, chính là yếu tố đã buộc phải tạm dừng đăng ký mới. Phân tích của Pandaily tóm lược tình hình hiện tại: khoảnh khắc đột phá đã hiện rõ nhưng chưa được củng cố thành một mô hình kinh doanh có thể nhân rộng ở quy mô lớn. Biến số quyết định trong các quý tới sẽ không phải là năng lực cạnh tranh kỹ thuật của mô hình, vốn đã được chứng minh qua các bảng đánh giá, mà là khả năng chuyển hóa kết quả này thành một hạ tầng dịch vụ ổn định và có thể thương mại hóa.
