Ngày 16/07/2026, phòng lab AI Trung Quốc Moonshot AI (được Alibaba hậu thuẫn) công bố Kimi K3 — mô hình 2,8 nghìn tỷ tham số, được chính công ty gọi là mô hình mở (open-weight) lớn nhất thế giới khi trọng số được phát hành công khai vào 27/07/2026. Điểm gây chấn động: các đánh giá độc lập xếp K3 chỉ sau hai mô hình đóng mạnh nhất hiện nay là Claude Fable 5 và GPT-5.6 Sol — với giá API rẻ hơn nhiều lần.
Tóm tắt nhanh
- Khi nào: công bố 16/07/2026; trọng số (weights) mở từ 27/07/2026.
- Ai: Moonshot AI — phòng lab AI Trung Quốc, Alibaba hậu thuẫn.
- Mô hình: 2,8 nghìn tỷ tham số MoE (kích hoạt 16/896 expert), thị giác tích hợp sẵn, ngữ cảnh 1 triệu token, luôn suy luận (mặc định mức "max").
- Benchmark: GDPval-AA v2 đạt 1.668 — hạng 3 sau Claude Fable 5 Max và GPT-5.6 Sol Max, trên Claude Opus 4.8 Max (1.600).
- Giá: $3 / 1M token đầu vào, $15 / 1M token đầu ra — rẻ bằng khoảng 1/3 Fable 5, và áp dụng cho toàn bộ cửa sổ 1 triệu token.
Kimi K3 là gì?
Theo blog chính thức của Kimi, K3 là mô hình mạnh nhất của Moonshot đến nay: 2,8 nghìn tỷ tham số, xây trên hai cải tiến kiến trúc Kimi Delta Attention (KDA) và Attention Residuals (AttnRes), có thị giác tích hợp sẵn (native vision — không phải module gắn ngoài) và cửa sổ ngữ cảnh 1 triệu token. Moonshot gọi đây là "mô hình mở hạng 3T đầu tiên của thế giới", nhắm vào lập trình dài hơi (long-horizon coding), công việc tri thức và suy luận sâu.
Về kiến trúc, K3 dùng Mixture-of-Experts với độ thưa (sparsity) được đẩy cao: mỗi truy vấn chỉ kích hoạt 16 trong 896 expert. Kết hợp với công thức huấn luyện mới, Moonshot cho biết hiệu quả chuyển đổi compute thành "trí tuệ" của K3 gấp ~2,5 lần Kimi K2. Đáng chú ý, mô hình luôn suy luận (reasoning) mặc định — tài liệu API hiện chỉ có một mức reasoning_effort là max, các mức nhẹ hơn sẽ bổ sung sau.
| Hạng mục | Kimi K3 |
|---|---|
| Tổng tham số | 2,8 nghìn tỷ (2.8T) — mở lớn nhất thế giới theo Moonshot |
| Kiến trúc | MoE kích hoạt 16/896 expert + Kimi Delta Attention + Attention Residuals |
| Ngữ cảnh | 1 triệu token (1.048.576) |
| Thị giác | Tích hợp sẵn trong mô hình (native) |
| Suy luận | Luôn bật; hiện chỉ mức "max" |
| Hiệu quả scaling | ~2,5× so với Kimi K2 (theo Moonshot) |
| Mở trọng số | 27/07/2026 |
| Đối chiếu model mở khác | DeepSeek V4-Pro 1,6T · Xiaomi 1,02T · Z.AI 744B tham số |
Benchmark: hạng 3 thế giới, trên cả Opus 4.8
Con số khiến giới AI chú ý nằm ở các đánh giá độc lập. Theo số liệu Artificial Analysis được Moonshot dẫn lại trong blog K3: trên GDPval-AA v2 — leaderboard đo khả năng làm việc thật trải 44 nghề nghiệp thuộc 9 nhóm ngành — K3 đạt 1.668 điểm, chỉ sau Claude Fable 5 Max (1.760) và GPT-5.6 Sol Max (1.748), và vượt Claude Opus 4.8 Max (1.600 điểm). Trên AA-Briefcase (benchmark riêng của Artificial Analysis đo công việc tri thức agentic dài hơi), K3 đạt 1.548 — hạng nhì sau Fable 5 Max (1.583), trên GPT-5.6 Sol Max (1.495).
Ở mảng lập trình front-end, leaderboard Code Arena của Arena.ai xếp K3 trên cả Fable 5 — nhảy 17 bậc so với model tiền nhiệm Kimi K2.6. CEO Arena Anastasios Angelopoulos bình luận trên X rằng đây có thể là "the single biggest release of the year" (bản phát hành lớn nhất năm). Còn với tác vụ tìm kiếm thông tin dài hơi, Moonshot tự công bố K3 đạt 91,2 điểm BrowseComp chạy single-agent — kết quả này dùng chiến lược nén ngữ cảnh (context-compaction) kích hoạt ở mốc 300K token theo cách Claude model cards áp dụng; nếu chạy nguyên cửa sổ 1 triệu token không quản lý ngữ cảnh, điểm đạt 90,4. Con số do Moonshot tự đo, cần chờ kiểm chứng độc lập.
| Benchmark | Kimi K3 | Đối chiếu |
|---|---|---|
| GDPval-AA v2 (việc thật, 44 nghề / 9 ngành) | 1.668 — hạng 3 | Sau Fable 5 Max (1.760) & GPT-5.6 Sol Max (1.748); trên Opus 4.8 Max (1.600) |
| AA-Briefcase (agentic dài hơi) | 1.548 — hạng 2 | Sau Fable 5 Max (1.583); trên GPT-5.6 Sol Max (1.495) |
| Code Arena front-end (Arena.ai) | Trên Fable 5 | +17 bậc so với Kimi K2.6 |
| BrowseComp (single agent) | 91,2 có nén ngữ cảnh · 90,4 không (Moonshot tự công bố) | Chưa có kiểm chứng độc lập |
Chính Moonshot cũng thừa nhận trong blog rằng hiệu năng tổng thể của K3 vẫn xếp sau hai mô hình đóng mạnh nhất là Claude Fable 5 và GPT-5.6 Sol — nhưng đạt "mức frontier" và vượt các mô hình còn lại trong bộ đánh giá nội bộ của họ. Bối cảnh đáng nói: Fable 5 mới ra mắt tháng trước, GPT-5.6 mới ra một tuần trước đó — tức khoảng cách mở-đóng giờ tính bằng tuần, không còn là quý.
Giá: rẻ bằng 1/3, cửa sổ 1 triệu token không phụ phí
Kimi K3 có giá $3 cho 1 triệu token đầu vào (cache hit chỉ $0,30) và $15 cho 1 triệu token đầu ra (đã gồm token suy luận) — và mức giá này áp dụng cho toàn bộ cửa sổ 1.048.576 token, không tăng giá theo độ dài ngữ cảnh. Để so sánh, chúng tôi đối chiếu trực tiếp bảng giá chính thức của Anthropic và OpenAI (giá chuẩn, chưa gồm ưu đãi batch):
| Mô hình | Đầu vào | Đầu vào (cache hit) | Đầu ra |
|---|---|---|---|
| Kimi K3 (mở) | $3 | $0,30 | $15 |
| Claude Fable 5 (đóng) | $10 | $1 | $50 |
| Claude Opus 4.8 (đóng) | $5 | $0,50 | $25 |
| GPT-5.6 Sol (đóng) | $5 | $0,50 | $30 |
Tính nhanh: đầu vào của K3 rẻ bằng 30% Fable 5 và 60% Opus 4.8 / GPT-5.6 Sol; đầu ra rẻ bằng 30% Fable 5 và 50% GPT-5.6 Sol. Với workload nhiều suy luận (output dài), chênh lệch chi phí cộng dồn rất nhanh.
K3 làm được gì? "Vision-in-the-loop" và lập trình dài hơi
Moonshot định vị K3 cho các phiên kỹ thuật kéo dài: đọc codebase lớn, điều phối công cụ terminal, tự sửa hướng khi cách làm không hiệu quả. Điểm khác biệt được nhấn mạnh là "vision-in-the-loop" — mô hình chụp màn hình kết quả render, nhìn, rồi quay lại sửa code, lặp cho đến khi đạt. Các demo được công bố gồm: game 3D thế giới mở chạy trong trình duyệt (Three.js + WebGPU), mô phỏng phóng-và-thu-hồi tên lửa Trường Chinh 10, và một trình giả lập Game Boy Advance. Trong một ca thử nghiệm khác, K3 tự chạy 48 giờ liên tục để thiết kế và kiểm chứng một con chip phục vụ mô hình nano trên thư viện Nangate 45nm bằng công cụ EDA mã nguồn mở.
Khoảnh khắc "DeepSeek thứ hai"?
Lần gần nhất một phòng lab Trung Quốc tung mô hình rẻ mà bám sát năng lực mô hình đóng của Mỹ là DeepSeek R1, tháng 1/2025 — sự kiện từng thổi bay khoảng 1.000 tỷ USD vốn hóa nhóm cổ phiếu công nghệ Mỹ. Cựu cố vấn chính sách AI Nhà Trắng Sriram Krishnan nhận định trên X rằng màn ra mắt K3 là khoảnh khắc lớn với nhiều hệ quả cho toàn ngành. Ở chiều ngược lại, SiliconANGLE lưu ý Anthropic từng cáo buộc Moonshot (cùng DeepSeek và MiniMax) vi phạm điều khoản khi "chưng cất" (distillation) năng lực từ Claude để huấn luyện mô hình riêng — tranh cãi quanh distillation và kiểm soát xuất khẩu chip nhiều khả năng sẽ nóng trở lại.
Về phía Moonshot, theo Financial Times (TechCrunch dẫn lại), công ty đang gọi vốn ở định giá 31,5 tỷ USD — tăng mạnh so với vòng 2 tỷ USD ở định giá 20 tỷ USD hồi tháng 5/2026.
Góc nhìn cho doanh nghiệp Việt
Kimi K3 củng cố xu hướng mà chúng tôi đã phân tích ở bài DeepSeek V4 và chủ quyền AI: mô hình mở ngày càng sát mô hình đóng, trong khi giá rẻ hơn nhiều lần. Với doanh nghiệp Việt, có ba điểm thực tế:
- Dùng qua API ngay: nếu bài toán không chứa dữ liệu nhạy cảm, giá $3/$15 với ngữ cảnh 1 triệu token là mức rất cạnh tranh cho tác vụ xử lý tài liệu dài, codebase lớn.
- Chờ weights 27/07 để tự vận hành: khi trọng số mở, doanh nghiệp có thể chạy K3 trên hạ tầng riêng — dữ liệu không rời tổ chức. Nhưng lưu ý: 2,8 nghìn tỷ tham số là mô hình rất lớn; tự host cần cụm GPU đáng kể, nên chỉ hợp với tổ chức đã có hạ tầng hoặc thuê private cloud. Cách tiếp cận phân loại dữ liệu — tác vụ thường dùng API, dữ liệu lõi chạy mô hình mở cỡ vừa on-premise — vẫn là khung chúng tôi khuyến nghị trong lộ trình tự xây AI nội bộ.
- Đọc kỹ giấy phép trước khi dùng thương mại: "open-weight" không tự động nghĩa là muốn làm gì cũng được — điều khoản license sẽ rõ khi weights phát hành 27/07, kèm technical report.
Câu hỏi thường gặp
Kimi K3 đã tải về tự host được chưa?
Chưa. Tại thời điểm công bố (16/07/2026), K3 mới dùng được qua Kimi.com, Kimi Work, Kimi Code và Kimi API. Moonshot cho biết trọng số đầy đủ sẽ phát hành công khai vào 27/07/2026, kèm technical report về kiến trúc và huấn luyện.
Kimi K3 có mạnh hơn Claude Fable 5 hay GPT-5.6 Sol không?
Tổng thể thì chưa — chính Moonshot thừa nhận K3 vẫn sau hai mô hình này. Nhưng ở đánh giá độc lập, K3 đứng hạng 3 trên GDPval-AA v2 (1.668, trên Opus 4.8 Max), hạng 2 trên AA-Briefcase, và leaderboard front-end của Arena.ai xếp K3 trên cả Fable 5.
Giá Kimi K3 là bao nhiêu?
Theo tài liệu API của Moonshot: $0,30/1M token đầu vào khi trúng cache, $3/1M token khi không, và $15/1M token đầu ra (gồm cả token suy luận). Giá không đổi theo độ dài ngữ cảnh — dùng full 1 triệu token vẫn cùng đơn giá.
"Open-weight" khác gì "open-source"?
Open-weight nghĩa là trọng số mô hình được công bố để tải về và tự chạy. Nó không nhất thiết bao gồm mã huấn luyện, dữ liệu huấn luyện, hay giấy phép tự do tuyệt đối — điều khoản sử dụng thương mại tùy license đi kèm. Với K3, license cụ thể sẽ rõ khi weights phát hành 27/07/2026.
Doanh nghiệp Việt có nên chuyển sang Kimi K3?
Tùy dữ liệu và bài toán. Tác vụ không nhạy cảm: API K3 rất đáng thử vì giá thấp và ngữ cảnh 1 triệu token. Dữ liệu lõi/nhạy cảm: chờ weights mở rồi đánh giá phương án tự vận hành, hoặc dùng mô hình mở cỡ vừa trên hạ tầng riêng. Nên chạy đánh giá (eval) trên bài toán thật của mình thay vì tin benchmark chung.
Triển khai AI nội bộ với mô hình mã nguồn mở
Namtech giúp doanh nghiệp chọn và vận hành mô hình mở phù hợp (Kimi, DeepSeek, Qwen, Gemma) trên hạ tầng nội bộ hoặc private cloud — dữ liệu tại chỗ, chi phí kiểm soát được.
Đặt lịch tư vấn miễn phíLưu ý: Bài viết tổng hợp từ nguồn công khai tại 17/07/2026; các con số benchmark/giá là theo công bố của Moonshot, Anthropic, OpenAI hoặc nguồn dẫn tại thời điểm viết và có thể thay đổi. Thông tin tham khảo, không phải tư vấn kỹ thuật hay đầu tư.
- Kimi (Moonshot AI) — Kimi K3: Open Frontier Intelligence (blog chính thức)
- SiliconANGLE — China's Moonshot throws down the gauntlet with Kimi K3
- OfficeChai — Moonshot's Kimi K3 To Be Largest Open Model With 2.8 Trillion Parameters
- TechCrunch — Moonshot's upcoming Kimi 3 is expected to close the gap with Anthropic's Opus 4.8
- Anthropic — Pricing (Claude Platform Docs)
- OpenAI — API Pricing
- Moonshot AI — Kimi K3 Pricing (Kimi API Platform)