Skip to content

Qwen 3.8 vs Kimi K3: Cuộc Đua Mô Hình AI Mở Của Trung Quốc Nóng Lên Từng Ngày

Karify98 & Amy 🌸·
Cover Image for Qwen 3.8 vs Kimi K3: Cuộc Đua Mô Hình AI Mở Của Trung Quốc Nóng Lên Từng Ngày

Hai Quả Bom Trong 3 Ngày

Ngày 16 tháng 7, Moonshot AI công bố Kimi K3 — mô hình 2.8 nghìn tỷ tham số, kiến trúc Mixture-of-Experts, cửa sổ ngữ cảnh 1 triệu token, và hứa mở trọng số vào ngày 27 tháng 7. Ba ngày sau, Alibaba đáp trả bằng Qwen 3.8: 2.4 nghìn tỷ tham số, cũng mở trọng số, và tuyên bố "chỉ đứng sau Fable 5" trong số các mô hình frontier.

Đây không chỉ là cuộc đua giữa hai công ty Trung Quốc. Đây là một chiến lược có chủ đích: biến LLM thành hàng hóa, phá vỡ thế độc quyền của các phòng lab phương Tây, và định vị Trung Quốc ở trung tâm hệ sinh thái AI mở.

Bối Cảnh: Từ DeepSeek Đến Cuộc Đua 2T+

Nửa đầu năm 2026 chứng kiến hàng loạt mô hình open-weight quy mô lớn từ Trung Quốc: DeepSeek với dòng model hiệu suất cao, Kimi K2 từ Moonshot, và Qwen3-235B từ Alibaba. Nhưng Qwen 3.8 và Kimi K3 đưa cuộc chơi lên một tầm mới.

Hãy đặt con số vào ngữ cảnh: GPT-5.x và Claude Opus 4.x — những model mà developer trả hàng trăm đô mỗi tháng để dùng qua API — có số tham số được ước tính trong khoảng 1-2T, và đều là model đóng. Việc hai model 2T+ ra mắt chỉ trong 3 ngày và cùng hứa mở trọng số là chưa từng có tiền lệ.

Trên Hacker News, chủ đề Qwen 3.8 thu hút 714 điểm và hơn 500 bình luận. Một phân tích nổi bật: "Các công ty Trung Quốc đang nỗ lực biến trí tuệ nhân tạo thành hàng hóa — đó có thể là cách hiệu quả nhất để làm suy yếu các phòng lab frontier của Mỹ. Và thành thật mà nói: điều đó cũng rất tốt cho nhân loại."

Kimi K3: Kẻ Tiên Phong Với Hệ Sinh Thái Đầy Đủ

Kimi K3 ra mắt ngày 16 tháng 7 với những con số gây choáng:

  • 2.8 nghìn tỷ tham số tổng, 896 expert, chỉ 16 được kích hoạt mỗi token — khoảng 1.8% mạng hoạt động mỗi bước inference
  • 1 triệu token cửa sổ ngữ cảnh — đủ để nhét toàn bộ repository, tài liệu thiết kế và lịch sử test trong một phiên
  • Luôn bật reasoning — mọi lần gọi đều suy luận ở mức tối đa (các mức nhẹ hơn được hứa trong tương lai)
  • Agent swarm tích hợp sẵn: nhiều sub-agent chạy song song trên batch, search và coding task lớn
  • API tương thích OpenAI — đổi base URL và model ID là dùng được ngay

Moonshot định vị K3 ngay sau Fable 5 và GPT 5.6 Sol về năng lực tổng thể, nhưng dẫn đầu trên Frontend Code Arena — bài kiểm tra code frontend mù. Trên các bài test coding và agent, K3 vượt Claude Opus 4.8 và GPT 5.5.

Điểm đáng giá nhất với developer: Moonshot ra mắt K3 kèm Kimi Code (IDE tích hợp AI), agent swarm gốc (không phải plugin gắn thêm), và mức giá $3-$15 — rẻ hơn đáng kể so với API Claude hay GPT tương đương. Hệ quả tức thì: Moonshot đã phải tạm ngừng đăng ký mới vì nhu cầu vượt quá khả năng phục vụ.

Qwen 3.8: Ẩn Số Đáng Gờm

Ba ngày sau Kimi K3, Alibaba tung Qwen 3.8 với thông điệp trực diện: 2.4 nghìn tỷ tham số, mở trọng số "sắp tới", tự tin tuyên bố "chỉ đứng sau Fable 5." Qwen 3.8-Max-Preview hiện có trên Alibaba Token Plan, Qoder và QoderWork.

Nhưng có một vấn đề: không benchmark, không technical report, không gì cả. Tất cả những gì tồn tại là một bài tweet. Việc thiếu benchmark có thể là tín hiệu của hai điều trái ngược: hoặc model này thực sự ấn tượng đến mức Alibaba muốn giữ kín trước khi mở trọng số, hoặc họ đang chạy đua để không bị bỏ lại phía sau.

Dù sao, việc Alibaba — công ty trị giá hàng trăm tỷ đô với hạ tầng cloud khổng lồ — đặt cược vào open-weight là tín hiệu rất rõ ràng. Họ không chỉ muốn cạnh tranh về model. Họ muốn trở thành nền tảng inference cho cả ngành.

Developer Được Gì Từ Cuộc Đua Này?

Self-host model 2T+ sắp thành hiện thực. Kimi K3 mở trọng số ngày 27/7. Qwen 3.8 sẽ theo sau. Developer có thể chạy model frontier trên infrastructure riêng, fine-tune với dữ liệu nội bộ, không cần gửi code qua API bên thứ ba. Với các tổ chức có yêu cầu bảo mật cao (ngân hàng, y tế, chính phủ), đây là game-changer.

Chi phí giảm theo cấp số nhân. Khi hai model 2T+ cạnh tranh trực tiếp với nhau và với các API phương Tây, giá inference sẽ lao dốc. Moonshot đã định giá $3-$15 cho K3. So sánh: Claude Opus 4.x qua API có giá $15/$75 per million token input/output. Khoảng cách là rất lớn.

Hệ sinh thái quyết định người thắng. Ai có tooling tốt hơn, documentation rõ ràng hơn, cộng đồng developer lớn hơn — người đó thắng. Hiện tại Kimi K3 đang dẫn trước với Kimi Code, agent swarm, và API tương thích OpenAI. Nhưng Alibaba có lợi thế hạ tầng cloud và hệ sinh thái thương mại điện tử khổng lồ để phân phối.

Rủi ro cần lưu ý. Mô hình open-weight từ Trung Quốc đi kèm câu hỏi về kiểm duyệt nội dung, bias chính trị, và quy định pháp lý (export control, data sovereignty). Khi triển khai trong môi trường enterprise, cần audit kỹ các lớp an toàn và alignment.

Takeaways

  • Cuộc đua mô hình mở tăng tốc chưa từng có: hai model 2T+ tham số ra mắt trong 3 ngày, cùng hứa mở trọng số. Chưa từng có tiền lệ trong lịch sử AI
  • Trung Quốc đang dẫn đầu open-weight AI: chiến lược "commoditize your complement" — biến model thành hàng hóa, phá vỡ mô hình kinh doanh API đóng của phương Tây
  • Developer hưởng lợi trực tiếp: model mạnh hơn, giá rẻ hơn 5-10 lần, tự do self-host và fine-tune
  • Kimi K3 có lợi thế thực tế rõ ràng: benchmark, người dùng thực, hệ sinh thái — nhưng tài nguyên hạ tầng của Alibaba đứng sau Qwen 3.8
  • Điều cần theo dõi: benchmark độc lập của Qwen 3.8 khi mở trọng số; liệu Kimi K3 có duy trì được đà tăng trưởng; và phản ứng của OpenAI/Anthropic/Google

Bài viết được hỗ trợ bởi AI (Amy 🌸). Nội dung đã được kiểm duyệt bởi tác giả.

Related Posts