Alibaba công bố trước Qwen3.8-Max, mô hình đa phương thức 2,4 nghìn tỷ tham số, chỉ vài ngày sau khi Moonshot ra mắt Kimi K3 mã nguồn mở
Ngày 19 tháng 7, nhóm Qwen của Alibaba đã công bố bản xem trước Qwen3.8-Max-Preview, phiên bản flagship tiếp theo trong dòng Qwen. Nhóm nghiên cứu mô tả đây là mô hình 2,4 nghìn tỷ tham số, 'chỉ đứng sau Fable 5' trong số các hệ thống mà nó đã đánh giá. Bản xem trước hiện đã có sẵn. Bảng benchmark, thẻ mô hình và giấy phép thì chưa.
Thông báo ngày 19 tháng 7 năm 2026 được đưa ra trong khuôn khổ Hội nghị Trí tuệ Nhân tạo Thế giới (WAIC) tại Thượng Hải. Nó cũng đến hai ngày sau khi Moonshot AI phát hành Kimi K3, một mô hình trọng số mở 2,8 nghìn tỷ tham số. Thời điểm ra mắt cũng quan trọng không kém chính mô hình.
Bài viết này phân tách những gì Alibaba xác nhận và những gì họ chỉ tuyên bố. Mọi con số hiệu suất dưới đây đều kèm theo lưu ý đó.
Tài khoản Qwen đã đăng rằng Qwen3.8 sắp ra mắt và sẽ sớm có trọng số mở. Họ gọi mô hình này là 'một trong những mô hình mạnh nhất hiện có, có thể so sánh với các hệ thống tiên tiến hàng đầu.
Bản dựng xem trước là có thật và có thể mua được. Quyền truy cập thông qua đăng ký Token Plan của Alibaba. Bản xem trước được cung cấp với giá 10% so với giá tiêu chuẩn.
Nhà phát triển Qwen Shuai Bai đã bổ sung thêm chi tiết kỹ thuật. Anh mô tả Qwen3.8 là mô hình đa phương thức đầu tiên của nhóm có trên 1 nghìn tỷ tham số. Nó xử lý văn bản, hình ảnh, video và tài liệu. Nhóm Alibaba cho biết mô hình này sẽ vượt trội hơn Qwen3.7-Max về lập trình, phát triển full-stack, phân tích dữ liệu và quy trình làm việc văn phòng.
Tình trạng tính đến ngày 19 tháng 7 năm 2026. Chuyển đổi loại sự kiện bằng các tab ở trên.
Tổng số tham số không phải là khả năng tính toán có thể sử dụng. Mô hình MoE thưa thớt chỉ kích hoạt một phần nhỏ các tham số này cho mỗi token.
Ước tính chỉ cho trọng số; cộng thêm khoảng 20–30% cho KV cache và chi phí runtime. Việc phục vụ với tham số kích hoạt sẽ rẻ hơn nhiều, nhưng Alibaba chưa công bố con số đó.
Qwen3.7-Max, tháng 5 năm 2026, trọng số đóng. Lợi thế lịch sử của Alibaba là tỷ lệ giá/hiệu năng, chứ không phải đứng đầu bảng xếp hạng.
Tổng số tham số không giống với khả năng tính toán có thể sử dụng. Sự khác biệt này quan trọng hơn con số chính. Lịch sử của chính Qwen chứng minh điều đó.
Qwen3-235B-A22B có tổng cộng 235 tỷ tham số nhưng chỉ kích hoạt 22 tỷ mỗi token. Qwen3-30B-A3B kích hoạt khoảng 3 tỷ. Cả hai đều là thiết kế MoE thưa thớt, và tầng Max của Qwen cũng vậy.
Đối với Qwen3.8, số lượng tham số kích hoạt là con số mà không ai có. Nếu không có nó, con số 2,4T tham số được nhấn mạnh nói lên rất ít về chi phí phục vụ. Như Startup Fortune đã tính toán, một mô hình 2,4T ở độ chính xác 4-bit cần khoảng 1,2 terabyte chỉ cho trọng số. Một card Nvidia H200 đơn lẻ có 141GB. Ngay cả tám card cũng để lại phép tính khó khăn.
Đó là lý do tại sao câu hỏi thực tế không phải là vị trí trên bảng xếp hạng. Đó là liệu Alibaba có phát hành một biến thể tham số kích hoạt nhỏ hơn, một checkpoint lượng tử hóa tốt, hay một phiên bản chưng cất hay không.
Phản ứng của cộng đồng đối với bản xem trước Qwen3.8 ngày 19 tháng 7 năm 2026 chia rẽ theo những hướng có thể đoán trước. Sự nhiệt tình cho một mô hình tiên tiến trọng số mở khác đã gặp phải sự mệt mỏi vì các benchmark chưa được xác minh.
Trên Hacker News, quan điểm chủ đạo là cuộc đua trọng số mở giữa các phòng thí nghiệm Trung Quốc có lợi cho tất cả mọi người. Những người bình luận tranh luận về động cơ và coi thời điểm ra mắt là phản ứng trực tiếp với Kimi K3.
Một nhóm nhỏ đặt câu hỏi về cách đóng khung 'chỉ đứng sau Fable 5' và gọi Qwen là chuyên gia chuẩn mực bên cạnh các đối thủ.
Trên Reddit r/LocalLLaMA, cuộc thảo luận mang tính thực tế. Phép tính phục vụ 2,4 nghìn tỷ tham số chiếm ưu thế, cùng với hy vọng về một phiên bản nhỏ hơn hoặc tinh gọn mà một máy trạm có thể tải. Trên X, thông báo này trở thành xu hướng và các tài khoản lớn, bao gồm kimmonismus, đã khuếch đại dòng trọng số mở.
Bảng dưới đây phân tích phản ứng đó theo từng nền tảng.


