VentureBeat AI

Moonshot AI của Trung Quốc phát hành Kimi K3, mô hình mã nguồn mở lớn nhất từ trước đến nay, sánh ngang với các hệ thống hàng đầu của Mỹ

🕐 20/07/2026 08:10 📰 VentureBeat AI ✅ Đã dịch sang tiếng Việt

VentureBeat đưa tin, hình ảnh được tạo bằng Midjourney.

Moonshot AI, công ty khởi nghiệp trí tuệ nhân tạo có trụ sở tại Bắc Kinh được Alibaba hậu thuẫn, hôm thứ Năm đã phát hành Kimi K3 — một mô hình có 2,8 nghìn tỷ tham số mà công ty tuyên bố hiện là mô hình AI nguồn mở lớn nhất thế giới, và theo các điểm chuẩn, nó hoạt động ngang ngửa với các hệ thống độc quyền mạnh nhất từ Anthropic và OpenAI.

Việc phát hành, được lên lịch ngay trước Hội nghị Trí tuệ Nhân tạo Thế giới 2026 tại Thượng Hải, là một sự leo thang đáng kể trong cuộc chạy đua AI toàn cầu và là một thời điểm bước ngoặt cho phong trào AI nguồn mở. Nó cũng đánh dấu sự trở lại ngoạn mục của một công ty có vị thế thị trường đã suy giảm đáng kể trong 18 tháng qua sau sự trỗi dậy thần tốc của DeepSeek.

Trọng số mô hình đầy đủ dự kiến sẽ được phát hành vào ngày 27 tháng 7, theo thông tin chi tiết được chia sẻ bởi các nhà nghiên cứu đã xem xét tài liệu kỹ thuật của công ty. Nếu bạn muốn dùng thử Kimi K3 ngay bây giờ, bạn có thể — chỉ cần truy cập kimi.com, đăng ký bằng tài khoản Google hoặc số điện thoại (không yêu cầu thẻ tín dụng), và bắt đầu trò chuyện với thứ có thể là mô hình nguồn mở mạnh nhất từng được xây dựng.

Kimi K3 là một mô hình ngôn ngữ lớn đẳng cấp tiên phong với tổng cộng 2,8 nghìn tỷ tham số — lớn hơn khoảng 75% so với V4 Pro của DeepSeek, mà biểu đồ dòng thời gian của chính công ty cho thấy ở mức xấp xỉ 1,6 nghìn tỷ tham số. Mô hình có cửa sổ ngữ cảnh 1 triệu token, khả năng hiểu hình ảnh gốc và chế độ suy luận luôn bật mà công ty gọi là "chế độ suy nghĩ".

Mô hình được xây dựng dựa trên hai cải tiến kiến trúc chính được phát triển nội bộ tại Moonshot AI: Kimi Delta Attention, một cơ chế chú ý tuyến tính lai, và Attention Residuals, mà công ty mô tả là sự thay thế trực tiếp cho các kết nối dư mang lại lợi ích mở rộng nhất quán. Cả hai kỹ thuật này trước đây đã được nhóm Moonshot công bố dưới dạng nghiên cứu mở trên GitHub.

Về phía API, Kimi K3 tương thích với OpenAI SDK, giảm rào cản tích hợp cho các nhà phát triển đã xây dựng trên các chuỗi công cụ của OpenAI hoặc Anthropic. Mô hình được định giá ở mức 3 đô la cho mỗi triệu token đầu vào và 15 đô la cho mỗi triệu token đầu ra, với token đầu vào được lưu trong bộ nhớ đệm chỉ còn 0,30 đô la cho mỗi triệu — mức giá định vị nó ngang bằng với các dịch vụ tầm trung từ các phòng thí nghiệm phương Tây, nhưng ở mức hiệu suất mà công ty tuyên bố là tiệm cận đỉnh thị trường. Một chương trình khuyến mãi hoàn tiền nạp thẻ kéo dài đến ngày 12 tháng 8 cung cấp tới 30% tiền thưởng dưới dạng phiếu thưởng cho các khoản tín dụng API từ 1.000 đô la trở lên.

Như Tân Hoa Xã đưa tin, một giám đốc điều hành của Moonshot AI đã giải thích tầm quan trọng của số lượng tham số một cách đơn giản: các tham số giống như các kết nối thần kinh trong não người, và gần 3 nghìn tỷ tham số có nghĩa là mô hình có thể "lưu trữ nhiều kiến thức và mẫu hình hơn trong bộ não của nó, hiểu nhiều hơn, suy nghĩ sâu hơn và trả lời chính xác hơn."

Kết quả điểm chuẩn, được lấy từ dữ liệu bảng xếp hạng công khai và đánh giá riêng tư của công ty phân tích Artificial Analysis, kể một câu chuyện ấn tượng.

Trên GDPval-A

**Phiên bản K3 của Kimi: Mô hình nguồn mở mới đạt điểm chuẩn AI hàng đầu, vượt qua GPT-5.6 Sol và Claude Opus 4.8**

Trong bài kiểm tra A v2 - một điểm chuẩn đo lường các tác vụ thực tế trên 44 ngành nghề và 9 lĩnh vực công nghiệp chính, Kimi K3 đạt 1.687 điểm, xếp thứ ba tổng thể, chỉ sau Claude Fable 5 Max (1.815) và GPT-5.6 Sol Max (1.747,8), đồng thời vượt qua Claude Opus 4.8 (1.600).

Trên AA-Briefcase, một điểm chuẩn tác nhân riêng tư từ Artificial Analysis được thiết kế để kiểm tra công việc tri thức tầm xa, K3 vươn lên vị trí thứ hai với 1.527 điểm, đánh bại GPT-5.6 Sol Max (1.495) và chỉ xếp sau Fable 5 Max (1.587).

Có lẽ ấn tượng nhất, K3 đạt điểm số tiên tiến nhất là 91,2/100 trên BrowseComp, một điểm chuẩn cho việc tìm kiếm thông tin tầm xa, độ khó cao.

Trong các bài kiểm tra tự động hóa tác vụ thực tế, Kimi K3 đứng đầu ở bốn trong tám điểm chuẩn - bao gồm Automation Bench, SpreadsheetBench 2 và BrowseComp - đồng thời về nhì sau Fable 5 ở hầu hết các điểm chuẩn còn lại. Fable 5 và GPT-5.6 Sol là những đối thủ cạnh tranh gần nhất của nó. (Nguồn: Moonshot AI)

Công ty cho biết họ đạt được điều này trong thiết lập một tác nhân duy nhất sử dụng cửa sổ ngữ cảnh 1 triệu token, mà không cần bất kỳ kỹ thuật nén ngữ cảnh hay quản lý ngữ cảnh bổ sung nào - một kỳ tích cho thấy độ dài ngữ cảnh thô, khi kết hợp với khả năng truy xuất mạnh mẽ, có thể mạnh hơn các giải pháp thay thế đa tác nhân phức tạp.

Như một nhà bình luận AI được theo dõi rộng rãi đã nói trên mạng xã hội: "Nguồn mở không còn tụt hậu sáu tháng so với các mô hình nguồn đóng phương Tây nữa. Hãy đọc lại điều đó và suy nghĩ về ý nghĩa của nó."

Nhận xét đó nắm bắt được tầm quan trọng của thời điểm này. Trong phần lớn ba năm qua, các mô hình nguồn mở thường tụt hậu so với các đối tác độc quyền với một khoảng cách đáng kể. Kimi K3 dường như đã thu hẹp khoảng cách đó gần như hoàn toàn.

Kimi K3 giành vị trí số 1 trên Arena.AI's Frontend Code Arena với 1.679 điểm, vượt qua Claude Fable 5 và GPT-5.6 Sol với một khoảng cách đáng kể. Bảng xếp hạng này xếp hạng các mô hình dựa trên sở thích của con người trong các so sánh mã frontend đối đầu. (Nguồn: arena.ai)

Ngoài các điểm chuẩn thô, Moonshot AI đã trình diễn một bằng chứng khái niệm có thể còn tiết lộ nhiều hơn về khả năng của K3 và định hướng chiến lược của công ty.

Trong một cuộc trình diễn được ghi lại trong tài liệu kỹ thuật của công ty, Kimi K3 được giao nhiệm vụ thiết kế một con chip vật lý để chạy một phiên bản thu nhỏ của chính nó. Trong 48 giờ hoạt động tác nhân tự động liên tục, K3 đã độc lập hoàn thành toàn bộ quy trình xây dựng chip - từ thiết kế kiến trúc qua tối ưu hóa đến xác minh - sử dụng các công cụ tự động hóa thiết kế điện tử nguồn mở. Kết quả là một thiết kế chip nhỏ nhưng có chức năng, chỉ 4 mm vuông, đạt được sự hội tụ thời gian ở 100 MHz và có thể giải mã hơn 8.700 token mỗi giây trong mô phỏng.

Đây không phải là một chip sản xuất. Đây là một minh chứng cho những gì Moonshot AI rõ ràng coi là ranh giới cạnh tranh tiếp theo: khả năng tác nhân tự động tầm xa. Khả năng duy trì công việc kỹ thuật mạch lạc, nhiều bước trong suốt 48 giờ - đọc tài liệu, thực hiện

Các quyết định thiết kế quan trọng, chạy các vòng lặp xác minh và lặp lại dựa trên thất bại — đại diện cho một bước nhảy vọt về chất so với kiểu trả lời câu hỏi một lượt đã định hình thế hệ đầu tiên của các mô hình ngôn ngữ lớn.

Công ty cũng nêu bật một trường hợp trong lĩnh vực vật lý thiên văn tính toán, nơi K3 được cho là đã tái tạo mối quan hệ vũ trụ I-Love-Q — một phép tính phức tạp thường mất một nhà nghiên cứu cấp cao từ một đến hai tuần — trong khoảng hai giờ, đọc và đối chiếu chéo hơn 20 bài báo, đồng thời triển khai một quy trình số hoàn chỉnh trong quá trình đó.

Để hiểu tại sao Kimi K3 lại quan trọng, bạn cần hiểu Moonshot AI đã ở đâu 18 tháng trước — và nó đã tụt hậu xa đến mức nào.

Được thành lập vào năm 2023 bởi Yang Zhilin, một cựu sinh viên Đại học Thanh Hoa từng nghiên cứu tại Google và Meta, Moonshot AI nhanh chóng trở thành một trong những startup AI nổi bật nhất của Trung Quốc. Công ty đã đạt được đà tăng trưởng ban đầu vào năm 2024 khi người dùng đổ xô đến nền tảng Kimi của họ nhờ khả năng phân tích văn bản dài và chức năng tìm kiếm AI. Đến đầu năm 2026, công ty đã huy động được khoảng 1,5 tỷ đô la Mỹ qua nhiều vòng, với định giá tăng từ 2,5 tỷ đô la lên 4,3 tỷ đô la, và được cho là đang tìm kiếm một vòng mới ở mức 5 tỷ đô la.

Sau đó, DeepSeek xuất hiện. Việc phát hành mô hình R1 chi phí thấp của DeepSeek vào tháng 1 năm 2025 đã làm đảo lộn toàn bộ bối cảnh AI của Trung Quốc, và Moonshot AI là một trong những công ty bị ảnh hưởng nặng nề nhất. Kimi, vốn đứng thứ ba về số lượng người dùng hoạt động hàng tháng tại Trung Quốc, đã tụt xuống thứ bảy. Việc công ty chuyển hướng chiến lược sang các mô hình mã nguồn mở — bắt đầu với Kimi K2 vào tháng 7 năm 2025 và tăng tốc với K2.5 vào tháng 1 năm 2026 — phần lớn là nỗ lực để giành lại vị thế.

Kimi K3 là đỉnh cao của nỗ lực đó — và quy mô tuyệt đối của mô hình cho thấy Moonshot AI đã lên kế hoạch cho bước đi này từ một thời gian. Việc huấn luyện một mô hình có 2,8 nghìn tỷ tham số đòi hỏi nguồn lực tính toán khổng lồ và nhiều tháng chuẩn bị, điều đó có nghĩa là các quyết định về kiến trúc và cơ sở hạ tầng đằng sau K3 có khả năng đã được xác định từ trước.

📎 Nguồn gốc: VentureBeat AI Xem bài gốc →