Phòng thí nghiệm AI Trung Quốc Moonshot AI đã công bố Kimi K3 vào ngày 16 tháng 7 năm 2026, phát hành cái mà họ gọi là "mô hình lớp 3T mở đầu tiên trên thế giới" - một hệ thống 2,8 nghìn tỷ tham số giúp thu hẹp khoảng cách với các mô hình độc quyền mạnh mẽ nhất của Anthropic và OpenAI. Sự ra mắt này ngay lập tức trở thành một trong những phiên bản AI được thảo luận nhiều nhất trong năm, lọt vào top đầu của Hacker News và thu hút sự quan tâm của Reuters, Bloomberg và The New York Times.
Đối với phạm vi phủ sóng của ngành AI rộng hơn, Kimi K3 quan trọng vì nó đẩy ranh giới của các mẫu máy mở lên cao hơn đáng kể, đồng thời tạo ra một cuộc tranh luận mới về việc liệu các hệ thống có thể tải xuống miễn phí có thể sánh ngang với các hệ thống đóng hay không. Moonshot cho biết trọng lượng mô hình đầy đủ sẽ được phát hành trước ngày 27 tháng 7 năm 2026.
Mô hình mở 2,8 nghìn tỷ tham số
Theo thông báo kỹ thuật của Moonshot, Kimi K3 là mô hình có 2,8 nghìn tỷ tham số được xây dựng trên hai bản cập nhật kiến trúc mà công ty gọi là Kimi Delta Chú ý (KDA) và Chú ý dư (AttnRes). Nó sử dụng thiết kế Hỗn hợp các chuyên gia (MoE) chỉ kích hoạt 16 trong số 896 chuyên gia cho bất kỳ mã thông báo nhất định nào, kết hợp với những gì Moonshot mô tả là khung Stable LatentMoE ổn định. Công ty tuyên bố những thay đổi này mang lại sự cải thiện khoảng 2,5 lần về hiệu quả mở rộng tổng thể so với mẫu Kimi K2 trước đây.
Mô hình này cũng được trang bị khả năng thị giác gốc và cửa sổ ngữ cảnh một triệu mã thông báo. Nhà phân tích Simon Willison, viết trên blog của mình, lưu ý rằng Kimi K3 chiếm ưu thế về kích thước mở từ v4 Pro 1,6 nghìn tỷ tham số của DeepSeek - "kích thước lớn hơn gấp đôi" của Kimi K2.6 1 nghìn tỷ tham số trước đó.
Moonshot coi việc phát hành là bước mới nhất trong nỗ lực mở rộng quy mô bền vững, nói rằng trong chín trong số mười hai tháng qua, các mô hình của nó đã đặt giới hạn trên của kích thước mô hình mở.
Nó so sánh như thế nào trên điểm chuẩn
Bộ đánh giá riêng của Moonshot xếp hiệu suất tổng thể của Kimi K3 chỉ sau hai hệ thống độc quyền — Claude Fable 5 của Anthropic và GPT-5.6 Sol của OpenAI — trong khi nó luôn vượt trội so với các mẫu được thử nghiệm khác, bao gồm Claude Opus 4.8 và GPT-5.5. Phân tích của bên thứ ba theo dõi rộng rãi những tuyên bố đó.
Dịch vụ đánh giá độc lập Phân tích nhân tạo đã báo cáo rằng trên điểm chuẩn công việc tri thức dài hạn riêng tư của mình, Kimi K3 đã đạt Elo tổng thể là 1547 - tăng 732 điểm so với Kimi K2.6 và chỉ sau Claude Fable 5. Trên đấu trường Frontend Code của Arena.ai, Kimi K3 đã leo lên vị trí số một, vượt qua cả Claude Fable 5, theo một bài đăng trên bảng xếp hạng được lan truyền rộng rãi sau khi ra mắt.
Giá cả là một phần đáng chú ý của câu chuyện. Phân tích nhân tạo đã chốt chi phí trung bình cho mỗi nhiệm vụ ở mức 0,94 USD, tương đương với 1,04 USD của GPT-5.6 Sol và gần bằng một nửa so với 1,80 USD của Claude Opus 4.8, đồng thời lưu ý rằng Kimi K3 sử dụng mã thông báo đầu ra ít hơn 21% so với phiên bản trước. Trên cơ sở mỗi mã thông báo, mô hình này có giá 3 USD trên một triệu mã thông báo đầu vào và 15 USD trên một triệu mã thông báo đầu ra - cùng mức với loạt Claude Sonnet của Anthropic và, như Willison quan sát, là mô hình đắt nhất do phòng thí nghiệm AI Trung Quốc phát hành cho đến nay, tăng từ mức 0,95 USD/4 USD của Kimi K2.6.
Mã hóa tác nhân và trình biên dịch do chính nó tạo ra
Phần lớn thông báo của Moonshot không tập trung vào điểm chuẩn của chatbot mà tập trung vào các nhiệm vụ tác nhân dài hạn. Công ty cho biết Kimi K3 có thể duy trì các phiên kỹ thuật kéo dài, điều hướng các kho mã lớn và điều phối các công cụ đầu cuối với sự giám sát tối thiểu của con người.
Trong một cuộc trình diễn, Moonshot cho biết phiên bản đầu tiên của Kimi K3 đã xử lý phần lớn công việc tối ưu hóa nhân GPU của chính nhóm trong quá trình phát triển ở giai đoạn cuối. Trong một mô hình khác, mô hình này đã xây dựng "MiniTriton", một trình biên dịch GPU nhỏ gọn giống Triton với biểu diễn trung gian ở cấp độ ô, các đường dẫn tối ưu hóa và quy trình tạo mã PTX. Moonshot khẳng định MiniTriton đã phù hợp hoặc đánh bại các ngăn xếp Triton và torch.compile đã được thiết lập trên các tiêu chuẩn đường mái được hỗ trợ và đào tạo nanoGPT từ đầu đến cuối được duy trì với khả năng hội tụ ổn định.
Công ty cũng giới thiệu một bằng chứng nổi bật về khái niệm trong thiết kế chip. Trong một lần chạy tự động kéo dài 48 giờ, Kimi K3 được cho là đã thiết kế, tối ưu hóa và xác minh một con chip được chế tạo để phục vụ mô hình nano trên kiến trúc của chính nó, sử dụng các công cụ EDA nguồn mở trên thư viện Nangate 45nm. Moonshot cho biết thiết kế này đóng thời gian ở tần số 100 MHz trong phạm vi 4 mm2 và duy trì thông lượng giải mã hơn 8.700 mã thông báo mỗi giây trong mô phỏng.
Về mặt nghiên cứu, Moonshot cho biết Kimi K3 đã tái tạo các mối quan hệ phổ quát I-Love-Q từ vật lý thiên văn tính toán trong khoảng hai giờ - công việc mà công ty ước tính thường sẽ khiến nhà nghiên cứu mất từ một đến hai tuần - bằng cách xác thực chéo hơn 20 bài báo, triển khai một hệ thống số đầy đủ trên hơn 300 phương trình trạng thái và viết hơn 3.000 dòng Python.
Cuộc tranh luận về hạng cân mở đã trở lại
Sự xuất hiện của Kimi K3 khơi lại một cuộc tranh luận kéo dài đến năm 2026 khi các phòng thí nghiệm của Trung Quốc đã nhiều lần đóng cửa - hoặc dường như thu hẹp - khoảng cách với các mô hình tiên phong của Hoa Kỳ. Mô hình giờ đây đã quen thuộc: một bản phát hành của Trung Quốc đăng các con số tự báo cáo ở gần đầu bảng xếp hạng, các phòng thí nghiệm phương Tây nhấn mạnh lợi thế độc quyền vẫn đang phát triển của họ và các doanh nghiệp cân nhắc chi phí và tính cởi mở so với năng lực thô.
Sự căng thẳng đó có thể thấy rõ trong giá cả. Một mô hình vượt trội hơn Claude Opus 4.8 về chi phí cho mỗi nhiệm vụ trong khi vẫn đạt đến khả năng của nó, nhưng lại tính phí nhiều hơn bất kỳ phiên bản phát hành nào trước đây của Trung Quốc, phản ánh sự tự tin của Moonshot rằng nó có thể đưa ra mức giá cao ngay cả trong một hệ sinh thái mở. Willison cảnh báo không nên đọc quá nhiều vào bất kỳ tiêu chuẩn đơn lẻ nào - ông viết, bài kiểm tra "bồ nông trên xe đạp" kéo dài của ông không còn tương quan đáng tin cậy với chất lượng trong thế giới thực - nhưng cho biết bản phát hành vẫn khen thưởng thử nghiệm thực hành.
Kimi K3 hiện có sẵn thông qua Kimi.com, tác nhân máy tính để bàn Kimi Work, công cụ phát triển Kimi Code và Kimi API. Moonshot cho biết họ đang làm việc với các đối tác suy luận và nhà bảo trì nguồn mở để đảm bảo triển khai đáng tin cậy trước khi phát hành toàn bộ trọng số.
Đi trước AI
Để biết thông tin liên tục về các phiên bản mô hình, trận chiến điểm chuẩn và biên giới trọng lượng mở, hãy theo dõi AI Buzz Wire để biết những phát triển định hình cuộc đua trí tuệ nhân tạo toàn cầu.
Đọc thêm tin tức về mô hình AI →


