Trọng số đầy đủ đã có thể tải xuống
Moonshot AI đã đưa toàn bộ trọng số Kimi K3 lên Hugging Face và công bố báo cáo kỹ thuật ngày 27/7. Đây là bước hoàn tất lời hẹn khi giới thiệu mô hình giữa tháng: nhà phát triển giờ có thể tải, kiểm tra và triển khai K3 theo các điều khoản của giấy phép Kimi K3, thay vì chỉ truy cập qua ứng dụng hoặc API của hãng.
Thẻ mô hình chính thức mô tả K3 là mô hình hỗn hợp chuyên gia có tổng cộng 2,8 nghìn tỷ tham số, nhưng chỉ kích hoạt 104 tỷ tham số cho mỗi lượt xử lý. Mô hình hỗ trợ văn bản và hình ảnh, có cửa sổ ngữ cảnh 1.048.576 token. Báo cáo kỹ thuật của nhóm nghiên cứu xác nhận trọng số đầy đủ được phát hành để phục vụ nghiên cứu và triển khai.
“Mở trọng số” không đồng nghĩa dễ tự vận hành
Việc công bố tệp trọng số cho phép một tổ chức lưu mô hình trên hạ tầng riêng, tinh chỉnh hoặc nghiên cứu sâu hơn mà không phải gửi toàn bộ dữ liệu qua một API bên ngoài. Tuy nhiên, K3 được phát hành theo giấy phép riêng của Moonshot, vì vậy nhóm sử dụng vẫn cần đọc điều khoản cụ thể trước khi đưa mô hình vào sản phẩm hoặc dịch vụ thương mại.
Rào cản lớn hơn nằm ở quy mô. Trong tài liệu kỹ thuật của Kimi K3, Moonshot khuyến nghị cấu hình siêu nút có từ 64 bộ tăng tốc trở lên để vận hành mô hình hiệu quả. Dù K3 dùng trọng số MXFP4 và chỉ kích hoạt một phần mạng lưới ở mỗi token, đây vẫn không phải mô hình mà một máy trạm phổ thông có thể chạy nguyên bản.
Với phần lớn doanh nghiệp và nhóm phát triển tại Việt Nam, lựa chọn thực tế trước mắt có thể vẫn là API, nhà cung cấp suy luận được quản lý hoặc các bản lượng tử hóa do cộng đồng xây dựng. Trọng số mở rộng quyền lựa chọn và khả năng kiểm chứng, nhưng không tự động loại bỏ chi phí hạ tầng, vận hành và đánh giá an toàn.
Điểm đáng chú ý
- Quy mô: 2,8 nghìn tỷ tham số tổng cộng, 104 tỷ tham số được kích hoạt trong mỗi lượt xử lý.
- Kiến trúc thưa: K3 chọn 16 trong số 896 chuyên gia định tuyến cho mỗi token, theo thẻ mô hình của Moonshot.
- Đa phương thức: mô hình tiếp nhận văn bản và hình ảnh, với ngữ cảnh tối đa hơn một triệu token.
- Điều kiện triển khai: mã và trọng số dùng giấy phép Kimi K3; cấu hình vận hành đầy đủ được khuyến nghị ở quy mô từ 64 bộ tăng tốc.
Hiệu năng vẫn cần được kiểm chứng độc lập
Associated Press cho biết K3 đứng đầu bảng đánh giá năng lực lập trình giao diện của Arena trong giai đoạn ra mắt. Tuy vậy, đây chỉ là một lát cắt. Axios lưu ý kết quả ban đầu và các màn trình diễn lan truyền có thể phóng đại mức độ ổn định của mô hình trong công việc thực tế.
Ngay trong báo cáo, Moonshot cũng nói hiệu năng tổng thể của K3 vẫn đứng sau các mô hình đóng mạnh nhất mà hãng đưa vào bộ so sánh. Nhiều điểm đánh giá chuẩn được công bố bằng bộ công cụ và mức suy luận khác nhau, nên không nên đọc chúng như một bảng xếp hạng tuyệt đối.
Điều này có ý nghĩa gì?
Sự kiện đáng chú ý không chỉ nằm ở con số 2,8 nghìn tỷ tham số, mà ở việc một mô hình sát nhóm dẫn đầu đã chuyển từ tuyên bố “sẽ mở” sang trạng thái có thể tải và kiểm tra. Điều đó tạo thêm dữ liệu cho cộng đồng đánh giá kiến trúc, chất lượng suy luận, khả năng tinh chỉnh và chi phí triển khai thực tế.
Trong ngắn hạn, K3 phù hợp hơn với phòng thí nghiệm, nhà cung cấp hạ tầng và doanh nghiệp có cụm tăng tốc lớn. Với nhóm nhỏ, giá trị trước mắt nằm ở hệ sinh thái công cụ, các bản triển khai tối ưu và kết quả kiểm thử độc lập sẽ xuất hiện sau khi trọng số được phổ biến rộng hơn. Câu hỏi quan trọng vì thế không phải K3 có “thắng” một mô hình nào trên một bảng điểm, mà là nó có đủ ổn định, kinh tế và phù hợp giấy phép cho từng bài toán cụ thể hay không.
Nguồn tham khảo
- Moonshot AI — Kimi K3 model card và trọng số, cập nhật ngày 27/7/2026, truy cập ngày 28/7/2026.
- Moonshot AI — Kimi K3: Open Frontier Intelligence, công bố ngày 27/7/2026, truy cập ngày 28/7/2026.
- Moonshot AI — Kimi K3 Tech Blog, công bố ngày 16/7/2026, truy cập ngày 28/7/2026.
- Associated Press — Chinese AI model takes US tech industry by surprise, công bố ngày 17/7/2026, truy cập ngày 28/7/2026.
- Axios — China's open-weight Kimi model stuns AI world, công bố ngày 16/7/2026, truy cập ngày 28/7/2026.