Kimi K3 là gì: mô hình AI mã nguồn mở 2.800 tỷ tham số
Moonshot AI vừa phát hành Kimi K3, mô hình ngôn ngữ lớn dùng kiến trúc Mixture-of-Experts với 2.800 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token và khả năng nhận đầu vào đa phương thức. Đây là mô hình có trọng số mở lớn nhất từng được công bố, đứng đầu bảng xếp hạng lập trình front-end và đặt ra câu hỏi mới về khoảng cách giữa AI mã nguồn mở và các mô hình đóng hàng đầu.
Kimi K3 là mô hình trọng số mở lớn nhất tính đến hiện tại. Nguồn: YouTube
Kimi K3 của Moonshot AI ra mắt ngày 16/7/2026, dùng kiến trúc Mixture-of-Experts với 2.800 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token và đầu vào đa phương thức. Mô hình đạt 1.679 điểm trên Frontend Code Arena của Arena.ai, xếp số 1 và vượt Claude Fable 5 (1.631 điểm). Trên bảng tổng hợp Artificial Analysis, K3 đứng thứ 3 sau Claude Fable 5 và GPT-5.6 Sol. Moonshot cam kết mở toàn bộ trọng số ngày 27/7/2026 theo giấy phép Modified MIT, cho phép tự lưu trữ và tùy biến.
Moonshot AI vừa phát hành Kimi K3, mô hình ngôn ngữ lớn mới nhất của công ty và nhanh chóng trở thành tâm điểm của giới công nghệ toàn cầu. Ra mắt ngày 16/7/2026, Kimi K3 dùng kiến trúc thưa Mixture-of-Experts với tổng cộng 2.800 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token và khả năng nhận đầu vào đa phương thức. Con số tham số này đưa K3 trở thành mô hình có trọng số mở lớn nhất từng được công bố, vượt qua mọi mô hình mã nguồn mở trước đó về quy mô.
| Nhà phát triển | Moonshot AI (Trung Quốc) |
| Kiến trúc | Mixture-of-Experts thưa |
| Tham số | 2.800 tỷ |
| Ngữ cảnh | 1 triệu token |
| Ngày ra mắt | 16/7/2026 |
| Mở trọng số | 27/7/2026, giấy phép Modified MIT |
Kimi K3 mạnh đến đâu trên các bài kiểm tra
Điểm gây chú ý nhất của Kimi K3 nằm ở mảng lập trình. Trên bảng xếp hạng Frontend Code Arena của nền tảng Arena.ai, nơi lập trình viên chấm mù các đoạn mã giao diện do nhiều mô hình tạo ra, Kimi K3 đạt 1.679 điểm và vươn lên vị trí số 1. Con số này vượt qua Claude Fable 5 của Anthropic với 1.631 điểm, một khoảng cách đủ lớn để giới quan sát coi là bước tiến thực chất chứ không chỉ là sai số. Ngoài ra, K3 còn dẫn đầu ở hai bài kiểm tra chuyên về kỹ thuật phần mềm là SWE Marathon và Program Bench.
Tuy vậy, cần đặt các con số này vào bối cảnh đầy đủ. Trên bảng tổng hợp năng lực chung Artificial Analysis, vốn cân nhắc nhiều khía cạnh từ suy luận, kiến thức tới toán học, Kimi K3 chỉ xếp thứ 3, đứng sau Claude Fable 5 và GPT-5.6 Sol của OpenAI. Nói cách khác, thế mạnh của K3 tập trung rõ ở mảng viết mã và xây dựng giao diện, trong khi các mô hình đóng hàng đầu vẫn nhỉnh hơn ở năng lực tổng quát. Đây cũng là xu hướng chung của làn sóng mô hình Trung Quốc mà chúng tôi từng đề cập trong bài phân tích cuộc đua GPT-5.6, Gemini và Claude nửa cuối 2026.
Kimi K3 được thử nghiệm và so sánh với các mô hình hàng đầu. Nguồn: YouTube
Kiến trúc Mixture-of-Experts và cửa sổ 1 triệu token
Kiến trúc thưa Mixture-of-Experts là chìa khóa giúp Kimi K3 đạt quy mô 2.800 tỷ tham số mà vẫn khả thi về chi phí vận hành. Thay vì kích hoạt toàn bộ tham số cho mỗi lượt tính toán, mô hình chỉ huy động một nhóm nhỏ các chuyên gia phù hợp với từng truy vấn. Cách làm này cho phép tăng tổng dung lượng tri thức của mô hình mà không làm chi phí suy luận tăng theo cấp số nhân, một hướng đi đang được nhiều phòng thí nghiệm lớn theo đuổi.
Cửa sổ ngữ cảnh 1 triệu token là điểm cộng đáng kể cho các tác vụ thực tế. Với dung lượng này, mô hình có thể đọc trọn một kho mã nguồn cỡ vừa, một tập tài liệu dài hay nhiều tệp cùng lúc trước khi trả lời, thay vì chỉ nhìn thấy vài trang văn bản. Khả năng nhận đầu vào đa phương thức, tức xử lý được cả hình ảnh lẫn văn bản, mở rộng phạm vi ứng dụng sang phân tích ảnh chụp màn hình, sơ đồ hay giao diện. So với thế hệ trước từng được tích hợp vào công cụ lập trình như đã phân tích trong bài về Kimi K2.7 Code và GitHub Copilot, K3 là bước nhảy rõ rệt cả về quy mô lẫn phạm vi.
Mã nguồn mở: điểm khác biệt lớn nhất
Yếu tố khiến Kimi K3 khác biệt so với các đối thủ hàng đầu không chỉ nằm ở điểm số. Moonshot AI cam kết công bố toàn bộ trọng số của mô hình vào ngày 27/7/2026 theo giấy phép Modified MIT, một trong những giấy phép cởi mở nhất hiện nay. Khi đó, bất kỳ nhà phát triển hay tổ chức nào cũng có thể tải về, kiểm tra cách mô hình hoạt động, chỉnh sửa và tự lưu trữ trên hạ tầng của mình. Đây là điều mà GPT-5.6 hay Claude không cho phép, khi các mô hình này chỉ truy cập được qua API và giữ kín trọng số.
Với doanh nghiệp quan tâm tới quyền kiểm soát dữ liệu và khả năng tùy biến sâu, một mô hình mở đạt trình độ gần với nhóm dẫn đầu là lựa chọn hấp dẫn. Tuy nhiên, quy mô 2.800 tỷ tham số cũng đồng nghĩa chi phí phần cứng để tự vận hành là rất lớn, đòi hỏi nhiều GPU cao cấp và hạ tầng chuyên dụng. Vì vậy, với phần lớn tổ chức, phương án thực tế vẫn là gọi qua API của các nền tảng cung cấp, hoặc dùng các bản chưng cất nhỏ gọn hơn khi Moonshot phát hành. Người dùng nên cân nhắc kỹ giữa chi phí, độ trễ và mức độ riêng tư trước khi chọn cách triển khai.
Ý nghĩa với cuộc đua AI và người dùng Việt
Sự xuất hiện của Kimi K3 làm nóng lại tranh luận về khoảng cách giữa AI Trung Quốc và Mỹ. Trong bối cảnh Mỹ siết chặt việc xuất khẩu chip AI cao cấp, việc một phòng thí nghiệm Trung Quốc tung ra mô hình trọng số mở lớn nhất và đứng đầu một bảng xếp hạng lập trình cho thấy nỗ lực tối ưu để làm nhiều hơn với nguồn lực tính toán hạn chế. Nhiều nhà quan sát cho rằng mỗi tuần các mô hình đóng chậm cập nhật là một cơ hội để phe mã nguồn mở thu hẹp khoảng cách.
Với người dùng và lập trình viên Việt Nam, tác động trực tiếp nhất là thêm một lựa chọn chất lượng cao cho các tác vụ viết mã, dựng giao diện và xử lý tài liệu dài. Khi trọng số được mở, cộng đồng có thể tạo ra các bản tinh chỉnh cho tiếng Việt hoặc cho từng lĩnh vực cụ thể. Dù vậy, người dùng phổ thông vẫn nên nhìn nhận thực tế rằng bảng xếp hạng chỉ phản ánh một phần năng lực, và trải nghiệm thật còn phụ thuộc vào cách triển khai, chi phí và độ ổn định. Để hiểu rõ hơn bức tranh mô hình đóng đang cạnh tranh ra sao, bạn có thể tham khảo thêm bài về Google Gemini 3.5 Pro với cửa sổ 2 triệu token.
Nhìn tổng thể, Kimi K3 là một cột mốc đáng chú ý của phong trào AI mã nguồn mở năm 2026, vừa lập kỷ lục về quy mô vừa chứng minh mô hình mở có thể cạnh tranh sòng phẳng ở những mảng nhất định. Câu hỏi còn lại là chi phí vận hành thực tế và mức độ phổ biến sau khi trọng số được công bố. LongTechVision sẽ tiếp tục theo dõi và cập nhật khi Moonshot AI phát hành trọng số cũng như các bản chưng cất nhỏ hơn của mô hình này.