Đánh giá Kimi K3: Điểm chuẩn, Giá API và Bản demo cộng đồng
Kimi K3 là mô hình chủ lực 2.8 nghìn tỷ tham số của Moonshot AI dành cho lập trình dài hạn, công việc tri thức, suy luận đa phương thức và các tác vụ agent. Bài đánh giá này bao gồm các thông số kỹ thuật, điểm chuẩn Kimi K3, giá API, thiết lập TokenHub và OpenCode, các bản demo cộng đồng và so sánh tập trung với Claude Fable 5, Opus 4.8 và GLM-5.2.
Phiên bản ngắn gọn: Cửa sổ ngữ cảnh 1 triệu token của Kimi K3, khả năng thị giác gốc và kết quả benchmark ban đầu khiến nó đáng để thử nghiệm cho các mã nguồn lớn, tài liệu dài, phát triển trực quan và nghiên cứu. Quyết định sản xuất vẫn nên phụ thuộc vào chất lượng tác vụ, độ trễ, chi phí và độ tin cậy trong quy trình làm việc của bạn.
Truy cập nhanh: Dùng thử Kimi K3 qua TokenHub bằng một khóa API duy nhất và một điểm cuối tương thích OpenAI.

Kimi K3 là gì?
Được phát hành vào ngày 16 tháng 7 năm 2026, Kimi K3 là mô hình mạnh mẽ nhất của Moonshot AI tính đến thời điểm đánh giá này. Thiết kế Mixture-of-Experts thưa thớt của nó kích hoạt 16 trong số 896 chuyên gia cho mỗi token thay vì sử dụng toàn bộ 2,8 nghìn tỷ tham số cho mọi yêu cầu. Kimi Delta Attention và Attention Residuals được thiết kế để cải thiện hiệu quả trên các chuỗi dài và độ sâu mô hình.

Thông số kỹ thuật và chi tiết ra mắt của Kimi K3
| Thông số kỹ thuật | Kimi K3 |
|---|---|
| Nhà phát triển | Moonshot AI |
| Ngày phát hành | July 16, 2026 |
| Kiến trúc | Hỗn hợp chuyên gia thưa |
| Tổng số tham số | 2.8 trillion |
| Cấu hình chuyên gia | 16 trong số 896 chuyên gia được kích hoạt cho mỗi token. |
| Cửa sổ ngữ cảnh | Lên đến 1,048,576 token |
| Phương thức nhập liệu gốc | Văn bản, hình ảnh và ngữ cảnh hình ảnh/video |
| Các tác vụ chính | Lập trình, nghiên cứu, công việc tri thức, agent, tài liệu dài |
| Các mức độ suy luận | Thấp, cao và tối đa, tùy thuộc vào phương thức truy cập |
| ID mô hình TokenHub | kimi-k3 |
| Đầu ra tối đa của TokenHub | 131.1K tokens |
| Các endpoint của TokenHub | /v1/chat/completions và /v1/messages |
| Bản phát hành đầy đủ trọng số | Được lên lịch vào ngày 27 tháng 7 năm 2026 |
Moonshot cho biết kiến trúc mới và công thức huấn luyện mới mang lại hiệu quả mở rộng tổng thể tốt hơn khoảng 2.5 lần so với Kimi K2. Kimi K3 cũng sử dụng huấn luyện nhận biết lượng tử hóa với trọng số MXFP4 và kích hoạt MXFP8. Mặc dù có kích hoạt thưa, việc tự lưu trữ một mô hình có kích thước này vẫn là một dự án nặng về hạ tầng thay vì một thiết lập local-LLM điển hình.
Điểm chuẩn Kimi K3: Những con số ban đầu cho thấy điều gì
Trang mô hình TokenHub hiện liệt kê các chỉ số sau đây lấy từ Artificial Analysis:
| Chuẩn đánh giá | Điểm số Kimi K3 | Đo lường điều gì |
|---|---|---|
| Artificial Analysis Intelligence Index | 57.1/100 | Năng lực mô hình tổng quát |
| Artificial Analysis Coding Index | 76.2/100 | Lập trình và kỹ thuật phần mềm |
| GPQA | 93.5% | Lập luận khoa học trình độ sau đại học |
| HLE | 44.3% | Kiến thức chuyên gia rộng rãi |
| SciCode | 58.7% | Lập trình Python khoa học |
| AA-LCR | 74.7% | Suy luận ngữ cảnh dài |
Đánh giá ra mắt của Moonshot cũng báo cáo 88.3 trên Terminal-Bench 2.1, 91.2 trên BrowseComp, 95.0 trên DeepSearchQA và 93.5% trên GPQA Diamond. Các điểm số này cho thấy các thế mạnh dự kiến của mô hình, nhưng Kimi K3 thường được thử nghiệm ở mức nỗ lực suy luận tối đa, và một số so sánh mô hình sử dụng các bộ khung tác nhân khác nhau. Hãy coi sự khác biệt nhỏ về điểm số là chỉ mang tính định hướng chứ không phải bằng chứng về sự vượt trội tuyệt đối.
Cách sử dụng Kimi K3 trên TokenHub
Đối với các nhà phát triển đang hỏi cách sử dụng Kimi K3 mà không cần tạo thêm một tích hợp riêng cho nhà cung cấp, TokenHub cung cấp mô hình này thông qua cổng API thống nhất của mình.
1. Tạo không gian làm việc TokenHub
Mở bảng điều khiển TokenHub và tạo không gian làm việc bằng xác thực email hoặc Google.
2. Thêm số dư sử dụng
TokenHub sử dụng số dư không gian làm việc dùng chung trên các nhà cung cấp và mô hình được hỗ trợ. Thêm đủ số dư cho khối lượng công việc thử nghiệm mà bạn định chạy.
3. Tạo khóa API TokenHub
Tạo khóa cổng trong bảng điều khiển TokenHub. Lưu khóa dưới dạng biến môi trường thay vì nhúng cứng nó vào ứng dụng của bạn.
export TOKENHUB_API_KEY="YOUR_TOKENHUB_API_KEY"4. Gửi yêu cầu với OpenAI SDK
TokenHub cung cấp API tương thích OpenAI. Mã SDK OpenAI hiện có có thể sử dụng Kimi K3 bằng cách thay đổi URL gốc, khóa API và ID mô hình.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://us-api.tokenhub.com/v1",
api_key=os.environ["TOKENHUB_API_KEY"],
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[
{
"role": "user",
"content": "Review this function and identify any concurrency bugs.",
}
],
)
print(response.choices[0].message.content)Trên TokenHub, định danh mô hình là kimi-k3. Đừng thay thế nó bằng k3 được sử dụng trong một số tích hợp Kimi Code trừ khi tài liệu điểm cuối hướng dẫn cụ thể bạn làm như vậy.
TokenHub cũng liệt kê một tương thích Anthropic /v1/messages đường dẫn. Sử dụng điểm cuối và phong cách SDK phù hợp với phần còn lại của ứng dụng của bạn.
Sử dụng Kimi K3 với OpenCode
Kimi K3 có thể hỗ trợ OpenCode thông qua Kimi For Coding đăng nhập hoặc thông qua TokenHub. Đường dẫn chính thức sử dụng khóa API Kimi và ID mô hình k3; đường dẫn TokenHub bên dưới sử dụng khóa API TokenHub và kimi-k3.
Thiết lập Kimi K3 OpenCode qua TokenHub
Vì TokenHub cung cấp điểm cuối tương thích với OpenAI, nó có thể được thêm làm nhà cung cấp OpenCode tùy chỉnh. Đầu tiên, hãy lưu khóa API một cách an toàn:
export TOKENHUB_API_KEY="YOUR_TOKENHUB_API_KEY"Sau đó, thêm nhà cung cấp tùy chỉnh vào opencode.json:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"tokenhub": {
"npm": "@ai-sdk/openai-compatible",
"name": "TokenHub",
"options": {
"baseURL": "https://us-api.tokenhub.com/v1",
"apiKey": "{env:TOKENHUB_API_KEY}"
},
"models": {
"kimi-k3": {
"name": "Kimi K3",
"limit": {
"context": 1048576,
"output": 131072
}
}
}
}
}
}Khởi động OpenCode và chạy /models để chọn TokenHub / Kimi K3. Cấu hình nhà cung cấp của OpenCode có thể thay đổi, vì vậy hãy xác nhận cú pháp nhà cung cấp tùy chỉnh hiện tại trong tài liệu OpenCode nếu mô hình không xuất hiện.
Kimi K3 – Các màn trình diễn cộng đồng
Các dự án cộng đồng mang lại cái nhìn cụ thể hơn về những gì mọi người đang thử nghiệm với Kimi K3 so với chỉ riêng bảng điểm chuẩn. Những ví dụ này là các bản trình diễn chứ không phải đánh giá có kiểm soát: lời nhắc ban đầu, số lần lặp, chỉnh sửa thủ công, công cụ và công việc lưu trữ có thể không được ghi chép công khai.
Tạo trang Front-End: Trải nghiệm web Windows XP
Một bài đăng được chia sẻ rộng rãi bài đăng X của AB Kuai.Dong nêu bật bản tái tạo Windows XP dựa trên trình duyệt được cho là được xây dựng bằng Kimi K3. Bài đăng liên kết đến windows-xp.kimi.site và hiển thị màn hình Windows XP quen thuộc với các cửa sổ tương tác. Video đi kèm minh họa Grand Theft Auto: Vice City chạy bên trong trải nghiệm web và cho biết dự án cũng có thể chạy Command & Conquer: Red Alert 2.
Tác giả của bài đăng giới thiệu dự án như một bước tiến xa hơn một trang web kiểu macOS do cộng đồng tạo ra. Tại thời điểm được xem xét, bài đăng trên X hiển thị khoảng 441,000 lượt xem, 2,489 lượt thích và 1,013 lượt đánh dấu, cho thấy sự quan tâm lớn đối với khả năng tạo giao diện người dùng của Kimi K3.
Những gì màn trình diễn thể hiện
- Tái tạo giao diện hệ điều hành máy tính để bàn dễ nhận biết
- Nhiều cửa sổ phân lớp và các trạng thái giao diện người dùng tương tác
- Tích hợp trải nghiệm trò chơi có thể chơi hoặc phát trực tiếp bên trong trang web
- Khả năng phối hợp thiết kế trực quan, logic ứng dụng và một cơ sở mã front-end lớn hơn
Điều mà nó không chứng minh
Bài đăng công khai không tiết lộ toàn bộ lịch sử prompt, mã nguồn, số lần tạo, các chỉnh sửa thủ công, hoặc liệu có mô hình và công cụ khác đóng góp hay không. Do đó, nó nên được xem như một bản giới thiệu cộng đồng về phát triển front-end có sự hỗ trợ của Kimi K3—không phải là một bài đánh giá độc lập về Kimi K3 hay bằng chứng rằng mô hình đã tạo ra toàn bộ dự án trong một lần thử.
Tạo cảnh 3D tương tác: Môi trường hồ nước
Một bài đăng cộng đồng từ gimu trình bày một môi trường hồ 3D được tạo ra như một phần của quá trình thử nghiệm hiệu suất Kimi K3 của tác giả. Video giới thiệu một cảnh quan có thể điều hướng với mặt nước phản chiếu, cây cối rậm rạp, núi non bao quanh và bảng điều chỉnh khí quyển trên màn hình để điều chỉnh các thiết lập môi trường.
Người tạo cho biết chất lượng của cảnh hồ, rừng và núi đã vượt quá mong đợi của họ và kết luận rằng kết quả tốt hơn so với thử nghiệm hồ Claude Fable 5 trước đó được bao gồm trong cùng bài đăng. Tại thời điểm xem xét, bài đăng Kimi K3 đã hiển thị khoảng 212,000 lượt xem, 1,268 lượt thích và 555 lượt đánh dấu.
Kết luận “tốt hơn Fable 5” là đánh giá chủ quan của người tạo. Bài đăng không công bố phương pháp chấm điểm chuẩn hóa, toàn bộ prompt, mã nguồn, cài đặt tạo, hoặc lượng công việc thủ công liên quan, vì vậy nó không nên được coi là một bài đánh giá có kiểm soát giữa Kimi K3 và Fable 5.
Quy trình thiết kế web: Từ nghiên cứu trực quan đến trang đích hoàn chỉnh
Trong một hướng dẫn cộng đồng do Viktor Oddy chia sẻ, Kimi K3 được sử dụng trong một quy trình làm việc kéo dài khoảng 13 phút để tạo ra một trang web mà tác giả mô tả là “đoạt giải thưởng”. Video cho thấy người sáng tạo thu thập các tài liệu tham khảo trực quan và thực hiện quy trình thiết kế trước khi trình bày một ý tưởng trang đích trau chuốt với kiểu chữ đậm, hình minh họa đơn sắc tinh tế, điều hướng rõ ràng và các lời kêu gọi hành động nổi bật.
Đây là một bản trình diễn thiết kế web Kimi K3 hữu ích vì nó trình bày nhiều hơn một ảnh chụp màn hình cuối cùng. Video cho thấy người sáng tạo thu thập các tài liệu tham khảo trực quan và thực hiện quy trình thiết kế trước khi trình bày một ý tưởng trang đích trau chuốt với kiểu chữ đậm, hình minh họa đơn sắc tinh tế, điều hướng rõ ràng và các lời kêu gọi hành động nổi bật.
Tại thời điểm xem xét, bài đăng hiển thị khoảng 107,000 lượt xem, 1,689 lượt thích và 2,223 lượt lưu. Số lượt lưu cao bất thường cho thấy độc giả thấy hướng dẫn này hữu ích như một quy trình làm việc lặp lại thay vì chỉ là một bản demo trực quan.
Kimi K3 so với Claude, Fable 5, Opus 4.8 và GLM-5.2
Bảng này cung cấp bối cảnh hỗ trợ cho bài đánh giá. Các bản demo cộng đồng và điểm chuẩn là những tín hiệu hữu ích, nhưng các quyết định sản xuất vẫn yêu cầu thử nghiệm có kiểm soát trên khối lượng công việc của riêng bạn.
| Mô hình | Định vị chính | Ngữ cảnh | Tính mở | Điểm mạnh nổi bật | Lưu ý chính |
|---|---|---|---|---|---|
| Kimi K3 | Lập trình đa phương thức, tác tử và công việc tri thức | Lên đến 1M | Công bố phát hành trọng số mở | Quy trình tác nhân ngữ cảnh dài và thị giác | Mô hình mới với bằng chứng sản xuất dài hạn hạn chế |
| Claude Fable 5 | Công việc lập trình và chuyên môn khó khăn, liên tục | Kiểm tra hạng truy cập hiện tại | Đóng | Công việc tri thức cao cấp và các tác vụ chạy dài | Nền tảng đóng và định vị cao cấp |
| Claude Opus 4.8 | Lập trình và suy luận tiên phong | Kiểm tra tài liệu API hiện tại | Đã đóng | Hiệu suất lập trình agentic trưởng thành | Chi phí và sự phụ thuộc vào nhà cung cấp |
| GLM-5.2 | Mô hình kỹ thuật mở tầm xa | 1M | Trọng số theo giấy phép MIT | Nỗ lực linh hoạt và triển khai mở | Theo sau các mô hình đóng mạnh nhất ở một số bài kiểm tra lập trình khó. |
Kimi K3 so với Fable 5
Đối với các tìm kiếm như “Kimi K3 so với Fable hoặc Kimi K3 so với Fable 5, Định vị khi ra mắt của Moonshot cho biết Fable 5 vẫn mạnh hơn về tổng thể. Kimi K3 có thể hấp dẫn hơn khi trọng số mở, cửa sổ ngữ cảnh 1M được ghi nhận, phát triển đa phương thức hoặc chi phí API được chú trọng; hãy thử nghiệm cả hai trên quy trình làm việc mục tiêu thay vì cho rằng một mô hình thắng mọi tác vụ.
Kimi K3 so với Claude
“Kimi K3 so với Claude” là một so sánh rộng vì Claude bao gồm nhiều phân khúc mô hình. Claude có hệ sinh thái trưởng thành và quy trình lập trình đã được thiết lập, trong khi Kimi K3 nhấn mạnh trọng số mở, thị giác nguyên bản, ngữ cảnh 1M và các tác vụ đại lý chạy dài. So sánh tỷ lệ thành công, độ trễ, độ tin cậy của công cụ và chi phí cho mỗi tác vụ hoàn thành—không chỉ giá token.
Kimi K3 so với Opus 4.8
Trong Kimi K3 so với Opus 4.8, Opus là lựa chọn đã được khẳng định hơn trong sản xuất cho kỹ thuật phần mềm tiên tiến và suy luận tác nhân. Kimi K3 cạnh tranh sát sao hoặc dẫn đầu trong một số điểm chuẩn khi ra mắt, nhưng đây là lựa chọn mới hơn cho các đội ngũ ưu tiên ngữ cảnh dài, đa phương thức và tính mở của mô hình cao hơn.
Kimi K3 so với GLM-5.2
Sự Kimi K3 so với GLM 5.2 so sánh là phù hợp vì cả hai đều nhắm đến công việc dài hạn và hỗ trợ ngữ cảnh 1M-token. GLM-5.2 cung cấp trọng số được cấp phép MIT và các mức nỗ lực có thể chọn; Kimi K3 lớn hơn nhiều và nhấn mạnh vào thị giác gốc và công việc tri thức rộng hơn. Báo cáo ra mắt của họ liệt kê 81.0 và 88.3 tương ứng trên Terminal-Bench 2.1, nhưng các chi tiết đánh giá khác nhau ngăn việc coi khoảng cách đó là kết quả đối đầu trực tiếp rõ ràng.
Giá API Kimi K3: API chính thức so với TokenHub
Giá API Kimi K3 phụ thuộc vào nơi mô hình được truy cập.
| Phương thức truy cập | Đầu vào trên 1M token | Đầu ra trên 1M token | Đầu vào/đọc cache trên 1M token |
|---|---|---|---|
| API Kimi chính thức | $3.00 | $15.00 | $0.30 |
| TokenHub | $2.8571 | $14.2857 | $0.2857 |
TokenHub hiện liệt kê mức giá hiệu dụng thấp hơn một chút so với API Kimi chính thức. Giá có thể thay đổi, vì vậy hãy kiểm tra trang mô hình trực tiếp trước khi tính ngân sách sản xuất.
Ví dụ: một yêu cầu TokenHub sử dụng 100,000 token đầu vào không được lưu vào bộ nhớ đệm và 20,000 token đầu ra sẽ có chi phí khoảng:
- Đầu vào:
0.1 × $2.8571 = $0.28571 - Đầu ra:
0.02 × $14.2857 = $0.285714 - Tổng ước tính: khoảng
$0.57
Nếu cùng 100,000 token đầu vào đó được tính phí như các lần đọc bộ nhớ đệm, phần đầu vào sẽ giảm xuống còn khoảng $0.02857. Chi phí tác tử thực tế có thể cao hơn vì suy luận, kết quả công cụ, thử lại và lịch sử hội thoại dài làm tăng mức tiêu thụ token.
Ưu điểm của Kimi K3
- Ngữ cảnh 1M-token cho các kho lưu trữ lớn và bộ sưu tập tài liệu
- Thị giác nguyên bản cho ảnh chụp màn hình, giao diện và phát triển trực quan
- Kết quả ban đầu mạnh mẽ trong lập trình, tìm kiếm, suy luận và đánh giá ngữ cảnh dài
- Các route tương thích OpenAI và Anthropic qua TokenHub
- Bộ nhớ đệm ngữ cảnh và bản phát hành trọng số mở đã được công bố
Hạn chế của Kimi K3
- Lịch sử sản xuất hạn chế và sự phụ thuộc lớn vào các đánh giá trong giai đoạn ra mắt
- Kết quả thay đổi tùy theo nỗ lực suy luận, công cụ và khung tác tử
- Suy luận sâu và ngữ cảnh dài có thể làm tăng độ trễ và tổng chi phí
- Tự lưu trữ một mô hình 2,8 nghìn tỷ tham số đòi hỏi cơ sở hạ tầng đáng kể
- Các tác tử sử dụng ngữ cảnh dài và công cụ vẫn cần kiểm tra truy xuất, phân quyền, ghi nhật ký và xem xét của con người
Ai Nên Thử Nghiệm Kimi K3?
Kimi K3 phù hợp nhất cho:
- Các nhà phát triển làm việc với kho lưu trữ lớn hoặc tác tử lập trình
- Các nhà nghiên cứu tổng hợp các bộ tài liệu dài
- Các nhóm front-end tạo mã từ tài liệu tham khảo trực quan
- Các ứng dụng tái sử dụng ngữ cảnh đã lưu trong bộ nhớ đệm nhiều lần
- Các nhóm đánh giá các giải pháp thay thế trọng số mở thông qua cổng tương thích với OpenAI
Có thể không cần thiết cho các tác vụ ngắn như phân loại, trích xuất hoặc trò chuyện thông thường mà một mô hình nhỏ hơn và rẻ hơn có thể xử lý.
Câu hỏi thường gặp
Làm cách nào để sử dụng Kimi K3?
Sử dụng Kimi K3 thông qua các ứng dụng của Kimi, API chính thức, Kimi Code, OpenCode hoặc TokenHub. Trên TokenHub, tạo khóa API và gọi kimi-k3 thông qua https://us-api.tokenhub.com/v1.
Kimi K3 có miễn phí không?
Kimi cung cấp gói thành viên miễn phí, nhưng việc sử dụng K3 dựa trên tín dụng và giới hạn truy cập phụ thuộc vào gói hiện tại. Việc sử dụng API không miễn phí: cả API Kimi chính thức và TokenHub đều tính phí theo token. TokenHub yêu cầu số dư sử dụng cho các yêu cầu mô hình trả phí trừ khi có khuyến mãi riêng hoặc tín dụng dùng thử được cung cấp một cách rõ ràng.
Tôi có thể lấy khóa API Kimi K3 ở đâu?
Để truy cập trực tiếp Moonshot, hãy tạo khóa API trong bảng điều khiển Kimi API. Để truy cập Kimi K3 cùng với các mô hình từ các nhà cung cấp khác, hãy tạo khóa API TokenHub trong không gian làm việc TokenHub. Các khóa này thuộc về các dịch vụ khác nhau và không thể thay thế cho nhau.
Kimi K3 sử dụng ID mô hình nào?
TokenHub sử dụng kimi-k3. Một số tích hợp Kimi Code và Kimi For Coding sử dụng k3. Luôn sử dụng định danh được ghi trong tài liệu của endpoint bạn đang gọi.
Kimi K3 có hoạt động với OpenCode không?
Có. Sử dụng đăng nhập chính thức của Kimi For Coding hoặc cấu hình TokenHub như một nhà cung cấp tương thích OpenAI tùy chỉnh với kimi-k3 ID mô hình.
Phán quyết cuối cùng: Bạn có nên thử Kimi K3?
Thông số kỹ thuật của Kimi K3, các điểm chuẩn ban đầu và các dự án cộng đồng cho thấy việc thử nghiệm nó trên các khối lượng công việc đòi hỏi cao là hợp lý. Màn trình diễn Windows XP minh họa tiềm năng giao diện người dùng của nó, nhưng đánh giá sản xuất vẫn nên đo lường mức độ thành công của tác vụ, các tuyên bố không được hỗ trợ, độ trễ, mức sử dụng token, độ tin cậy của công cụ và mức độ cần chỉnh sửa thủ công.
Dùng thử Kimi K3 trên TokenHub và chạy nó trên kho lưu trữ, tài liệu, hình ảnh hoặc quy trình tác nhân của riêng bạn bằng một khóa API thống nhất.