Models

Khám phá giá, năng lực, endpoint và phạm vi nhà cung cấp của mô hình AI trong một catalog sản xuất.

Moonshot

Kimi K3

kimi-k3

Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

16 thg 7, 2026

Đầu vào$2.8571 / triệu token
Đầu ra$14.2857 / triệu token
Đọc cache$0.2857 / triệu token

OpenAI

GPT-5.5

gpt-5.5

GPT-5.5 được các nguồn nhấn mạnh ở các điểm: frontier OpenAI model, stronger lập trình/nghiên cứu/phân tích dữ liệu profile. Giá trị chính của mô hình nằm ở broad professional intelligence and có cấu trúc công việc tri thức. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

23 thg 4, 2026

Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro được các nguồn nhấn mạnh ở các điểm: MoE 1.6T tổng / 49B kích hoạt, 1M-token ngữ cảnh, hybrid ngữ cảnh dài attention. Giá trị chính của mô hình nằm ở nâng cao suy luận, lập trình, toàn bộ codebase phân tích and dài hạn quy trình agent. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

24 thg 4, 2026

Đầu vào$1.8 / triệu token
Đầu ra$3.5 / triệu token
Đọc cache$0.015 / triệu token

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash được các nguồn nhấn mạnh ở các điểm: MoE 284B tổng / 13B kích hoạt, 1M-token ngữ cảnh, suy luận tối ưu thông lượng. Giá trị chính của mô hình nằm ở khối lượng lớn lệnh gọi production, nhanh ngữ cảnh dài xử lý and nhạy cảm chi phí tự động hóa. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

24 thg 4, 2026

Đầu vào$0.15 / triệu token
Đầu ra$0.3 / triệu token
Đọc cache$0.003 / triệu token

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus được các nguồn nhấn mạnh ở các điểm: text+image input, vision-language upgrade, hybrid agent capability. Giá trị chính của mô hình nằm ở tác vụ GUI, điều hướng di động, tham chiếu hình ảnh quy trình and hiệu quả chi phí Qwen3.7 use. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

64K

Ngày phát hành

2 thg 6, 2026

Đầu vào$0.2857 / triệu token
Đầu ra$1.1429 / triệu token
Đọc cache$0.0571 / triệu token

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1 được các nguồn nhấn mạnh ở các điểm: improved lập trình, instruction following and long ngữ cảnh versus earlier GPT-4 generation. Giá trị chính của mô hình nằm ở công cụ lập trình viên, hỗ trợ lập trình and instruction-heavy tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

32.8K

Ngày phát hành

14 thg 4, 2025

Đầu vào$2 / triệu token
Đầu ra$8 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini được các nguồn nhấn mạnh ở các điểm: nhanher/lower-cost GPT-4.1 variant. Giá trị chính của mô hình nằm ở khối lượng lớn developer features, có cấu trúc generation and trích xuất. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

32.8K

Ngày phát hành

14 thg 4, 2025

Đầu vào$0.4 / triệu token
Đầu ra$1.6 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-4o

gpt-4o

GPT-4o được các nguồn nhấn mạnh ở các điểm: đa phương thức GPT-4o flagship, text/image input and broad general intelligence. Giá trị chính của mô hình nằm ở vision-language applications, tương tác tự nhiên and general assistant tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

128K

Đầu ra tối đa

16.4K

Ngày phát hành

13 thg 5, 2024

Đầu vào$2.5 / triệu token
Đầu ra$10 / triệu token
Đọc cache$1.25 / triệu token

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini được các nguồn nhấn mạnh ở các điểm: small affordable GPT-4o model with text/image input and có cấu trúc output support. Giá trị chính của mô hình nằm ở lightweight đa phương thức production, fine-tuning, distillation and focused tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

128K

Đầu ra tối đa

16.4K

Ngày phát hành

18 thg 7, 2024

Đầu vào$0.15 / triệu token
Đầu ra$0.6 / triệu token
Đọc cache$0.075 / triệu token

OpenAI

GPT-5.3 Chat

gpt-5.3-chat

gpt-5.3-chat là tên API của GPT-5.3 Instant, snapshot ChatGPT được thiết kế để hội thoại hằng ngày mượt hơn, trực tiếp hơn và hữu ích hơn. OpenAI mô tả phiên bản này là cải thiện độ chính xác, ngữ cảnh khi tìm kiếm web và nhịp hội thoại, đồng thời giảm các cảnh báo, vòng vo và cách diễn đạt quá thận trọng không cần thiết. Tài liệu API đánh dấu mô hình này là deprecated.

Ngữ cảnh tối đa

128K

Đầu ra tối đa

16.4K

Ngày phát hành

3 thg 3, 2026

Đầu vào$1.75 / triệu token
Đầu ra$14 / triệu token
Đọc cache$0.175 / triệu token

OpenAI

GPT-5.3 Codex

gpt-5.3-codex

gpt-5.3-codex là mô hình agentic coding của OpenAI cho Codex và các môi trường phát triển tương tự. Mô hình kết hợp năng lực kỹ thuật phần mềm tiên tiến với suy luận rộng hơn và kiến thức chuyên môn, hỗ trợ reasoning effort có thể cấu hình, cửa sổ ngữ cảnh 400K và tối đa 128K token đầu ra. OpenAI định vị nó vượt ra ngoài viết/review code, hướng tới thao tác máy tính, terminal workflow và tác vụ kỹ thuật dài hạn.

Ngữ cảnh tối đa

400K

Đầu ra tối đa

128K

Ngày phát hành

5 thg 2, 2026

Đầu vào$1.75 / triệu token
Đầu ra$14 / triệu token
Đọc cache$0.175 / triệu token

OpenAI

GPT-5.4

gpt-5.4

GPT-5.4 được các nguồn nhấn mạnh ở các điểm: frontier work model, native computer use, tài liệu/bảng tính/thuyết trình, large ngữ cảnh. Giá trị chính của mô hình nằm ở professional productivity, lập trình, phân tích thực kiện and real work execution. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

5 thg 3, 2026

Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.25 / triệu token

OpenAI

GPT-5.4 Mini

gpt-5.4-mini

GPT-5.4 Mini được các nguồn nhấn mạnh ở các điểm: smaller/nhanher GPT-5.4 variant with dùng công cụ and đa phương thức suy luận. Giá trị chính của mô hình nằm ở độ trễ thấp production tasks, sub-agent and well-scoped lập trình quy trình. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

400K

Đầu ra tối đa

128K

Ngày phát hành

17 thg 3, 2026

Đầu vào$0.75 / triệu token
Đầu ra$4.5 / triệu token
Đọc cache$0.075 / triệu token

OpenAI

GPT-5.4 Nano

gpt-5.4-nano

GPT-5.4 Nano được các nguồn nhấn mạnh ở các điểm: smallest/lowest-cost GPT-5.4 option. Giá trị chính của mô hình nằm ở phân loại, định tuyến, trích xuất and predictable khối lượng lớn generation. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

400K

Đầu ra tối đa

128K

Ngày phát hành

17 thg 3, 2026

Đầu vào$0.2 / triệu token
Đầu ra$1.25 / triệu token
Đọc cache$0.02 / triệu token

OpenAI

GPT-5.4 Pro

gpt-5.4-pro

GPT-5.4 Pro được các nguồn nhấn mạnh ở các điểm: higher-precision GPT-5.4 tier. Giá trị chính của mô hình nằm ở demanding phân tích, complex code and high-stakes professional outputs. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

5 thg 3, 2026

Đầu vào$30 / triệu token
Đầu ra$180 / triệu token

OpenAI

GPT-5.5 Pro

gpt-5.5-pro

GPT-5.5 Pro được các nguồn nhấn mạnh ở các điểm: higher-compute GPT-5.5 tier, precision-first suy luận. Giá trị chính của mô hình nằm ở difficult công việc chuyên nghiệp, lập trình, nghiên cứu, phân tích dữ liệu and nhiều tài liệu tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

23 thg 4, 2026

Đầu vào$30 / triệu token
Đầu ra$180 / triệu token

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna là phiên bản đa năng của dòng Luna, phù hợp cho các ứng dụng AI hàng ngày. Có thể dùng cho hỏi đáp trò chuyện, viết lại văn bản, tóm tắt, trích xuất thông tin, suy luận đơn giản, hỗ trợ lập trình và tự động hóa văn phòng. Luna là lựa chọn thực tế cho nguyên mẫu, tính năng kinh doanh nhẹ, xử lý nội dung hàng loạt và các tình huống tương tác người dùng phổ biến. Đây là mô hình khởi đầu tốt khi tốc độ, sự đơn giản và kiểm soát chi phí là quan trọng; đối với các tác vụ đòi hỏi chất lượng cao hơn hoặc đầu ra ổn định hơn, bạn có thể cân nhắc Luna Pro.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro là phiên bản nâng cao của dòng Luna, nhằm cung cấp câu trả lời chất lượng cao hơn, tuân thủ hướng dẫn ổn định hơn và hoàn thành nhiệm vụ mạnh mẽ hơn. Phù hợp với các cuộc hội thoại phức tạp, tạo nội dung, hỏi đáp kiến thức, phân tích kinh doanh, hỗ trợ lập trình và các tác vụ tự động hóa nhiều bước. Luna Pro rất thích hợp cho các trải nghiệm sản phẩm coi trọng chất lượng đầu ra và trải nghiệm người dùng, chẳng hạn như trợ lý viết chuyên nghiệp, trợ lý AI doanh nghiệp, hỗ trợ khách hàng, hệ thống cơ sở tri thức và quy trình làm việc của tác nhân. Đây là lựa chọn tốt khi nhiệm vụ yêu cầu độ tin cậy cao hơn so với mô hình Luna tiêu chuẩn.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol là phiên bản tiêu chuẩn của dòng Sol. Nó phù hợp cho các tác vụ hỏi đáp chung, xử lý văn bản, soạn thảo nội dung, tóm tắt, hỗ trợ lập trình nhẹ và tự động hóa doanh nghiệp. Sol được thiết kế cho các kịch bản cần năng lực tổng quát vững chắc nhưng vẫn đảm bảo hiệu quả phản hồi và chi phí hợp lý. Có thể dùng cho tính năng sản phẩm, trợ lý trò chuyện, công cụ tạo nội dung, làm sạch dữ liệu, hỏi đáp từ cơ sở tri thức và tác vụ xử lý hàng loạt. Đối với triển khai quy mô lớn hoặc tạo mẫu nhanh, Sol là điểm khởi đầu linh hoạt.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro là phiên bản Pro của dòng Sol, được thiết kế cho các tác vụ phức tạp và đầu ra chất lượng cao hơn. Phù hợp cho viết nâng cao, hỏi đáp chính xác, suy luận kinh doanh, tạo mã, phân tích có cấu trúc và thực hiện tác vụ đa vòng. Sol Pro phù hợp với những tác vụ yêu cầu độ chính xác cao hơn, hiểu ngữ cảnh và hoàn thành hướng dẫn. Có thể sử dụng cho sản xuất nội dung chuyên nghiệp, trợ lý phân tích dữ liệu, hệ thống hỏi đáp tri thức, quy trình làm việc tác nhân phức tạp và các công cụ AI nội bộ doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra là phiên bản đa năng của dòng Terra. Nó phù hợp cho hội thoại hàng ngày, tạo văn bản, tóm tắt, trích xuất thông tin, suy luận nhẹ và hỗ trợ lập trình. Terra mang lại sự cân bằng thực tế giữa khả năng chung, hiệu quả phản hồi và chi phí. Nó có thể được dùng cho trợ lý trò chuyện, công cụ nội dung, tự động hóa văn phòng, hỏi đáp kho tri thức và quy trình xử lý văn bản hàng loạt. Với các ứng dụng cần lặp nhanh hoặc nhạy cảm về chi phí, Terra là lựa chọn mặc định mạnh mẽ trong dòng Terra.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.275 / triệu token

Gợi ý mô hình phổ biến

Bắt đầu với các mô hình nổi bật trong danh mục trực tiếp, rồi mở trang chi tiết để so sánh context, endpoint và giá hiệu dụng.

Moonshot

Kimi K3

Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.

Ngữ cảnh tối đa

1M

Giá đầu vào

$2.8571 / triệu token

Xem mô hình

OpenAI

GPT-5.5

GPT-5.5 được các nguồn nhấn mạnh ở các điểm: frontier OpenAI model, stronger lập trình/nghiên cứu/phân tích dữ liệu profile. Giá trị chính của mô hình nằm ở broad professional intelligence and có cấu trúc công việc tri thức. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$5 / triệu token

Xem mô hình

DeepSeek

DeepSeek V4 Pro

DeepSeek V4 Pro được các nguồn nhấn mạnh ở các điểm: MoE 1.6T tổng / 49B kích hoạt, 1M-token ngữ cảnh, hybrid ngữ cảnh dài attention. Giá trị chính của mô hình nằm ở nâng cao suy luận, lập trình, toàn bộ codebase phân tích and dài hạn quy trình agent. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Giá đầu vào

$1.8 / triệu token

Xem mô hình

DeepSeek

DeepSeek V4 Flash

DeepSeek V4 Flash được các nguồn nhấn mạnh ở các điểm: MoE 284B tổng / 13B kích hoạt, 1M-token ngữ cảnh, suy luận tối ưu thông lượng. Giá trị chính của mô hình nằm ở khối lượng lớn lệnh gọi production, nhanh ngữ cảnh dài xử lý and nhạy cảm chi phí tự động hóa. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Giá đầu vào

$0.15 / triệu token

Xem mô hình

Alibaba

Qwen3.7 Plus

Qwen3.7 Plus được các nguồn nhấn mạnh ở các điểm: text+image input, vision-language upgrade, hybrid agent capability. Giá trị chính của mô hình nằm ở tác vụ GUI, điều hướng di động, tham chiếu hình ảnh quy trình and hiệu quả chi phí Qwen3.7 use. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Giá đầu vào

$0.2857 / triệu token

Xem mô hình

OpenAI

GPT-4.1

GPT-4.1 được các nguồn nhấn mạnh ở các điểm: improved lập trình, instruction following and long ngữ cảnh versus earlier GPT-4 generation. Giá trị chính của mô hình nằm ở công cụ lập trình viên, hỗ trợ lập trình and instruction-heavy tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Giá đầu vào

$2 / triệu token

Xem mô hình

So sánh mô hình

So sánh nhanh với các mô hình lân cận được chọn trong danh mục.

FAQ danh mục mô hình

Hướng dẫn nhanh để chọn, so sánh và sử dụng mô hình trong danh mục TokenHub.

Nên chọn mô hình trong danh sách này như thế nào?

+

Hãy bắt đầu từ workload của bạn. Dùng bộ lọc theo nhà cung cấp, tag, loại endpoint và nhóm tính phí, sau đó so sánh context, giới hạn output, modality và giá input hoặc output.

Giá hiệu dụng nghĩa là gì?

+

Giá hiệu dụng áp dụng tỷ lệ của nhóm tính phí hiện tại vào dữ liệu giá của mô hình. Nó giúp ước tính chi phí input, output hoặc mỗi request thực tế cho nhóm bạn đang dùng.

Có thể dùng các mô hình này qua API endpoint không?

+

Có. Mở trang chi tiết mô hình để xem loại endpoint được hỗ trợ và liên kết tài liệu. Khả dụng có thể khác nhau theo mô hình, nhà cung cấp và cấu hình routing hiện tại.

Vì sao context window và max output quan trọng?

+

Context window quyết định lượng prompt và lịch sử hội thoại mà mô hình có thể đọc. Max output quyết định lượng nội dung có thể tạo trong một phản hồi, quan trọng với viết dài, coding và tài liệu.