Mô hình

Khám phá giá, năng lực, endpoint và phạm vi nhà cung cấp của mô hình AI trong một catalog sản xuất.

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol là một mô hình suy luận tiên tiến được xây dựng cho việc giải quyết vấn đề phức tạp, lập trình và các ứng dụng dựa trên tác nhân. Nó được thiết kế để mang lại hiệu suất suy luận mạnh mẽ trong khi duy trì sự cân bằng thực tế giữa trí tuệ, tốc độ và chi phí. Khác với các mô hình trò chuyện truyền thống chủ yếu tập trung vào việc tạo phản hồi, GPT-6.1 Sol được tối ưu hóa cho các tác vụ cần suy nghĩ sâu hơn, bao gồm suy luận nhiều bước, tạo mã, gỡ lỗi, phân tích dữ liệu và tuân theo các hướng dẫn phức tạp. GPT-6.1 Sol hỗ trợ các quy trình suy luận đáng tin cậy, đầu ra có cấu trúc và các ứng dụng dựa trên công cụ, phù hợp cho nhà phát triển xây dựng trợ lý AI, tác nhân lập trình, hệ thống tự động hóa và ứng dụng AI trong môi trường production.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

29 thg 9, 2026

Đầu vào$2 / triệu token
Đầu ra$10 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro là phiên bản lý luận được nâng cấp của GPT-6.1 Sol. Nó sử dụng cùng mô hình nền tảng như GPT-6.1 Sol nhưng bật reasoning.mode=pro, cho phép mô hình dành nhiều tính toán hơn đáng kể cho mỗi yêu cầu. Ngân sách lý luận bổ sung giúp GPT-6.1 Sol Pro xử lý các vấn đề khó hơn đòi hỏi phân tích sâu hơn, lập kế hoạch dài hơn và độ chính xác cao hơn. Nó được thiết kế cho các tác vụ mà việc có được câu trả lời tốt nhất có thể quan trọng hơn tốc độ phản hồi hoặc hiệu quả chi phí. So với GPT-6.1 Sol, GPT-6.1 Sol Pro tiêu thụ nhiều token lý luận hơn đáng kể cho mỗi yêu cầu, dẫn đến chi phí sử dụng cao hơn và thời gian phản hồi lâu hơn.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

29 thg 9, 2026

Đầu vào$2 / triệu token
Đầu ra$10 / triệu token
Đọc cache$0.1 / triệu token

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5 là mô hình AI thế hệ mới được thiết kế cho suy luận nâng cao, lập trình, phân tích và các quy trình tác tử phức tạp. Mô hình đạt hiệu năng cao trong phát triển phần mềm, hiểu ngữ cảnh dài, tác vụ đa phương thức và công việc tri thức chuyên nghiệp, mang lại sự cân bằng giữa trí tuệ, tốc độ và hiệu quả. Với khả năng suy luận được tăng cường và tuân thủ chỉ dẫn tốt hơn, Claude Sonnet 5.5 vượt trội trong việc viết và gỡ lỗi mã, phân tích tài liệu phức tạp, giải quyết bài toán nhiều bước và vận hành các AI agent cần ra quyết định đáng tin cậy cùng khả năng sử dụng công cụ.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

28 thg 9, 2026

Đầu vào$2 / triệu token
Đầu ra$10 / triệu token
Đọc cache$0.2 / triệu token

xAI

Grok 4.7

grok-4.7

Grok 4.7 là mô hình thế hệ mới nhất của xAI, được thiết kế cho các tác vụ lập trình khó, suy luận phức tạp và ứng dụng chuyên sâu về tri thức. Mô hình cải thiện khả năng giải quyết vấn đề dài hạn, tự kiểm chứng và thực thi quy trình, phù hợp với nhà phát triển xây dựng trợ lý thông minh và sản phẩm ứng dụng AI. Grok 4.7 thể hiện hiệu năng mạnh mẽ trong lập trình, phân tích và các tác vụ AI đa dụng, đồng thời duy trì hiệu quả cạnh tranh cho triển khai sản xuất.

Ngữ cảnh tối đa

500K

Đầu ra tối đa

500K

Ngày phát hành

21 thg 9, 2026

Đầu vào$1.6 / triệu token
Đầu ra$4.8 / triệu token
Đọc cache$0.4 / triệu token

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5 là mô hình trí tuệ hàng đầu của Anthropic, được thiết kế cho những khối lượng công việc khắt khe đòi hỏi khả năng suy luận sâu, độ tin cậy cao và thực thi tác vụ dài hạn. Mô hình đạt hiệu năng mạnh mẽ trong kỹ thuật phần mềm, quy trình tác tử, phân tích chuyên môn và các tác vụ đòi hỏi nhiều kiến thức. Với hiệu quả được cải thiện và các biện pháp bảo vệ được tăng cường, Claude Opus 5.5 được tối ưu hóa cho các nhà phát triển xây dựng ứng dụng AI tinh vi cần hiệu năng ổn định xuyên suốt các tác vụ phức tạp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

22 thg 9, 2026

Đầu vào$4 / triệu token
Đầu ra$20 / triệu token
Đọc cache$0.2 / triệu token

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol là mô hình hiệu năng cao thuộc dòng GPT-6 của OpenAI, được thiết kế cho các tác vụ suy luận phức tạp, phát triển phần mềm và quy trình làm việc AI chuyên nghiệp. Mô hình mang lại trí tuệ vượt trội cho việc giải quyết vấn đề nhiều bước, lập trình nâng cao, phân tích dữ liệu và các ứng dụng dựa trên agent. GPT-6 Sol kết hợp khả năng suy luận mạnh mẽ với tốc độ suy luận hiệu quả, phù hợp với các nhà phát triển cần hiệu năng tiên tiến cho hệ thống AI trong môi trường sản xuất.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

22 thg 9, 2026

Đầu vào$2 / triệu token
Đầu ra$10 / triệu token
Đọc cache$0.2 / triệu token

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro là biến thể suy luận nâng cao của GPT-6 Sol, được thiết kế cho các tác vụ cần phân tích sâu hơn, độ chính xác cao hơn và thực thi đa bước đáng tin cậy hơn. Với khả năng suy luận được tăng cường, GPT-6 Sol Pro mang lại hiệu năng mạnh mẽ hơn trong kỹ thuật phần mềm, quy trình làm việc phức tạp, phân tích dữ liệu và ứng dụng tác nhân AI. Mô hình được tối ưu hóa cho các nhà phát triển xây dựng hệ thống AI tiên tiến cần kết quả nhất quán trên các tác vụ khó. GPT-6 Sol Pro hỗ trợ xử lý ngữ cảnh dài, gọi công cụ và đầu ra có cấu trúc, phù hợp cho các ứng dụng cấp sản xuất cần khả năng suy luận và tự động hóa mạnh mẽ.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

22 thg 9, 2026

Đầu vào$2 / triệu token
Đầu ra$10 / triệu token
Đọc cache$0.2 / triệu token

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna là mô hình nhỏ gọn và hiệu quả thuộc dòng GPT-6 của OpenAI, được thiết kế để mang lại trí tuệ ngôn ngữ mạnh mẽ với hiệu quả chi phí được cải thiện đáng kể. Mô hình cung cấp hiệu suất đáng tin cậy cho các ứng dụng AI hằng ngày, bao gồm AI hội thoại, tạo nội dung, hỗ trợ lập trình và quy trình tự động hóa. Với cửa sổ ngữ cảnh lớn và hiệu quả suy luận được tối ưu hóa, GPT-6 Luna lý tưởng cho các nhà phát triển xây dựng sản phẩm AI có khả năng mở rộng, đòi hỏi thông lượng cao, độ trễ thấp và chi phí vận hành có thể dự đoán.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

22 thg 9, 2026

Đầu vào$0.1 / triệu token
Đầu ra$0.5 / triệu token
Đọc cache$0.01 / triệu token

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro là phiên bản tối ưu hóa suy luận của GPT-6 Luna, được thiết kế để cung cấp khả năng giải quyết vấn đề mạnh mẽ hơn trong khi vẫn duy trì hiệu quả và mức chi phí hợp lý của dòng Luna. Nó cải thiện hiệu suất trên các hướng dẫn phức tạp, tác vụ lập trình, quy trình phân tích và ứng dụng tác nhân nhẹ so với các mô hình suy luận nhanh tiêu chuẩn. GPT-6 Luna Pro lý tưởng cho các nhà phát triển cần phản hồi chất lượng cao hơn mà vẫn đảm bảo khả năng mở rộng cho khối lượng công việc sản xuất. Với hỗ trợ xử lý ngữ cảnh dài, gọi hàm và đầu ra có cấu trúc, GPT-6 Luna Pro mang đến giải pháp cân bằng giữa trí tuệ, tốc độ và hiệu quả chi phí.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

22 thg 9, 2026

Đầu vào$0.1 / triệu token
Đầu ra$0.5 / triệu token
Đọc cache$0.01 / triệu token

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash là mô hình đa phương thức toàn diện thế hệ mới thuộc dòng Qwen của Alibaba, được thiết kế để hiểu và xử lý văn bản, hình ảnh, âm thanh và video trong một hệ thống AI thống nhất. Mô hình kết hợp trí tuệ ngôn ngữ mạnh mẽ với khả năng hiểu đa phương thức tiên tiến cho các ứng dụng AI thực tế. Với cửa sổ ngữ cảnh lên đến 1M token, Qwen3.8 Omni Flash được tối ưu hóa cho phân tích tài liệu dài, hiểu nội dung đa phương tiện và quy trình làm việc dạng tác tử. Mô hình có thể phân tích nội dung âm thanh và video phức tạp, suy luận trên nhiều phương thức và hỗ trợ gọi công cụ để xây dựng các ứng dụng AI thông minh. Được thiết kế để triển khai hiệu quả cao, Qwen3.8 Omni Flash mang lại sự cân bằng vượt trội giữa trí tuệ đa phương thức, khả năng mở rộng và hiệu quả chi phí, phù hợp cho các nhà phát triển xây dựng trợ lý AI thế hệ mới, hệ thống phân tích nội dung và tác tử tự động hóa.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

17 thg 9, 2026

Đầu vào$0.1143 / triệu token
Đầu ra$0.3857 / triệu token
Đọc cache$0.0143 / triệu token

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13 là mô hình ra quyết định System One đầu tiên của TypeSafe AI, được xây dựng cho phán đoán AI có cấu trúc thay vì tạo văn bản. Mô hình phân tích ngữ cảnh được cung cấp và trả về các lựa chọn có cấu trúc, điểm số và quyết định dựa trên độ tin cậy. Được thiết kế cho quy trình phân loại, định tuyến, đánh giá và tự động hóa, Jev mang lại các quyết định AI nhanh, có thể dự đoán với độ trễ thấp và sử dụng token hiệu quả.

Ngữ cảnh tối đa

32K

Đầu ra tối đa

N/A

Ngày phát hành

18 thg 9, 2026

Đầu vào$0.042 / triệu token
Đầu ra$0 / triệu token

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX là mô hình đa phương thức tốc độ cao của Z.ai, được thiết kế cho suy luận nhanh, phản hồi tốt trong khi vẫn giữ các năng lực cốt lõi của GLM-5.3-Flash. Mô hình hỗ trợ đầu vào văn bản, hình ảnh, video và tệp, với cửa sổ ngữ cảnh lên đến 1 triệu token. Mô hình hoạt động hiệu quả trong lập trình, quy trình tác nhân, hiểu hình ảnh, tác vụ ngữ cảnh dài và suy luận phức tạp, là lựa chọn mạnh mẽ cho các ứng dụng AI thời gian thực đòi hỏi cả tốc độ lẫn trí tuệ.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

18 thg 9, 2026

Đầu vào$0.2857 / triệu token
Đầu ra$1 / triệu token
Đọc cache$0.0814 / triệu token

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash là mô hình AI đa phương thức nhanh và hiệu quả, với khả năng suy luận, lập trình và tác nhân tiên tiến. Hỗ trợ ngữ cảnh lên đến 1 triệu token và khả năng hiểu thị giác nguyên bản, mô hình mang lại trí tuệ tầm tiên phong với chi phí suy luận thấp hơn, lý tưởng cho tác nhân AI, tự động hóa, trợ lý lập trình và ứng dụng có thể mở rộng.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

10 thg 9, 2026

Đầu vào$0.2857 / triệu token
Đầu ra$1.1429 / triệu token
Đọc cache$0.0057 / triệu token

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra là mô hình chủ lực thế hệ mới của OpenAI, được thiết kế cho suy luận phức tạp, kỹ thuật phần mềm, tác tử AI, nghiên cứu và các quy trình làm việc chuyên nghiệp liền mạch có yêu cầu cao. Mô hình vượt trội trong các tác vụ đa bước trên mã nguồn, trình duyệt và phần mềm chuyên nghiệp, mang lại hiệu suất mạnh hơn trong giải quyết vấn đề, sử dụng công cụ, sử dụng máy tính và hiểu ngữ cảnh dài. GPT-6 Astra hỗ trợ cửa sổ ngữ cảnh lên tới 1,05 triệu token và sản lượng tối đa 128K token, với nhiều mức độ nỗ lực suy luận gồm Low, Medium, High, XHigh và Max, giúp nhà phát triển cân bằng khả năng suy luận, hiệu quả và chi phí dựa trên độ phức tạp của tác vụ. Mô hình rất phù hợp cho các tác tử AI tiên tiến, phát triển phần mềm phức tạp, quy trình tự động hóa, nghiên cứu chuyên sâu, xử lý tài liệu dài, phân tích dữ liệu và các ứng dụng AI doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

4 thg 9, 2026

Đầu vào$10 / triệu token
Đầu ra$50 / triệu token
Đọc cache$1 / triệu token

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5 là mô hình hạng Mythos của Anthropic, được thiết kế cho các nhu cầu suy luận phức tạp, kỹ thuật phần mềm, xử lý tri thức, phân tích hình ảnh và nghiên cứu khoa học. Được xây dựng cho các tác vụ tự chủ dài hạn, mô hình có thể duy trì lập kế hoạch và thực thi qua các quy trình phức tạp, phân tích các kho mã nguồn và tài liệu lớn, đồng thời cải tiến kết quả qua nhiều bước. Claude Fable 5 rất phù hợp cho các ứng dụng sản xuất đòi hỏi mã hóa nâng cao, nghiên cứu, phân tích chuyên sâu và hoàn thành tác vụ tự động đáng tin cậy.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

1 thg 9, 2026

Đầu vào$10 / triệu token
Đầu ra$50 / triệu token
Đọc cache$0.25 / triệu token

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flash là mô hình đa phương thức gốc đầu tiên của Z.ai trong dòng GLM-5, được xây dựng để lập trình nhanh, hiểu hình ảnh và quy trình tác tử. Kiến trúc MoE 320B tham số kích hoạt 18B tham số cho mỗi token, kết hợp attention thưa và attention tuyến tính giúp xử lý tác vụ ngữ cảnh dài hiệu quả hơn. Hãy sử dụng GLM API qua TokenHub để đánh giá giá hiện tại, ID mô hình, đầu vào được hỗ trợ, gọi công cụ, giới hạn ngữ cảnh và endpoint của GLM-5.3-Flash trước khi triển khai cho lập trình sản xuất hoặc tác vụ tác tử đa phương thức.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

26 thg 8, 2026

Đầu vào$0.1143 / triệu token
Đầu ra$0.4 / triệu token
Đọc cache$0.0329 / triệu token

Z.ai

GLM-5.3

glm-5.3

GLM-5.3 là mô hình hàng đầu mới nhất của Z.ai, được xây dựng cho lập trình nâng cao, kỹ thuật phần mềm và các tác vụ tác tử dài hạn. Với cửa sổ ngữ cảnh 1M token, lên đến 128K token đầu ra, khả năng suy luận mạnh mẽ và sử dụng công cụ, mô hình này lý tưởng cho tác tử lập trình, quy trình phát triển phức tạp và tự động hóa đa bước.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

19 thg 8, 2026

Đầu vào$1.1429 / triệu token
Đầu ra$4 / triệu token
Đọc cache$0.2857 / triệu token

Tencent

Hy4 preview

hy4-preview

Hy4 preview là mô hình MoE mã nguồn mở thế hệ mới của Tencent Hunyuan, được thiết kế cho các tác vụ năng suất thực tế như lập trình, công việc văn phòng, nghiên cứu khoa học, suy luận ngữ cảnh dài và quy trình tác tử phức tạp. Còn được gọi là Tencent Hy4 preview hoặc Hunyuan 4 preview, mô hình có tổng cộng 770B tham số, kích hoạt 49B tham số cho mỗi token và hỗ trợ cửa sổ ngữ cảnh hơn 1M token. Mô hình nổi bật trong việc hiểu các kho mã và tài liệu lớn, lập kế hoạch nhiều bước, sử dụng công cụ, gỡ lỗi, xác minh và thực thi tác vụ liên tục.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

64K

Ngày phát hành

28 thg 8, 2026

Đầu vào$0.8571 / triệu token
Đầu ra$2.5714 / triệu token
Đọc cache$0.0429 / triệu token

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max là mô hình hàng đầu MoE với 2,4 nghìn tỷ tham số, được thiết kế cho lý luận nâng cao, lập trình và năng suất doanh nghiệp. Mô hình có thể tự động thực hiện các tác vụ phức tạp, kéo dài — từ phát triển phần mềm đến quy trình làm việc chuyên nghiệp — mang lại kết quả cấp sản xuất trong các lĩnh vực như luật, tài chính và thiết kế. Được hỗ trợ bởi trí thông minh đa phương thức bản địa, Qwen3.8-Max hiểu văn bản, hình ảnh và video trong bối cảnh dài, hỗ trợ phân tích sâu các tài liệu mở rộng và nội dung dạng dài. Khả năng tác tử của nó cho phép lập kế hoạch, thực thi, xác minh và lặp lại liên tục một cách tự động trong các quy trình phức tạp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

3 thg 8, 2026

Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.25 / triệu token

Moonshot

Kimi K3

kimi-k3

Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

16 thg 7, 2026

Đầu vào$2.8571 / triệu token
Đầu ra$14.2857 / triệu token
Đọc cache$0.2857 / triệu token

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp là biến thể thử nghiệm hỗ trợ thị giác của DeepSeek V4 Flash 0731, giới thiệu khả năng hiểu hình ảnh trong khi vẫn giữ nguyên hiệu suất văn bản của mô hình gốc, bao gồm khả năng tác tử, suy luận và kiến thức thế giới. Mô hình được xây dựng trên kiến trúc hỗn hợp chuyên gia thưa (MoE) với 284B tham số tổng và 13B tham số kích hoạt.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

21 thg 8, 2026

Đầu vào$0.2857 / triệu token
Đầu ra$1.1429 / triệu token
Đọc cache$0.0057 / triệu token

Gợi ý mô hình phổ biến

Bắt đầu với các mô hình nổi bật trong danh mục trực tiếp, rồi mở trang chi tiết để so sánh context, endpoint và giá hiệu dụng.

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol là một mô hình suy luận tiên tiến được xây dựng cho việc giải quyết vấn đề phức tạp, lập trình và các ứng dụng dựa trên tác nhân. Nó được thiết kế để mang lại hiệu suất suy luận mạnh mẽ trong khi duy trì sự cân bằng thực tế giữa trí tuệ, tốc độ và chi phí. Khác với các mô hình trò chuyện truyền thống chủ yếu tập trung vào việc tạo phản hồi, GPT-6.1 Sol được tối ưu hóa cho các tác vụ cần suy nghĩ sâu hơn, bao gồm suy luận nhiều bước, tạo mã, gỡ lỗi, phân tích dữ liệu và tuân theo các hướng dẫn phức tạp. GPT-6.1 Sol hỗ trợ các quy trình suy luận đáng tin cậy, đầu ra có cấu trúc và các ứng dụng dựa trên công cụ, phù hợp cho nhà phát triển xây dựng trợ lý AI, tác nhân lập trình, hệ thống tự động hóa và ứng dụng AI trong môi trường production.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$2 / triệu token

Xem mô hình

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro là phiên bản lý luận được nâng cấp của GPT-6.1 Sol. Nó sử dụng cùng mô hình nền tảng như GPT-6.1 Sol nhưng bật reasoning.mode=pro, cho phép mô hình dành nhiều tính toán hơn đáng kể cho mỗi yêu cầu. Ngân sách lý luận bổ sung giúp GPT-6.1 Sol Pro xử lý các vấn đề khó hơn đòi hỏi phân tích sâu hơn, lập kế hoạch dài hơn và độ chính xác cao hơn. Nó được thiết kế cho các tác vụ mà việc có được câu trả lời tốt nhất có thể quan trọng hơn tốc độ phản hồi hoặc hiệu quả chi phí. So với GPT-6.1 Sol, GPT-6.1 Sol Pro tiêu thụ nhiều token lý luận hơn đáng kể cho mỗi yêu cầu, dẫn đến chi phí sử dụng cao hơn và thời gian phản hồi lâu hơn.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$2 / triệu token

Xem mô hình

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 là mô hình AI thế hệ mới được thiết kế cho suy luận nâng cao, lập trình, phân tích và các quy trình tác tử phức tạp. Mô hình đạt hiệu năng cao trong phát triển phần mềm, hiểu ngữ cảnh dài, tác vụ đa phương thức và công việc tri thức chuyên nghiệp, mang lại sự cân bằng giữa trí tuệ, tốc độ và hiệu quả. Với khả năng suy luận được tăng cường và tuân thủ chỉ dẫn tốt hơn, Claude Sonnet 5.5 vượt trội trong việc viết và gỡ lỗi mã, phân tích tài liệu phức tạp, giải quyết bài toán nhiều bước và vận hành các AI agent cần ra quyết định đáng tin cậy cùng khả năng sử dụng công cụ.

Ngữ cảnh tối đa

1M

Giá đầu vào

$2 / triệu token

Xem mô hình

xAI

Grok 4.7

Grok 4.7 là mô hình thế hệ mới nhất của xAI, được thiết kế cho các tác vụ lập trình khó, suy luận phức tạp và ứng dụng chuyên sâu về tri thức. Mô hình cải thiện khả năng giải quyết vấn đề dài hạn, tự kiểm chứng và thực thi quy trình, phù hợp với nhà phát triển xây dựng trợ lý thông minh và sản phẩm ứng dụng AI. Grok 4.7 thể hiện hiệu năng mạnh mẽ trong lập trình, phân tích và các tác vụ AI đa dụng, đồng thời duy trì hiệu quả cạnh tranh cho triển khai sản xuất.

Ngữ cảnh tối đa

500K

Giá đầu vào

$1.6 / triệu token

Xem mô hình

Anthropic

Claude Opus 5.5

Claude Opus 5.5 là mô hình trí tuệ hàng đầu của Anthropic, được thiết kế cho những khối lượng công việc khắt khe đòi hỏi khả năng suy luận sâu, độ tin cậy cao và thực thi tác vụ dài hạn. Mô hình đạt hiệu năng mạnh mẽ trong kỹ thuật phần mềm, quy trình tác tử, phân tích chuyên môn và các tác vụ đòi hỏi nhiều kiến thức. Với hiệu quả được cải thiện và các biện pháp bảo vệ được tăng cường, Claude Opus 5.5 được tối ưu hóa cho các nhà phát triển xây dựng ứng dụng AI tinh vi cần hiệu năng ổn định xuyên suốt các tác vụ phức tạp.

Ngữ cảnh tối đa

1M

Giá đầu vào

$4 / triệu token

Xem mô hình

OpenAI

GPT-6 Sol

GPT-6 Sol là mô hình hiệu năng cao thuộc dòng GPT-6 của OpenAI, được thiết kế cho các tác vụ suy luận phức tạp, phát triển phần mềm và quy trình làm việc AI chuyên nghiệp. Mô hình mang lại trí tuệ vượt trội cho việc giải quyết vấn đề nhiều bước, lập trình nâng cao, phân tích dữ liệu và các ứng dụng dựa trên agent. GPT-6 Sol kết hợp khả năng suy luận mạnh mẽ với tốc độ suy luận hiệu quả, phù hợp với các nhà phát triển cần hiệu năng tiên tiến cho hệ thống AI trong môi trường sản xuất.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$2 / triệu token

Xem mô hình

So sánh mô hình

So sánh nhanh với các mô hình lân cận được chọn trong danh mục.

FAQ danh mục mô hình

Hướng dẫn nhanh để chọn, so sánh và sử dụng mô hình trong danh mục TokenHub.

Nên chọn mô hình trong danh sách này như thế nào?

+

Hãy bắt đầu từ workload của bạn. Dùng bộ lọc theo nhà cung cấp, tag, loại endpoint và nhóm tính phí, sau đó so sánh context, giới hạn output, modality và giá input hoặc output.

Giá hiệu dụng nghĩa là gì?

+

Giá hiệu dụng áp dụng tỷ lệ của nhóm tính phí hiện tại vào dữ liệu giá của mô hình. Nó giúp ước tính chi phí input, output hoặc mỗi request thực tế cho nhóm bạn đang dùng.

Có thể dùng các mô hình này qua API endpoint không?

+

Có. Mở trang chi tiết mô hình để xem loại endpoint được hỗ trợ và liên kết tài liệu. Khả dụng có thể khác nhau theo mô hình, nhà cung cấp và cấu hình routing hiện tại.

Vì sao context window và max output quan trọng?

+

Context window quyết định lượng prompt và lịch sử hội thoại mà mô hình có thể đọc. Max output quyết định lượng nội dung có thể tạo trong một phản hồi, quan trọng với viết dài, coding và tài liệu.