Models

Khám phá giá, năng lực, endpoint và phạm vi nhà cung cấp của mô hình AI trong một catalog sản xuất.

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max là mô hình hàng đầu MoE với 2,4 nghìn tỷ tham số, được thiết kế cho lý luận nâng cao, lập trình và năng suất doanh nghiệp. Mô hình có thể tự động thực hiện các tác vụ phức tạp, kéo dài — từ phát triển phần mềm đến quy trình làm việc chuyên nghiệp — mang lại kết quả cấp sản xuất trong các lĩnh vực như luật, tài chính và thiết kế. Được hỗ trợ bởi trí thông minh đa phương thức bản địa, Qwen3.8-Max hiểu văn bản, hình ảnh và video trong bối cảnh dài, hỗ trợ phân tích sâu các tài liệu mở rộng và nội dung dạng dài. Khả năng tác tử của nó cho phép lập kế hoạch, thực thi, xác minh và lặp lại liên tục một cách tự động trong các quy trình phức tạp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

3 thg 8, 2026

Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.25 / triệu token

Moonshot

Kimi K3

kimi-k3

Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

16 thg 7, 2026

Đầu vào$2.8571 / triệu token
Đầu ra$14.2857 / triệu token
Đọc cache$0.2857 / triệu token

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol là phiên bản tiêu chuẩn của dòng Sol. Nó phù hợp cho các tác vụ hỏi đáp chung, xử lý văn bản, soạn thảo nội dung, tóm tắt, hỗ trợ lập trình nhẹ và tự động hóa doanh nghiệp. Sol được thiết kế cho các kịch bản cần năng lực tổng quát vững chắc nhưng vẫn đảm bảo hiệu quả phản hồi và chi phí hợp lý. Có thể dùng cho tính năng sản phẩm, trợ lý trò chuyện, công cụ tạo nội dung, làm sạch dữ liệu, hỏi đáp từ cơ sở tri thức và tác vụ xử lý hàng loạt. Đối với triển khai quy mô lớn hoặc tạo mẫu nhanh, Sol là điểm khởi đầu linh hoạt.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro là phiên bản Pro của dòng Sol, được thiết kế cho các tác vụ phức tạp và đầu ra chất lượng cao hơn. Phù hợp cho viết nâng cao, hỏi đáp chính xác, suy luận kinh doanh, tạo mã, phân tích có cấu trúc và thực hiện tác vụ đa vòng. Sol Pro phù hợp với những tác vụ yêu cầu độ chính xác cao hơn, hiểu ngữ cảnh và hoàn thành hướng dẫn. Có thể sử dụng cho sản xuất nội dung chuyên nghiệp, trợ lý phân tích dữ liệu, hệ thống hỏi đáp tri thức, quy trình làm việc tác nhân phức tạp và các công cụ AI nội bộ doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra là phiên bản đa năng của dòng Terra. Nó phù hợp cho hội thoại hàng ngày, tạo văn bản, tóm tắt, trích xuất thông tin, suy luận nhẹ và hỗ trợ lập trình. Terra mang lại sự cân bằng thực tế giữa khả năng chung, hiệu quả phản hồi và chi phí. Nó có thể được dùng cho trợ lý trò chuyện, công cụ nội dung, tự động hóa văn phòng, hỏi đáp kho tri thức và quy trình xử lý văn bản hàng loạt. Với các ứng dụng cần lặp nhanh hoặc nhạy cảm về chi phí, Terra là lựa chọn mặc định mạnh mẽ trong dòng Terra.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.275 / triệu token

OpenAI

GPT-5.6 Terra Pro

gpt-5.6-terra-pro

GPT-5.6 Terra Pro là phiên bản nâng cao của dòng Terra, được thiết kế để tạo ra đầu ra chất lượng cao trong các tác vụ phức tạp. Phù hợp cho Hỏi đáp nâng cao, sáng tạo nội dung chuyên sâu, phân tích kinh doanh, hỗ trợ lập trình và suy luận nhiều bước. So với phiên bản tiêu chuẩn, Terra Pro phù hợp hơn với các tình huống yêu cầu độ tin cậy cao hơn, lý luận đầy đủ hơn và tuân thủ hướng dẫn tốt hơn. Thích hợp cho viết chuyên nghiệp, tổng hợp thông tin phức tạp, trợ lý dựa trên tri thức, tác tử tự động hóa và các ứng dụng AI cấp doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.275 / triệu token

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna là phiên bản đa năng của dòng Luna, phù hợp cho các ứng dụng AI hàng ngày. Có thể dùng cho hỏi đáp trò chuyện, viết lại văn bản, tóm tắt, trích xuất thông tin, suy luận đơn giản, hỗ trợ lập trình và tự động hóa văn phòng. Luna là lựa chọn thực tế cho nguyên mẫu, tính năng kinh doanh nhẹ, xử lý nội dung hàng loạt và các tình huống tương tác người dùng phổ biến. Đây là mô hình khởi đầu tốt khi tốc độ, sự đơn giản và kiểm soát chi phí là quan trọng; đối với các tác vụ đòi hỏi chất lượng cao hơn hoặc đầu ra ổn định hơn, bạn có thể cân nhắc Luna Pro.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro là phiên bản nâng cao của dòng Luna, nhằm cung cấp câu trả lời chất lượng cao hơn, tuân thủ hướng dẫn ổn định hơn và hoàn thành nhiệm vụ mạnh mẽ hơn. Phù hợp với các cuộc hội thoại phức tạp, tạo nội dung, hỏi đáp kiến thức, phân tích kinh doanh, hỗ trợ lập trình và các tác vụ tự động hóa nhiều bước. Luna Pro rất thích hợp cho các trải nghiệm sản phẩm coi trọng chất lượng đầu ra và trải nghiệm người dùng, chẳng hạn như trợ lý viết chuyên nghiệp, trợ lý AI doanh nghiệp, hỗ trợ khách hàng, hệ thống cơ sở tri thức và quy trình làm việc của tác nhân. Đây là lựa chọn tốt khi nhiệm vụ yêu cầu độ tin cậy cao hơn so với mô hình Luna tiêu chuẩn.

Ngữ cảnh tối đa

1.1M

Đầu ra tối đa

128K

Ngày phát hành

9 thg 7, 2026

Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro được các nguồn nhấn mạnh ở các điểm: MoE 1.6T tổng / 49B kích hoạt, 1M-token ngữ cảnh, hybrid ngữ cảnh dài attention. Giá trị chính của mô hình nằm ở nâng cao suy luận, lập trình, toàn bộ codebase phân tích and dài hạn quy trình agent. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

24 thg 4, 2026

Đầu vào$1.2857 / triệu token
Đầu ra$3.8571 / triệu token
Đọc cache$0.0429 / triệu token

Z.ai

GLM-5.2

glm-5.2

GLM-5.2 là mô hình nền tảng flagship của Z.ai cho các tác vụ kỹ thuật dài hạn. Mô hình nhấn mạnh cửa sổ ngữ cảnh 1M token có thể sử dụng thực tế, phù hợp để xử lý mã nguồn, tài liệu và bối cảnh hệ thống ở cấp độ dự án. Nó hướng tới toàn bộ quy trình phát triển, từ phân tích yêu cầu, hiểu repository đến triển khai, kiểm thử và phát hành đa nền tảng.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

131.1K

Ngày phát hành

13 thg 6, 2026

Đầu vào$1.1429 / triệu token
Đầu ra$4 / triệu token
Đọc cache$0.2857 / triệu token

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash được các nguồn nhấn mạnh ở các điểm: MoE 284B tổng / 13B kích hoạt, 1M-token ngữ cảnh, suy luận tối ưu thông lượng. Giá trị chính của mô hình nằm ở khối lượng lớn lệnh gọi production, nhanh ngữ cảnh dài xử lý and nhạy cảm chi phí tự động hóa. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

384K

Ngày phát hành

24 thg 4, 2026

Đầu vào$0.4286 / triệu token
Đầu ra$1.2857 / triệu token
Đọc cache$0.0143 / triệu token

Anthropic

Claude Opus 5

claude-opus-5

Claude Opus 5 là mô hình chủ lực của Anthropic dành cho các tác vụ suy luận, lập trình và công việc đại diện dài hạn đòi hỏi khắt khe. Mô hình đặc biệt mạnh trong các tác vụ phần mềm từ đầu đến cuối, đánh giá mã và tìm lỗi, phân tích trực quan biểu đồ và tài liệu, các sản phẩm văn phòng phức tạp và điều phối các tác nhân phụ song song. Mô hình duy trì khả năng tuân thủ hướng dẫn và sử dụng công cụ mạnh mẽ trong các tác vụ kéo dài, đồng thời vẫn hiệu quả ở các cài đặt nỗ lực thấp hơn cho khối lượng công việc ưu tiên độ trễ và hiệu quả token.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

24 thg 7, 2026

Đầu vào$5 / triệu token
Đầu ra$25 / triệu token
Đọc cache$0.5 / triệu token

Anthropic

Claude Opus 5 Fast

claude-opus-5-fast

Biến thể chế độ nhanh của Opus 5 - khả năng tương tự với tốc độ xuất cao hơn, giá gấp đôi so với Opus 5 thông thường. Tìm hiểu thêm trong tài liệu của Anthropic: https://platform.claude.com/docs/en/build-with-claude/fast-mode

Ngữ cảnh tối đa

1M

Đầu ra tối đa

128K

Ngày phát hành

24 thg 7, 2026

Đầu vào$10 / triệu token
Đầu ra$50 / triệu token
Đọc cache$1 / triệu token

xAI

Grok 4.6

grok-4.6

Grok 4.6 là mô hình suy luận tiên tiến của xAI, được xây dựng cho lập trình phức tạp, các tác vụ tác tử chạy lâu và công việc tri thức. Mô hình hỗ trợ nhập văn bản và hình ảnh, cửa sổ ngữ cảnh lên tới 500 nghìn token, và cường độ suy luận có thể tùy chỉnh (thấp/trung bình/cao/rất cao). Với khả năng gọi hàm, tìm kiếm web và X, thực thi mã và đầu ra có cấu trúc, Grok 4.6 được tối ưu hóa cho việc phân tích trên nhiều mã nguồn, sử dụng công cụ đa bước liên tục, tự xác minh và quy trình kỹ thuật đầu cuối. Đây là mô hình suy luận và tác tử đa dụng, không chỉ đơn thuần là chatbot gắn với nền tảng X.

Ngữ cảnh tối đa

500K

Đầu ra tối đa

500K

Ngày phát hành

12 thg 8, 2026

Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.3 / triệu token

Google

Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash là mô hình hiệu quả cao từ Google dành cho lập trình, quy trình tác nhân và phát triển web và ứng dụng. Nó được thiết kế để tạo ra đầu ra tinh gọn với ít chỉnh sửa không cần thiết và ít mơ hồ hơn, đồng thời giảm mức sử dụng token và số lần gọi mô hình cần thiết để hoàn thành tác vụ.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

65.5K

Ngày phát hành

21 thg 7, 2026

Đầu vào$1.5 / triệu token
Đầu ra$7.5 / triệu token
Đọc cache$0.15 / triệu token

xAI

Grok 4.5

grok-4.5

Grok 4.5 là mô hình suy luận của xAI dành cho lập trình, tác vụ tác nhân và công việc tri thức. Mô hình hỗ trợ đầu vào văn bản và hình ảnh, ngữ cảnh lên đến 500.000 token, và cường độ suy luận có thể cấu hình (thấp/trung bình/cao). Nó hỗ trợ gọi hàm, tìm kiếm web và X, thực thi mã và đầu ra có cấu trúc, phù hợp cho phân tích ngữ cảnh dài, gọi công cụ nhiều bước và quy trình kỹ thuật đầu cuối. Không nên chỉ coi đây là chatbot gắn với nền tảng X.

Ngữ cảnh tối đa

500K

Đầu ra tối đa

500K

Ngày phát hành

8 thg 7, 2026

Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.3 / triệu token

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus được các nguồn nhấn mạnh ở các điểm: text+image input, vision-language upgrade, hybrid agent capability. Giá trị chính của mô hình nằm ở tác vụ GUI, điều hướng di động, tham chiếu hình ảnh quy trình and hiệu quả chi phí Qwen3.7 use. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

64K

Ngày phát hành

2 thg 6, 2026

Đầu vào$0.2857 / triệu token
Đầu ra$1.1429 / triệu token
Đọc cache$0.0571 / triệu token

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1 được các nguồn nhấn mạnh ở các điểm: improved lập trình, instruction following and long ngữ cảnh versus earlier GPT-4 generation. Giá trị chính của mô hình nằm ở công cụ lập trình viên, hỗ trợ lập trình and instruction-heavy tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

32.8K

Ngày phát hành

14 thg 4, 2025

Đầu vào$2 / triệu token
Đầu ra$8 / triệu token
Đọc cache$0.5 / triệu token

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini được các nguồn nhấn mạnh ở các điểm: nhanher/lower-cost GPT-4.1 variant. Giá trị chính của mô hình nằm ở khối lượng lớn developer features, có cấu trúc generation and trích xuất. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

1M

Đầu ra tối đa

32.8K

Ngày phát hành

14 thg 4, 2025

Đầu vào$0.4 / triệu token
Đầu ra$1.6 / triệu token
Đọc cache$0.1 / triệu token

OpenAI

GPT-4o

gpt-4o

GPT-4o được các nguồn nhấn mạnh ở các điểm: đa phương thức GPT-4o flagship, text/image input and broad general intelligence. Giá trị chính của mô hình nằm ở vision-language applications, tương tác tự nhiên and general assistant tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

128K

Đầu ra tối đa

16.4K

Ngày phát hành

13 thg 5, 2024

Đầu vào$2.5 / triệu token
Đầu ra$10 / triệu token
Đọc cache$1.25 / triệu token

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini được các nguồn nhấn mạnh ở các điểm: small affordable GPT-4o model with text/image input and có cấu trúc output support. Giá trị chính của mô hình nằm ở lightweight đa phương thức production, fine-tuning, distillation and focused tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Ngữ cảnh tối đa

128K

Đầu ra tối đa

16.4K

Ngày phát hành

18 thg 7, 2024

Đầu vào$0.15 / triệu token
Đầu ra$0.6 / triệu token
Đọc cache$0.075 / triệu token

Gợi ý mô hình phổ biến

Bắt đầu với các mô hình nổi bật trong danh mục trực tiếp, rồi mở trang chi tiết để so sánh context, endpoint và giá hiệu dụng.

Alibaba

Qwen3.8 Max

Qwen3.8-Max là mô hình hàng đầu MoE với 2,4 nghìn tỷ tham số, được thiết kế cho lý luận nâng cao, lập trình và năng suất doanh nghiệp. Mô hình có thể tự động thực hiện các tác vụ phức tạp, kéo dài — từ phát triển phần mềm đến quy trình làm việc chuyên nghiệp — mang lại kết quả cấp sản xuất trong các lĩnh vực như luật, tài chính và thiết kế. Được hỗ trợ bởi trí thông minh đa phương thức bản địa, Qwen3.8-Max hiểu văn bản, hình ảnh và video trong bối cảnh dài, hỗ trợ phân tích sâu các tài liệu mở rộng và nội dung dạng dài. Khả năng tác tử của nó cho phép lập kế hoạch, thực thi, xác minh và lặp lại liên tục một cách tự động trong các quy trình phức tạp.

Ngữ cảnh tối đa

1M

Giá đầu vào

$2 / triệu token

Xem mô hình

Moonshot

Kimi K3

Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.

Ngữ cảnh tối đa

1M

Giá đầu vào

$2.8571 / triệu token

Xem mô hình

OpenAI

GPT-5.6 Sol

GPT-5.6 Sol là phiên bản tiêu chuẩn của dòng Sol. Nó phù hợp cho các tác vụ hỏi đáp chung, xử lý văn bản, soạn thảo nội dung, tóm tắt, hỗ trợ lập trình nhẹ và tự động hóa doanh nghiệp. Sol được thiết kế cho các kịch bản cần năng lực tổng quát vững chắc nhưng vẫn đảm bảo hiệu quả phản hồi và chi phí hợp lý. Có thể dùng cho tính năng sản phẩm, trợ lý trò chuyện, công cụ tạo nội dung, làm sạch dữ liệu, hỏi đáp từ cơ sở tri thức và tác vụ xử lý hàng loạt. Đối với triển khai quy mô lớn hoặc tạo mẫu nhanh, Sol là điểm khởi đầu linh hoạt.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$5 / triệu token

Xem mô hình

OpenAI

GPT-5.6 Sol Pro

GPT-5.6 Sol Pro là phiên bản Pro của dòng Sol, được thiết kế cho các tác vụ phức tạp và đầu ra chất lượng cao hơn. Phù hợp cho viết nâng cao, hỏi đáp chính xác, suy luận kinh doanh, tạo mã, phân tích có cấu trúc và thực hiện tác vụ đa vòng. Sol Pro phù hợp với những tác vụ yêu cầu độ chính xác cao hơn, hiểu ngữ cảnh và hoàn thành hướng dẫn. Có thể sử dụng cho sản xuất nội dung chuyên nghiệp, trợ lý phân tích dữ liệu, hệ thống hỏi đáp tri thức, quy trình làm việc tác nhân phức tạp và các công cụ AI nội bộ doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$5 / triệu token

Xem mô hình

OpenAI

GPT-5.6 Terra

GPT-5.6 Terra là phiên bản đa năng của dòng Terra. Nó phù hợp cho hội thoại hàng ngày, tạo văn bản, tóm tắt, trích xuất thông tin, suy luận nhẹ và hỗ trợ lập trình. Terra mang lại sự cân bằng thực tế giữa khả năng chung, hiệu quả phản hồi và chi phí. Nó có thể được dùng cho trợ lý trò chuyện, công cụ nội dung, tự động hóa văn phòng, hỏi đáp kho tri thức và quy trình xử lý văn bản hàng loạt. Với các ứng dụng cần lặp nhanh hoặc nhạy cảm về chi phí, Terra là lựa chọn mặc định mạnh mẽ trong dòng Terra.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$2.5 / triệu token

Xem mô hình

OpenAI

GPT-5.6 Terra Pro

GPT-5.6 Terra Pro là phiên bản nâng cao của dòng Terra, được thiết kế để tạo ra đầu ra chất lượng cao trong các tác vụ phức tạp. Phù hợp cho Hỏi đáp nâng cao, sáng tạo nội dung chuyên sâu, phân tích kinh doanh, hỗ trợ lập trình và suy luận nhiều bước. So với phiên bản tiêu chuẩn, Terra Pro phù hợp hơn với các tình huống yêu cầu độ tin cậy cao hơn, lý luận đầy đủ hơn và tuân thủ hướng dẫn tốt hơn. Thích hợp cho viết chuyên nghiệp, tổng hợp thông tin phức tạp, trợ lý dựa trên tri thức, tác tử tự động hóa và các ứng dụng AI cấp doanh nghiệp.

Ngữ cảnh tối đa

1.1M

Giá đầu vào

$2.5 / triệu token

Xem mô hình

So sánh mô hình

So sánh nhanh với các mô hình lân cận được chọn trong danh mục.

FAQ danh mục mô hình

Hướng dẫn nhanh để chọn, so sánh và sử dụng mô hình trong danh mục TokenHub.

Nên chọn mô hình trong danh sách này như thế nào?

+

Hãy bắt đầu từ workload của bạn. Dùng bộ lọc theo nhà cung cấp, tag, loại endpoint và nhóm tính phí, sau đó so sánh context, giới hạn output, modality và giá input hoặc output.

Giá hiệu dụng nghĩa là gì?

+

Giá hiệu dụng áp dụng tỷ lệ của nhóm tính phí hiện tại vào dữ liệu giá của mô hình. Nó giúp ước tính chi phí input, output hoặc mỗi request thực tế cho nhóm bạn đang dùng.

Có thể dùng các mô hình này qua API endpoint không?

+

Có. Mở trang chi tiết mô hình để xem loại endpoint được hỗ trợ và liên kết tài liệu. Khả dụng có thể khác nhau theo mô hình, nhà cung cấp và cấu hình routing hiện tại.

Vì sao context window và max output quan trọng?

+

Context window quyết định lượng prompt và lịch sử hội thoại mà mô hình có thể đọc. Max output quyết định lượng nội dung có thể tạo trong một phản hồi, quan trọng với viết dài, coding và tài liệu.