Qwen3.8-Max là mô hình hàng đầu MoE với 2,4 nghìn tỷ tham số, được thiết kế cho lý luận nâng cao, lập trình và năng suất doanh nghiệp. Mô hình có thể tự động thực hiện các tác vụ phức tạp, kéo dài — từ phát triển phần mềm đến quy trình làm việc chuyên nghiệp — mang lại kết quả cấp sản xuất trong các lĩnh vực như luật, tài chính và thiết kế. Được hỗ trợ bởi trí thông minh đa phương thức bản địa, Qwen3.8-Max hiểu văn bản, hình ảnh và video trong bối cảnh dài, hỗ trợ phân tích sâu các tài liệu mở rộng và nội dung dạng dài. Khả năng tác tử của nó cho phép lập kế hoạch, thực thi, xác minh và lặp lại liên tục một cách tự động trong các quy trình phức tạp.
Ngày phát hành
3 thg 8, 2026
Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.25 / triệu token
Kimi K3 là mô hình AI hiệu suất cao được thiết kế cho suy luận nâng cao, lập trình và thực thi tác vụ phức tạp. Nó mang lại hiệu năng mạnh mẽ trong các dự án lập trình quy mô lớn, giải quyết vấn đề nhiều bước và ứng dụng chuyên sâu về tri thức. Với khả năng xử lý ngữ cảnh rộng và đa phương thức, K3 phù hợp để xây dựng các tác nhân AI mạnh mẽ, công cụ cho nhà phát triển và ứng dụng cấp doanh nghiệp.
Ngày phát hành
16 thg 7, 2026
Đầu vào$2.8571 / triệu token
Đầu ra$14.2857 / triệu token
Đọc cache$0.2857 / triệu token
GPT-5.6 Sol là phiên bản tiêu chuẩn của dòng Sol. Nó phù hợp cho các tác vụ hỏi đáp chung, xử lý văn bản, soạn thảo nội dung, tóm tắt, hỗ trợ lập trình nhẹ và tự động hóa doanh nghiệp.
Sol được thiết kế cho các kịch bản cần năng lực tổng quát vững chắc nhưng vẫn đảm bảo hiệu quả phản hồi và chi phí hợp lý. Có thể dùng cho tính năng sản phẩm, trợ lý trò chuyện, công cụ tạo nội dung, làm sạch dữ liệu, hỏi đáp từ cơ sở tri thức và tác vụ xử lý hàng loạt. Đối với triển khai quy mô lớn hoặc tạo mẫu nhanh, Sol là điểm khởi đầu linh hoạt.
Ngày phát hành
9 thg 7, 2026
Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token
GPT-5.6 Sol Pro là phiên bản Pro của dòng Sol, được thiết kế cho các tác vụ phức tạp và đầu ra chất lượng cao hơn. Phù hợp cho viết nâng cao, hỏi đáp chính xác, suy luận kinh doanh, tạo mã, phân tích có cấu trúc và thực hiện tác vụ đa vòng.
Sol Pro phù hợp với những tác vụ yêu cầu độ chính xác cao hơn, hiểu ngữ cảnh và hoàn thành hướng dẫn. Có thể sử dụng cho sản xuất nội dung chuyên nghiệp, trợ lý phân tích dữ liệu, hệ thống hỏi đáp tri thức, quy trình làm việc tác nhân phức tạp và các công cụ AI nội bộ doanh nghiệp.
Ngày phát hành
9 thg 7, 2026
Đầu vào$5 / triệu token
Đầu ra$30 / triệu token
Đọc cache$0.5 / triệu token
GPT-5.6 Terra là phiên bản đa năng của dòng Terra. Nó phù hợp cho hội thoại hàng ngày, tạo văn bản, tóm tắt, trích xuất thông tin, suy luận nhẹ và hỗ trợ lập trình.
Terra mang lại sự cân bằng thực tế giữa khả năng chung, hiệu quả phản hồi và chi phí. Nó có thể được dùng cho trợ lý trò chuyện, công cụ nội dung, tự động hóa văn phòng, hỏi đáp kho tri thức và quy trình xử lý văn bản hàng loạt. Với các ứng dụng cần lặp nhanh hoặc nhạy cảm về chi phí, Terra là lựa chọn mặc định mạnh mẽ trong dòng Terra.
Ngày phát hành
9 thg 7, 2026
Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.275 / triệu token
GPT-5.6 Terra Pro là phiên bản nâng cao của dòng Terra, được thiết kế để tạo ra đầu ra chất lượng cao trong các tác vụ phức tạp. Phù hợp cho Hỏi đáp nâng cao, sáng tạo nội dung chuyên sâu, phân tích kinh doanh, hỗ trợ lập trình và suy luận nhiều bước. So với phiên bản tiêu chuẩn, Terra Pro phù hợp hơn với các tình huống yêu cầu độ tin cậy cao hơn, lý luận đầy đủ hơn và tuân thủ hướng dẫn tốt hơn. Thích hợp cho viết chuyên nghiệp, tổng hợp thông tin phức tạp, trợ lý dựa trên tri thức, tác tử tự động hóa và các ứng dụng AI cấp doanh nghiệp.
Ngày phát hành
9 thg 7, 2026
Đầu vào$2.5 / triệu token
Đầu ra$15 / triệu token
Đọc cache$0.275 / triệu token
GPT-5.6 Luna là phiên bản đa năng của dòng Luna, phù hợp cho các ứng dụng AI hàng ngày. Có thể dùng cho hỏi đáp trò chuyện, viết lại văn bản, tóm tắt, trích xuất thông tin, suy luận đơn giản, hỗ trợ lập trình và tự động hóa văn phòng.
Luna là lựa chọn thực tế cho nguyên mẫu, tính năng kinh doanh nhẹ, xử lý nội dung hàng loạt và các tình huống tương tác người dùng phổ biến. Đây là mô hình khởi đầu tốt khi tốc độ, sự đơn giản và kiểm soát chi phí là quan trọng; đối với các tác vụ đòi hỏi chất lượng cao hơn hoặc đầu ra ổn định hơn, bạn có thể cân nhắc Luna Pro.
Ngày phát hành
9 thg 7, 2026
Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token
GPT-5.6 Luna Pro là phiên bản nâng cao của dòng Luna, nhằm cung cấp câu trả lời chất lượng cao hơn, tuân thủ hướng dẫn ổn định hơn và hoàn thành nhiệm vụ mạnh mẽ hơn. Phù hợp với các cuộc hội thoại phức tạp, tạo nội dung, hỏi đáp kiến thức, phân tích kinh doanh, hỗ trợ lập trình và các tác vụ tự động hóa nhiều bước.
Luna Pro rất thích hợp cho các trải nghiệm sản phẩm coi trọng chất lượng đầu ra và trải nghiệm người dùng, chẳng hạn như trợ lý viết chuyên nghiệp, trợ lý AI doanh nghiệp, hỗ trợ khách hàng, hệ thống cơ sở tri thức và quy trình làm việc của tác nhân. Đây là lựa chọn tốt khi nhiệm vụ yêu cầu độ tin cậy cao hơn so với mô hình Luna tiêu chuẩn.
Ngày phát hành
9 thg 7, 2026
Đầu vào$1 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.1 / triệu token
DeepSeek V4 Pro được các nguồn nhấn mạnh ở các điểm: MoE 1.6T tổng / 49B kích hoạt, 1M-token ngữ cảnh, hybrid ngữ cảnh dài attention. Giá trị chính của mô hình nằm ở nâng cao suy luận, lập trình, toàn bộ codebase phân tích and dài hạn quy trình agent. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
24 thg 4, 2026
Đầu vào$1.2857 / triệu token
Đầu ra$3.8571 / triệu token
Đọc cache$0.0429 / triệu token
GLM-5.2 là mô hình nền tảng flagship của Z.ai cho các tác vụ kỹ thuật dài hạn. Mô hình nhấn mạnh cửa sổ ngữ cảnh 1M token có thể sử dụng thực tế, phù hợp để xử lý mã nguồn, tài liệu và bối cảnh hệ thống ở cấp độ dự án. Nó hướng tới toàn bộ quy trình phát triển, từ phân tích yêu cầu, hiểu repository đến triển khai, kiểm thử và phát hành đa nền tảng.
Ngày phát hành
13 thg 6, 2026
Đầu vào$1.1429 / triệu token
Đầu ra$4 / triệu token
Đọc cache$0.2857 / triệu token
DeepSeek V4 Flash được các nguồn nhấn mạnh ở các điểm: MoE 284B tổng / 13B kích hoạt, 1M-token ngữ cảnh, suy luận tối ưu thông lượng. Giá trị chính của mô hình nằm ở khối lượng lớn lệnh gọi production, nhanh ngữ cảnh dài xử lý and nhạy cảm chi phí tự động hóa. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
24 thg 4, 2026
Đầu vào$0.4286 / triệu token
Đầu ra$1.2857 / triệu token
Đọc cache$0.0143 / triệu token
Claude Opus 5 là mô hình chủ lực của Anthropic dành cho các tác vụ suy luận, lập trình và công việc đại diện dài hạn đòi hỏi khắt khe. Mô hình đặc biệt mạnh trong các tác vụ phần mềm từ đầu đến cuối, đánh giá mã và tìm lỗi, phân tích trực quan biểu đồ và tài liệu, các sản phẩm văn phòng phức tạp và điều phối các tác nhân phụ song song. Mô hình duy trì khả năng tuân thủ hướng dẫn và sử dụng công cụ mạnh mẽ trong các tác vụ kéo dài, đồng thời vẫn hiệu quả ở các cài đặt nỗ lực thấp hơn cho khối lượng công việc ưu tiên độ trễ và hiệu quả token.
Ngày phát hành
24 thg 7, 2026
Đầu vào$5 / triệu token
Đầu ra$25 / triệu token
Đọc cache$0.5 / triệu token
Biến thể chế độ nhanh của Opus 5 - khả năng tương tự với tốc độ xuất cao hơn, giá gấp đôi so với Opus 5 thông thường.
Tìm hiểu thêm trong tài liệu của Anthropic: https://platform.claude.com/docs/en/build-with-claude/fast-mode
Ngày phát hành
24 thg 7, 2026
Đầu vào$10 / triệu token
Đầu ra$50 / triệu token
Đọc cache$1 / triệu token
Grok 4.6 là mô hình suy luận tiên tiến của xAI, được xây dựng cho lập trình phức tạp, các tác vụ tác tử chạy lâu và công việc tri thức. Mô hình hỗ trợ nhập văn bản và hình ảnh, cửa sổ ngữ cảnh lên tới 500 nghìn token, và cường độ suy luận có thể tùy chỉnh (thấp/trung bình/cao/rất cao). Với khả năng gọi hàm, tìm kiếm web và X, thực thi mã và đầu ra có cấu trúc, Grok 4.6 được tối ưu hóa cho việc phân tích trên nhiều mã nguồn, sử dụng công cụ đa bước liên tục, tự xác minh và quy trình kỹ thuật đầu cuối. Đây là mô hình suy luận và tác tử đa dụng, không chỉ đơn thuần là chatbot gắn với nền tảng X.
Ngày phát hành
12 thg 8, 2026
Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.3 / triệu token
Gemini 3.6 Flash là mô hình hiệu quả cao từ Google dành cho lập trình, quy trình tác nhân và phát triển web và ứng dụng. Nó được thiết kế để tạo ra đầu ra tinh gọn với ít chỉnh sửa không cần thiết và ít mơ hồ hơn, đồng thời giảm mức sử dụng token và số lần gọi mô hình cần thiết để hoàn thành tác vụ.
Ngày phát hành
21 thg 7, 2026
Đầu vào$1.5 / triệu token
Đầu ra$7.5 / triệu token
Đọc cache$0.15 / triệu token
Grok 4.5 là mô hình suy luận của xAI dành cho lập trình, tác vụ tác nhân và công việc tri thức. Mô hình hỗ trợ đầu vào văn bản và hình ảnh, ngữ cảnh lên đến 500.000 token, và cường độ suy luận có thể cấu hình (thấp/trung bình/cao). Nó hỗ trợ gọi hàm, tìm kiếm web và X, thực thi mã và đầu ra có cấu trúc, phù hợp cho phân tích ngữ cảnh dài, gọi công cụ nhiều bước và quy trình kỹ thuật đầu cuối. Không nên chỉ coi đây là chatbot gắn với nền tảng X.
Ngày phát hành
8 thg 7, 2026
Đầu vào$2 / triệu token
Đầu ra$6 / triệu token
Đọc cache$0.3 / triệu token
Qwen3.7 Plus được các nguồn nhấn mạnh ở các điểm: text+image input, vision-language upgrade, hybrid agent capability. Giá trị chính của mô hình nằm ở tác vụ GUI, điều hướng di động, tham chiếu hình ảnh quy trình and hiệu quả chi phí Qwen3.7 use. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
2 thg 6, 2026
Đầu vào$0.2857 / triệu token
Đầu ra$1.1429 / triệu token
Đọc cache$0.0571 / triệu token
GPT-4.1 được các nguồn nhấn mạnh ở các điểm: improved lập trình, instruction following and long ngữ cảnh versus earlier GPT-4 generation. Giá trị chính của mô hình nằm ở công cụ lập trình viên, hỗ trợ lập trình and instruction-heavy tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
14 thg 4, 2025
Đầu vào$2 / triệu token
Đầu ra$8 / triệu token
Đọc cache$0.5 / triệu token
GPT-4.1 Mini được các nguồn nhấn mạnh ở các điểm: nhanher/lower-cost GPT-4.1 variant. Giá trị chính của mô hình nằm ở khối lượng lớn developer features, có cấu trúc generation and trích xuất. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
14 thg 4, 2025
Đầu vào$0.4 / triệu token
Đầu ra$1.6 / triệu token
Đọc cache$0.1 / triệu token
GPT-4o được các nguồn nhấn mạnh ở các điểm: đa phương thức GPT-4o flagship, text/image input and broad general intelligence. Giá trị chính của mô hình nằm ở vision-language applications, tương tác tự nhiên and general assistant tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
13 thg 5, 2024
Đầu vào$2.5 / triệu token
Đầu ra$10 / triệu token
Đọc cache$1.25 / triệu token
GPT-4o Mini được các nguồn nhấn mạnh ở các điểm: small affordable GPT-4o model with text/image input and có cấu trúc output support. Giá trị chính của mô hình nằm ở lightweight đa phương thức production, fine-tuning, distillation and focused tasks. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Ngày phát hành
18 thg 7, 2024
Đầu vào$0.15 / triệu token
Đầu ra$0.6 / triệu token
Đọc cache$0.075 / triệu token