Gemini 3.6 Flash
Ngữ cảnh tối đa
1M
Đầu ra tối đa
65.5K
Ngày phát hành
N/A
gemini-2.5-flashGemini 2.5 Flash được các nguồn nhấn mạnh ở các điểm: balanced Gemini 2.5 price-performance model with thinking. Giá trị chính của mô hình nằm ở production suy luận, đa phương thức input and practical throughput. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Context Window
1M tokens
Maximum Output
65.5K tokens
Release Date
17 thg 6, 2025
Modalities
| Giá đầu vào | Giá đầu ra | Đọc cache |
|---|---|---|
| $0.3/M | $2.5/M | $0.03/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Gemini 2.5 Flash kết hợp suy luận thích ứng, hiểu đa phương thức và cửa sổ ngữ cảnh lớn cho các tác vụ khối lượng cao cần phản hồi nhanh.
Mô hình có thể tăng cường suy luận khi tác vụ cần phân tích thêm, cân bằng giữa độ sâu lập luận và tốc độ phản hồi.
Mô hình tiếp nhận văn bản, hình ảnh, video và âm thanh, cho phép phân tích nhiều loại nội dung bằng một mô hình duy nhất.
Cửa sổ đầu vào 1.048.576 token hỗ trợ phân tích tài liệu lớn, tập hợp nội dung đa phương tiện và ngữ cảnh ứng dụng đã tổng hợp.
Gemini 2.5 Flash phù hợp với xử lý nội dung quy mô lớn, phân tích đa phương thức và các ứng dụng tương tác vẫn cần khả năng suy luận.
Phân tích hình ảnh, bản ghi và video cùng văn bản để tạo bản tóm tắt có thể tìm kiếm, kết quả phân loại và thông tin trích xuất.
Phân loại, tóm tắt và trích xuất thông tin từ luồng nội dung lớn, đồng thời áp dụng suy luận cho các trường hợp ít thông thường hơn.
Xây dựng trợ lý phản hồi nhanh, có thể hiểu nội dung người dùng, suy luận yêu cầu và trả về văn bản hữu ích với độ trễ cảm nhận thấp.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| Điểm chỉ số | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Đánh giá tổng hợp năng lực chung | 14.1 |
| Artificial Analysis Coding Index | Đánh giá tổng hợp năng lực lập trình | 17.8 |
| Artificial Analysis Math Index | Đánh giá tổng hợp suy luận toán học | 60.3 |
| Kiến thức và suy luận | ||
| MMLU-Pro | Kiến thức đa lĩnh vực nâng cao | 80.9% |
| GPQA | Giải quyết vấn đề khoa học nâng cao | 68.3% |
| HLE | Bộ đề chuyên gia đa lĩnh vực | 5.1% |
| Lập trình và kỹ thuật phần mềm | ||
| LiveCodeBench | Bài toán lập trình mới | 49.5% |
| SciCode | Thử thách lập trình khoa học | 29.1% |
| Terminal-Bench Hard | Thực thi tác vụ terminal nâng cao | 12.1% |
| Toán học | ||
| MATH-500 | Giải toán nâng cao | 93.2% |
| AIME | Bài toán theo dạng thi đấu | 50% |
| AIME 2025 | Bài toán theo dạng thi đấu | 60.3% |
| Tuân thủ hướng dẫn và tác vụ tác nhân | ||
| IFBench | Tuân thủ ràng buộc trong câu lệnh | 39.0% |
| AA-LCR | Suy luận trên ngữ cảnh dài | 45.9% |
| τ²-Bench | Tác vụ quy trình của tác nhân | 14.9% |
Nguồn chỉ số Artificial Analysis
Tìm hiểu Gemini 2.5 Flash là gì, phù hợp với tác vụ nào, có điểm mạnh gì, cần lưu ý hạn chế nào và cách tích hợp an toàn qua TokenHub.
Gemini 2.5 Flash là mô hình Gemini 2.5 Flash cân bằng của Google cho tác vụ khối lượng lớn, độ trễ thấp nhưng vẫn cần suy luận. Đây vẫn là một thế hệ mô hình riêng, nhưng dự án mới nên so sánh với các bản mới hơn cùng họ.
Các tình huống phù hợp gồm yêu cầu ứng dụng khối lượng lớn, thực thi đáng tin cậy quy trình tác nhân nhiều bước và phân tích đầu vào văn bản và hình ảnh. Trước khi đưa vào sản xuất, hãy thử đầu vào đại diện và đặt tiêu chí chấp nhận có thể đo lường.
Điểm mạnh chính gồm cân bằng tốt giữa chất lượng, tốc độ và chi phí, thời gian phản hồi nhanh và suy luận mạnh với bài toán khó. Sự kết hợp này đặc biệt hữu ích với thực thi đáng tin cậy quy trình tác nhân nhiều bước.
Hãy cân nhắc mô hình khác khi tác vụ cần suy luận mạnh nhất ở cấp Pro, dự án có thể dùng thế hệ Gemini mới hơn hoặc quy trình không thể có bước con người rà soát quyết định quan trọng. Đầu ra quan trọng về sự thật, pháp lý, tài chính, y tế hoặc vận hành cần được người có chuyên môn rà soát.
Trong TokenHub, hãy chọn đúng định danh mô hình hiển thị cho Gemini 2.5 Flash, dùng endpoint được ghi trong tài liệu tài khoản và xác thực bằng thông tin TokenHub. Hãy xác nhận loại đầu vào, công cụ, tùy chọn grounding và vòng đời mô hình thực tế trên TokenHub thay vì giả định hoàn toàn giống Gemini API.
Truy cập Gemini 2.5 Flash và nhiều mô hình AI khác bằng một khóa API TokenHub.
TruyềN ThôNg Và ThảO LuậN
Tuyển chọn video và bài đăng công khai liên quan đến mô hình này.
X (Twitter)
Reddit
YouTube