Gemini 3.6 Flash
Ngữ cảnh tối đa
1M
Đầu ra tối đa
65.5K
Ngày phát hành
N/A
gemini-2.5-flash-liteGemini 2.5 Flash Lite được các nguồn nhấn mạnh ở các điểm: nhanhest/budget Gemini 2.5 option, thinking budgets and tool integrations. Giá trị chính của mô hình nằm ở phân loại, dịch, định tuyến, trích xuất and high-scale workloads. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.
Context Window
1M tokens
Maximum Output
65.5K tokens
Release Date
17 thg 6, 2025
Modalities
| Giá đầu vào | Giá đầu ra | Đọc cache |
|---|---|---|
| $0.1/M | $0.4/M | $0.01/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Gemini 2.5 Flash-Lite ưu tiên độ trễ thấp và xử lý đa phương thức hiệu quả cho các tác vụ nhẹ, thường xuyên ở quy mô lớn.
Mô hình được tối ưu để thực thi nhanh các yêu cầu nhẹ, phù hợp với ứng dụng cần phản hồi nhanh và quy trình xử lý thường xuyên.
Mô hình có thể hiểu văn bản, hình ảnh, video, âm thanh và tệp PDF, đồng thời tạo kết quả dạng văn bản cho các ứng dụng phía sau.
Giới hạn đầu vào 1.048.576 token cho phép xử lý tài liệu dài và tập nội dung lớn bằng ít yêu cầu hơn.
Gemini 2.5 Flash-Lite phù hợp với phân loại khối lượng lớn, trích xuất đơn giản và xử lý nội dung nhạy cảm với độ trễ.
Nhanh chóng gán danh mục, mức ưu tiên hoặc nhãn kiểm duyệt cho luồng lớn văn bản và nội dung đa phương thức.
Trích xuất các trường và dữ kiện thông thường từ tin nhắn, biểu mẫu, hình ảnh hoặc PDF để lập chỉ mục và tự động hóa tiếp theo.
Rút gọn tài liệu dài và PDF thành phần tổng quan, ý chính hoặc siêu dữ liệu định tuyến cho quy trình xử lý nội dung.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| Điểm chỉ số | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Đánh giá tổng hợp năng lực chung | 11.4 |
| Artificial Analysis Coding Index | Đánh giá tổng hợp năng lực lập trình | 9.5 |
| Artificial Analysis Math Index | Đánh giá tổng hợp suy luận toán học | 53.3 |
| Kiến thức và suy luận | ||
| MMLU-Pro | Kiến thức đa lĩnh vực nâng cao | 75.9% |
| GPQA | Giải quyết vấn đề khoa học nâng cao | 62.5% |
| HLE | Bộ đề chuyên gia đa lĩnh vực | 6.4% |
| Lập trình và kỹ thuật phần mềm | ||
| LiveCodeBench | Bài toán lập trình mới | 59.3% |
| SciCode | Thử thách lập trình khoa học | 19.3% |
| Terminal-Bench Hard | Thực thi tác vụ terminal nâng cao | 4.5% |
| Toán học | ||
| MATH-500 | Giải toán nâng cao | 96.9% |
| AIME | Bài toán theo dạng thi đấu | 70.3% |
| AIME 2025 | Bài toán theo dạng thi đấu | 53.3% |
| Tuân thủ hướng dẫn và tác vụ tác nhân | ||
| IFBench | Tuân thủ ràng buộc trong câu lệnh | 49.9% |
| AA-LCR | Suy luận trên ngữ cảnh dài | 51.3% |
| τ²-Bench | Tác vụ quy trình của tác nhân | 18.4% |
Nguồn chỉ số Artificial Analysis
Tìm hiểu Gemini 2.5 Flash-Lite là gì, phù hợp với tác vụ nào, có điểm mạnh gì, cần lưu ý hạn chế nào và cách tích hợp an toàn qua TokenHub.
Gemini 2.5 Flash-Lite là mô hình Gemini 2.5 tiết kiệm nhất của Google cho xử lý đa phương thức đơn giản, tần suất cao. Đây vẫn là một thế hệ mô hình riêng, nhưng dự án mới nên so sánh với các bản mới hơn cùng họ.
Các tình huống phù hợp gồm phân loại và định tuyến quy mô lớn, trích xuất dữ liệu có cấu trúc đơn giản và dịch thuật khối lượng lớn. Trước khi đưa vào sản xuất, hãy thử đầu vào đại diện và đặt tiêu chí chấp nhận có thể đo lường.
Điểm mạnh chính gồm khả năng mở rộng tiết kiệm chi phí, thời gian phản hồi nhanh và hỗ trợ nhiều loại đầu vào đa phương thức. Sự kết hợp này đặc biệt hữu ích với trích xuất dữ liệu có cấu trúc đơn giản.
Hãy cân nhắc mô hình khác khi tác vụ có suy luận khó nhiều bước, dự án có thể dùng thế hệ Gemini mới hơn hoặc quy trình không thể có bước con người rà soát quyết định quan trọng. Đầu ra quan trọng về sự thật, pháp lý, tài chính, y tế hoặc vận hành cần được người có chuyên môn rà soát.
Trong TokenHub, hãy chọn đúng định danh mô hình hiển thị cho Gemini 2.5 Flash-Lite, dùng endpoint được ghi trong tài liệu tài khoản và xác thực bằng thông tin TokenHub. Hãy xác nhận loại đầu vào, công cụ, tùy chọn grounding và vòng đời mô hình thực tế trên TokenHub thay vì giả định hoàn toàn giống Gemini API.
Truy cập Gemini 2.5 Flash-Lite và nhiều mô hình AI khác bằng một khóa API TokenHub.
TruyềN ThôNg Và ThảO LuậN
Tuyển chọn video và bài đăng công khai liên quan đến mô hình này.
X (Twitter)
Reddit
YouTube