Based On Current Page Data
HYHy3Tencent Hunyuan
MIMiMo V2.5Xiaomi MiMo
How To Read It
Best For
Text-first codingoffice worktool-using agents
Multimodal understandingmillion-token agent workflows
How To Read ItUse-case synthesis from model capabilities and positioning.
Workload Fit
256K contextReasoning modesAgent workflows
1M contextTextimagevideoaudioAgentic tasks
How To Read ItThe workloads each model is most directly shaped for.
Input
$0.1429/M
$0.14/MEdge
How To Read ItLower is better when prompts or retrieval payloads are large.
Output
$0.5714/M
$0.28/MEdge
How To Read ItLower is better for reasoning-heavy or long-generation traffic.
Context length
256K
1.1MEdge
How To Read ItHigher is better for repositories, retrieval packs, and transcripts.
Input modalities
Text
Audio, Image, Text, VideoEdge
How To Read ItBroader input support reduces the need for separate vision or video models.