/v1/chat/completionsMiniMax M3
MiniMax-M3MiniMax M3 是 MiniMax 面向长周期 Agent 工作流、代码任务和工具调用的前沿多模态模型,支持 1M token 上下文。其 MiniMax Sparse Attention 旨在降低超长上下文工作负载的成本。你可以通过 TokenHub 调用 MiniMax API,查看当前 MiniMax M3 的价格、模型 ID、支持端点、上下文限制和基准测试结果,再评估它是否适合生产级软件任务或协作式 Agent 工作流。
最大上下文
512KToken
最大输出
128KToken
发布日期
2026年6月1日
模态
MiniMax M3 价格
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.6/M | $2.4/M | $0.12/M |
如何通过 API 使用 MiniMax M3?
/v1/messages/v1beta/models/{model}:generateContentMiniMax M3 基准测试
MiniMax-M3
44.4
/100
Artificial Analysis 综合能力指数
Artificial Analysis 综合能力评分
指数分数
43.4
/100
Artificial Analysis 代码能力指数
Artificial Analysis 软件任务评分
指数分数
知识与推理
GPQA
高阶科学问题求解
92.9%
HLE
广泛专家级考试集合
37.1%
代码与工程
SciCode
科学计算代码挑战
45.4%
Terminal-Bench Hard
高难度终端任务执行
42.4%
指令遵循与 Agent 任务
IFBench
指令约束遵循
82.9%
AA-LCR
长上下文推理
74%
τ²-Bench
Agent 工作流任务
88.9%
指标来源 Artificial Analysis
MiniMax M3 API 常见问题
解答关于 MiniMax M3 API、价格、代码与 Agent 工作流、长上下文限制和模型对比的常见问题。
MiniMax M3 是什么?+
MiniMax M3 是 MiniMax 面向长周期 Agent 工作、代码任务和工具调用的多模态模型。它适合需要处理大量项目资料、大上下文和生产级软件任务的工作负载。
MiniMax M3 适合代码和 Agent 工作流吗?+
对于需要长上下文、连续工具调用或多步骤协作的代码和 Agent 工作流,MiniMax M3 值得评估。上线前应使用真实的仓库任务、工具调用和验收标准进行测试,而不是只依赖通用基准分数。
如何通过 TokenHub 调用 MiniMax M3 API?+
先创建 TokenHub API Key,复制本页显示的准确 MiniMax M3 模型 ID,再在 API 模块选择支持的端点。可直接以页面生成的请求示例为起点,接入 OpenAI 兼容客户端或其他已支持的调用方式。
如何评估 MiniMax M3 的价格?+
查看本页展示的当前输入、输出和缓存读取价格,再结合典型提示词长度、输出长度、请求量和缓存命中率估算成本。长上下文与 Agent 工作流的成本结构,通常会与短文本请求明显不同。
使用 MiniMax M3 处理长上下文任务前,应确认什么?+
请确认模型参数中的当前上下文窗口、最大输出、输入模态、支持端点和价格。即使上下文窗口很大,也仍需要整理文档输入、控制工具调用循环,并使用真实项目数据测试模型表现。
MiniMax M3 和 Kimi K3 应该怎么选?+
应围绕实际要交付的工作负载比较 MiniMax M3 和 Kimi K3。先查看当前 API 价格、上下文与最大输出限制、模态、支持端点和基准数据,再用自己的代码、推理或 Agent 任务做小规模评测后决定。
在哪里获取 MiniMax API Key 和当前 MiniMax M3 模型 ID?+
请在 TokenHub 工作台创建 API Key,再复制本页展示的准确 MiniMax M3 模型 ID。发送生产流量前,请在本页确认支持端点和当前规格,因为可用性与模型信息可能会更新。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube