/v1/messagesStep 3.7 Flash
step-3.7-flashStepFun Step 3.7 Flash 是阶跃星辰推出的高效多模态混合专家(MoE)模型,面向生产级 Agent 工作流和开发者任务。它支持原生文本与图像理解、256K 上下文窗口和灵活推理,适合编程、视觉与文档分析、工具调用、搜索增强任务及复杂的多步骤智能体工作流。其稀疏的 198B 架构每个 token 仅激活约 11B 参数,在推理与多模态性能之间兼顾了推理效率。你可以通过 TokenHub 调用 StepFun API / 阶跃星辰 API,查看当前 Step 3.7 Flash 的价格、模型 ID、支持端点和使用限制,再决定是否集成到生产环境。
最大上下文
256KToken
最大输出
256KToken
发布日期
2026年5月29日
模态
Step 3.7 Flash 价格
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.2/M | $1.15/M | $0.04/M |
如何通过 API 使用 Step 3.7 Flash?
/v1/chat/completions/v1/responsesStep 3.7 Flash 基准测试
Step 3.7 Flash
30.9
/100
Artificial Analysis 综合能力指数
Artificial Analysis 综合能力评分
指数分数
39.6
/100
Artificial Analysis 代码能力指数
Artificial Analysis 软件任务评分
指数分数
指标来源 Artificial Analysis
Step 3.7 Flash API 常见问题
了解通过 TokenHub 调用 StepFun API / 阶跃星辰 API 使用 Step 3.7 Flash 时的多模态能力、Agent 工作流、价格、上下文限制和接入方式。
Step 3.7 Flash 是什么?+
Step 3.7 Flash 是阶跃星辰(StepFun)推出的高效多模态混合专家模型,面向生产级 Agent 和开发者工作负载。它结合文本与图像理解、256K 上下文窗口和灵活推理能力,可用于编程、文档分析、工具调用和多步骤任务。
Step 3.7 Flash 最适合哪些场景?+
Step 3.7 Flash 适合响应速度要求较高的编程助手、视觉或文档分析、搜索增强研究、结构化提取和会调用工具的 Agent 工作流。当一个任务既需要多模态输入,又需要多步骤推理,而不只是一次纯文本问答时,它更值得优先评估。
Step 3.7 Flash 支持多模态输入、推理和工具调用吗?+
该模型面向原生文本与图像理解、灵活推理和以工具为中心的 Agent 任务而设计。接入前请以 TokenHub 当前模型页为准,确认你的账户可用的具体输入格式、支持端点、请求结构和工具调用行为。
256K 上下文和稀疏 MoE 架构对使用有什么影响?+
256K 上下文可让 Step 3.7 Flash 处理较大的文档、视觉材料、检索证据和多步骤任务状态。其稀疏架构旨在平衡能力与推理效率,但实际延迟和成本仍取决于输入大小、输出长度、推理设置以及 TokenHub 当前价格。
如何通过 TokenHub 调用 StepFun API 使用 Step 3.7 Flash?+
先创建 TokenHub API Key,在模型目录中选择当前展示的 Step 3.7 Flash 模型 ID,再按照模型页发布的端点和请求示例发起调用。若应用包含图像输入、流式输出或工具调用,请在发送生产流量前查看最新文档。
应如何评估 Step 3.7 Flash API 价格?+
应以 TokenHub 当前价格表为准,而不是引用旧文章中的固定数字。根据典型输入与输出 token、可用时的缓存使用、请求量,以及每个工作流中的图像或长上下文内容来估算成本;在确定生产预算前,先用有代表性的提示词进行测试。
什么时候应该选择 Step 3.7 Flash,而不是其他模型?+
当工作负载同时涉及图像或文档理解、编程或研究、工具调用和多步骤 Agent 执行,并且你重视推理效率时,可优先评估 Step 3.7 Flash。对于简单纯文本请求,应比较更小、更低成本的模型;对于高风险任务,应在相同提示词、延迟目标和预算下测试 Step 3.7 Flash 与其他候选模型。
Step-3.7-flash 媒体与演示
精选的 step-3.7-flash 公开公告、测试和社区讨论。
X (Twitter)
Reddit
YouTube