Step 3.7 Flash

step-3.7-flash

StepFun Step 3.7 Flash 是阶跃星辰推出的高效多模态混合专家(MoE)模型,面向生产级 Agent 工作流和开发者任务。它支持原生文本与图像理解、256K 上下文窗口和灵活推理,适合编程、视觉与文档分析、工具调用、搜索增强任务及复杂的多步骤智能体工作流。其稀疏的 198B 架构每个 token 仅激活约 11B 参数,在推理与多模态性能之间兼顾了推理效率。你可以通过 TokenHub 调用 StepFun API / 阶跃星辰 API,查看当前 Step 3.7 Flash 的价格、模型 ID、支持端点和使用限制,再决定是否集成到生产环境。

最大上下文

256KToken

最大输出

256KToken

发布日期

2026年5月29日

模态

Step 3.7 Flash 价格

输入价格输出价格缓存读取
$0.2/M$1.15/M$0.04/M

如何通过 API 使用 Step 3.7 Flash?

POSTanthropic/v1/messages
POSTopenai/v1/chat/completions
POSTopenai-response/v1/responses

Step 3.7 Flash 基准测试

Step 3.7 Flash

30.9

/100

Artificial Analysis 综合能力指数

Artificial Analysis 综合能力评分

指数分数

39.6

/100

Artificial Analysis 代码能力指数

Artificial Analysis 软件任务评分

指数分数

指标来源 Artificial Analysis

Step-3.7-flash 媒体与演示

精选的 step-3.7-flash 公开公告、测试和社区讨论。

X (Twitter)

Open social media source
View post on X
Open social media source
View post on X
Open social media source
View post on X

Reddit

YouTube

Open social media source
Watch on YouTube
Open social media source
Watch on YouTube
Open social media source
Watch on YouTube

Step 3.7 Flash API 常见问题

了解通过 TokenHub 调用 StepFun API / 阶跃星辰 API 使用 Step 3.7 Flash 时的多模态能力、Agent 工作流、价格、上下文限制和接入方式。

Step 3.7 Flash 是什么?+

Step 3.7 Flash 是阶跃星辰(StepFun)推出的高效多模态混合专家模型,面向生产级 Agent 和开发者工作负载。它结合文本与图像理解、256K 上下文窗口和灵活推理能力,可用于编程、文档分析、工具调用和多步骤任务。

Step 3.7 Flash 最适合哪些场景?+

Step 3.7 Flash 适合响应速度要求较高的编程助手、视觉或文档分析、搜索增强研究、结构化提取和会调用工具的 Agent 工作流。当一个任务既需要多模态输入,又需要多步骤推理,而不只是一次纯文本问答时,它更值得优先评估。

Step 3.7 Flash 支持多模态输入、推理和工具调用吗?+

该模型面向原生文本与图像理解、灵活推理和以工具为中心的 Agent 任务而设计。接入前请以 TokenHub 当前模型页为准,确认你的账户可用的具体输入格式、支持端点、请求结构和工具调用行为。

256K 上下文和稀疏 MoE 架构对使用有什么影响?+

256K 上下文可让 Step 3.7 Flash 处理较大的文档、视觉材料、检索证据和多步骤任务状态。其稀疏架构旨在平衡能力与推理效率,但实际延迟和成本仍取决于输入大小、输出长度、推理设置以及 TokenHub 当前价格。

如何通过 TokenHub 调用 StepFun API 使用 Step 3.7 Flash?+

先创建 TokenHub API Key,在模型目录中选择当前展示的 Step 3.7 Flash 模型 ID,再按照模型页发布的端点和请求示例发起调用。若应用包含图像输入、流式输出或工具调用,请在发送生产流量前查看最新文档。

应如何评估 Step 3.7 Flash API 价格?+

应以 TokenHub 当前价格表为准,而不是引用旧文章中的固定数字。根据典型输入与输出 token、可用时的缓存使用、请求量,以及每个工作流中的图像或长上下文内容来估算成本;在确定生产预算前,先用有代表性的提示词进行测试。

什么时候应该选择 Step 3.7 Flash,而不是其他模型?+

当工作负载同时涉及图像或文档理解、编程或研究、工具调用和多步骤 Agent 执行,并且你重视推理效率时,可优先评估 Step 3.7 Flash。对于简单纯文本请求,应比较更小、更低成本的模型;对于高风险任务,应在相同提示词、延迟目标和预算下测试 Step 3.7 Flash 与其他候选模型。