/v1/chat/completionsClaude Opus 5 Fast
claude-opus-5-fastOpus 5 的快速模式变体 - 与常规 Opus 5 相同的性能,但输出速度更快,价格为常规 Opus 5 的两倍。 了解更多,请查看 Anthropic 文档:https://platform.claude.com/docs/en/build-with-claude/fast-mode
最大上下文
1MToken
最大输出
128KToken
发布日期
2026年7月24日
模态
Claude Opus 5 Fast 价格
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $10/M | $50/M | $1/M |
如何通过 API 使用 Claude Opus 5 Fast?
/v1/messagesClaude Opus 5 Fast 基准测试
60.7
/100
Artificial Analysis 综合能力指数
Artificial Analysis 综合能力评分
指数分数
78
/100
Artificial Analysis 代码能力指数
Artificial Analysis 软件任务评分
指数分数
知识与推理
GPQA
高阶科学问题求解
93.2%
HLE
广泛专家级考试集合
52.6%
代码与工程
SciCode
科学计算代码挑战
55.7%
指令遵循与 Agent 任务
AA-LCR
长上下文推理
70%
指标来源 Artificial Analysis
claude-opus-5-fast 常见问题
在 TokenHub 使用 claude-opus-5-fast 前可了解的实用问题。
claude-opus-5-fast 是什么?+
claude-opus-5-fast 是 TokenHub 中 Claude Opus 5 的高速模式条目。Anthropic 将高速模式描述为同一模型和能力采用更快的推理配置,而不是独立的智能模型。
claude-opus-5-fast 最适合哪些用途?+
它适合交互式编程智能体、实时分析、流式响应,以及其他需要 Opus 级质量且更快输出能改善体验的工作流。
高速模式快多少?+
Anthropic 表示高速模式可将每秒输出词元数提高到最多 2.5 倍。提升主要体现在输出生成速度,不一定缩短首个词元的等待时间。
高速模式有哪些限制或取舍?+
高速模式处于研究预览阶段,价格更高,并使用独立容量限额。可用性可能受限,而且并非每个请求都会更快开始;重要输出仍需审核。
如何通过 TokenHub 使用 claude-opus-5-fast?+
如果账户可用,请在 TokenHub API 请求中选择 claude-opus-5-fast,并使用 TokenHub 接口地址和凭据。请在实时模型页面确认当前参数、配额和路由。
高速模式如何计费,何时应该选择它?+
Anthropic 公布的高速模式价格为每百万输入词元 10 美元、每百万输出词元 50 美元。当输出延迟明显影响体验时选择它;更看重低成本时选择标准 Opus 5。TokenHub 价格可能不同。
Claude-opus-5-fast 媒体与演示
关于 Claude Opus 5 及其高速模式的已验证公开帖子、讨论与视频。
X (Twitter)
Reddit
YouTube