Anthropic
Claude Sonnet 5.5
最大上下文
1M
最大输出
128K
发布日期
暂无
claude-haiku-4.5Claude Haiku 4.5 是 Anthropic 更快、更具成本效率的模型,但在代码、计算机使用和 Agent 任务上表现很强。官方资料将部分能力与早期 Sonnet 级表现进行对比,同时强调速度和价格优势。它适合被描述为面向快速 Agent 应用的紧凑型生产模型。
上下文窗口
200K Token
最大输出
64K Token
发布日期
2025年10月15日
模态
| 输入价格 | 输出价格 | 缓存读取 | 缓存创建 5m |
|---|---|---|---|
| $1/M | $5/M | $0.1/M | $1.25/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
Claude Haiku 4.5 融合快速响应、可靠编程和计算机操作推理能力,适合实时及高吞吐开发工作负载。
在保持交互式助手和迭代开发所需推理能力的同时,提供快速响应。
能够生成和修改代码,编程表现可比更早的大型模型,同时具有更低延迟和计算开销。
可理解界面状态并在浏览器或桌面流程中选择操作,同时保持较低交互延迟。
Claude Haiku 4.5 适合交互式编程、高吞吐客户支持自动化以及快速响应的子 Agent 或计算机操作流程。
在开发过程中快速建议代码、解释错误并迭代小范围改动。
对请求分类、检索相关指导,并为高并发支持队列起草及时回复。
并行执行代码搜索、文件检查或浏览器操作等聚焦子任务,并快速返回结果。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)了解 Claude Haiku 4.5 的定位、适合处理的任务、主要优势、使用限制,以及在 TokenHub 中接入时需要注意的事项。
Claude Haiku 4.5 是 Anthropic 面向快速、高并发应用的轻量 Claude 模型。它是提供商文档中的当前公开模型,但不同平台的可用性可能不同。
它适合高并发应用请求、快速编程辅助以及客服自动化。上线前应使用有代表性的输入进行测试,并制定可衡量的验收标准。
它最实用的优势包括较快的响应速度、较好的成本效率以及较强的编程能力。这些特点对快速编程辅助尤其有价值。
如果任务需要最强的 Opus 级能力、流程需要最长时间且高度自主的执行,或重要决策流程无法安排人工复核,可以考虑其他模型。涉及事实、法律、财务、医疗或运营的重要结果,应由具备相关资质的人员复核。
在 TokenHub 中,请选择页面显示的 Claude Haiku 4.5 精确模型标识,使用账号文档中指定的接口,并通过 TokenHub 凭证完成认证。请在 TokenHub 模型页面确认账号可用的 Claude 功能、上下文限制、工具支持和当前模型状态。
通过一个 API Key 接入 Claude Haiku 4.5 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube