Z.ai
GLM-5.3-FlashX
最大上下文
1M
最大输出
131.1K
发布日期
暂无
glm-5.3GLM-5.3 是 Z.ai 最新的旗舰模型,专为高级编码、软件工程和长周期智能体任务而构建。拥有 1M 令牌上下文窗口、最高 128K 输出令牌、强大的推理和工具使用能力,非常适合编码智能体、复杂开发工作流和多步骤自动化。
上下文窗口
1M Token
最大输出
128K Token
发布日期
2026年8月19日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $1.1429/M | $4/M | $0.2857/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
GLM-5.3 面向复杂编程、长程 Agent 任务、网络安全分析和可调节推理,适合高难度文本工程工作。
模型通过后训练强化复杂编程和项目级工程能力,可处理需要多步骤协调推理的任务。
模型可在长时间 Agent 工作流中保持任务目标,持续规划、执行并修订结果。
后训练增强了漏洞发现和后续利用阶段分析能力,可用于经过授权的安全工作。
GLM-5.3 适合大型软件项目、长时间运行的工程 Agent,以及经过授权的漏洞研究或代码安全审查。
规划架构改动、跨多个文件实现功能、运行检查,并根据执行反馈修订方案。
管理多步骤依赖,将工程任务从问题分析推进到实现和验证。
在授权评估中检查源代码的潜在漏洞,追踪可利用条件,并编写修复建议。
curl 'https://us-api.tokenhub.com/v1/messages' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"关于在 TokenHub 使用 GLM-5.3 的实用问答。
GLM-5.3 是 Z.ai 面向复杂软件工程和长程智能体任务的旗舰文本模型。它与 GLM-5.2 使用相同的基础模型,改进主要来自后训练。
它适合代码库级编程、调试、重构、终端工作流、工具调用型智能体,以及需要持续推理的其他多步骤技术任务。
它的优势包括智能体编程、长程执行、函数调用、结构化输出、上下文缓存和可配置的推理强度。Z.ai 还报告其防御性漏洞分析能力有显著提升。
GLM-5.3 仅接受文本输入且始终启用推理。更高的推理强度可能增加延迟和令牌消耗。应审核生成的代码与事实性陈述,并仅在获得授权的环境中使用其安全能力。
在 TokenHub API 请求中选择 glm-5.3 模型标识,并使用 TokenHub 账户提供的接口地址和凭据。正式使用前,建议先发送小型请求并确认支持的参数。
Z.ai 公布的 GLM-5.3 API 价格为每百万输入令牌 1.40 美元、每百万输出令牌 4.40 美元,并向 GLM Coding Plan 用户提供。TokenHub 的价格、配额和地区可用性可能不同,请在使用前查看当前模型页面。
当编程质量、工具调用和长时间运行的智能体任务更重要时,可优先选择它。简单请求可考虑更快或更便宜的模型;需要理解图片、截图或文档时,应选择具备视觉能力的模型。
通过一个 API Key 接入 GLM-5.3 与更多 AI 模型。
GLM-5.3 媒体与演示
精选的 GLM-5.3 公开公告、讨论与视频。
X (Twitter)
Reddit
YouTube