Zhipu AI
GLM 5.3 Flash
GLM-5 系列中兼顾前沿能力与调用效率的 Flash 模型:原生支持多模态,面向长上下文和高频执行,适合代码、智能体以及需要图文理解的复杂任务;相比更大档位,更适合作为成本敏感的生产主力。
- 推理
- 工具调用
- 结构化输出
- 长上下文
AI 对话
输入提示词,在这里查看模型回复。
glm-5.3-flash有什么可以帮你?
向这个模型提问,也可以结合上下文继续追问。
USD /1M tokens
价格
| 分组 | 输入 | 输出 | 缓存读 |
|---|---|---|---|
| default | $0.119 | $0.419999 | $0.014697 |
default
输入$0.119输出$0.419999缓存读$0.014697
展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。
API
代码示例
curl --location --request POST 'https://api.tokenhot.ai/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
"model": "glm-5.3-flash",
"messages": [
{
"role": "user",
"content": "What model are you"
}
]
}'FAQ
常见问题
GLM 5.3 Flash 适合哪些场景?
GLM 5.3 Flash 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。
GLM 5.3 Flash 如何计费?
价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。
如何调用 GLM 5.3 Flash?
使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。
开始使用
使用 GLM 5.3 Flash 构建
API