切换外观
GLM-5.3-Flash
适用场景
GLM-5.3-Flash 适合日常对话、编程辅助和图文理解任务。调用前在实时模型目录确认模型 ID、能力与价格。
模型标识与能力
| 项目 | 说明 |
|---|---|
| Token Factory 模型 ID | glm-5.3-flash |
| 上游输入 / 输出 | 文本、图片、视频、文件 / 文本 |
| 上游上下文 | 1M token |
| 上游最大输出 | 128K token |
| 当前入口最大输出 | 128,000 token |
| 思考模式 | 始终开启,可调整推理强度 |
智谱于 2026-08-26 发布 GLM-5.3-Flash。它与仅接受文本的 GLM-5.3 使用不同的模型 ID。上游规格来自原厂公开说明,当前入口的输出上限单独列出;实际支持的输入形式以本页说明为准。官方模型说明、官方发布记录
调用方式
OpenAI Chat Completions 和 Anthropic Messages 两个入口均支持文本对话和流式响应。
本模型当前不提供 Responses 生成或 Responses Compact。
按快速开始准备 API Key 与账户余额,两种请求均设置 Content-Type: application/json。
OpenAI Chat Completions
请求地址为 POST https://api.tokenfactory.cn/v1/chat/completions,鉴权头为 Authorization: Bearer <TOKENFACTORY_API_KEY>。
json
{
"model": "glm-5.3-flash",
"max_tokens": 4096,
"messages": [{ "role": "user", "content": "用三点解释缓存命中与缓存未命中的区别。" }],
"stream": false
}字段与响应格式见对话补全。配置 OpenAI 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/v1。
Anthropic Messages
请求地址为 POST https://api.tokenfactory.cn/anthropic/v1/messages,请求头为:
http
Content-Type: application/json
x-api-key: <TOKENFACTORY_API_KEY>
anthropic-version: 2023-06-01json
{
"model": "glm-5.3-flash",
"max_tokens": 4096,
"messages": [{ "role": "user", "content": "用三点解释缓存命中与缓存未命中的区别。" }],
"stream": false
}将 stream 改为 true 可使用流式响应,按 Anthropic 消息接口或对话补全处理对应 SSE 事件。配置 Anthropic 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/anthropic;工具配置步骤见兼容客户端配置。
思考与多轮消息
原厂 GLM-5.3-Flash 始终开启思考,thinking.type 仅接受 enabled。文本参数与 GLM-5.3 对齐,reasoning_effort 支持 low、high、max,默认 max;不能通过 disabled 关闭思考。这些模型扩展参数应按所选入口的实际支持情况使用。官方参数说明
需要工具调用时,请使用 OpenAI Chat Completions 入口,该入口已验证工具调用和工具结果回传。Anthropic Messages 当前提供文本、流式和图片理解,不承诺完整工具调用流程。
Chat 工具调用应保留完整历史消息及相应的思考内容,使用 reasoning_content、tool_calls 和 role: "tool",不要混入 Anthropic 的工具内容块格式。
图片与接口边界
两个入口均已使用 PNG Base64 合成单图确认图片理解可用;其他图片格式和外链图片尚未核验。
原厂图像请求使用 user 消息中的内容块数组,每张图片使用一个 image_url 块,可传图片 URL 或 Base64 Data URL。视频、文件与图片是不同的输入形式,不能从图片理解能力推断其他输入也可使用。官方视觉说明
图像理解输出文本,生成和编辑图片应选择具有相应能力的模型。Token Factory 未提供原厂 Files 生命周期,请以本页调用方式和对应 API 文档为准。
OpenAI 图片请求
沿用前述 OpenAI 地址和鉴权,将 <BASE64_IMAGE_DATA> 替换为 PNG 图片的 Base64 内容:
json
{
"model": "glm-5.3-flash",
"max_tokens": 4096,
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "描述这张图片中的主要内容。"
},
{
"type": "image_url",
"image_url": {
"url": "data:image/png;base64,<BASE64_IMAGE_DATA>"
}
}
]
}
],
"stream": false
}Anthropic 图片请求
沿用前述 Anthropic 地址和鉴权。source.data 只放 Base64 内容,不包含 data:image/png;base64, 前缀:
json
{
"model": "glm-5.3-flash",
"max_tokens": 4096,
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "描述这张图片中的主要内容。"
},
{
"type": "image",
"source": {
"type": "base64",
"media_type": "image/png",
"data": "<BASE64_IMAGE_DATA>"
}
}
]
}
],
"stream": false
}价格与平台折扣
从实时模型目录查看输入、缓存输入、输出单价及当前平台折扣。目录展示的是折扣后的最终单价,不要再次乘折扣。
原厂按输入、缓存命中输入和输出 token 分别计费;本模型没有按时段或输入长度切换的价格阶梯。图像理解按输入 token 计量,不按图像生成的张数单独收费。原厂优惠与平台当前价格可能随时间变化,以实时目录返回值为准。官方价格说明
变化与下架
- 停用时间:以实时模型目录和正式变更说明为准。
- 影响范围:本页对应
glm-5.3-flash,不将名称相近的文本模型视为同一模型。 - 替代选项:从实时目录重新选择模型,重新评估输入形式和图片理解效果。
- 行动建议:模型不再返回时停止新请求,并通过本页查看迁移说明。
官方规格核验日期:2026-09-10。