Skip to content

GLM-5.3

适用场景

GLM-5.3 适合代码库分析、复杂工程任务、知识整理和需要多步工具协作的文本任务。调用前在实时模型目录确认模型仍可用。

模型标识与能力

项目说明
Token Factory 模型 IDglm-5.3
输入 / 输出文本 / 文本
上游上下文1M token
上游最大输出128K token
当前入口最大输出128,000 token
思考模式始终开启,可调整推理强度

智谱于 2026-08-19 发布 GLM-5.3。输入与生成内容仍受上下文限制,上游最大规格不代表每个接入入口都能达到。官方模型说明官方发布记录

GLM-5.3 是文本模型。需要理解截图、图表和图片时,请查看 GLM-5.3-Flash 等视觉模型的实际输入支持范围。

调用方式

OpenAI Chat Completions 和 Anthropic Messages 两个入口均已验证普通请求、流式响应,以及工具调用和工具结果回传。

快速开始准备 API Key 与账户余额,两种请求均设置 Content-Type: application/json

OpenAI Chat Completions

请求地址为 POST https://api.tokenfactory.cn/v1/chat/completions,鉴权头为 Authorization: Bearer <TOKENFACTORY_API_KEY>

json
{
  "model": "glm-5.3",
  "max_tokens": 4096,
  "messages": [{ "role": "user", "content": "为一个订单服务列出三个关键测试场景。" }],
  "stream": false
}

字段与响应格式见对话补全。配置 OpenAI 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/v1

Anthropic Messages

请求地址为 POST https://api.tokenfactory.cn/anthropic/v1/messages,请求头为:

http
Content-Type: application/json
x-api-key: <TOKENFACTORY_API_KEY>
anthropic-version: 2023-06-01
json
{
  "model": "glm-5.3",
  "max_tokens": 4096,
  "messages": [{ "role": "user", "content": "为一个订单服务列出三个关键测试场景。" }],
  "stream": false
}

stream 改为 true 可使用流式响应,按 Anthropic 消息接口对话补全处理对应 SSE 事件。配置 Anthropic 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/anthropic;工具配置步骤见兼容客户端配置

思考与工具调用

原厂 GLM-5.3 始终开启思考,thinking.type 仅接受 enabled,不能通过 disabled 关闭。reasoning_effort 支持 lowhighmax,默认 max。这些模型扩展参数应按所选入口的实际支持情况使用。官方参数说明

多轮工具调用应完整保留相应协议的历史消息。Chat 使用 tool_callsrole: "tool";Anthropic 使用 tool_use / tool_result 内容块。保留响应返回的思考内容,不把它拼接到普通文本字段,也不要混用两种消息格式。

本模型当前不提供 Responses 生成或 Responses Compact。其他接口字段见对应 API 文档

价格与平台折扣

实时模型目录查看输入、缓存输入、输出单价及当前平台折扣。目录展示的是折扣后的最终单价,不要再次乘折扣。

原厂价目按三类 token 分别计费,本模型未列按输入长度或时段切换的阶梯。思考会产生输出 token,工具结果和后续历史消息也会计入输入用量。官方价格说明

变化与下架

  • 停用时间:以实时模型目录和正式变更说明为准。
  • 影响范围:本页对应 glm-5.3,与其他 GLM 版本分别管理。
  • 替代选项:从实时目录重新选择模型,复核上下文、工具消息格式和价格。
  • 行动建议:模型不再返回时停止新请求,并通过本页查看迁移说明。

官方规格核验日期:2026-09-10。

Token Factory · 国产合规 AI Gateway