Skip to content

GLM-5.3-Flash

适用场景

GLM-5.3-Flash 适合日常对话、编程辅助和图文理解任务。调用前在实时模型目录确认模型 ID、能力与价格。

模型标识与能力

项目说明
Token Factory 模型 IDglm-5.3-flash
上游输入 / 输出文本、图片、视频、文件 / 文本
上游上下文1M token
上游最大输出128K token
当前入口最大输出128,000 token
思考模式始终开启,可调整推理强度

智谱于 2026-08-26 发布 GLM-5.3-Flash。它与仅接受文本的 GLM-5.3 使用不同的模型 ID。上游规格来自原厂公开说明,当前入口的输出上限单独列出;实际支持的输入形式以本页说明为准。官方模型说明官方发布记录

调用方式

OpenAI Chat Completions 和 Anthropic Messages 两个入口均支持文本对话和流式响应。

本模型当前不提供 Responses 生成或 Responses Compact。

快速开始准备 API Key 与账户余额,两种请求均设置 Content-Type: application/json

OpenAI Chat Completions

请求地址为 POST https://api.tokenfactory.cn/v1/chat/completions,鉴权头为 Authorization: Bearer <TOKENFACTORY_API_KEY>

json
{
  "model": "glm-5.3-flash",
  "max_tokens": 4096,
  "messages": [{ "role": "user", "content": "用三点解释缓存命中与缓存未命中的区别。" }],
  "stream": false
}

字段与响应格式见对话补全。配置 OpenAI 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/v1

Anthropic Messages

请求地址为 POST https://api.tokenfactory.cn/anthropic/v1/messages,请求头为:

http
Content-Type: application/json
x-api-key: <TOKENFACTORY_API_KEY>
anthropic-version: 2023-06-01
json
{
  "model": "glm-5.3-flash",
  "max_tokens": 4096,
  "messages": [{ "role": "user", "content": "用三点解释缓存命中与缓存未命中的区别。" }],
  "stream": false
}

stream 改为 true 可使用流式响应,按 Anthropic 消息接口对话补全处理对应 SSE 事件。配置 Anthropic 兼容客户端时,Base URL 为 https://api.tokenfactory.cn/anthropic;工具配置步骤见兼容客户端配置

思考与多轮消息

原厂 GLM-5.3-Flash 始终开启思考,thinking.type 仅接受 enabled。文本参数与 GLM-5.3 对齐,reasoning_effort 支持 lowhighmax,默认 max;不能通过 disabled 关闭思考。这些模型扩展参数应按所选入口的实际支持情况使用。官方参数说明

需要工具调用时,请使用 OpenAI Chat Completions 入口,该入口已验证工具调用和工具结果回传。Anthropic Messages 当前提供文本、流式和图片理解,不承诺完整工具调用流程。

Chat 工具调用应保留完整历史消息及相应的思考内容,使用 reasoning_contenttool_callsrole: "tool",不要混入 Anthropic 的工具内容块格式。

图片与接口边界

两个入口均已使用 PNG Base64 合成单图确认图片理解可用;其他图片格式和外链图片尚未核验。

原厂图像请求使用 user 消息中的内容块数组,每张图片使用一个 image_url 块,可传图片 URL 或 Base64 Data URL。视频、文件与图片是不同的输入形式,不能从图片理解能力推断其他输入也可使用。官方视觉说明

图像理解输出文本,生成和编辑图片应选择具有相应能力的模型。Token Factory 未提供原厂 Files 生命周期,请以本页调用方式和对应 API 文档为准。

OpenAI 图片请求

沿用前述 OpenAI 地址和鉴权,将 <BASE64_IMAGE_DATA> 替换为 PNG 图片的 Base64 内容:

json
{
  "model": "glm-5.3-flash",
  "max_tokens": 4096,
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "描述这张图片中的主要内容。"
        },
        {
          "type": "image_url",
          "image_url": {
            "url": "data:image/png;base64,<BASE64_IMAGE_DATA>"
          }
        }
      ]
    }
  ],
  "stream": false
}

Anthropic 图片请求

沿用前述 Anthropic 地址和鉴权。source.data 只放 Base64 内容,不包含 data:image/png;base64, 前缀:

json
{
  "model": "glm-5.3-flash",
  "max_tokens": 4096,
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "描述这张图片中的主要内容。"
        },
        {
          "type": "image",
          "source": {
            "type": "base64",
            "media_type": "image/png",
            "data": "<BASE64_IMAGE_DATA>"
          }
        }
      ]
    }
  ],
  "stream": false
}

价格与平台折扣

实时模型目录查看输入、缓存输入、输出单价及当前平台折扣。目录展示的是折扣后的最终单价,不要再次乘折扣。

原厂按输入、缓存命中输入和输出 token 分别计费;本模型没有按时段或输入长度切换的价格阶梯。图像理解按输入 token 计量,不按图像生成的张数单独收费。原厂优惠与平台当前价格可能随时间变化,以实时目录返回值为准。官方价格说明

变化与下架

  • 停用时间:以实时模型目录和正式变更说明为准。
  • 影响范围:本页对应 glm-5.3-flash,不将名称相近的文本模型视为同一模型。
  • 替代选项:从实时目录重新选择模型,重新评估输入形式和图片理解效果。
  • 行动建议:模型不再返回时停止新请求,并通过本页查看迁移说明。

官方规格核验日期:2026-09-10。

Token Factory · 国产合规 AI Gateway