Skip to content

DeepSeek V4 Flash

本页介绍 DeepSeek V4 Flash 的上游公开能力、适用场景和 Token Factory 接入方式。

上游能力来源

DeepSeek 官方当前将 deepseek-v4-flash 列为 API 模型,而不是 Token Factory 自造别名。官方公开规格为 1M 上下文、最大 384K 输出,支持思考与非思考模式,并列出 JSON Output、Tool Calls、前缀续写和非思考模式 FIM 能力。

以上为上游能力来源,不等于 Token Factory 对延迟、全部字段或兼容行为作出承诺。

适用场景

适合优先评估需要长上下文、工具调用或高吞吐响应的文本任务;具体模式和字段仍需按 API Reference 与实时调用结果核对。

在 Token Factory 中选择

实时模型目录查看 Token Factory 当前使用的 modelId 和价格,并将目录返回的模型 ID 用于请求。

变化与下架

  • 停用时间:以实时模型目录和正式变更说明为准。
  • 影响范围:若目录停止返回该模型,本页将补充受影响的模型 ID 和入口。
  • 替代选项:确认功能和迁移条件后在此列出,不默认将其他模型视为等价替代。
  • 行动建议:调用前读取实时目录;模型不再返回时停止新请求,并按本页后续说明迁移。

Token Factory · 国产合规 AI Gateway