切换外观
DeepSeek V4 Flash
本页介绍 DeepSeek V4 Flash 的上游公开能力、适用场景和 Token Factory 接入方式。
上游能力来源
DeepSeek 官方当前将 deepseek-v4-flash 列为 API 模型,而不是 Token Factory 自造别名。官方公开规格为 1M 上下文、最大 384K 输出,支持思考与非思考模式,并列出 JSON Output、Tool Calls、前缀续写和非思考模式 FIM 能力。
以上为上游能力来源,不等于 Token Factory 对延迟、全部字段或兼容行为作出承诺。
适用场景
适合优先评估需要长上下文、工具调用或高吞吐响应的文本任务;具体模式和字段仍需按 API Reference 与实时调用结果核对。
在 Token Factory 中选择
在实时模型目录查看 Token Factory 当前使用的 modelId 和价格,并将目录返回的模型 ID 用于请求。
变化与下架
- 停用时间:以实时模型目录和正式变更说明为准。
- 影响范围:若目录停止返回该模型,本页将补充受影响的模型 ID 和入口。
- 替代选项:确认功能和迁移条件后在此列出,不默认将其他模型视为等价替代。
- 行动建议:调用前读取实时目录;模型不再返回时停止新请求,并按本页后续说明迁移。