DeepSeek V4 Flash 0731 (batch)
DeepSeek V4 Flash 0731 · 批量推理档(Batch)
异步批量调用档:以折扣价处理离线批量请求,吞吐高、延迟不敏感,适合大规模非实时任务。
适用场景:大规模离线推理、成本敏感批处理、跑批与回填
本页为 DeepSeek V4 Flash 0731 的批量推理档,与其实时标准档共享底层模型能力,主要差异在计费模式与调用方式。标准实时档详见 DeepSeek V4 Flash 0731 标准实时档。
厂商:深度求索
DeepSeek V4 Flash 0731 is a sparse mixture-of-experts model from DeepSeek, with 13B active parameters out of 284B total. This re-post-trained revision is suited for coding, reasoning, and agent workflows....
关键参数
- 上下文长度:1M
- 最大输出:943.7K
- Tokenizer:DeepSeek
- 发布时间:2026-07-31
Token 定价
- 输入价格:$0.140 / 100 万 tokens
- 输出价格:$0.280 / 100 万 tokens
- 缓存读取价格:$0.030 / 100 万 tokens
- 综合单价:$0.175 / 100 万 tokens
输入输出模态
文本
典型用例
- 深度推理与复杂分析:处理长篇法律文书、学术论文、财报,在超长上下文中进行多跳推理与证据链追踪。(≈ $0.0022/次)
- 智能客服与对话:FAQ 自动应答、多轮对话、情绪识别,适合电商、金融、政务等场景。(≈ $0.0014/轮)
什么时候选这个模型
基于公开定价与能力字段派生的选型信号(非实测benchmark),最终选型请结合官方文档与你的评测。
- 输入与输出单价都较低,适合高频调用与大批量批处理。
- 综合单价低,舰队级(大规模)部署成本友好。
- 超长上下文(≥1M tokens),适合长文档问答、代码库分析、多轮 Agent。
- 最大输出 ≥30K tokens,适合深度报告 / 长文 / 文档起草。
相关问题
- DeepSeek V4 Flash 0731 (batch) 的 Token 定价是多少? 该模型的输入价为 $0.140 / 100 万 tokens,输出价为 $0.280 / 100 万 tokens,综合单价约 $0.175 / 100 万 tokens。具体价格以 深度求索 官方页面为准。
- DeepSeek V4 Flash 0731 (batch) 支持多大的上下文窗口? 上下文窗口为 1M,最大输出约 943.7K,适合处理长文档、多轮对话与复杂推理任务。
- DeepSeek V4 Flash 0731 (batch) 适合哪些使用场景? 基于其能力与定价,DeepSeek V4 Flash 0731 (batch) 最适合:深度推理与复杂分析、智能客服与对话。可在详情页「典型用例」区查看更详细的场景说明与成本估算。
- DeepSeek V4 Flash 0731 (batch) 支持哪些输入输出模态? 支持 文本 模态。
- DeepSeek V4 Flash 0731 (batch) 是免费模型吗? DeepSeek V4 Flash 0731 (batch) 按 Token 计费,不属于免费模型。
- DeepSeek V4 Flash 0731 (batch) 由哪家厂商提供? DeepSeek V4 Flash 0731 (batch) 由 深度求索 提供。
同厂商其他模型
查看完整信息:DeepSeek V4 Flash 0731 (batch)