×
加载中...
DeepSeek V4 Pro 正式上线
鞭牛士 2026-08-13 07:12

8月13日消息,DeepSeek 已正式发布其 V4 Pro 型号,并在其定价页面上将其版本号列为 DeepSeek-V4-Pro-0813。


这款旗舰级产品拥有 100 万个token的上下文窗口和 38.4 万个token的最大输出,默认采用思考模式,同时还提供了一个非思考模式的端点,用于处理对延迟敏感的调用。


对于大型代码库、大型文档语料库和多步骤代理运行,100 万输入和 38.4 万输出的组合意味着单次调用即可摄取和生成比上一代产品多得多的内容。


DeepSeek 还集成了大多数代理开发者现在所期望的功能:结构化 JSON 输出、工具调用、Responses API 和 Anthropic API 兼容性,以及对对话前缀延续和 FIM 补全的测试版支持(FIM 仅限非思考模式)。


在底层架构方面,该服务同时提供 OpenAI 和 Anthropic 兼容的接口,因此已经在使用任一标准的团队无需重新配置技术栈即可轻松切换。


同时,定价也体现了有意划分的层级。Pro 的缓存命中费用为每百万token 0.025 元,缓存未命中(输入)费用为 3 元,缓存未命中(输出)费用为 6 元。


相比之下,Flash 的相应费用分别为 0.02 元、1 元和 2 元,这意味着 Pro 在缓存未命中(输入和输出)方面的成本大约是 Flash 的三倍。并发限制也进一步强化了这种差异:Flash 支持 2500 个并发请求,而 Pro 的并发请求上限为 500 个。


这一比例表明V4系列产品的结构更加清晰。Flash面向高频、高吞吐量的流量,成本是其主要考量因素。Pro则将容量集中于更复杂的推理、长上下文编码和代理工作流程,这些场景下,该模型拥有更大的性能提升空间。Pro的绝对价格按前沿模型的标准来看仍然适中,这使得DeepSeek能够在弥补近期价格上涨带来的成本的同时,仍然低于大多数海外竞争对手。


随着 DeepSeek-V4-Pro-0813 的推出,V4 产品线实际上提供了两条轨道:低成本、高并发的 Flash 层用于扩展,以及更高规格的 Pro 层,专门针对编码和代理用例。

扫码下载app 最新资讯实时掌握