DeepSeek V4 Pro正式上线
2026-08-15 · 美港通证券
8月12日晚,DeepSeek正式发布V4 Pro型号,并在定价页面上将版本号列为DeepSeek-V4-Pro-0813。 这款旗舰级产品拥有100万个令牌的上下文窗口和38.4万个令牌的最大输出,默认采用思考模式,同时还提供了一个非思考模式的端点,用于处理对延迟敏感的调用。 对于大型代码库、大型文档语料库和多步骤代理运行,100万输入和38.4万输出的组
8月12日晚,DeepSeek正式发布V4 Pro型号,并在定价页面上将版本号列为DeepSeek-V4-Pro-0813。
这款旗舰级产品拥有100万个令牌的上下文窗口和38.4万个令牌的最大输出,默认采用思考模式,同时还提供了一个非思考模式的端点,用于处理对延迟敏感的调用。
对于大型代码库、大型文档语料库和多步骤代理运行,100万输入和38.4万输出的组合意味着单次调用即可摄取和生成比上一代产品多得多的内容。
DeepSeek还集成了大多数代理开发者现在所期望的功能:结构化JSON输出、工具调用、Responses API和Anthropic API兼容性,以及对对话前缀延续和FIM补全的测试版支持(FIM仅限非思考模式)。
在底层架构方面,该服务同时提供 OpenAI和Anthropic兼容的接口,因此已经在使用任一标准的团队无需重新配置技术栈即可轻松切换。
Pro缓存命中费用为每百万代币0.025元,缓存未命中(输入)费用为3元,缓存未命中(输出)费用为6元。
相比之下,Flash的相应费用分别为0.02元、1元和2元,这意味着Pro在缓存未命中*输入和输出)方面的成本大约是 Flash的三倍。
并发限制也进一步强化了这种差异:Flash支持2500个并发请求,而Pro的并发请求上限为500个。这一比例表明V4系列产品的结构更加清晰。
Flash面向高频、高吞吐量的流量,成本是其主要考量因素。Pro则将容量集中于更复杂的推理、长上下文编码和代理工作流程,这些场景下,该模型拥有更大的性能提升空间。
Pro的绝对价格按前沿模型的标准来看仍然适中,这使得DeepSeek能够在弥补近期价格上涨带来的成本的同时,仍然低于大多数海外竞争对手。
随着DeepSeek-V4-Pro-0813的推出,V4产品线实际上提供了两条轨道:低成本、高并发的Flash层用于扩展,以及更高规格的 Pro 层,专门针对编码和代理用例。
伊朗-阿曼协议能否解决霍尔木兹海峡通航风险
“山寨机之王”失守手机,联发科50亿美元豪赌AI,能逃过“高通们”围剿吗
隆基绿能的“反内卷”市值管理,为什么不起作用
ETF风向标 | 算力硬件产业链反弹,地产股午后崛起,房地产ETF、地产ETF劲升4%,通信ETF涨3.6%,上证50ETF单日“吸金”11亿元,位居ETF首位
马斯克内部讲话:AI收入最早9月将超全部业务!
A股收评:创业板指涨1.49%,地产、CPO板块大涨
美股盘前要点 | 美国7月CPI同比增3.4%符合预期,云计算巨头CoreWeave飙升超21%
7月跌超20%!梁文峰旗下幻方量化大面积翻车
ETF风向标 | 算力硬件产业链反弹,地产股午后崛起,房地产ETF、地产ETF劲升4%,通信ETF涨3.6%,上证50ETF单日“吸金”11亿元,位居ETF首位
早报 (08.10)| 伊朗高层大换血!特朗普称要“低调处理”;宇树科技今日打新!中一签或暴赚20万;药明康德迎重大利好
AI存储需求挤爆产能!闪迪交“炸裂”财报仍难逃杀跌
马斯克内部讲话:AI收入最早9月将超全部业务!
声明 未经授权,不得复制、转载或以其他方式使用本站内容。格隆汇及授权的第三方信息提供者竭力确保数据准确可靠,但不保证数据绝对正确。
违法与不良信息举报热线:0755-86533750-821 举报邮箱:service@gelonghui.com