突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

APPSO 2026-08-12 23:47
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5图1
就在刚刚,DeepSeek V4 Pro 正式版来了。
最新的模型与价格页面显示,deepseek-v4-pro 对应模型版本已经更新为 DeepSeek-V4-Pro-0813。
从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。
对于长代码库、大规模文档处理以及需要连续执行大量步骤的 Agent 任务来说,1M 上下文和 384K 最大输出,意味着一次调用能够容纳和生成的内容规模都相当可观。
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5图2
配套能力也基本覆盖了目前主流的 Agent 开发需求。
deepseek-v4-pro 支持 JSON Output、Tool Calls、Responses API、Anthropic API,同时支持 Beta 阶段的对话前缀续写与 FIM 补全,其中 FIM 补全仅限非思考模式使用。
API 接入方式则同时兼容 OpenAI 和 Anthropic 两套格式。
更值得关注的还是价格。DeepSeek 此前发布公告,宣布计划近期整体上调 API 服务定价,现在靴子落定。
deepseek-v4-pro 当前每百万 Token 的价格分别为:缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元。
相比之下,deepseek-v4-flash 分别为 0.02 元、1 元和 2 元。也就是说,在缓存未命中输入和输出两个主要计费项目上,Pro 的价格都是 Flash 的 3 倍。
两者的并发限制也有所区别。deepseek-v4-flash 的并发限制为 2500,deepseek-v4-pro 则为 500。
跑分图如下:
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5图3
此外,从价格和并发配置来看,Flash 更明显地面向高频、大规模调用场景,而 Pro 则把资源进一步集中到规格更高的任务上。即便如此,V4 Pro 目前的绝对调用成本依旧不算太高。
随着 DeepSeek-V4-Pro-0813 出现,V4 系列的产品结构也进一步清晰起来:
Flash 主打更低成本和更高并发,Pro 则提供更高规格的模型服务,并围绕 Tool Calls、Responses API、Anthropic API 等能力继续向 Agent 和 Coding 场景延伸。
今晚又是一个不眠夜。
官方博客地址:
https://api-docs.deepseek.com/zh-cn/quick\_start/pricing
我们正在招募伙伴
📮 简历投递邮箱hr@ifanr.com
✉️ 邮件标题「姓名+岗位名称」(请随简历附上项目/作品或相关链接)
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5图4

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
more
半导体全链聚合,IICIE国际集成电路创新博览会9月深圳举办
AMD为什么押注一个违背半导体周期的AI芯片方向?
韩国拟设5万亿韩元半导体专项基金
半导体AI困局:七成项目卡死在试点阶段
8点1氪:马斯克个人财富亏掉2个“黄仁勋”;上海雪花膏母公司破产;日本半导体或面临断供
韩国高官:中国半导体发展太快了,韩国要跟上
40年半导体量测史,芯片微缩背后的技术接力
Omdia: AI需求激增,2026年半导体市场增幅上调至94.1%
台积电突破二维半导体界面瓶颈,助力芯片迈向1纳米以下
Omdia:2026年半导体市场增幅上调至94.1%
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号