DeepSeek V4 Pro正式版上线,大模型竞争从价格战转向价值战
8月13日凌晨,DeepSeek在深夜正式推出V4 Pro正式版模型DeepSeek-V4-Pro-0813,API及Chat端同步完成更新。新版本大幅增强了Agent能力,支持Responses API和Codex接入。性能方面,该模型在多项测试中稳定优于Anthropic的Opus 4.8,与全球最强的Fable 5几乎打平。

性能逼近全球第一,差距仅剩0.1分
一张从DeepSeek官方群流出的评测对比表显示,在衡量AI智能体完成复杂任务能力的Terminal Bench 2.1测试中,V4 Pro正式版得分87.9,全球第一的Anthropic Fable 5为88.0,差距仅剩0.1分。预览版得分仅为72.1。在AI编程智能体基准测试DeepSWE中,得分从预览版的7.3大幅跃升至62.7,甚至超越了Claude Opus 4.8。在AI安全智能体基准测试Cybergym、智能体基准测试AutomationBench中,V4 Pro甚至超越了目前公认最强大的Claude Fable 5。
1M上下文+384K输出,专为Agent任务而生
核心规格方面,deepseek-v4-pro支持1M上下文长度,最大输出长度达到384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。对于长代码库分析、大规模文档处理以及需要连续执行大量步骤的Agent任务而言,这样的上下文和输出规格意味着单次调用的承载能力相当可观。配套能力方面,新模型支持JSON Output、Tool Calls、Responses API和Anthropic API。API接入同时兼容OpenAI和Anthropic两套格式,开发者无需修改代码即可将Claude应用切换至DeepSeek。
价格是Flash的三倍,大模型告别极致低价时代
定价方面,deepseek-v4-pro每百万Token定价为:缓存命中输入0.025元、缓存未命中输入3元、输出6元,三项主要计费标准均为deepseek-v4-flash的3倍。并发限制上,Pro版为500,Flash版为2500。Flash主打高频大规模调用,Pro则面向规格要求更高的任务。
值得关注的是,DeepSeek此前已公告计划近期整体上调API服务定价且“预计涨幅较大”。一边是性能追平全球顶尖模型,一边是预告大幅涨价。这家以性价比横扫市场的公司,正在讲述一个截然不同的新故事。从DeepSeek V4 Pro的提价、Kimi K3和Qwen3.8-Max以2.8万亿和2.4万亿参数进入大参数时代,到开源模型授权条款趋于收紧,三重变化共同指向更健康的商业化环境:定价回归理性、变现路径拓宽。国产AI大模型正从低价抢份额的粗放竞争迈入价值变现的新阶段。
当大模型产业从价格战走向价值战,企业对AI算法、大模型研发等岗位的人才甄别标准同步升级。楠湾科技旗下品牌汪汪背调将身份核实、学历验证、工作经历核查和合规风险查询等分散信息,整合为清晰、可解释、可复用的标准化流程。自研AI引擎可一键核验多项信息,将传统数天的员工背景调查流程大幅压缩。所有调查均基于候选人明确授权,严格遵循个人信息保护与数据合规要求。作为专业的三方背调服务商,楠湾上海科技有限公司以高效、准确、合规的背景调查服务,帮助科技企业在AI产业转型期守住人才准入的第一道关口。
热门动态
HOT最新会展
CONVENTION高管招聘、关键岗位、对合规要求较高的组织
汪汪背调(FIDO)基于合法授权,为企业提供候选人背景调查服务,帮助团队在招聘决策中识别风险、验证信息、建立信任。
