ITBear旗下自媒体矩阵:

DeepSeek V4 Pro正式版登场:与Grok 4.6同日竞技,性能比肩Claude Fable 5且成本更低

   时间:2026-08-13 15:39:47 来源:天脉网编辑:快讯 IP:北京 发表评论无障碍通道
 

科技圈再度被一场悄无声息的“升级风暴”席卷——DeepSeek在未发布任何正式公告的情况下,将其V4 Pro模型从预览版升级为正式版,版本号更新为DeepSeek-V4-Pro-0813。这一动作最初由用户在DeepSeek API的模型与价格页面发现:原“deepseek-v4-pro”的标识被替换为新版本号,随后通过OpenRouter平台确认,该模型已支持100万Token上下文,输入价格为每百万Token 0.435美元,输出价格为0.87美元,缓存命中输入成本更低至0.003625美元/百万Token。

价格优势成为新版本最直接的冲击点。与Anthropic的Fable 5相比,后者输入每百万Token需10美元,输出高达50美元,综合均价约30美元,而DeepSeek新版本仅需0.65美元,成本差距达46倍。若考虑实际任务中的推理耗时与文本生成量差异,这一差距可能进一步扩大。据第三方分析,Fable 5在基准测试中单任务成本达3.15美元,而DeepSeek此前版本V4-Flash仅需3美分,价差超百倍。尽管新版本0813的单任务成本尚未公布,但其定价策略已引发行业对AI工具规模化应用成本的重新评估。

性能提升则是另一重惊喜。DeepSeek官方群发布的10项智能体基准测试显示,在Claude Fable 5或其他模型领先的8项测试中,新版本与对手的性能差距微乎其微——Fable 5平均领先5.3%,但剔除“无工具版人类终极考试”这一极端样本后,剩余项目平均差距仅2.8%。更关键的是,在考察AI编程Agent长周期软件工程能力的DeepSWE测试中,新版本得分从预览版的12.8跃升至62.7,暴涨近5倍。这一测试要求模型进入复杂开源代码仓库,自主完成代码理解、多文件修改、测试运行与修正等全流程任务,其得分飙升意味着模型处理复杂工程任务的能力实现质变。

新版本在网络安全攻防(CyberGym)与自动化能力(AutomationBench)两项测试中反超Fable 5,进一步巩固其在特定场景下的优势。DeepSeek将这一成果归因于模型架构的优化,尤其是稀疏KV Cache技术的突破,使其在保持低成本的同时,实现了与闭源模型同级的缓存命中率,甚至可能推动SSD KV Cache成为AI基础设施的标准配置。

就在DeepSeek升级消息引发讨论的同时,马斯克旗下xAI公司也官宣了Grok 4.6的发布。这款新模型同样聚焦AI Agent与复杂任务处理,基于Grok 4.5强化了长时间运行能力、交互与视觉任务处理,可应对研究、信息分析及跨代码库开发等场景。其性能在多项基准测试中达到前沿水平,与GPT-5.6 Sol持平,并通过Cursor、Grok Build等平台及API提供服务,输入价格为每百万Token 2美元,输出6美元。Grok 4.6的定价策略与DeepSeek形成鲜明对比:前者强调性能突破,后者则以成本碾压,两者的“同日登场”为AI模型竞争增添了新变量。

开发者社区已迅速展开实测对比。在Hacker News讨论区,一名用户将V4 Pro 0813与Grok 4.6置于同一编程环境中测试新功能开发:V4 Pro耗时12分02秒、成本0.12美元,但出现Bug;Grok 4.6仅用3分18秒、成本1.41美元,且无错误。这一结果引发关于模型能力评估的讨论——单一任务表现能否代表整体水平?有开发者指出,Agent的随机性意味着单次测试结果仅供参考,但DeepSeek新版本在成本与性能的平衡上已展现出独特竞争力。

行业观察者认为,DeepSeek的升级路径揭示了AI模型竞争的新趋势:从单纯追求性能超越,转向通过技术优化压缩成本边界。若其公布的测试数据经第三方验证,顶级闭源模型与开源模型之间的性能差距可能进一步缩小,而AI工具的普及速度或将因成本下降而加速。这场“静默升级”背后,不仅是技术实力的较量,更是AI商业化逻辑的重构——当性能接近时,成本可能成为决定模型生死的关键因素。

 
 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version