人工智能大模型领域正迎来新一轮技术竞赛。8月12日,DeepSeek与马斯克旗下SpaceXAI同日推出新版本模型DeepSeek-V4-Pro和Grok 4.6,引发行业高度关注。第三方评测数据显示,这两款模型在多项关键指标上已接近全球顶尖水平,标志着中美大模型竞争进入新阶段。
DeepSeek-V4-Pro在智能体能力方面实现突破性进展。根据官方公布的测试结果,该模型在软件工程、数据科学、终端操作等核心场景的得分较预览版提升3-4倍。其中终端操作测试Terminal Bench 2.1得分达87.9,网络安全测试Cybergym得分83.3,均超过Anthropic旗下Claude Opus 4.8的同期表现。半导体研究机构SemiAnalysis对比发现,V4-Pro在终端操作任务中的表现是英伟达Nemotron 3 Ultra的1.63倍。
技术升级伴随商业模式创新。DeepSeek宣布自2026年8月17日起实施峰谷定价机制,将每日划分为9:00-12:00、14:00-18:00两个高峰时段,其余时间为空闲时段。新定价体系下,百万Tokens输出价格在高峰时段最高达27元,空闲时段则降至13.5元。这种差异化定价策略在行业引发讨论,此前该模型曾通过限时折扣创造全球最低价纪录。
SpaceXAI推出的Grok 4.6展现出显著的成本优势。在Artificial Analysis最新智能指数评测中,Grok 4.6以61分追平OpenAI旗舰模型GPT-5.6 Sol,单任务平均成本仅0.84美元,与Kimi K3持平。价格体系显示,其百万Tokens输入输出价格分别为2美元和6美元,仅为Claude Opus 5(5/25美元)和GPT-5.6 Sol(5/30美元)的40%和20%。马斯克在社交平台连续转发相关评测,强调新模型在智能水平、响应速度和成本效益的综合优势。
行业格局正在发生深刻变化。摩根士丹利研报指出,中国大模型市场正从价格竞争转向技术比拼。2026年第二季度,国内主流厂商API平均输入价格升至4.9元/百万Tokens,输出价格达21.9元,较年初分别上涨48%和80%。与之形成对比的是,美国闭源模型价格持续下探,中美大模型价差从2025年一季度的20倍缩小至当前的7倍。该机构分析认为,模型智能水平而非价格将成为长期竞争的关键,持续的技术投入需要合理的利润空间支撑。
技术演进呈现明显分化特征。DeepSeek-V4-Pro支持100万Tokens上下文窗口和38.4万Tokens输出,兼容OpenAI与Anthropic双API标准;Grok 4.6则专注于长时间运行智能体和复杂交互场景。这种差异化发展路径反映出,头部企业正通过技术深耕构建竞争壁垒。市场观察人士指出,随着模型能力边界不断拓展,单纯的价格竞争已难以维持,构建健康商业生态成为行业共识。










