你有没有发现,这两天大模型圈的风向突然变了。
就在所有人都以为价格战会一路杀到底的时候,牌桌上的玩家们突然开始换打法了。
8月6号这天,发生了三件很有意思的事。
Meta发布了首款编程Agent Muse Code,定价直接比DeepSeek还便宜。
同一天,DeepSeek发公告说要涨价,而且涨幅不小。
字节跳动CEO梁汝波在中全会上公开说,我们大模型被海外拉开差距了,但坚持自研,接受短期落后。
好家伙,这剧本谁写的?

一、Meta杀疯了:缓存输入便宜75倍,不是做慈善,是要你的数据
你看这次Meta的定价,确实狠。
他们搞了个"贡献者套餐",只要你允许Meta用你的数据训练模型,就能享受折扣价。
数据共享版的输入价格是0.10美元/百万Tokens,比隐私版便宜12.5倍。
缓存输入更夸张,0.002美元/百万Tokens,便宜了整整75倍。
输出价格0.20美元/百万Tokens,也便宜21倍以上。
有网友算过账,Muse Spark的输入输出成本都比DeepSeek-V4-Flash低,缓存命中率还做了特殊优化。
这不是正常的商业定价,是赔本赚吆喝。
Meta不在乎这单赚不赚钱,他们在乎的是你手里的真实用户数据。
你想想,大模型训练到今天,公开数据集早就挖得差不多了。
真正有价值的,是开发者在真实编程场景里产生的高质量交互数据。
这些数据你花钱买都买不到,只能通过产品让用户自愿交出来。
扎克伯格这步棋,看得很远。

二、DeepSeek反套路:别人降价我涨价,这不是怂,是底气
很多人看到DeepSeek涨价第一反应是:他们扛不住价格战了?
恰恰相反。
7月31号DeepSeek-V4-Flash刚上线API的时候,价格是1元/百万Tokens输入,0.2元缓存命中,2元输出。
这个价格当时已经把整个行业卷到没朋友了。
但真正让海外开发者集体震惊的,不是价格,是性能。
拉美头部在线教育平台Platzi的CEO当天发文说:"我完全不明白DeepSeek-V4-Flash是怎么达到这种速度和质量的。"
在Almanbench测试里,Flash版本得分几乎媲美GPT-5.6 Sol xhigh,超越了Kimi K3。
海外网友直接喊出"Claude死了",说没有理由再用价格高出百倍、性能却差不多的供应商。
当你的产品强到这种程度,你还需要靠低价抢市场吗?
不需要了。
DeepSeek现在涨价,不是打不动了,是他们觉得自己的产品值这个价。
而且据可靠消息,他们正在紧锣密鼓地招Agent Harness人才,代号DeepSeek Code的产品马上就要出来。
价格战是最低级的竞争,他们要打的是下一场仗。

三、字节说实话了:接受短期落后,不是认输,是要打基本功
梁汝波这次的表态,在互联网圈传得很广。
他说大语言模型被海外领先模型拉开差距了,但字节坚持自研,做好基本功,接受短期落后。
坚持自研不是因为外部压力,是希望团队延迟满足感,打好技术基础,这对长期实现AGI至关重要。
说实话,这种公开承认落后的勇气,不是每家公司都有的。
过去两年大模型创业热潮里,我们见过太多"吊打GPT""全球第一"的口号。
真正敢站出来说"我们暂时落后,但我们在认真做事"的,少之又少。
字节这两年在AI上的投入其实不小。
今年年初他们就推出了桌面智能体QoderWork,之后腾讯WorkBuddy、阿里千问办公相继入场。
办公Agent这个赛道,国内互联网大厂已经全部就位了。
8月3号阿里刚发布Qwen3.8-Max和千问办公QwenWork,目标是打造"中国微软"。
腾讯、字节、阿里三家在办公场景的Agent战争,其实才刚刚开始。
OpenAI那边也没闲着,据说最快下周就要推出Astra模型,内部代号mewfour,是GPT-4.5以来训练的最大模型。
同时他们那款Jony Ive设计的AI智能音箱也曝光了,定价300到400美元,2027年发售。
你看,没人真的在躺平。

四、价格战只是序幕,真正的战场在Agent
很多人看今天的新闻,只看到了价格涨跌。
但你往深一层想,为什么Meta一边降价一边推编程Agent?
为什么DeepSeek涨价的同时在狂招Agent人才?
为什么国内大厂全部扎堆做办公Agent?
答案很简单:大模型本身的战争已经接近尾声,应用层的战争才刚开始。
基础模型能力再强,最终要落地到具体场景里才能产生价值。
编程是第一个被验证的Agent场景,因为代码世界规则明确、反馈清晰、商业价值直接。
Muse Code能处理大型代码库里的完整软件工程任务,从规划变更、写代码到验证结果一条龙。
这不是聊天机器人,是能真正帮你干活的数字同事。
Meta测试过让模型连续24小时、超过1000次工具调用来迭代优化GPU内核。
这种工作强度,哪个程序员扛得住?
但Agent能扛。
价格战打了这么久,Token越来越便宜,对开发者来说当然是好事。
可你有没有想过,当Token便宜到几乎免费的时候,什么才是真正值钱的?
是能把模型能力组织起来、解决真实问题的Agent产品。
是垂直场景里的工作流和数据积累。
是用户愿意为之付费的实际价值。
这不是大模型的终局,是真正的开始。
过去两年大家比的是谁家模型参数大、谁跑分高、谁价格低。
接下来两年,大家比的是谁家Agent真能干活、谁能把AI落到具体业务里、谁能赚到真金白银。
你觉得在这场新的战争里,谁能跑到最后?