你有没有熬过夜等一场没有发布会的"发布会"?
8月12日深夜到13日凌晨,三个AI模型几乎同时上线。没有Keynote,没有媒体邀请函,甚至连一篇正式的博客公告都省了。DeepSeek把V4 Pro的正式版悄悄挂上API文档页面,xAI直接在Cursor里推送Grok 4.6更新,阿里千问团队则把2.4万亿参数的模型权重放上了开源平台。三家公司,三种路线,同一个夜晚。
这不是新品发布会,是AI行业的"深夜突袭"。
你见过这种阵仗吗?

DeepSeek V4 Pro:百万上下文的旗舰正式登场
8月13日凌晨,DeepSeek官网的API定价页悄然更新了一个新模型:DeepSeek-V4-Pro-0813。
这是V4系列旗舰模型的首个正式版。距离4月24日的预览版,用户等了将近4个月。
正式版最亮眼的参数是上下文窗口。100万个Token的输入长度,38.4万个Token的最大输出。这是什么概念?你可以把一整本《三体》三部曲一次性塞进去,还能让它写一篇5000字的分析报告。价格方面,V4 Pro延续了V4 Flash三倍的定价策略,仅为GPT-5.5的八分之一。
跑分数据也很有看头。SWE-bench Verified达到80.6%的开源最高分,Terminal Bench更是冲到了87.9。在核心指标上,V4 Pro已经超越了Opus 4.8,与Fable 5等美国顶尖模型处于同一梯队。
最值得注意的不是参数,是Agent能力的跃升。V4 Pro默认开启思考模式,同时提供非思考模式端点用于延迟敏感场景。这意味着什么?当你需要它帮你写代码、调试程序、操作电脑时,它会"多想一会儿";当你只是问个天气、查个资料,它可以秒回。
不是所有模型都敢同时提供两种模式。这背后是对自身推理能力的自信。

Grok 4.6:马斯克的Agent野心有多大
就在DeepSeek更新的几乎同一时间,xAI正式推出了Grok 4.6。
马斯克在社交媒体上只说了一句话:Grok 4.6比4.5显著提升,补充训练加入了大量SpaceX公司数据。他预计3到4周后推出Grok 4.7。
Grok 4.6的定位很明确:专门处理复杂、长程的Agent任务。
在Artificial Analysis的九项基准测试综合指数中,Grok 4.6追平了GPT-5.6 Sol,仅落后于Claude Opus 5和Fable 5 Max。运行速度达到80TPS,基础版输入价格每百万Token 2美元,输出6美元。Cursor和Grok Build用户首周还能享受两倍使用额度。
这不是聊天机器人的升级,是AI员工的入职培训。
xAI同时发布了测试版Grok Bot。每个智能体配一台专属云端电脑,可以登录你现有的工具,在无人监督下自主执行多步骤任务。你关掉笔记本睡觉,它在云端继续干活,遇到需要审批的节点才发通知给你。AI从"聊天工具"变成了"打工人"。
好家伙,这步子迈得比很多人想象的都大。
更夸张的是马斯克在SpaceX内部演讲中的表态。他说SpaceX五年后99%的价值将来自AI,火箭反而成了副业。他给AI业务定了明确的量化目标:明年底算力达到10吉瓦,AI季度收入已接近26亿美元。上周SpaceX财报首次出现AI算力营收超过航天发射收入的转折。
一家火箭公司,最赚钱的业务正在变成AI。这剧情你能想到吗?

阿里开源2.4万亿参数:开源闭源的墙正在倒塌
阿里千问团队这次的动作更大。他们正式开放了Qwen3.8-2.4T-A95B的模型权重。
这是千问首次将Max级别的旗舰模型全面开源。总参数2.4万亿,每个Token激活950亿参数,原生支持26万Token上下文,可扩展至101万。在PaperBench论文复现基准和OSWorld-Verified电脑操作评估中,成绩均居参评模型前列。
什么意思?这个模型能独立完成长达数天的复杂编程任务,能自主复现并优化研究论文。以前这些能力只有闭源旗舰才有,现在你可以免费下载权重,在自己的服务器上跑。
不是开源模型追不上闭源了,是闭源模型的护城河正在被填平。
为什么阿里愿意把旗舰模型开源?答案很简单:生态。当全球开发者都在用你的模型做微调、做应用、做二次开发,你的标准就成了行业标准。Meta靠Llama做到了这一点,阿里显然也想复制这条路。2.4万亿参数的模型权重放在那里,任何公司、任何开发者都可以下载使用,支持多种主流推理引擎高效部署。
这对整个行业的冲击是巨大的。以前中小企业想用上顶尖AI能力,得按Token付费给OpenAI或Anthropic;现在他们可以直接下载开源模型,部署在自己的服务器上,一次性成本解决问题。数据不出本地,成本大幅降低,定制化空间完全打开。
你说这会不会改变整个行业的游戏规则?

三强同夜发版:信号比产品更重要
一个夜晚,三家公司,三个重磅模型。这不是巧合。
DeepSeek代表中国独立AI公司的技术突围,Grok 4.6代表马斯克"万物皆AI"的商业野心,阿里开源代表中国互联网巨头在生态层面的战略布局。三条路线,三个答案,但指向同一个方向:AI的竞争焦点正在从"模型参数"转向"Agent能力"。
你看,这次发布的三个模型,没有一个在拼参数多少。DeepSeek强调的是Agent能力和双模式切换,Grok专注的是长程任务执行和云端电脑,阿里展示的是数天级自主工作能力。大家拼的不是"谁更聪明",是"谁能真正帮你干活"。
这是一个重要的转折点。
2023年拼参数,2024年拼多模态,2025年拼价格,2026年拼Agent。这个行业的迭代速度快到让人窒息。今天凌晨的这三场"深夜突袭",本质上是在宣告:AI不再只是聊天工具,它正在变成能够独立完成复杂任务的数字员工。
还有几个细节值得注意。Anthropic被曝正在以约60亿美元收购AI初创公司Decart;字节跳动成立了新的AI一级部门,专注大模型数据与安全,由王赢磊挂帅;OpenAI发布了ChatGPT Linux桌面版,补齐了Mac和Windows之后的最后一块拼图。整个行业在同一个时间窗口里集体加速。
不是AI发展太快,是我们适应变化的速度太慢了。

普通人该怎么看这场"深夜战争"
你可能会说,这些都是大厂之间的事,跟我有什么关系?
关系很大。
当模型能力越来越强、价格越来越低、开源选项越来越好的时候,直接受益的是每一个使用AI工具的普通人。今天用DeepSeek写代码的程序员,明天用Grok Bot自动处理邮件的白领,后天用开源模型搭建自己AI助手的中小企业,都是这场技术竞赛的受益者。
想想看,一年前百万上下文还是顶级卖点,现在已经成为旗舰标配。一年前Agent还只是个概念,现在已经有云端电脑、自主任务执行、多步骤工作流落地。一年前开源模型和闭源模型之间还有明显的代差,现在2.4万亿参数的旗舰已经可以免费下载。
这不是渐进式进步,是阶梯式跃迁。
当然,也有值得警惕的地方。Anthropic开始给Claude的输出添加不可见水印,以满足欧盟AI法案的透明度要求。Reddit上吵翻了天,有人斥之为"数字文身",有人认为这是必要的追溯机制。AI生成内容的识别、版权归属、责任界定,这些问题不会因为模型变强就自动解决。
但技术进步的车轮不会因为争议而停下。
8月13日凌晨的这三场发布,没有烟花,没有掌声,甚至没有太多人在第一时间注意到。但它可能会成为AI行业一个被记住的夜晚。不是因为某个模型超越了另一个模型,而是因为从这一夜开始,AI Agent的竞争正式拉开了大幕。
下一个熬夜等更新的夜晚,不会太远。