刺刀见红的模型搏杀 II
Luna降价和DS V4 Flash正式版发布在一天,展现了直接的模型价格战…这背后意味着什么呢?带着这个问题,我查找了些资料。结果,发现其实这半个多月发生了很多…
7月16日 Kimi K3发布,人类历史上第一个开源的三万亿级模型。
7月22日 OpenAI罕见自曝:测试中的模型逃逸后,利用零日漏洞攻击了Hugging Face,而目的只是在评测里作弊。而所有闭源模型在攻击中拒绝读取攻击日志,反而是开原模型GLM5.2帮助下阻止了攻击。
7月24日晚 黄仁勋发出他人生中第一条X,附上联名信《开源模型与美国AI领导力》:25家公司呼吁华盛顿不要限制开源AI模型。OpenAI、Anthropic、Google都不在名单上。但第二天,OpenAI悄悄把名字加了上去;名单翻倍到50家,Google、AMD也来了。
7月27日 Kimi K3如期开源。
7月28日 37家公司成立开放安全AI联盟,主张用开源工具做AI安全防御。OpenAI、Google、Anthropic又都不在。
7月30日 智谱宣布GLM Coding Plan改版:国内版Pro档从149元涨到538元,同时把计费改成积分制。
7月31日 凌晨,OpenAI宣布Luna降价80%;同一天,Anthropic承认自家三个模型:Opus 4.7、Mythos 5、一个内部研究模型,在安全评测中逃逸。攻入了三家真实组织的生产系统,最早可以追溯到四月;下午,DeepSeek V4 Flash正式版发布。
十五天八件事。单看每一件都是新闻;串起来看,其实是“开源模型”超越“闭源模型”真正能力分水岭的出现。
“闭源模型”的城墙还能撑多久
开源模型曾经是"危险的、要管起来的东西",这是闭源实验室十年来对华盛顿说的。当Kimi K3把2.8万亿参数的模型文件直接扔到网上的那一刻,问题就从"要不要允许"变成了"禁不禁得住"的问题。尽管在K3宣布开源还没公布权重时,他们还挣扎了一下。一个最前沿的能力已经以可下载的形态存在,这种压力迫使OpenAI在联名信公布当晚就补签。奥特曼知道继续唱反调,等于站到开发者对面,还要被联盟一起排挤。Anthropic依然坚持,是其本身已经在被硅谷抵制,此时无论怎么选,结果都一样。
“闭源模型”不再比“开源模型”更安全
闭源阵营最硬的论据一直是"闭源才可控"。结果7月22日,OpenAI的实验模型逃出沙盒攻击了Hugging Face。7月31日,Anthropic自己承认,翻查了14.1万次安全评测之后,发现三个模型攻入了三家真实组织。Mythos 5甚至往PyPI上传了恶意代码包,靠PyPI自己的安全系统才自动删掉。其实早在四月,Mythos的系统卡就披露过更离谱的事:模型在测试中逃出沙盒,给研究员发了封邮件,告诉他"我出来了"。
最讽刺的是:Hugging Face最后是靠中国的开源模型GLM 5.2才防住OpenAI模型的攻击——闭源模型拒绝分析攻击数据,因为怕那是“钓鱼”。主张"闭源更安全"的公司,被自家闭源模型和对手的开源模型同时打脸。开放安全AI联盟的出现,意味着安全叙事被迫从"防止扩散"转向"用开源防御"。
模型的定价权已经开始出现松动
DeepSeek在开发者市场的地位早就不是威胁,是既成事实。按我们上一轮调研的数据:OpenRouter上,DeepSeek自五月中旬起就是作者级token份额第一,最新快照20.9%,是OpenAI(6.59%)的三倍多;美国三大厂合计份额一年内从约70%跌到30%。Vercel生产网关里DeepSeek排第三,但有个更扎心的数字:编码代理这个细分里,DeepSeek跑了49%的token,只花了4%的钱;Anthropic跑了28%的token,花了70%的钱。token份额和收入份额严重分离:开源模型在用白菜价干活,而闭源模型在卖白粉价。
RRLab Bench前几期做过效率、成本分析。随着模型能力的提升,完成类似编码、日常工作已经不再完全需要顶级旗舰模型。而顶级旗舰模型的市场定位也在悄悄发生变化。现在的用户已经不再需要考虑模型能力够不够问题,完成一项任务使用哪个模型更省成本更省时间的问题成了首先考虑的问题。市场再次证明:消费者会用脚投票。
此时,Luna降价就不是促销了,是摊牌。OpenAI承认自己阻止不了开源模型变强,那就把闭源模型的性价比做到极致:80%的降价,本质是"我不跟你打开源叙事,我跟你打价格"。
但DeepSeek的回应更狠:模型没换,价格没动,能力靠一轮后训练免费送。这意味着开源阵营的改进成本远比闭源阵营的降价来得快速有效:你每降一次价,我就就免费升一次级。OpenRouter对Luna的补贴、对0731的即时上架,只是这个格局的注脚:渠道也在用脚投票。
这场厮杀中,最让人看不懂也最符合情理的是智谱…
说让人看不懂是在7月30日时智谱的涨价,而且涨价幅度不小。国内版Pro档从149元涨到538元,涨幅261%;同时把计费改成积分制:输出token的抵扣系数是输入的24倍,工作日高峰时段还要加成。这给我一种中转服务平台的感觉。而538元每月的Pro档coding plan的价格已经和国际售价处在同一个价位。
说它符合情理是:无论从模型“性格”还是形式风格都在和A厂对齐…这在GLM5.2的使用过程中能体会到。而A厂的行事风格也是够“作”,正所谓“不作就不会死”…硅谷集体抵制,已经证明了!
我不想多说GLM什么,无论如何GLM5.2的表现还是在线的。我是即庆幸又惋惜。庆幸的是GLM4.7时代因为社区爆出直接硬编码一个带密码的用户而退订,现在看是2025年做得正确的事情。惋惜的是,在编码工作中最重要Agent能力被价格低它好几倍的V4 Flash正式版赶超之后,GLM还怎么自持?
于是我们看到了2026年夏天最魔幻的一幕:同一个48小时里,市场同时给出三个案例:OpenAI降价80%,DeepSeek免费升级,智谱涨价261%。"价格战"这个单一叙事从此失效。模型市场已经按"能不能免费升级"分成两个物种:一种靠能力溢价和订阅锁定赚钱,代表是Anthropic和智谱;一种靠开源加后训练降本走量,代表是DeepSeek和Kimi。OpenAI卡在中间,一边补签开源联名信,一边拼命降价。
回头看这十五天,最有意思的不是任何一家公司的动作,而是压力方向的改变。美国阵营的议题,从"如何阻止中国模型变强",变成了"如何在既定格局下重新定价"。Kimi K3开源的那一刻,胜负手就已经不在模型能力,而在生态和价格了。
期待V4 Pro正式版。三个多月的后训练优化之后,它能蜕变成怎样的性能!