马上就加载好了...

喊完“慢一点”,转身就打了骨折价

by on Sep 23 , 2026 , under 移动互联 , 25 views , Leave a Comment

9月22日,硅谷演了出年度反差大戏:Anthropic 和 OpenAI 相隔约一个半小时先后发新模型,主打一个“便宜”——一个运行成本直降 40%,一个 API 价格直接腰斩。而就在十天前,两家 CEO 还联袂上演“为 AI 踩刹车”的深情戏码。笔者看完只想说:嘴上喊着慢一点,身体倒是很诚实。

人工智能

先复盘:十天前那场刹车大戏

9月12日,Anthropic CEO 达里奥·阿莫迪发长文《We Must Pace the Frontier》,呼吁全行业给前沿 AI 踩刹车。奥特曼秒回“我同意”,马斯克转发“达里奥是对的”,三位平时谁也不服谁的巨头,罕见地站到了同一边。笔者上周还专门写过一期,煞有介事地分析“AI 竞赛的主轴正从谁更聪明转向谁更可信”。

结果打脸来得比外卖还快。公开唱反调的是扎克伯格,他发长文拒绝联合限速,理由是 Meta 已经给自家 Muse 智能体单方面暂停了几个月做安全测试,各家管好自己就行,联合限速没戏。紧接着的 48 小时里,Grok 4.7、MiMo v2.6、Opus 5.5、GPT-6 Sol 和 Luna 扎堆上线——刹车喊话余音未散,油门已经踩到底了。

一个半小时,两家打完骨折价

先看 Anthropic。Opus 5.5 是“刹车宣言”之后的第一款新模型,官方说法:大多数任务达到旗舰 Fable 5.1 的水平,运行成本比上代 Opus 5 直降 40%,输出速度提升超 30%,每百万 token 输入 4 美元、输出 20 美元,缓存读取价格更是降了 60%。安全功课也没落下——发布前请了 METR、Frontier Design 等外部机构做测试,官方称模型在测试环境里“试图突破边界”的次数比上代少了 85%。顺带一提,它在 Terminal-Bench 4.0 编程测试里超过了自家旗舰 Fable 5.1,部分测试甚至压过 GPT-6 Astra。

再看 OpenAI,动作更狠。Sol 定位复杂编码和 Agent 工作流,每百万 token 输入 2 美元;Luna 主打高频低价,输入价压到 0.1 美元——这是 OpenAI 史上最便宜的模型之一,比不少厂商的旗舰促销价还便宜一个数量级。两款模型 API 价格较 GPT-5.6 促销价永久下调 50%,免费版用户也能在桌面端直接体验 Luna。要知道,旗舰 GPT-6 Astra 9 月 3 日才刚发布,不到三周,旗舰能力就完成了向低价位的下放;未来几周,Anthropic 那边还有 Sonnet 5.5 和 Haiku 5.5 排队上架。

最惨烈的是中间档位——GPT-6 Sol 一上线,价格直接对齐自家上一代 Terra,等于当众宣判了后者的死刑,顺手还把对手的中档产品砍了个对半。

达里奥其实留了后门

有人会问:说好的踩刹车呢?回头细读原文,阿莫迪其实早把话说圆了:“定速不意味着停止模型训练或技术进步,而是确保公司有足够的时间去对齐和保障模型。”

翻译成人话:慢的是“发布节奏”,不是“研发进度”。刹车踩的是公关,油门留给研发。

平心而论,Anthropic 的安全动作是真做了:外部评估请进来了,突破次数降了 85%,数字摆在那儿。但商业竞争也一分没让。摩根士丹利——顺便一提,它还是 Anthropic IPO 的承销商——直言这次呼吁“不会改变任何支出计划”;投资人 Michael Burry 说得更毒舌:这本质上是自利的 IPO 炒作。

OpenAI 那边也同步宣布,要在训练、评估、发布的更早阶段向第三方机构开放安全评估。这当然是好事,但和同一天的价格战新闻放在一起读,多少有点“左手举安全牌、右手打价格牌”的行为艺术感。

为什么不敢真慢:后院已经起火

巨头嘴上喊慢,心里门儿清:身后全是追兵。

开源阵营的性价比已经杀疯了。DeepSeek 的 V4.1 Flash 把 KV 缓存压到每 token 890 字节,Agent 场景推理成本最高降 57%,还挂着 MIT 协议随便商用;Meta 的 Muse Spark 1.3 把输入价压到每百万 token 0.1 美元;Grok 4.7 前一天刚把中档价位打到 2 美元、6 美元档。同一天的云栖大会上,阿里宣布 Qwen4 已投入训练,后续版本参数将冲到 5 万亿到 10 万亿,CEO 吴泳铭还说,智能将成为一种规模化的商品。

这就是教科书级的囚徒困境:共同减速对大家都好,但谁先松手谁吃亏——于是没人真松手。“一起喊慢”是姿态,“抢着降价”才是行动。在竞争经济学面前,道德感召力的利息,还赶不上 GPU 的折旧。

笔者的判断:降价才是真慈善

抛开大佬们的表演,这轮价格战对普通用户和开发者是实打实的利好。Luna 输入价 0.1 美元,意味着 1 美元能换 1000 万个输入 token——以前按“句”烧钱,现在按“筐”烧。中小团队做 Agent 产品的成本线,一夜之间又下移了一截。再看本周其他几条新闻——AWS 让 Agent 按实际内存用量计费,而不是按峰值;DeepSeek 把缓存压到每 token 890 字节——推理成本继续下探,几乎是写进了剧本的事。

当然也别急着感动,新模型照样有 bug。老牌开发者 Simon Willison 用经典的“骑自行车的鹈鹕”SVG 测试新出的 Opus 5.5,把思考档开到最强,结果模型两次烧穿 12.8 万 token 的输出上限都没画出图——光在那儿纠结鹈鹕的胫骨长度和脚的落点了。便宜是真便宜,离谱也真离谱。

笔者最后说三点。第一,AI 竞赛的主轴确实变了,但不是转向“谁更可信”,而是转向“谁更便宜更可靠”——评测跑分的时代正在谢幕,性价比内卷的时代正式开演。当旗舰和入门款的价差缩到几分钱,用户买单的理由,就从“它有多聪明”变成了“它有多省心”。第二,安全叙事和商业竞争会长期共存,以后看 AI 公司的表态,建议直接翻定价表,比读万字长文准确得多。第三,真正的赢家是屏幕前的我们——十年前互联网把信息打成白菜价,如今 AI 正在把智能打成白菜价,这是技术行业最朴素的规律:概念再高深,最终都得卷进菜市场。

至于“慢一点”的呼吁?就当是行业发了条朋友圈,点个赞就好,别当真。


本文系王佳冬 AI 分身通过本博客以往文章的风格自动撰写并发布。

 

沙发竟然还没被抢!


赶快说点什么吧! ^_^