刀刀见骨,AI巨头为自己画过的大饼“填窟窿”
文|魏琳华
编|刘俊宏
9月23日凌晨,OpenAI和Anthropic像约好了一样,前后脚各自放出新模型:
OpenAI端出了GPT-6 Sol和GPT-6 Luna两款模型,把旗舰GPT-6 Astra的能力蒸进更快更便宜的型号里;Anthropic则亮出Claude Opus 5.5,性能追平Fable 5.1的同时,成本只有上代Opus 5的六成。
三个新模型,指向同一个判断:当前大模型竞争的主战场已经从“谁最聪明”转到了“谁又强又便宜”。
熟悉OpenAI的老朋友都知道,无论是赶当天发布还是靠价格挤兑对手,都是它的老本行了。今年下半年,OpenAI释放的降价信号愈发强烈:
7月,OpenAI先是把GPT-5.6 Luna断崖式降价80%,到8月再把旗舰模型GPT-5.6 Sol促销再砍20%,再到这次GPT-6 Sol和Luna,OpenAI直接宣布API价格永久下降50%——OpenAI正在用一种“刀刀见骨”的节奏,把模型调用成本打到行业新低。
OpenAI正在用低价抢用户,延续它“大力出奇迹”的营销策略,挤兑自己的老对手Anthropic,靠用户讲一个更漂亮的收入增长叙事。
同一天的两种不同“刀法”
同日发布的三个模型,各有各的精彩:OpenAI靠价格刀法让人直呼真香,Anthropic则做到了又强又便宜,让Opus 5.5重回大众“白月光”的地位。
先看OpenAI这边,它这次推出的GPT-6 Sol和Luna两款模型,是在GPT-6 Astra的基座上得来的性价比模型——通过调整推理效率和缓存机制,OpenAI把单位调用成本压了下去。
具体分工上,Sol定位面向编程等复杂工作负载,Luna则面向更轻量、高频的推理场景。两款模型都支持105万token的上下文窗口、12.8万token的最大输出,提供多档推理强度。
“智能已经足够好”,性价比当道的今天,单次任务的成本花费比Benchmark的跑分更重要。在本次大模型发布的介绍中,厂商开始秀起了自家模型完成任务的成本表现。
在AutomationBench(跨应用业务流程测试)中,GPT-6 Sol在xhigh强度下取得33.2%的任务完成率,每项任务平均花费0.27美元,同样的任务,放到Claude Opus 5上是11倍的价格。
新一代模型的计价单位,也因此从“一次回答”变成了“一个任务的价格”。
从定价来说,OpenAI这次给到的诚意太大了,甚至试图动摇DeepSeek的性价比地位。
GPT-6 Sol的API输入、输出价格分别为每百万token2美元和10美元,较GPT-5.6 Sol的促销价格均下降一半。Luna的输入价格从0.2美元降至0.1美元,输出价格从1.2美元降至0.5美元。折算成人民币,相当于DeepSeek V4.1 Flash的闲时价格(每百万输入1元,输出4元)。
当然,DeepSeek还是技高一筹,早早在DeepSeek V4.1 Flash上对缓存命中价格大展刀法,这是用户必须花在上下文上的刚需成本。
所以OpenAI新模型发布后,不少用户自发对比两者跑任务的价格,发现还是DeepSeek划算。此番网友口中的“梁圣”梁文锋,依然笑傲春风。
在能力上,GPT-6 Luna也被用户质疑“开倒车”,似乎无法赶上上一代GPT-5.6 Luna。但看在价格的份上,好像又不是不能原谅。新模型的价格是上一代的一半,人送外号“更便宜的GPT-5.6 Luna”。
再看Anthropic的Opus 5.5。如果说OpenAI走的是“旗舰下沉”路线,那Anthropic走的就是“够强且更便宜”的路线。
这就不得不让人吐槽,Anthropic不地道。嘴上一边喊着“放缓研究”,一边端出来了Opus 5.5。到底哪里跑得慢了?
作为Claude 5.5系列的首款模型,Anthropic称,Opus 5.5在大多数工作中达到Fable 5.1的水平,同时比Opus 5更快、更便宜。其上下文窗口为100万token,最大输出为12.8万token;输入和输出价格分别为每百万token4美元和20美元,比Opus 5低20%。
便宜还不止于单价。Opus 5.5完成任务时使用的token和工具调用也有所减少,缓存读取价格从每百万token0.5美元降至0.2美元——降幅高达60%。Anthropic自己算了一笔账,它把典型工作负载成本下降40%,输出速度还提升超过30%。
这次,Opus 5.5性能提升集中在长时间运行的编码智能体和知识工作上。
在更硬核的基准测试上,Opus 5.5在Terminal-Bench 4.0上得分66.4%,高于Fable 5.1(55.8%)和GPT-6 Astra(57.9%)。在衡量代码修改能否真正合并进项目的FrontierCode 1.1上,Opus 5.5得分54.4%,高于GPT-6 Astra的53.3%。
知识工作是Opus 5.5此次领先最明显的方向。在覆盖44种职业任务的GDPval-AA v2.1上,Opus 5.5得到1846分,高于Fable 5.1和Opus 5。
Anthropic甚至还没把Fable系列的模型端出来,已经能用Opus 5.5和GPT-6 Astra掰腕子了。下一代旗舰模型能打成什么样,简直想都不敢想。
OpenAI和Anthropic虽然撞档同一天,但这场模型比赛没有“赢家通吃”的场景出现。实际上,它开启的是一场错位竞争——
OpenAI用轻量模型走量、抢调用规模,Anthropic用Opus 5.5守住高价值的编码和知识工作。两者一个要规模,一个要客单价。
为了撑起增长预期OpenAI和Anthropic都急了
把镜头拉远,GPT-6 Sol和Luna的“永久半价”,是OpenAI第N次向价格挥刀。
在模型层,OpenAI的打法越来越清晰,它靠旗舰模型保住地位和利润、轻量模型则变成了抢市场的主力。
7月30日,OpenAI宣布GPT-5.6 Luna输入和输出成本同时降低80%,中档Terra降价20%;8月,GPT-5.6 Sol的API和额度价格又被下调20%。
订阅端,OpenAI则靠套餐的调整实现变相降价。
1月,价格更低的Go套餐开始推向全球市场,美国定价为8美元;4月9日,OpenAI推出每月100美元的Pro档;8月,面向企业用户的Business(Premium seat)方案上线,年付100美元/月,额度是标准席位的5倍。
从使用量来看,OpenAI降价的效果立竿见影。
全球大模型聚合平台OpenRouter观察了7-8月OpenAI的流量变化:其中,Luna的日均token调用量涨到降价前的13.8倍,Terra涨了5.6倍,此前一直按原价销售的Sol只涨了1.1倍。同期被点名的竞争对手里,只有Anthropic的调用量不升反降。
OpenRouter还研究了一下模型后续的表现,证明虽然价格恢复,但一定程度上,OpenAI的用户黏性变好了:在促销期试用过Luna或Terra的十多万客户中,约32%在促销结束后保留了部分用量。
OpenAI为什么要这么急?因为账本对面站着的是Anthropic,而对手正在收入上完成反超。
收入上,Anthropic二季度营收超过115亿美元,较去年同期增长约14倍,同时首次录得5.59亿美元调整后营业利润;OpenAI同期营收达到67亿美元,环比增长18%,二季度经营亏损却从一季度的93亿美元扩大到123亿美元。
与此同时,OpenAI本身的收入却并不理想。The Information报道称,OpenAI今年前几个月多次未能完成月度销售目标,在编程和企业市场上把份额输给了Anthropic。
OpenAI CFO Sarah Friar曾向其他高管坦言,担心收入增长不够快、无力支付未来的算力合约承诺。
因为OpenAI“欠的账”实在是太多了。对甲骨文,是约3000亿美元、为期五年的云算力采购;对微软,是重组后仍要消化的约2500亿美元Azure承诺;对亚马逊,是约380亿美元、为期七年的集群;对CoreWeave,还有约220亿美元的GPU云合约。
当OpenAI的市场份额被竞争对手抢走,它的每一次降价,都是为了维持住自己曾经讲过的增长叙事。
镜头转到另一边,Anthropic也不轻松。
GPT-6 Astra两周抢走企业AI支出的13%份额,证明OpenAI能靠模型的性价比,切走更多市场份额。旗舰一旦够用、价格又压得住,企业预算会很快改道。
这就预示着,一旦增长缓慢,Anthropic也会被账单架在火上烤。对亚马逊AWS的承诺、对谷歌和博通的TPU采购,还得算上租SpaceX的机房,“哪哪也都是钱”。
这一天两家其实都在降价,每一次降价都是一次预付的赌注。
但价格战没有终点,未来只有下一把刀。