出品 | 网易智能
作者 | 辰辰
编辑 | 王凤枝
上线仅三周,,,,,价钱最高下调八成。。。。
OpenAI的GPT-5.6系列7月上旬才推出,,,,,7月30日,,,,,Luna模子就从每百万token输入1美元,,,,,直接砸到20美分。。。。中档的Terra降20%。。。。旗舰Sol纹丝不动。。。。
CEO山姆·奥特曼(Sam Altman)在X上发帖:"今天宣布大幅降价。。。。"
官方诠释是:GPU内核、推理系统和生产情形效率均有所提升,,,,,公司将效率提升带来的收益部分反馈给用户。。。。
听着很合理。。。。但Luna降80%,,,,,Terra降20%,,,,,Sol一分不降。。。。这个降价名堂,,,,,单靠"效率提升"四个字诠释不了。。。。
一、烧钱时代竣事了
硅谷有一个词,,,,,叫tokenmaxxing。。。。
意思是在使用AI时尽可能增添token消耗,,,,,以最大化使用AI能力,,,,,而不优先思量本钱。。。。这个词降生于2023年,,,,,自己就带着自嘲。。。。彼时ChatGPT引爆全球,,,,,美国企业争先恐后把AI塞进每一个事情流,,,,,账单的事以后再说。。。。
现在,,,,,账单来了。。。。
AI账单已经膨胀到数十亿美元规模。。。。CNBC的报道里有一个细节:亚马逊刚刚把2026年的资笔僻出上调到2200亿美元,,,,,其中一大块烧给了AI基础设施。。。。企业端的AI开支同样在膨胀。。。。软件公司、金融机构、医疗集团,,,,,每家每年花在AI API和智能体上的钱,,,,,动辄数万万美元。。。。
《华尔街日报》6月份就披露过,,,,,OpenAI在思量大幅降价,,,,,而它预判竞争敌手Anthropic也会跟进。。。。企业高管最先不耐心了。。。。 Uber一位高管透露,,,,,公司2026年的AI智能体预算已经用尽。。。。另一位科技公司认真人坦言:很难把AI编程带来的效率提升,,,,,直接对应到新功效和新收入上。。。。
"tokenmaxxing的时代竣事了。。。。" 市场研究机构EMARKETER高级剖析师雅各布·博恩(Jacob Bourne)这样果真下了判断。。。。
企业不再照单全收。。。。他们在问统一个问题:花了几万万美元,,,,,究竟换来了什么???
CNBC有篇最新报道的问题耐人寻味:China's open-weight model lead exposes America's AI blind spot。。。。中国开源权重模子的领先,,,,,袒露了美国AI的盲区。。。。这个盲区不是手艺,,,,,是本钱。。。。
已往,,,,,这个问题最多让AI公司有点尴尬。。。。现在纷歧样了。。。。中国公司带着另一种打法登场了。。。。
二、中国模子的另一种打法:开放权重
7月初,,,,,中国首创公司月之暗面(Moonshot AI)宣布了开源权重模子Kimi K3。。。。在一些行业基准测试中,,,,,它的体现凌驾了美国最先进的闭源系统。。。。
要害是:Kimi K3的模子权重是果真的。。。。 用户可以下载、修改,,,,,并安排在自己的基础设施上,,,,,不需要支付月之暗面的API挪用用度。。。。
它不是孤例。。。。DeepSeek、智谱(Z.ai)的GLM-5.2、阿里的Qwen系列。。。。一些中国公司正在通过开放权重、低价服务等方式提供前沿AI能力。。。。
《The Verge》在一篇深度剖析中直指焦点矛盾:"一家AI公司花了天量资金训练模子,,,,,为什么要把最有价值的部分免费送出去???"
福特汉姆大学法学教授钦玛伊·沙玛(Chinmayi Sharma)的谜底很透彻:"一组免费的权重,,,,,不即是一个免费的AI服务。。。。公司可以在模子免费的同时,,,,,从盘算基础设施、工程、清静、维护等环节赚钱。。。。"
当中国开源权重模子的性能追平闭源,,,,,开发者最先在AWS、Azure甚至外地集群上私有化安排这些模子,,,,,直接切走了OpenAI的API挪用量。。。。 对OpenAI来说,,,,,丢掉的不但是一笔笔推理收入,,,,,更是"默认选项"的职位。。。。一旦开发者习惯了开源安排的事情流,,,,,就很难再拉回来。。。。
乔治城大学清静与新兴手艺中心高级研究员凯尔·米勒(Kyle Miller)以阿里Qwen系列模子为例,,,,,指出它在中国工业界的渗透深度,,,,,展现了开源生态一旦扎根的威力。。。。
美国这边,,,,,围绕开源权重的政策辩说也起来了。。。。Kimi K3宣布后,,,,,一个由25家科技公司组成的同盟(包括IBM、微软、Meta、英伟达、Palantir)揭晓果真信,,,,,忠言美国政府不要对开源权重模子施加"过早的限制"。。。。这封信点名缺席的,,,,,恰恰是OpenAI、谷歌和Anthropic三家闭源巨头。。。。
《The Verge》的报道问题写得直白:Why China is giving away its best AI models。。。。中国为什么要把最好的AI模子免费送人???
对美国闭源模子提供商来说,,,,,这不但是价钱竞争,,,,,也涉及商业模式的挑战。。。。当中国公司把前沿模子免费开放,,,,,OpenAI和Anthropic还能靠"按token计价"的模式撑多久???
三、但涨价也在爆发
中国开源权重模子用免费撕开了一道口子。。。。但免费是一种打法,,,,,不是所有中国公司都选了这条路。。。。
就在OpenAI宣布降价的统一天(7月30日),,,,,中国AI公司智谱在海内不限量重新开放了GLM Coding Plan订阅服务,,,,,价钱不是降了,,,,,是涨了。。。;;;;;蛘吒既返厮,,,,,是跟国际版价钱对齐。。。。
Lite档从每月49元涨到118元,,,,,涨幅140%;;;;;Pro档从149元涨到538元,,,,,涨幅260%;;;;;Max档从469元涨到1078元,,,,,涨幅130%。。。。
智谱今年已经涨过好一再。。。。2月,,,,,GLM Coding Plan整体上调30%起步,,,,,作废首购优惠。。。。3月,,,,,GLM-5-Turbo API加价20%。。。。4月,,,,,外洋版全线涨价80%到140%。。。。一季度累计下来,,,,,智谱的API定价提升了83%。。。。
价钱上涨,,,,,但用量增添更快。。。。400%。。。。
这是整个故事里最反直觉的一组数字:价钱涨了八成,,,,,用量翻了四倍。。。。智谱CEO张鹏在业绩说明会上的诠释是:模子能力提升意味着推理链路更长,,,,,一个重大使命的token消耗量可以抵达简朴问答的十倍甚至百倍。。。。涨价"是本钱转变的自然效果"。。。。
智谱的官方亮相更直白:低价竞争倒运于行业生长,,,,,价钱需要"回归正常商业价值区间"。。。。摩根大通7月研报给出了投资端的注脚:GLM-5.2的平均API收费较上一代提高了约13%,,,,,公司"展现出更强的定价能力"。。。。目的价上调到1800港元,,,,,维持增持评级。。。。
这不但是智谱一家的事。。。。据律动BlockBeats统计,,,,,2026年头以来,,,,,中国已有七家云厂商和模子厂商上调价钱,,,,,最高涨幅凌驾400%。。。。中国AI行业正在履历一个整体转身:从"免费津贴抢用户"转向"商业变现求生涯"。。。。
统一其中国市场,,,,,正在上演两出完全相反的戏。。。。
需要分清两件事的计价工具。。。。Kimi K3免费的是模子权重,,,,,你可以下载、可以安排,,,,,但推理算力由你自己肩负,,,,,一张H100的租金并没有消逝。。。。智谱涨价的是商业API服务,,,,,厂商代你肩负了算力、运维和一连迭代本钱,,,,,价钱里包括的是一整条"开箱即用"的生产链。。。。一个免费的是半制品质料,,,,,一个涨价的是制品服务,,,,,它们并不在统一条价钱轴上竞争。。。。
这两件事同时爆发,,,,,并不矛盾。。。???慈ㄖ啬W拥拿夥颜铰,,,,,是为了建生态、抢标准;;;;;商业API服务的涨价战略,,,,,是为了活下来、证实商业模式。。。。前者是战略性投入,,,,,后者是生涯性选择。。。。
对OpenAI而言,,,,,这形成了一种重大时势:中国开放权重模子正在低本钱市场形成竞争压力,,,,,而部分商业API服务则探索更高价值定位。。。。OpenAI夹在中心:降价吧,,,,,中国开源模子比你更自制;;;;;涨价吧,,,,,智谱正在证实"贵一点也有人买单"。。。。
四、华尔街要看账本了
降价的在降价,,,,,涨价的在涨价。。。。两件事凑到一起,,,,,问的着实是统一件事:这个行业的商业模式,,,,,究竟能不可跑通???
OpenAI和Anthropic马上就要面临这个问题了。。。。由于它们都在准备上市。。。。
OpenAI已于本周向美国证券生意委员会神秘提交了IPO申请,,,,,奥特曼在内部Slack新闻中说妄想"一年内上市"。。。。Anthropic也在走同样的路。。。。价钱竞争,,,,,可能成为这两家公司上市前需要面临的一项商业模式磨练。。。。
Gartner优异副总裁剖析师阿伦·钱德拉塞卡兰(Arun Chandrasekaran)对Business Insider的判断很直白:"这次价钱竞争,,,,,可能是前沿AI实验室商业模式的一次早期测试。。。。尤其是OpenAI最近神秘提交了IPO申请。。。。"
说究竟就是华尔街要看账本。。。。降价能不可换来足够大的使用量???使用量能不可填补利润率的压缩???这个故事,,,,,投资人买不买账???
不止OpenAI在焦虑,,,,,整个赛道都在转向。。。。谷歌7月宣布了三款新模子,,,,,主打的卖点就是比Kimi K3更自制。。。。微软CEO萨提亚·纳德拉(Satya Nadella)在季度财报电话会上,,,,,重复把"本钱效率"挂在嘴边,,,,,称其为微软MAI-Thinking-1模子的"焦点"。。。。Anthropic新推出的Claude Opus 5,,,,,性能靠近旗舰Fable 5,,,,,价钱只要一半。。。。
X上一位用户的谈论一针见血:"DeepSeek和Kimi K3突破的不但是OpenAI的能力护城河,,,,,尚有它的定价地板。。。。降价80%不是立异,,,,,是恐慌性打折。。。。"
但若是只看价钱跌幅就下结论,,,,,可能忽略了调价背后的结构设计。。。。
五、OpenAI布的局:塔尖的才值钱
回到OpenAI自己。。。。降价背后,,,,,它着实在布一个更深的局。。。。
细看这次调价:Luna降价80%,,,,,Terra降价20%,,,,,而Sol价钱坚持稳固。。。。这更像是一种分层定价战略,,,,,而非周全降价。。。。
降价后,,,,,Luna的输入价钱(20美分/百万token)已经低于DeepSeek V4 Pro(约43美分),,,,,迫近Kimi K3的缓存掷中价。。。。OpenAI总裁格雷格·布罗克曼(Greg Brockman)在X上写道:"Luna现在显然是同级别中最具性价比的模子。。。。"
对开发者来说,,,,,这个价钱意味着什么???自力开发者WolfMark Tools在X上算了一笔账:GPT-5.6 Luna的编程能力,,,,,已经靠近此前许多用户使用的GPT-5.5高品级版本。。。。而价钱,,,,,只有后者的二十五分之一。。。。
"对大大都开发者来说,,,,,问题不再是'我能肩负得起AI编程智能体吗',,,,,而是'我为什么不找一个来用'。。。。"他写道。。。。
日本投资人国光宏尚以为,,,,,Luna可能被OpenAI定位为AI智能体时代的基础运行模子。。。。足够智慧、足够自制,,,,,可以7×24小时不中止运行。。。。日常使命跑Luna,,,,,重大使命上Terra,,,,,要害决议用Sol。。。。一套"低中高"三级火力设置,,,,,第一次在价钱上有了实战意义。。。。
这套战略的潜台词是:OpenAI认可了低端市场的价钱战现实,,,,,但它同时想证实,,,,,真正值钱的工具,,,,,在塔尖。。。。
公正地说,,,,,OpenAI的效率提升并非全是话术。。。。用Sol来优化自家模子的推理代码,,,,,让AI来降低AI的运行本钱,,,,,这件事自己确着实爆发。。。。国光宏尚估算,,,,,GPU内核调优和推理情形优化帮OpenAI降低了约20%的服务本钱。。。。
但20%的本钱节约,,,,,诠释不了80%的降价。。。。剩下的缺口,,,,,是中国开源模子用"免费"两个字生生撕开的。。。。
布罗克曼在宣布降价时,,,,,说了一句意味深长的话:"期待看到你们用'自制到不值得计价'的智能做出什么工具。。。。"
"自制到不值得计价"(too cheap to meter)。。。。这个词脱胎于20世纪核电时代的著名口号:"电力会自制到不值得装电表。。。。"当一样工具自制到你不再盘算单次本钱时,,,,,它的计价方式就彻底变了。。。。
六、AI正在履历的时刻
中国开放权重模子带来的影响,,,,,不但是降低AI使用本钱,,,,,也让行业重新思索按token销售智能的商业模式。。。。X上一位用户写道:"中国没有仅仅降低中国AI的价钱,,,,,它迫使整个行业降低了智能的价钱。。。。"
但智谱的涨价提醒了另一件事:好的智能,,,,,照旧有人愿意付钱的。。。。
当Kimi K3把前沿能力免费开放,,,,,当DeepSeek用不到5美元跑完一个完整编程使命,,,,,当智谱把Coding Plan从49块涨到118块、挪用量反而翻了四倍。。。。这三个事实摆在一起,,,,,指向的是统一个结论:
智能的定价方式正在分化:一部分走向更开放、更低本钱,,,,,另一部分则通过高价值服务维持更高价钱。。。。
一半免费。。。。一半更贵。。。。
OpenAI想同时站在这两半上。。。。这可能吗???