菜单
首页财产ai正文 GPT-5.6一晚上爆砍80%,1元搏斗最贵Claude! OpenAI的GPT-5.6降价,Luna每一百万Token输入0.2美元输出1.2美元,能力未缩水,反超Anthropic的Fable 5,7月Codex等活跃用户超万万。 2026-07-31 11:22 ·微信公家号:新智元 ASI启迪录 ASI启迪录 AI投资人解读· OpenAI的GPT-5.6 Luna价格砍失80%,履行单个使命成本仅为Anthropic最贵的Fable 5的1%,且反超其分数。Sol重写并优化出产内核,端到端办事成本降20%。Codex及ChatGPT Work活跃用户两周内近翻倍,7月年化常常性收入超二季度,部门增加来自Anthropic。 · 开源模子价格碾压,Anthropic于企业市场猛攻价格战会压利润率,企业最先看重投资回报率。 总结:GPT-5.6系列依附高性价比与用户增加揭示投资潜力,但面对开源竞争与利润率压力,需存眷成本节制与市场竞争态势对于盈利的影响。
一醒觉来,OpenAI给GPT-5.6 Luna来了一记「脚踝斩」。
价格直接砍失了80%——
每一百万Token,输入0.2美元,输出1.2美元。

价格低成如许,能力却没随着缩水。
于专业评测Agents’ Last Exam中,Luna不仅反超了Anthropic最贵的Fable 5。
并且履行单个使命的成本,只有对于方的越1%。

更魔幻的还有于后面。
这轮降本的暗地里,是GPT-5.6 Sol亲自下场,重写并优化了运行本身的出产内核。
然后再加之其他优化,端到端办事成本就这么水灵灵地降了20%。
是的,AI最先给本身打工了。
0一、三档模子,一晚上年夜洗牌
GPT-5.6分三档:Sol是旗舰,Terra是一样平常均衡,Luna是最快最 自制阿谁。此次屠刀砍的是后两位。
新旧一比更直不雅。
Luna的输入从美金1干到了美金0.20,输出从美金6干到了美金1.20,一口吻削失八成;
Terra的输入从美金2.50降到美金2,输出从美金15降到美金12,降了两成。
Sol则维持美金5及美金30稳定。
对于开发者来讲,最直接的感触感染是,多量量调Luna,成本险些可以纰漏不计了。
一个跑几十万次模子挪用的Agent事情流,已往光token费就是一笔年夜开消,此刻Luna把它压到不消算的水平。
并且,定阅用户也没被落下。
Codex及ChatGPT Work的月费及额度没变,但用Luna及Terra干活时耗损的积分更少了,能干的活更多了。

不仅云云,Sol这边加了个Fast mode,替换本来的Priority Processing。
最高2.5倍速率,价格翻倍,智能程度一点没变。
于Codex里对于应/fast指令,以前标priority的哀求主动切换。对于延迟敏感的场景,这就是个用钱买速率的开关。
借着这波操作,App里阿谁「替我审核」(auto-approve)功效也改为了用Luna来提早阻挡主agent的高危害动作,直接把成本降了约10倍。

降本的活,Sol本身干了
能砍这么狠,是由于Sol经由过程Codex接进了OpenAI的出产推理栈,本身动手,把跑它本身的那套体系优化了一遍。
Codex卖力人Tibo把这套打法归纳综合成两步。
起首训出一个充足强的模子,然后再用这个模子去把一切变患上更好,包括但不限在运行它本身的基础举措措施、推理栈及内核。
详细到此次,GPT-5.6统共针对于四个问题举行了优化。
1. 负载平衡。
OpenAI的哀求会按地区、容量、加快器类型分发,集群内再按负载、上下文长度、缓存可用性举行分配。
解法:Sol阐发了出产流量,揪出工程师以前没留意到的负载不均,测试了新的路由计谋。
2. GPU内核。
模子的前向流传靠内核履行数学运算,但内存搬运、同步、数据结构分歧理会让GPU闲置。
解法:Sol找到了能估计算、能跳过、能并行的事情,用Triton及Gluon这两种OpenAI维护的GPU编程语言,自立重写并优化了出产内核。这些改动加之更广泛的内核优化,把端到端办事成本压低了20%。
3. 推测解码。
这套技能让一个更小的draft模子先猜几个token,主模子并行验证,猜对于了一次就能多输出几个token。
解法:Sol针对于draft模子设计并跑了数百次架构试验,改尺寸、改布局、改特征,还有本身启动并盯着练习流程,碰到硬件妨碍及练习不不变自动参与。token天生效率是以晋升跨越15%。
4. KV缓存及配置调优。
batching、sharding、KV治理的最 优配置高度依靠负载,因为配置空间太年夜,基本端赖工程师的经验来做。
解法:Sol阐发出产负载,天生并评估候选配置,把已往调不动的工具调到极 致。
不外,Sol写的内核不克不及直接上线。OpenAI会用开源东西FpSan(浮点数消毒器),把布局、数据流一项项查已往,确认没问题才放行。
看看内部数据,就能知道这个轮回转患上有多快。
GPT-5.6内测阶段,每一位活跃研究员的日均token输出,是GPT-5.5时代峰值的两倍以上。
已往半年,内部代码推理研究算力占比涨了100倍,内部智能体token用量涨了约22倍。
省下的算力,直接酿成了降价的底气。
20美分,反超Anthropic最贵的阿谁
绝不夸张地说,如今的GPT-5.6系列已经经正式站到了价格/机能效率的帕累托曲线上。
于横跨55个范畴、评估长周期专业事情流的评测Agents' Last Exam上,Luna的患上分直接反超了Anthropic的旗舰Fable 5。而且,单使命成本只要1%,而速率却高达9倍。
第三方评测机构The Agent Report的拆解一样显示,GPT-5.6三档于Agents' Last Exam上均高在Fable 5。
此外,于DeepSWE上,Luna每一美元能换约24个基准分,而Fable 5只有约3.2,效率差出5到7.5倍。
0二、收入加快,Codex杀回来了
综合来看,让GPT-5.6刚发布三周就降价的压力,重要来自两个方面:
开源模子的价格碾压:中国模子的token成本总体比美国偕行自制最高9倍
Anthropic于企业市场的猛攻:Claude Code本年初于编程东西市场领 先,5月宣布年化收入跨越470亿美元。
但比降价先到的,是收入。
于7月29日的内部会上,CFO Sarah Friar暗示——
Codex及ChatGPT Work加起来,活跃用户已经颠末了1000万,两周翻了近一倍。
基在此,OpenAI单7月一个月的年化常常性收入,直接跨越了整个第二季度。
并且,这内里有一部门增加,还有是从Anthropic何处抢来的。缘故原由恰是于在,Claude Code的账单过高,用户纷纷最先找替换方案了。
不外,虽然价格战能拉升利用量,但也会压利润率。
于EMARKETER阐发师Jacob Bourne看来,「疯狂刷token的时代竣事了」,企业最先要清楚的投资回报率。
但OpenAI不怕降价,由于帮它把效率推上去的,是它本身的模子。
末了,真正决议格式的,是谁能于一样一张卡上榨出更多的智能。
【本文由投资界互助伙伴微信公家号:新智元授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-南宫娱乐相信品牌的力量