菜单
首页财产ai正文 AI最先给本身写代码了!GPT-5.6重写内核,办事成本直降20% 7月29日OpenAI称,GPT-5.6优化内核使办事成本降20%,token天生效率晋升超15%,形成闭环,鞭策模子更强、办事更多人,竞争轴也于改变。 2026-07-30 15:18 ·微信公家号:新智元 ASI启迪录 ASI启迪录 AI投资人解读· GPT-5.6 优化 OpenAI 出产体系,使办事成本降 20%,token 天生效率晋升超 15%。其经由过程阐发流量、重写内核等优化多个环节,形成闭环,晋升推理效率。 · 今朝 GPT-5.6 未转变自身主体权重,仍需人工审核验证。将来主动验证系统若跟不上,会限定其成长。 总结:GPT-5.6 揭示出强盛的自优化能力,晋升了 OpenAI 的运营效率。虽未真正实现自我进化,但为递归自我改良奠基基础。推理效率成为竞争要害,其飞轮效应已经现,值患上存眷其后续成长和对于行业的影响。
这回,AI最先为本身写代码了!
GPT-5.6一上线,接到的第 一个年夜活,就是给本身的运行情况来了一次年夜「翻修」。
它自立重写、优化了OpenAI线上那套底层代码,也就是真正卖力跑模子的出产GPU内核。
7月29日,OpenAI官方甩出一组数字:
GPT-5.6 Sol介入的内核优化,让OpenAI对于外的办事成本降了20%;推测解码的改良,让模子天生token的效率晋升跨越15%。

此次GPT-5.6动的不是一个跑于演示情况里的Demo,而是OpenAI正于线上跑的,天天承载十亿级用户哀求的那套出产体系。
用OpenAI总裁Greg Brockman的话说:让GPT-5.6 Sol去晋升出产办事效率,恰是它又强又自制的缘故原由之一。

而OpenAI内部,早已经形成一套完备的打法,Codex掌门人Tibo(Thibault Sottiaux)把它归纳综合成两步:
第 一步,训出一个充足强的模子;
第二步,用这个模子去把一切变患上更好,包括运行它本身的基础举措措施、推理栈及内核。

0一、20%是怎么省出来的?
这20%的办事成本,究竟是怎么省出来的?
GPT-5.6 Sol经由过程Codex,接进了OpenAI的出产推理栈,碰的全是推理栈里最焦点的几块:GPU内核、负载平衡、推测解码、KV缓存。
负载平衡,翻译成人话就是别让某几张卡忙到冒烟,而别的几张卡却只是闲着;
KV缓存,是把算过的中间成果存下来反复用,不做无用功;
推测解码,是让一个小模子先抢答、年夜模子只卖力验收。答对于了,一次就能多输出好几个字,不消像寻常那样一个字一个字逐步挤。
然后再看GPT-5.6 Sol干了甚么。
它阐发真正的出产流量,揪出之前被纰漏的负载不均,测试新的路由计谋;
它自立重写了用Triton及Gluon这两种GPU编程语言写成的出产内核,专门去找那些能预先算好、能跳过、能并行的活儿;
于推测解码环节,它针对于配套的draft模子,设计并跑了数百次架构试验,还有本身启动、盯着练习流程,碰到硬件妨碍及练习不不变,本身自动参与。
这些环节一个个抠下来,末了就换来了开首那两个数字:办事成本降20%,token天生效率涨15%+。
实在早于7月9日GPT-5.6发布时,OpenAI就已经吐露眉目。
内部研究员已经经于用它排查妨碍、优化练习体系、跑试验、注释成果,还有专门给它设了KernelGen、NanoGPT、RSI Index这几项「自我改良」评测。
此次降本20%,象征着这些结构,第 一次酿成账单上实打实的数字。
0二、比节省20%更主要的,是一个闭环
真正主要的变化,是一个闭环跑通了。
阐发流量、提出优化、写出代码、跑完试验、处置惩罚失妨碍,再拿出产指标回来验证成果,此刻这条回路的每一一环,模子险些都能介入。
拿推测解码举例。
这个技能要配一个更小的draft模子,GPT-5.6 Sol针对于这个draft模子,设计并跑了数百次架构试验,改尺寸、改布局、改特征。
数百次试验,已往这要靠一个稀缺的GPU工程师,凭着经验及直觉,一个配置一个配置地手工试,试上几个月。
配置空间太年夜,年夜到人底子试不完,只能靠粗拙的经验规则拍脑壳。
此刻,模子能把这个「丈量、优化、验证」的轮回压到极短。在是,团队能摸索更多设法,更快跟上不停变化的负载。
更要害的是,这个闭环,还有会本身滚起来。
模子越强,越能把推理栈优化患上越省;越省,一样的硬件就能办事越多哀求;办事的人越多,OpenAI就能把更强的模子铺给更多的人用。
OpenAI的内部数据能左证这个环转患上有多快:
GPT-5.6内测阶段,每一位活跃研究员的日均token输出,是GPT-5.5时代最高值的两倍以上;已往半年,用在内部代码推理的研究算力占比涨了100倍,内部智能体token用量涨了约22倍。
省下的每一一分算力,末了都酿成了让更多人能用上的智能。
0三、AI最先自进化了吗?
那末,这到底算不算「AI最先自我进化」?
至少此刻,还有不算。
GPT-5.6 Sol优化的,是运行本身的软件、办事配置,还有有辅助的draft模子。
没有证据注解它于线改动了本身的主体权重,也没有证据注解它能离开工程团队,本身进级出下一代模子。
假如把权重比作模子智能的「货物」,内核及配置就是运货的卡车及线路。它此次优化的是运输,还有没遇到货物。
是以,更正确地说这是「自优化飞轮」的初期形态,不是递归自我改良。
还有有一点要留意。
官方此次用了「自立(autonomously)」来形容内核重写及部门试验,但不等在「彻底无人介入」,方针由谁定、接进哪套出产体系、拿甚么东西验证、怎么部署上线,这些环节都还有紧紧攥于OpenAI的工程系统手里。
好比验证环节:模子写完的出产内核,要颠末审核才能上线。
OpenAI专门搬出一个叫FpSan(浮点消毒器)的开源东西,查抄这些内核的布局及数据流对于不合错误。
主动验证系统跟不跟患上上,才是「敢让AI写底层代码」的真正瓶颈。
往前看,OpenAI也一直于为RSI(Recursive Self-Improvement,递归式自我改良)铺路。
早于2月,GPT-5.3-Codex就被官方形容为「介入了本身的创造」;这一次,GPT-5.6 Sol又自立后练习了更小的Luna;于内部专门权衡自我改良能力的RSI Index上,它比GPT-5.5超出跨越16.2分。
老敌手Anthropic的一个判定更激进:
人类如今只对于个位数百分比的标的目的性决议计划卖力。
其联创Jack Clark更是称2028年末前呈现完备的递归自我改良,几率跨越60%。
飞轮是转起来了,但真实的「AI本身造AI本身」还有于路上。
0四、竞争轴变了:从谁GPU多到谁榨出更多token
这20%,象征着一样一批卡,OpenAI此刻能多接两成的活。
它指向一个更年夜的变化。
已往几年,AI公司比的是谁买患上起更多GPU。这套逻辑简朴粗鲁,也砸钱如流水。
但于一个算力永远不敷、需求涨患上比产能快的世界里,另外一个要害变量已经经浮出水面:一样一批卡,谁能榨出更多token?
推理效率,正于酿成及芯片数目一样主要的筹马。
OpenAI本身已经经用产物线投了票。
GPT-5.6此次一口吻分成Sol、Terra、Luna三档,就是要主打一个卖点:划一智力,更少token。
效率,被摆到了及智能一样主要的位置。
而这一次,帮OpenAI的模子晋升推理效率的,恰是模子本身。
模子越强,越能优化推理栈;推理栈越高效,一样硬件就能办事更多token;成本一降,更强的模子又能铺给更多人用。
这个飞轮,OpenAI已经经让它转起来了。
【本文由投资界互助伙伴微信公家号:新智元授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-南宫娱乐相信品牌的力量