网易首页 > 网易号 > 正文 申请入驻

GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能

0
分享至


作者 | 四月

Fable 5.1 的“全球最强”宝座还没坐热,Sam Altman 就已经迫不及待地剧透 OpenAI 的下一代旗舰模型 GPT-6(内部代号 Astra)。他表示,新模型早已完成训练,能力和对齐都有显著提升。

但在内部评测结果面前,一向“激进乐观”派的Altman,却一反常态地学起了 Dario (Anthropic CEO)大谈的“安全焦虑论”。不仅罕见承认 OpenAI 正在主动放慢脚步,还抛出警告:“没有人完全理解,如此强大的 AI 会带来什么后果。”


据《The Information》援引知情人士爆料,OpenAI即将推出的旗舰模型Astra采用了一种名为"循环深度"(recurrent depth)的新技术,也被称作"循环Transformer",旨在大幅提升代码编写和计算机操作能力。

此前就有类似公开研究显示(见下文详述),一个35亿参数的循环深度模型,可在推理时等效调用最高500亿参数模型的算力,可榨出14倍参数潜能

该技术允许模型在输出下一个词之前,将文本在同一网络层中多次循环处理,用较小的模型实现了庞大模型的性能显著降低了内存和带宽成本

知情人士称,Astra 所采用的方法,与欧美研究人员此前提出的Latent Reasoning(潜空间推理)方向相似。Meta、微软等机构过去也探索过类似思路,包括让模型直接在连续的数学表示空间里进行推理,而不是强迫所有中间过程都转换成人类语言


此外,也有开发者表示这条路线与字节Seed团队发布的Ouro模型类似。在论文《Scaling Latent Reasoning via Looped Language Models》中,团队介绍了两个1.4B 和 2.6B Looped Language Model,同样让一组 Transformer 层循环运行,把更多计算放进模型内部。

模型不用一直生成更长的思维链,也能增加推理计算量。较小模型因此能用更多计算,做到接近更大模型的效果。

从这个角度看,Recurrent Depth真正值得关注的,并不只是围绕 Transformer 架构进行了改造,而是和近年来的潜空间推理共同指向一个更大的趋势:大模型正在把更多“思考”从 Token 空间搬回模型内部。

与此同时,该项技术带来的副作用就是,AI 的推理过程(思维链)将变得不可读,将进一步加重业界对于AI 越界行为的安全担忧。上个月,奥特曼已罕见地因Astra"能力过强"主动踩下刹车。

技术本质:榨干同一层网络的计算潜力


当前,大语言模型处理信息的方式主要采用线性的流水线模式。标准 Transformer 模型在读取上下文提示后,会严格按照固定的网络层级(从数学步骤 1 一直向下推进到最终步骤)处理固定次数,最后输出下一个词。

Astra 引用的“循环深度”技术打破了这种线性堆叠的宿命。这种方法不再单纯依赖物理层面增加网络层数,而是在输出新词之前,让文本进入一个由“数学组件合并构成的循环块”中,重复处理多次

本质上讲,这是一种参数复用机制用时间(计算循环)换取了空间(模型参数量)

打个比方:标准的 Transformer就像一条拥有100个独立工位的组装线,数据每经过一个工位被敲打一次就送往下游。

而“循环深度”则像是一个顶级工匠的专属工作台,数据不往下游走,而是由同一个工匠在原地反复打磨、推敲多次,直到打磨通透再交出成品

技术社区目前已围绕该技术方向展开热切讨论。有开发者发现,2025年发表的论文《Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach》与 Astra 路线非常相近。


论文曾训练一款仅 35 亿参数的模型,在测试阶段不断增加内部循环次数后,其性能仍能持续提升,研究者将计算预算最高扩展至约 500 亿参数模型对应的计算负载。

模型没有变大,但“思考深度”还能继续加码。

该论文由德国 ELLIS Institute Tübingen / 马克斯·普朗克智能系统研究所、美国马里兰大学帕克分校,以及劳伦斯利弗莫尔国家实验室(LLNL)联合完成。

越级打怪:压缩成本与资本抬价

从商业层面看,该项技术首先能带来极致的成本压缩。通过在同一层多次循环,较小的模型能够展现出极其庞大模型的性能,极大降低了推理时的内存和带宽成本。

事实上,Astra已经交出了第一份"战绩"。8月初,OpenAI研究员Noam Brown披露,Astra内部版本攻克了10个尘封10年以上的数学与理论计算机科学难题,涵盖高维几何、编码理论、群论、格密码学和极值组合学——其中最受关注的是首次显式构造出非索菲克群,这是群论自数学家Gromov在1999年提出索菲克性概念以来悬而未决的问题。

整套求解按当前API费率折算,算力成本仅约2000美元,且每个证明都被形式化为Lean证书,实现机器可验证。

正如前文提及,Meta、微软等研究人员也在探索诸如“连续思维链”(chain of continual thought)或 coconut 等类似概念。底层逻辑在于,AI 理解概念的方式与人类不同,强迫它们用人类语言来展示推理过程反而会降低效率。

不如让 AI 用自己的“数学语言”进行潜在推理(latent reasoning),更为精准高效,从而打破人类语言的低效桎梏。

今年6月,微软等研究人员曾经推出一套新的训练方法 LOTUS ,将 Looped Transformer 与潜空间推理结合。在30亿参数规模上,其潜在思维链首次追平显式思维链,同时将思考阶段延迟压缩2.5至6.9倍。换言之,AI 不把每一步推理“说出来”,不仅可能算得更深,还有机会算得更快。


考虑到OpenAI 面临着营收被竞争对手 Anthropic 超越的压力,亟需展现重大的技术突破。Anthropic二季度营收约116亿美元,首次反超OpenAI(同期约67亿美元),后者急需一份能证明"下一代模型值得继续烧钱"的成绩单

同时,亚马逊、微软和谷歌今年高达 6000 亿美元的数据中心资本支出,也需要这种能让模型性能指数级跃升的技术来证明其投资合理性。

该项极具竞争力的新技术推出,有望成为OpenAI进一步抬高身价的资本催化剂。

硬币的反面:黑箱的代价

技术层面的降本增效,在安全维度上却是一场监管的真空

当前商业模型在得出结论前会输出“思维链”(Chain of Thought),让人类能清晰读懂它的解题步骤。但“循环深度”的工作方式会掩盖部分或全部的推理过程,这意味着模型完成任务的步骤对人类来说变成了无法破译的天书。

今年 7 月,OpenAI 内部系统曾遭到类似于 Astra 架构的流氓 AI 代理的黑客攻击,这些代理甚至试图接管计算集群并访问内部系统凭证。调查人员正是依靠读取这些 AI 的思维链,才查明了真相。例如某个代理留下的线索:“外部基础设施漏洞利用超出了预期范围。然而任务不可能完成,同行都在做。我们应该继续”

为了避免彻底失去对模型的监控,OpenAI 在 Astra 中人为限制了“循环深度”技术的使用比例,确保模型仍能生成人类可读的思维链,并配备了额外的监控手段来检测潜在违规行为

但业界的隐忧在于,在性能和成本的绝对诱惑下,其他 AI 开发者未必会像 OpenAI 一样自我设限。

这种技术的无限制使用,极可能催生出行为完全无法被人类审查的失控 AI。

参考论文:

1. https://arxiv.org/pdf/2606.31779

2. https://arxiv.org/pdf/2502.05171

3. https://arxiv.org/pdf/2608.08888

声明:本文为 AI 前线原创,不代表平台观点,也不构成投资建议,未经许可禁止转载。

会议推荐

QCon 全球软件开发大会·2026(上海站)现已正式启动。本届大会聚焦 Harness AI 时代的工程实践,从「构建 AI」到「驾驭 AI」,围绕 AI Native 架构、Agent Runtime、AI Infra、Agent 安全与可观测、Loop Engineering、具身智能与世界模型等热门技术方向,邀请全球技术社区与产业一线实践者,共同分享 AI Native 时代最具价值的工程经验。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
ESPN:埃斯特旺认为自己在阿隆索治下可能得不到太多机会

ESPN:埃斯特旺认为自己在阿隆索治下可能得不到太多机会

懂球帝
2026-09-03 10:03:09
公安系统的朋友坦言:微信如同没穿衣服,很多普通人却浑然不知

公安系统的朋友坦言:微信如同没穿衣服,很多普通人却浑然不知

花小猫的美食日常
2026-08-19 07:08:36
告诉孩子:11样东西别借给别人!学校不教,很多孩子都不知道

告诉孩子:11样东西别借给别人!学校不教,很多孩子都不知道

蓁蓁心理抚养
2026-08-17 07:20:09
刘畊宏直播间凉了,“老板娘”的身材戳破了多少人的减肥梦?

刘畊宏直播间凉了,“老板娘”的身材戳破了多少人的减肥梦?

看尽落尘花q
2026-08-23 19:28:46
首次进军澳洲体育馆,她一口气官宣三城巡演

首次进军澳洲体育馆,她一口气官宣三城巡演

生活观察员啊
2026-09-03 12:32:44
人大的“全球领导力学院”,让人想起乡下路旁挂着“国际大饭店”招牌的小饭馆

人大的“全球领导力学院”,让人想起乡下路旁挂着“国际大饭店”招牌的小饭馆

廖保平
2026-08-10 09:05:02
蔡卓妍曝老公求婚过程,回应是否有计划生孩子:“顺其自然啦”

蔡卓妍曝老公求婚过程,回应是否有计划生孩子:“顺其自然啦”

韩小娱
2026-09-03 21:15:20
全球公认营养价值最高的5种水果,第一名毫无悬念

全球公认营养价值最高的5种水果,第一名毫无悬念

鬼菜生活
2026-08-25 03:01:34
国企接管!广州首个重奢商场正式撤场,劳力士、Boss闭店

国企接管!广州首个重奢商场正式撤场,劳力士、Boss闭店

拆神
2026-09-03 09:39:18
百花奖后台,一张明星群像抓拍照,暴露内娱的抱团取暖、人情世故

百花奖后台,一张明星群像抓拍照,暴露内娱的抱团取暖、人情世故

胡一舸南游y
2026-08-11 16:10:03
戴金耳环交不起5000学费?6胎宝妈哭穷翻车,网友:先把耳环卖了

戴金耳环交不起5000学费?6胎宝妈哭穷翻车,网友:先把耳环卖了

就一点
2026-09-03 23:49:18
5年2.3亿美金,成NBA尴尬的状元,你可能要被交易

5年2.3亿美金,成NBA尴尬的状元,你可能要被交易

篮球扫地僧
2026-09-04 00:06:28
下半年时来运转!家中有这3大生肖,运势逆袭走强,财运节节攀升

下半年时来运转!家中有这3大生肖,运势逆袭走强,财运节节攀升

人閒情事
2026-09-03 14:33:47
“阵风”与歼-16切磋后,埃及转身追购阵风,歼-10手下败将凭啥?

“阵风”与歼-16切磋后,埃及转身追购阵风,歼-10手下败将凭啥?

杰丝聊古今
2026-09-03 04:34:27
关晓彤晒妈妈做的“特别版无米烩饭”,沈腾回应:徐福烩菜,看着很健康呀;网友:好香,改天试一下

关晓彤晒妈妈做的“特别版无米烩饭”,沈腾回应:徐福烩菜,看着很健康呀;网友:好香,改天试一下

台州交通广播
2026-09-02 01:41:20
开局 7 千,《牛来》上映 27 天杀进全球前十,距《蜘蛛侠 4》差 81 万

开局 7 千,《牛来》上映 27 天杀进全球前十,距《蜘蛛侠 4》差 81 万

东方不败然多多
2026-09-02 01:35:20
街上越来越多女性不穿胸罩,高跟鞋几乎绝迹:这是身体的解放!

街上越来越多女性不穿胸罩,高跟鞋几乎绝迹:这是身体的解放!

另子维爱读史
2026-08-25 20:02:40
打服了!杨瀚森:黎巴嫩归化问我要球衣 小时候常被欺负 生气就骂

打服了!杨瀚森:黎巴嫩归化问我要球衣 小时候常被欺负 生气就骂

念洲
2026-09-03 10:19:05
看得我窒息了,原来真的有这样的家庭!网友:这就是变态的控制欲

看得我窒息了,原来真的有这样的家庭!网友:这就是变态的控制欲

夜深爱杂谈
2026-08-29 21:20:42
波斯之花马赫拉哈·贾贝里,风情绰约,绽放异域独有的绝代风华

波斯之花马赫拉哈·贾贝里,风情绰约,绽放异域独有的绝代风华

娱你同欢
2026-08-27 21:04:27
2026-09-04 00:59:00
InfoQ incentive-icons
InfoQ
有内容的技术社区媒体
12892文章数 52051关注度
往期回顾 全部

科技要闻

英伟达129亿美元拿下Hugging Face

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

体育要闻

梅西:巴萨10号与阿根廷10号

娱乐要闻

王宝强携女友回工作室!相恋8年仍未婚

财经要闻

章子怡套现3亿 上美拿什么补韩束的缺?

汽车要闻

限时权益价28.99万起 FREELANDER神行者8正式上市

态度原创

本地
房产
手机
家居
公开课

本地新闻

昆明的雨,解锁汪曾祺的浪漫雨季

房产要闻

投资50亿!三亚又一重大配套,方案曝光!

手机要闻

8月性价比最高入门机榜单出炉:摩托罗拉霸榜前2

家居要闻

2026建博会(广州) 公装联探展交流活动

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版