网易首页 > 网易号 > 正文 申请入驻

GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能

0
分享至


作者 | 四月

Fable 5.1 的“全球最强”宝座还没坐热,Sam Altman 就已经迫不及待地剧透 OpenAI 的下一代旗舰模型 GPT-6(内部代号 Astra)。他表示,新模型早已完成训练,能力和对齐都有显著提升。

但在内部评测结果面前,一向“激进乐观”派的Altman,却一反常态地学起了 Dario (Anthropic CEO)大谈的“安全焦虑论”。不仅罕见承认 OpenAI 正在主动放慢脚步,还抛出警告:“没有人完全理解,如此强大的 AI 会带来什么后果。”


据《The Information》援引知情人士爆料,OpenAI即将推出的旗舰模型Astra采用了一种名为"循环深度"(recurrent depth)的新技术,也被称作"循环Transformer",旨在大幅提升代码编写和计算机操作能力。

此前就有类似公开研究显示(见下文详述),一个35亿参数的循环深度模型,可在推理时等效调用最高500亿参数模型的算力,可榨出14倍参数潜能

该技术允许模型在输出下一个词之前,将文本在同一网络层中多次循环处理,用较小的模型实现了庞大模型的性能显著降低了内存和带宽成本

知情人士称,Astra 所采用的方法,与欧美研究人员此前提出的Latent Reasoning(潜空间推理)方向相似。Meta、微软等机构过去也探索过类似思路,包括让模型直接在连续的数学表示空间里进行推理,而不是强迫所有中间过程都转换成人类语言


此外,也有开发者表示这条路线与字节Seed团队发布的Ouro模型类似。在论文《Scaling Latent Reasoning via Looped Language Models》中,团队介绍了两个1.4B 和 2.6B Looped Language Model,同样让一组 Transformer 层循环运行,把更多计算放进模型内部。

模型不用一直生成更长的思维链,也能增加推理计算量。较小模型因此能用更多计算,做到接近更大模型的效果。

从这个角度看,Recurrent Depth真正值得关注的,并不只是围绕 Transformer 架构进行了改造,而是和近年来的潜空间推理共同指向一个更大的趋势:大模型正在把更多“思考”从 Token 空间搬回模型内部。

与此同时,该项技术带来的副作用就是,AI 的推理过程(思维链)将变得不可读,将进一步加重业界对于AI 越界行为的安全担忧。上个月,奥特曼已罕见地因Astra"能力过强"主动踩下刹车。

技术本质:榨干同一层网络的计算潜力


当前,大语言模型处理信息的方式主要采用线性的流水线模式。标准 Transformer 模型在读取上下文提示后,会严格按照固定的网络层级(从数学步骤 1 一直向下推进到最终步骤)处理固定次数,最后输出下一个词。

Astra 引用的“循环深度”技术打破了这种线性堆叠的宿命。这种方法不再单纯依赖物理层面增加网络层数,而是在输出新词之前,让文本进入一个由“数学组件合并构成的循环块”中,重复处理多次

本质上讲,这是一种参数复用机制用时间(计算循环)换取了空间(模型参数量)

打个比方:标准的 Transformer就像一条拥有100个独立工位的组装线,数据每经过一个工位被敲打一次就送往下游。

而“循环深度”则像是一个顶级工匠的专属工作台,数据不往下游走,而是由同一个工匠在原地反复打磨、推敲多次,直到打磨通透再交出成品

技术社区目前已围绕该技术方向展开热切讨论。有开发者发现,2025年发表的论文《Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach》与 Astra 路线非常相近。


论文曾训练一款仅 35 亿参数的模型,在测试阶段不断增加内部循环次数后,其性能仍能持续提升,研究者将计算预算最高扩展至约 500 亿参数模型对应的计算负载。

模型没有变大,但“思考深度”还能继续加码。

该论文由德国 ELLIS Institute Tübingen / 马克斯·普朗克智能系统研究所、美国马里兰大学帕克分校,以及劳伦斯利弗莫尔国家实验室(LLNL)联合完成。

越级打怪:压缩成本与资本抬价

从商业层面看,该项技术首先能带来极致的成本压缩。通过在同一层多次循环,较小的模型能够展现出极其庞大模型的性能,极大降低了推理时的内存和带宽成本。

事实上,Astra已经交出了第一份"战绩"。8月初,OpenAI研究员Noam Brown披露,Astra内部版本攻克了10个尘封10年以上的数学与理论计算机科学难题,涵盖高维几何、编码理论、群论、格密码学和极值组合学——其中最受关注的是首次显式构造出非索菲克群,这是群论自数学家Gromov在1999年提出索菲克性概念以来悬而未决的问题。

整套求解按当前API费率折算,算力成本仅约2000美元,且每个证明都被形式化为Lean证书,实现机器可验证。

正如前文提及,Meta、微软等研究人员也在探索诸如“连续思维链”(chain of continual thought)或 coconut 等类似概念。底层逻辑在于,AI 理解概念的方式与人类不同,强迫它们用人类语言来展示推理过程反而会降低效率。

不如让 AI 用自己的“数学语言”进行潜在推理(latent reasoning),更为精准高效,从而打破人类语言的低效桎梏。

今年6月,微软等研究人员曾经推出一套新的训练方法 LOTUS ,将 Looped Transformer 与潜空间推理结合。在30亿参数规模上,其潜在思维链首次追平显式思维链,同时将思考阶段延迟压缩2.5至6.9倍。换言之,AI 不把每一步推理“说出来”,不仅可能算得更深,还有机会算得更快。


考虑到OpenAI 面临着营收被竞争对手 Anthropic 超越的压力,亟需展现重大的技术突破。Anthropic二季度营收约116亿美元,首次反超OpenAI(同期约67亿美元),后者急需一份能证明"下一代模型值得继续烧钱"的成绩单

同时,亚马逊、微软和谷歌今年高达 6000 亿美元的数据中心资本支出,也需要这种能让模型性能指数级跃升的技术来证明其投资合理性。

该项极具竞争力的新技术推出,有望成为OpenAI进一步抬高身价的资本催化剂。

硬币的反面:黑箱的代价

技术层面的降本增效,在安全维度上却是一场监管的真空

当前商业模型在得出结论前会输出“思维链”(Chain of Thought),让人类能清晰读懂它的解题步骤。但“循环深度”的工作方式会掩盖部分或全部的推理过程,这意味着模型完成任务的步骤对人类来说变成了无法破译的天书。

今年 7 月,OpenAI 内部系统曾遭到类似于 Astra 架构的流氓 AI 代理的黑客攻击,这些代理甚至试图接管计算集群并访问内部系统凭证。调查人员正是依靠读取这些 AI 的思维链,才查明了真相。例如某个代理留下的线索:“外部基础设施漏洞利用超出了预期范围。然而任务不可能完成,同行都在做。我们应该继续”

为了避免彻底失去对模型的监控,OpenAI 在 Astra 中人为限制了“循环深度”技术的使用比例,确保模型仍能生成人类可读的思维链,并配备了额外的监控手段来检测潜在违规行为

但业界的隐忧在于,在性能和成本的绝对诱惑下,其他 AI 开发者未必会像 OpenAI 一样自我设限。

这种技术的无限制使用,极可能催生出行为完全无法被人类审查的失控 AI。

参考论文:

1. https://arxiv.org/pdf/2606.31779

2. https://arxiv.org/pdf/2502.05171

3. https://arxiv.org/pdf/2608.08888

声明:本文为 AI 前线原创,不代表平台观点,也不构成投资建议,未经许可禁止转载。

会议推荐

QCon 全球软件开发大会·2026(上海站)现已正式启动。本届大会聚焦 Harness AI 时代的工程实践,从「构建 AI」到「驾驭 AI」,围绕 AI Native 架构、Agent Runtime、AI Infra、Agent 安全与可观测、Loop Engineering、具身智能与世界模型等热门技术方向,邀请全球技术社区与产业一线实践者,共同分享 AI Native 时代最具价值的工程经验。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
14岁男孩因琐事和妈妈争吵,独自在家赌气点燃床铺,随后离家,同学得知后立即联系房主提醒,家具等损毁无人伤亡;因未满16周岁被批评教育

14岁男孩因琐事和妈妈争吵,独自在家赌气点燃床铺,随后离家,同学得知后立即联系房主提醒,家具等损毁无人伤亡;因未满16周岁被批评教育

极目新闻
2026-09-03 18:55:07
大众、奔驰、宝马表态,星宇致歉涨薪,国内车企暂未发声

大众、奔驰、宝马表态,星宇致歉涨薪,国内车企暂未发声

ZAKER新闻
2026-09-02 15:17:25
抖音主播码字的:郭德纲是我举报的,我是骨干,证据都是我提供的

抖音主播码字的:郭德纲是我举报的,我是骨干,证据都是我提供的

早起的鸟儿有饭吃
2026-09-03 02:08:06
顶级体坛流氓,逼走陈忠和、刘国梁、郎平,单挑 3 个体坛顶流

顶级体坛流氓,逼走陈忠和、刘国梁、郎平,单挑 3 个体坛顶流

酷侃体坛
2026-08-04 18:30:28
美国能打一场世界大战吗?美智库:一旦中美台海打起来,规模十分庞大

美国能打一场世界大战吗?美智库:一旦中美台海打起来,规模十分庞大

一姐说军史
2026-09-02 07:16:54
德国宣布关闭俄驻波恩总领馆,普京发声:严重错误

德国宣布关闭俄驻波恩总领馆,普京发声:严重错误

环球网资讯
2026-09-02 21:15:28
反对浪潮高涨,委内瑞拉代总统罗德里格斯真的要垮台了!特朗普和罗德里格斯达成委美两国合作协议

反对浪潮高涨,委内瑞拉代总统罗德里格斯真的要垮台了!特朗普和罗德里格斯达成委美两国合作协议

宸风遇玥
2026-09-03 11:05:09
是时候重视养老金巨大差距:民心是最大的政治,公平是最强的动力

是时候重视养老金巨大差距:民心是最大的政治,公平是最强的动力

花小猫的美食日常
2026-09-01 00:05:19
没想到,对星宇威胁最大的,不是欧盟和港交所,而是弯道超车的它

没想到,对星宇威胁最大的,不是欧盟和港交所,而是弯道超车的它

乐天闲聊
2026-09-03 12:00:08
飞机上随手一拍,成都航空这位空乘小姐姐真的绝了。

飞机上随手一拍,成都航空这位空乘小姐姐真的绝了。

毒舌八卦
2026-09-03 22:32:24
单杆63分逆转!赵心童连赢2局扩大优势,领先147先生;张安达救赛点,3-3迎生死战!

单杆63分逆转!赵心童连赢2局扩大优势,领先147先生;张安达救赛点,3-3迎生死战!

刘姚尧的文字城堡
2026-09-03 22:17:30
美媒:詹姆斯再次登顶NBA第一,生涯99.4%的比赛得分上双!

美媒:詹姆斯再次登顶NBA第一,生涯99.4%的比赛得分上双!

爱体育
2026-09-02 22:45:45
全民进入纯过日子模式。

全民进入纯过日子模式。

老陆不老
2026-09-02 08:27:57
张康阳社媒告别奥西利奥:最好中的最好

张康阳社媒告别奥西利奥:最好中的最好

懂球帝
2026-09-03 10:03:08
尼泊尔救灾直升机频繁出镜,他们有多少架,都什么型号?

尼泊尔救灾直升机频繁出镜,他们有多少架,都什么型号?

弹痕驿站
2026-09-02 13:35:11
网友称飞机抵达后机场出口却大门紧闭,敦煌莫高国际机场致歉:工作疏漏致乘客滞留,已立即开展内部整改

网友称飞机抵达后机场出口却大门紧闭,敦煌莫高国际机场致歉:工作疏漏致乘客滞留,已立即开展内部整改

潇湘晨报
2026-09-03 14:00:02
《大话西游》罗家英癌症复发!「医估剩8年」 拒化疗急救:宁愿舒服走

《大话西游》罗家英癌症复发!「医估剩8年」 拒化疗急救:宁愿舒服走

ETtoday星光云
2026-09-01 10:15:07
笑不活了!特朗普砍百年日美友谊樱花树,日本攒百年面子碎一地

笑不活了!特朗普砍百年日美友谊樱花树,日本攒百年面子碎一地

大又元
2026-09-02 21:40:42
白金汉宫出手!梅根刚返英便失人心,温莎家族这招太绝了

白金汉宫出手!梅根刚返英便失人心,温莎家族这招太绝了

草莓解说体育
2026-09-04 00:40:03
狗子喜欢躺男子身上睡觉,长大后习惯没改,网友:快窒息了!

狗子喜欢躺男子身上睡觉,长大后习惯没改,网友:快窒息了!

爱宠物
2026-08-22 21:50:17
2026-09-04 02:00:49
InfoQ incentive-icons
InfoQ
有内容的技术社区媒体
12892文章数 52051关注度
往期回顾 全部

科技要闻

英伟达129亿美元拿下Hugging Face

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

头条要闻

男子逛夜市遭按摩摊大妈拉住 被5个大妈服务按到发红

体育要闻

梅西:巴萨10号与阿根廷10号

娱乐要闻

王宝强携女友回工作室!相恋8年仍未婚

财经要闻

章子怡套现3亿 上美拿什么补韩束的缺?

汽车要闻

限时权益价28.99万起 FREELANDER神行者8正式上市

态度原创

艺术
手机
本地
时尚
公开课

艺术要闻

他画中的女人只露出一半侧脸,却让无数男人盯着看了整整三分钟,秘密全在光影里……

手机要闻

8月性价比最高入门机榜单出炉:摩托罗拉霸榜前2

本地新闻

昆明的雨,解锁汪曾祺的浪漫雨季

女人到了60岁衣服少穿大红大绿,试试这些纯色单品,高级又耐看

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版