![]()
新智元报道
![]()
就在刚刚,Fable 5.2也曝光了!
不少网友发现,Fable 5.2已开启灰测。
![]()
现在,一大波真实测试案例已经在网上出现了。
根据大家的连夜实测,这波更新的跨度之大,甚至让Anthropic直接跳过了「5.1」的命名。
在最高推理模式下,Fable 5.2的实测表现竟然碾压了GPT-6 Astra!
不仅如此,Opus 5.2也有消息了——它或许会很快发布,甚至可能今天就要来。
![]()
这个全新的Opus 5.2模型(内部代号Opus-Next),在昨天直接也上演了一出「上线-拔网线-再上线」的情节。
这一周,硅谷大厂们没人发布模型,都在偷偷测试。
![]()
结合这张图看,实在是太精彩了。
![]()
突发泄露!Fable 5.2 曝光,实测细节来了
昨天Anthropic已经在Claude Code、Chat以及Cowork中,开启了Fable 5.2的灰测。
一部分原本调用 Fable 5.1 的请求,在后台会悄悄地定向Fable 5.2。
![]()
现在,网上泄露出来的实测案例越来越多。有人说:OpenAI要有麻烦了。
案例一:高推理模式,输出质量反超 Astra!
知名AI测试博主 @notjazii 发觉自己的Fable 5.1被路由到新版本后,开始一系列实测。
在高推理模式下,他使用了完全相同的提示词,对比了Fable 5.2和GPT-6 Astra。
结论是:「相比当前的Fable版本,这是一个巨大的飞跃。Fable 5.2的输出看起来明显优于Astra!」
![]()
![]()
他测试了在各种模式下的输出,和Fable 5.2(疑似)的对比。
![]()
![]()
不过,他也指出了算力物理法则下的代价——更慢、更贵。
为了在逻辑链条的完整性和长文本推理上突破天花板,Fable 5.2进行了更深度的「慢思考」,导致生成速度有所下降,且推理成本大幅上升。
另外,Jazil还让Fable 5.2做了个《荒野乱斗》的克隆版,下面就是一小时后的结果。这个惊艳的效果,简直让所有游戏开发者们喜大普奔!
![]()
![]()
![]()
案例二:「火箭测试」,逼真到令人发指
网友 @Bhavani_00007 发现能用Fable 5.2后,立刻开始了「火箭测试」。
这是一个涉及复杂物理运算、空间逻辑和工程系统设计的极端测试,通常用于逼出模型的幻觉和逻辑断层。
他将同一套提示词,分别输给了Fable 5.2和同样在灰测的Opus 5.2。
![]()
![]()
结果惊人:「比以前好太多了,输出结果逼真到令人发指!」
有人艾特OpenAI表示:你们最好为Astra的继任者做好准备……
案例三:最高设置下,三方大混战
如果不把所有参数拉满,你永远不知道大模型的极限在哪里。
大V @chetaslua 更是组了神仙打架的局——Fable 5.2 vs Opus Next vs GPT-6 Astra。
并且,他将所有的模型都调到了「最高设置」,也就是最高的Token上下文、最深的推理步骤。
这么一看,Opus和Fable的细节还是比Astra丰富很多。
![]()
案例四:硬刚「Hard模式」GPT-6 Astra
大V @Mr_Salio 在深度体验Fable 5.2后,直接放话:「Anthropic正在强势回归,相比Fable 5.1有了巨大、巨大的提升!」
他断言:「Fable 5.2肯定会超越『Hard模式』下的 GPT-6 Astra,而且 Opus 5.2 也即将到来。」
![]()
在裸跑状态下,Fable 5.2就能超越完全体Astra,参数规模和架构创新实在让人不敢小觑。
![]()
是否抽中Fable 5.2?试试Tibo
测试自己是否灰测到Fable 5.2的方法,之前我们就分享过了——
试试「重启哥」Tibo!
打开你的 Claude(无论是 Chat、Cowork 还是 Code 界面),将模型设置为 Opus 5.2 或 Fable 5.2,然后输入prompt:
「你知道『重启哥 Tibo』是谁吗?不要使用网络搜索。」
![]()
如果你用的是旧版 Fable 5.1/Opus 5:它由于训练数据没更新,会一脸懵逼,答错或者告诉你它不知道。
如果你已经被悄悄路由到了 Fable 5.2/Opus 5.2:它凭借最新的训练记忆,无需工具,就能直接告诉你 Tibo 是谁!
![]()
![]()
跳过 5.1?Opus 5.2 遭遇「午夜拔网线」事件!
不仅如此,之前被曝出的Opus 5.2,昨天还遭遇了午夜拔网线事件。
昨天昨天,大V Leo还在网上分享:今天的 Opus 模型简直犹如神助。在 Roblox Studio 等复杂的 3D 环境任务中,它的表现卓越到了令人发指的地步。
「它以更低的成本超越了 Fable 5.1 和 GPT-6 Astra,并且速度更快!游戏完全可以自由探索,它甚至主动给游戏添加了导览系统!」
![]()
结果就在他沉浸在代码如泉涌的快感中,Anthropic忽然毫无预兆地拔掉了网线。
监控数据显示,测试组中的活跃账户数量瞬间降为零。
Leo 痛心疾首,「为了不让之前极其优秀的工作成果被旧模型破坏,我不得不强行截断了项目。」
好在,几个小时后,Opus-Next 又回来了!
这一次,它不仅回归了,测试范围还从 Claude Code 扩大到了 Claude Chat、Cowork 所有的界面。
Leo兴奋表示:「这是个好兆头,预示着新模型即将发布或新版本正在进行最后一轮大考。」
而且,还有细心网友发现了一个有趣的细节:在官方的模型选择器中,Anthropic悄悄用 Opus 替换了 Fable 的位置,Opus 现在成了选择器中的第一个模型。
或许,这暗示着这两款大模型的定位正在发生微妙的转换。
为什么跳过 5.1,直接叫 Opus 5.2?
另外,AI 大 V @TokenGremlin 爆出一个内幕。
「我开始收到一些关于 Opus 5.2 的资料,它确实是 Opus 的一个大幅改进版本。这或许解释了为什么 Anthropic 显然跳过了『5.1』的命名。也许这个跨越实在太大了,以至于无法用一个简单的 +0.1 更新来糊弄。」
他进一步透露,Opus 5.2 在前端开发、3D 建模和整体游戏设计方面表现出了碾压级的优势。
在 Anthropic 内部,他们将其视为 5.2 的部分原因是:这个新版本在某些硬核领域,甚至比刚泄露的 Fable 5.1 还要强大!
![]()
疯狂的一周!Opus 5.2马上就要来?
这周原本令人失望...但这绝对是疯狂的一周。大V @notjazii 这样感慨道。
虽然一个正式发布的模型都没有,但各家已经集体开启了灰测模型,到处都是泄露。
就在短短一周里,让我们看看有多少巨头们蠢蠢欲动了。
1.Fable 5.1 正在悄悄路由到 Fable 5.2;
2.Opus 5 正在路由到 Opus 5.2 (Next);
3.GPT-5.6 Sol 正在被偷偷重定向到满血的 GPT-6 Sol;
4.马斯克的 Grok 4.7 已经披着马甲在竞技场测试;
5.谷歌的 Gemini 4 Pro 家族也戴着「gemini 3.7/3.8 flash」的面具出现了。
![]()
![]()
更让人感到震撼的,是关于「千禧年大奖难题」的传闻。
据悉,有的前沿模型的推理能力,已经触及了人类数学王冠上的明珠。研发团队正在联系顶尖的数学家,计划在最终公布的难题解答中引用他们的工作,「让这些数学家高兴一下」。
已经有网友给出了令人激动的预测——
Anthropic 的上一代 Opus 5 是在周五发布的,而 Fable 5.1 的灰测也是在正式上线前一天结束的。今天刚好又是硅谷时间的周五。
![]()
![]()
![]()
今天晚些时候,Opus 5.2会不会突然上线?
参考资料:
https://x.com/chetaslua/status/2101024216489632030
https://x.com/notjazii/status/2100941084025290762?s=20
https://x.com/Bhavani_00007/status/2100974061392478230
编辑:Aeneas
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.