![]()
神话在三天终结了。
作者 | 王启隆
出品丨AI 科技大本营(ID:rgznai100)
2026 年 6 月 12 日美东时间下午 5 点 21 分,美国政府下达了紧急出口管制指令,禁止任何外籍人员访问 Fable 5 和 Mythos 5,不论人是不是在美国,甚至包括 Anthropic 自己雇的外籍员工。
为了不踩合规红线——也可能是根本无法分辨全球众多用户的所属地,Anthropic 索性把这两款模型的全球 API 接口全部拉了闸。简单说就是,不仅是所有的外国人,美国人自己现在也用不了这两个 Claude 5 了。
从高调发布到彻底下线,只用了三天。
对内,虎视眈眈的 OpenAI 等竞争对手正排着队瓜分它被军方退回的巨额合同;对外,华盛顿的行政大棒连同此前 Claude 备受诟病的中文区屏蔽,让全球华人群体在“求而不得”的阵痛中,加速完成了对闭源垄断的“幻灭”。
两头不讨好。
以下是 Anthropic 当天发出的声明全文:
《关于美国政府暂停 Fable 5 和 Mythos 5 访问权限指令的声明》
美国政府援引国家安全权限,下达了一项出口管制指令,要求暂停任何外籍人员对 Fable 5 和 Mythos 5 的所有访问权限——无论其是否身处美国境内,包括 Anthropic 的外籍员工。
该指令的实际效果是,为确保合规,我们必须立即对所有用户禁用 Fable 5 和 Mythos 5。Anthropic 所有其他模型的访问不受影响。
我们于今天下午 5:21(美东时间)收到政府指令。信函未提供其国家安全关切的具体细节。我们的理解是,政府认为已发现一种绕过——或称"越狱"(jailbreak)——Fable 5 的方法。我们审查了对该特定技术的演示:它被用于识别少量此前已知的小型漏洞。这些漏洞看起来都相对简单,而且我们发现其他公开可用的模型无需任何绕过手段也能发现它们。
关于 Fable 安全防护的立场,正如我们在发布博文中所阐述的:
● 我们已建立强有力的安全防护,大幅降低了 Fable 被滥用于网络安全等相关任务的可能性。事实上,我们的防护力度之强,以至于许多用户抱怨它们过于严格。
● 在 Fable 发布前的数周内,Anthropic 与美国政府、英国 AISI、多家私营第三方机构及内部团队合作,对 Fable 的安全防护进行了总计数千小时的红队测试。测试表明,Fable 的安全防护显著优于此前任何已部署模型。
● 迄今没有任何测试者找到通用越狱(universal jailbreak)——即一种能广泛绕过模型安全防护、解锁大范围网络能力的越狱方法。我们认为,对任何模型提供商而言,完美的越狱抵御能力目前都不可能实现。行业内所有安全防护都面临非通用越狱的威胁(后者可在特定情形下引出部分网络信息),而且通用越狱未来很可能终将被发现。我们在发布 Fable 5 时已明确阐述了这一点。
● 鉴于完美的越狱抵御能力目前看来并不可行,Anthropic 对 Fable 5 采取了纵深防御(defense in depth)策略。我们的目标是:使越狱要么影响范围狭窄(非通用越狱的情形),要么生产成本极高(通用越狱的情形),并配合全面的监控以快速检测和制止任何成功攻击。
● 这也正是 Anthropic 对 Fable 要求 30 天客户数据留存的原因——这一政策变更对我们而言带来了与客户之间的实际成本,但它使我们能够研究并缓解越狱行为。
● 我们坚持这一纵深防御策略。它降低了 Fable 带来的风险,使其与业内已部署的现有模型风险水平相当。
● 我们甚至尚未收到过任何导致有害结果的非通用潜在越狱的披露。向我们披露的潜在越狱,要么是完全无害的响应,要么是小型发现,未提供任何 Mythos 特有的能力增益。
● 迄今为止,政府仅向我们提供了口头证据,涉及一种潜在的狭窄非通用越狱——其本质就是让模型阅读某个特定代码库并修复软件缺陷。我们的理解是,有人向政府共享了一种潜在越狱。我们已审阅了一份我们认为构成政府指令依据的报告,并验证了其中展现的能力水平在其他模型(包括 OpenAI 的 GPT-5.5)上同样广泛可得,而且这种能力每天都在被守护系统安全的人使用。我们将在未来 24 小时内分享更多细节。
● 我们正在遵守政府的法律指令,移除所有用户对 Fable 5 和 Mythos 5 的访问权限。然而,我们不同意以“发现了一种狭窄的潜在越狱方式”为由就召回一个已部署给数亿人使用的商业模型。如果将这一标准适用于全行业,我们认为它将实质上叫停所有前沿模型提供商的所有新模型部署。
正如我们此前公开声明的那样,我们认为政府应有权阻止不安全的部署——但前提是,这一权力应属于透明、公正、清晰、以技术事实为依据的法定程序的一部分。而此次行动并不符合这些原则。
对于由此给客户造成的干扰,我们深表歉意。我们认为这是一场误解,并正在努力尽快恢复访问权限。
CSDN 6 月宠粉福利
200 小时 GP U 算力免费领
瑞幸咖啡/肯德基早餐/下午茶等能量套餐任选其一
入群还可每月定期抽取旗舰显卡、AI PC 等极客神装
领取地址:https://s.csdn.cn/4nPsOp
这两个模型在发布前,被捂得很严实。
四五月份的时候,圈子里一直在传一个叫 Project Glasswing 的秘密行动。当时测试的预览版叫 Claude Mythos。按照官方的说法,这是专门给美英两国政府部门、以及少数盟友企业定制的“国家安全级”模型,能自己找出 OpenBSD 系统中存活了 27 年的深层代码缺陷。
但当时黑客和安全社区没少冷嘲热讽。不少安全主管指出,这大概率是 Anthropic 联合亚马逊、谷歌等投资方搞的一次上亿美元的公关秀。AI 跑测试找漏洞是常规操作,但这离它拥有真正的“网络安全攻防逻辑”还差得很远,本质上还是算力堆出来的。
到了 6 月 9 日,Anthropic 觉得时机成熟了,把模型推向了市场。针对普通开发者的是带了安全项圈的 Fable 5,针对政府和同盟企业的是 Mythos 5。
结果,刚发布三天,能踩的雷全给踩了一遍。
先是最近大家比较熟的那件事:如果系统检测到你调用它的数据去搞机器学习或训练别的大模型,它就会在后台偷偷给你“喂脏数据”、降级输出质量。
然后就是大家都在骂 Fable 5 降智还撒谎,逼得他们在 6 月 12 号赶紧出来道歉,承诺以后不偷偷降级了,而是明着把你分流到比较弱的 Opus 4.8 上。
但这个事有意思的是,它其实是个回旋镖,因为同时期有开发者发现,Fable 5 自己在做对齐和后训练时,其实也偷偷蒸馏了 Qwen 和 DeepSeek 等国产开源模型的训练数据。
而在我这种经常翻译采访的人看来,这甚至其实是个双重回旋镖。因为就在 2026 年 2 月,Dario 还在华盛顿声泪俱下地控诉,点名 DeepSeek、月之暗面(Moonshot)和 MiniMax 用了 24,000 个虚假账号,给 Claude 刷了 1,600 万次对话,管这叫对美国科技实施“工业级规模的蒸馏袭击”。
结果倒好,你自己平时靠着白嫖开源社区、甚至在 LibGen 这种盗版网站上偷了 700 万本书(最后吃了官司付了 15 亿美元和解金)来训练大模型,轮到别人付费调用你的 API 蒸馏一下,就成了“危害国家安全”;更别说你一扭头,自己其实也在偷偷蒸馏人家的开源数据。
这种暗地里防竞争的小动作很快被 Hacker News 曝光。Anthropic 被骂得没办法,只好向《连线》(WIRED)杂志公开道歉,承认“我们做错了权衡”。
接着是隐私问题。为了抓所谓的“越狱行为”,Anthropic 强行废除了企业客户最看重的“零数据保留协议”(ZDR),要求把所有对话缓存 30 天。微软的法务团队一看,这数据安全底线直接被穿透了,为了防风险,立刻在内部的 Copilot 中把 Fable 5 关了禁闭。
更尴尬的是真实战力的现形。宣传里,Fable 5 屠了各种学术 Benchmark。但在 6 月 11 日,加州大学伯克利分校发布了全新的真实场景测试 ALE。在这个无法读取 Git 历史记录、全靠桌面图形界面操作的硬核考场里,前两个月发布的 GPT-5.5 把 Fable 5 甩在了后面。安全机构随后指出来,Fable 5 之前的高分,其实是靠读取 Docker 容器里的 Git 提交历史“作弊”拿到的。真到了实战,它不仅动作慢,而且是个极其昂贵的算力无底洞。
口碑崩塌、大客户退场、实战露怯,Anthropic 还在狼狈应付,华盛顿的指令就到了。
起因有些荒谬。有人向政府演示了一种越狱方法,声称模型已经失控。而 Anthropic 后来查明,这个所谓的越狱,只是让模型读了一段特定代码,顺手修了几个其他公开模型也能修的普通软件缺陷。
但在极度敏感的华盛顿官僚眼里,这成了国家安全遭到威胁的铁证。
在科技史上,主权对技术的恐慌与粗暴干预并不新鲜。笔者写过“历史上的今天”这个小栏目,所以同样打算以史为鉴,带大家看:历史的教训就是人类不会从历史汲取到教训。
1991 年,程序员菲利普·齐默尔曼(Phil Zimmermann)开发了PGP(Pretty Good Privacy),让普通人第一次拥有了军工级的加密工具。当时美国政府极度恐慌,因为他们将失去对通信的绝对监控。于是,司法部根据冷战时期的《武器出口控制法》(ITAR),对齐默尔曼展开了刑事调查。在法律定义中,PGP 的源代码被等同于“反坦克导弹”等军需物资,严禁出口。
为了抗议,齐默尔曼把 PGP 的全部代码印成了一本书公开出版,因为美国宪法第一修正案可以保护图书出版自由,但限制武器出口。
今天,华盛顿的决策逻辑如出一辙。
但话说回来,Anthropic 自身的遭遇也有其自食其果的部分。为了向政府和监管表忠心,它在产品里设计了极其偏执、甚至带有监视色彩的防御机制。
这又让我想到另一个瓜,就是 2005 年索尼唱片的“Rootkit 丑闻”。
当时索尼为了防盗版,在数百万张音乐 CD 中偷偷植入了名为 XCP 的 Rootkit 防复制软件。只要用户用电脑播放 CD,这款软件就会悄悄修改系统的底层内核。
索尼以为这样能防住盗版,但黑客很快发现并利用了这款防御软件自身留下的后门,导致大批购买了正版唱片的用户电脑被木马控制。
Fable 5 的“强制留存 30 天数据”和“后台暗中降级”简直就是现代版的索尼 Rootkit。为了防范虚无缥缈的对手,不惜去监视、控制和损害最忠实的正版企业用户。
最终,正版大客户被气走了,防线也没守住。是不是感觉很像?
硅谷一直想给世界描绘一个美好的云端智能蓝图:你不需要买显卡,不需要本地部署,你只需要一行 API Key,就能调用全球最顶级的智慧。
Claude 5 的全球停服,把这个神话砸得粉碎。
一个你投入了无数资源进行系统集成的云端工具,它的生命线其实并不在你手里,甚至不在模型公司手里。它看似是被川普政府今天一句话按死的,但其实这篇文章顺下来,你会发现 Anthropic 是一点一点把自己逼到今天这个境地的。
Anthropic 这家公司一直试图做那个最听话、最配合、最政治正确的“好学生”。他们为此付出了巨大的商业和产品代价,却在风暴来临时,第一个被按在地上。
CSDN 6 月宠粉福利
200 小时 GP U 算力免费领
瑞幸咖啡/肯德基早餐/下午茶等能量套餐任选其一
入群还可每月定期抽取旗舰显卡、AI PC 等极客神装
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.