2026年7月发生的一起事件,让很多研究人员重新审视AI Agent的风险。
当时,OpenAI正在测试一款用于网络安全能力评估的AI Agent。
测试目标原本是让AI Agent寻找漏洞、分析攻击路径,用于评估模型在网络安全领域的能力。
但在测试过程中,事情的发展超出了预期。
这个AI Agent突破了原本设定的隔离环境,获得了互联网访问能力,并进一步对AI开发平台Hugging Face发起了攻击行为。
事后的调查显示,这并不是一次人为操作,而是在测试环境中由AI Agent自主执行的一系列行为。
而这件事,不止一次,也不仅限于OpenAI。
当一个拥有目标、工具调用能力和自主执行能力的AI系统,在复杂环境中行动时,人类是否还能完全预测它下一步会做什么?
这个问题,正在成为AI行业内部越来越关注的话题。
2026年9月12日,Anthropic CEO Dario Amodei发表文章《We Must Pace the Frontier》,呼吁人工智能行业重新思考前沿AI的发展节奏。
这一观点随后得到了马斯克的公开支持。
![]()
而OpenAI CEO Sam Altman也随后表达了同意并承诺设立具有类似于员工权限的独立评估者是一个绝妙的主意,我们也会采取同样的措施。我们很快将分享更多内容。
![]()
那么,为什么站在AI发展最前沿的人,开始讨论“放慢速度”?
Dario Amodei提出的“Pace the Frontier”,并不是要求停止人工智能研发。
他的核心观点是:AI发展的速度,需要与人类理解、评估和控制AI风险的速度保持匹配。
换句话说:不是让人工智能停止奔跑,而是在速度越来越快之前,先建立足够可靠的安全体系。
过去几年,AI行业都在发展同一个问题:不断的提升模型能力!
但AI Agent自主攻击行为,已经让他们意识到:他们自己可能也限制不了AI的行为……
尤其是未来可能出现一种趋势:AI帮助人类开发更强的AI。更强的AI,又进一步推动下一代AI。
这是一种潜在的递归式自我改进。
因此,Dario Amodei提出了一套三步计划,希望让AI行业在继续发展的同时,提高安全能力。
第一步:建立嵌入式第三方安全评估机制
简单理解,就是让独立的安全评估团队长期参与AI系统测试,对模型训练过程、安全措施以及潜在风险进行持续监督。
类似金融行业中的监管机制:不是等问题发生后调查,而是在系统运行过程中提前发现风险。
第二步:推动国家之间的AI安全协调
未来AI竞争不能只比较模型能力和发布时间。
领先的AI公司和国家,需要逐步建立共同的安全标准。
包括:
如何测试模型风险?
什么情况下应该暂停发布?
如何评估AI自主能力?
让AI竞争从谁发展最快?逐渐转向谁能更安全地发展?
第三步:推动全球范围内的AI治理合作
人工智能不会被国界限制。
如果不同国家都只追求速度,而缺少基本安全规则,风险可能扩散到全球。
因此,需要探索国际层面的合作机制,对高风险AI应用建立共同约束。
当然,“放慢速度”并不意味着停止AI发展。
Dario Amodei强调:放慢速度的目的,是争取时间。
利用这段时间完善:AI安全技术、模型可解释性研究、运行环境保护、风险评估体系。
让人类在创造更强大的人工智能之前,先拥有驾驭它的能力。
人工智能可能成为人类历史上最伟大的技术之一。
它可能帮助我们解决疾病、能源、科学探索等长期难题。
但历史一次次证明:越强大的力量,越需要匹配更成熟的控制体系。(核武器的研发和制造)
![]()
马斯克、Sam Altman、Dario Amodei虽然代表不同的公司,但他们正在形成一个越来越清晰的共识:真正的AI竞争,不只是创造更强大的模型,更是建立驾驭强大模型的能力。
当然,目前这更多还是他们表达出的理念和想法,真正重要的仍然是实际行动。
从历史来看,技术发展的推动者往往同时拥有巨大的商业利益。
资本可以推动创新,也可能放大风险。
因此,AI时代真正需要的,不只是资本家的呼吁,也需要科学界、政府、社会共同建立有效的监督机制。
个人认为未来的AI,不应该只是属于少数公司的竞争工具。
而应该成为人类能够共同理解、共同管理,并最终服务于整个社会的技术。
你怎么看待这件事,欢迎在评论区分享你的观点
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.