OpenAI正式发布GPT‑6 Astra。与过去擅长聊天、写作和生成代码的模型不同,Astra最受关注的变化,是能够直接进入浏览器和专业软件,代替用户完成检索资料、填写表格、整理日程、修改代码以及制作文档等连续任务。AI正在从“告诉你怎么做”,迈向“直接替你做”。
![]()
OpenAI将其称为迄今能力最强、最符合人类意图的模型。官方资料显示,Astra拥有105万Token上下文窗口,重点提升了电脑操作、软件工程、科研和复杂专业工作能力。不过,它并未立即向所有人开放,目前主要面向可信访问计划中的少量机构,Plus、Pro、Business、Enterprise及API用户将在随后数日逐步获得权限。
更具争议的是,OpenAI总裁Greg Brockman表示,他个人认为人类可能已经进入“AGI时代”。但这并不等于业界已经认定AGI诞生。Astra在ARC-AGI-3测试中取得99.9%的成绩,使用标准测试框架时成绩则为62.7%。如此大的差距提醒我们:一个耀眼分数不仅取决于模型,也取决于运行工具、记忆和测试方式。
![]()
与此同时,Astra成为OpenAI首个达到“Critical”网络安全能力等级的模型。按照公司的定义,它在获得适当工具后,可能自主发现未知漏洞并设计攻击方法。因此,最强网络能力不会无条件提供给普通用户,系统还会监控越界行为,必要时暂停任务。
在我看来,Astra真正重要的地方,不是“AGI”这个足够吸睛的标签,而是AI第一次如此接近数字世界里的执行者。当它能阅读、判断并操作电脑,效率提高的同时,误删文件、错误决策和权限失控也会产生真实后果。下一阶段的竞争,不只是看谁的模型分数更高,而是看谁能回答一个更现实的问题:当AI真正开始干活,出了问题究竟由谁负责?
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.