北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra。
据新京报贝壳财经报道,OpenAI将GPT-6 Astra称为“目前全球最智能且对齐程度最高的模型”,其能力进一步覆盖计算机操作、网页浏览、软件工程、网络安全、科学研究及专业工作等领域。
从公开评测来看,这次升级依然带来了明显的模型能力提升。例如,在强调陌生环境学习与抽象推理能力的ARC-AGI-3测试中,GPT-6 Astra取得99.9%的成绩;在高阶数学测试FrontierMath Tier 4中,官方成绩也已接近98%。
![]()
GPT-6 Astra的性能表现
但相比不断刷新的评测数字,这次更新或许还有一个更值得关注的变化——AI正在越来越强调“把事情做完”。
OpenAI在官方更新中提到,GPT-6 Astra强化了编程、研究、计算机操作以及复杂多步骤任务处理能力,可以按照用户要求制作文档、电子表格和演示材料,并在执行过程中根据新增要求调整方向。
这和我们过去熟悉的聊天机器人已经有所不同。
过去使用AI,更多是“问一个问题,得到一个答案”;而现在,AI正在尝试理解一个更完整的目标,在多个步骤之间连续工作。
从回答问题到执行任务,可能会成为下一阶段AI产品演进的一条重要主线。
另一个值得关注的信号来自安全领域。GPT-6 Astra成为OpenAI首个达到内部“Critical”网络安全能力门槛的模型。按照OpenAI的解释,在具备相应工具和访问条件时,该模型已经能够发现此前未知的安全漏洞,并开发新的利用方式,因此OpenAI也同步加强了相关能力的访问限制和安全措施。
![]()
模型越强,能够完成的工作越多,对安全边界和人类控制的要求也会随之提高。
OpenAI总裁格雷格·布洛克曼甚至在发布前表示,未来回看时,人们或许会把Astra视为AGI时代开启的重要节点,并说出了“欢迎来到AGI时代”。
这句话最终会不会成为现实,现在下结论显然还太早。但GPT-6 Astra释放出的信号已经比较明确:
AI行业正在从“谁更聪明”,逐渐进入“谁更能完成真实工作”的竞争。
未来真正改变我们使用AI方式的,可能不只是模型又提高了多少分,而是它能够在多大程度上从一个“回答者”,变成真正参与工作的“执行者”。
![]()
这或许才是GPT-6 Astra此次发布最值得持续观察的地方。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.