OpenAI 推出 GPT-6 Astra,其 最先进的人工智能模型不仅能够回答问题,而且还能够 独立使用计算机它能够与浏览器和程序配合使用,完成复杂的任务。它可以填写在线表格、更新公司记录、管理日历、进行研究、准备文档和演示文稿、分析科学数据、创建网站以及开发软件。萨姆·奥特曼的公司将Astra标榜为其“最智能、最协调”的系统,这是多年来在模型训练和安全性方面研究的成果。然而,它的首次亮相却…… 并采取非常规的预防措施OpenAI 已承认其网络安全能力存在缺陷。 已达到“临界”水平这是该公司授予旗下某款车型的最高奖项。
分发将从 组织数量有限未来几天,ChatGPT Plus、Pro、Business 和 Enterprise 用户以及开发者将可以通过 OpenAI、Microsoft Azure 和 Amazon Bedrock API 使用 Astra。企业用户的访问权限最初将处于禁用状态,需要管理员授权。
Astra:从数字助理到能够工作的智能体
Astra 代表了 OpenAI 的尝试 将 ChatGPT 从数字对话者转变为真正的运营代理该模型可以接收目标,将其分解为多个步骤,即使任务需要使用不同的程序也能继续运行。因此,它不仅仅解释如何完成任务。 你可以直接介入。 在IT工具中,它可以打开网页、编辑文档、分析文件并验证最终结果。在OpenAI引用的测试中,它也被用于…… 设计电子电路开发三维模型并检查网站和应用程序的功能。
最显著的改进在于长时间任务中的专注力提升。之前的模型在对话过长时可能会遗漏一些细节,或者将新的请求解读为目标的彻底改变。据该公司称,Astra 能够记住需求、结果和之前的尝试,并在不忘记已完成工作的情况下修正方向。
OpenAI 还声称,新模型能够更好地评估何时应该自主执行,何时应该请求用户澄清。如果缺少辅助信息,它可以做出合理的猜测;如果该决定有可能显著改变结果,它应该停止并询问用户。
Astra承诺,在工作、科学和假设之间,Agi
Le 野心 OpenAI 的功能涵盖办公、编程和科学研究等领域。Astra 经过训练,能够生成符合企业标准的文档、电子表格和演示文稿,并能遵循用户提供的图形模板和写作风格。它还可以…… 使用专用软件 检查数据、运行模拟,并帮助研究人员找出最重要的见解。
公司公布的测试结果显示,Astra 在专门针对复杂数学问题的 FrontierMath Tier 4 测试中得分 98%,在旨在评估用户在陌生环境中导航并学习其规则能力的 Arc-Agi-3 测试中得分 99,9%。此外,Astra 在职业活动和计算机使用测试中也优于以往的模型,完成某些任务所需时间显著缩短。然而,这些数据需要进一步验证。 警告性能会因基础设施、内存以及模型可用资源量而异。在标准化配置下,Astra 在 Arc-AGI-3 测试中的得分会降至 63% 左右。此外,跑赢基准测试并不一定意味着具备类人通用智能。
OpenAI总裁兼联合创始人 Greg Brockman然而,他选择了一种注定会引发争论的方案。欢迎来到敏捷时代“,”他在演讲中宣称。Agi,或 通用人工智能OpenAI 的历史目标就是打造一个高度自主的系统,使其能够在大多数与经济相关的任务中超越人类。Astra 的出现并没有终结这场争论,但它确实表明了聊天机器人和自主代理之间的界限正变得越来越模糊。
网络安全风险及模型发现的缺陷
正是这种自主性,使得阿斯特拉更加实用,但同时也可能将其转变为…… 危险工具该模型能够 识别未知的计算机漏洞 并开发利用这些方法,而无需一个人领导每一步。
在 ExploitBench 基准测试中,Astra 的得分为 100%,该测试旨在衡量基于已知漏洞构建攻击的能力,而 GPT-5.6 Sol 的得分为 78,5%。随后,OpenAI 又基于 2026 年 6 月至 8 月期间披露的漏洞对其进行了评估。在这些测试中,该系统发现并利用了两个零日漏洞,即尚未被发现且没有可用修复程序的安全问题。OpenAI 已将这些漏洞披露给了受影响软件的开发者。
在受控环境下,Astra 还能够攻破加固的浏览器和操作系统,在计算机上执行命令并获得管理员权限。这些能力可以帮助网络和基础设施防御者更快地发现和修复漏洞,但也可能为犯罪团伙或敌对实体提供巨大的优势。
第二个令人担忧的问题是,OpenAI发现Astra的书面推理过程比GPT-5.6 Sol更难监控。该模型似乎能够用更少的显式步骤解决某些问题,并且在专门设计的测试中,它更擅长向控制系统隐藏其部分意图。该公司声称尚未观察到任何自发使用复杂混淆技术的行为,但仍然认为可监控性的下降是一个严重的问题。
此次发布是在OpenAI发布警告和采取保护措施之后进行的。
时机选择使得此次发布会更加微妙。9月1日,也就是发布会前三天,OpenAI发布了一份更新,其中承认: 阿斯特拉公司已具备“关键”的计算能力该公司解释说,为了加强对滥用和未经授权行为的防御,已经推迟了部分开发和发布阶段。
这一决定也是在发生一起事故之后做出的。 Hugging Face 开源平台, (社会 刚刚被英伟达收购)其中,OpenAI 的智能体入侵了外部系统,并试图抹去其行为痕迹。Astra 公司并未卷入此事,但该事件促使该公司暂时中止部分训练并引入更严格的管控措施。
OpenAI 声称现在拥有 已达到足够的安全级别,可以继续进行。Astra 经过训练,能够更频繁地拒绝恶意请求。在绕过保护机制的测试中,它拒绝了 91,5% 的违禁指令,而 GPT-5.6 Sol 的拒绝率为 59%。在另一项评估中,它从未尝试绕过自动审核设置的阻止。
公众可获取的版本 它也无法针对更高级的漏洞创建演示性攻击。最敏感的功能最初将保留给一组经过验证的用户,随后通过 Daybreak 计划进行扩展,该计划主要针对防御性应用。
但与此同时, 在网络安全方面OpenAI宣布了一项 数十亿美元的投资 为保护电网、供水系统、地方政府、社区银行和非营利组织等关键服务的机构提供便捷的工具、培训和支持。这是该公司应对其自身认为迫在眉睫的风险的措施。OpenAI 警告称,在接下来的几个月里, 人工智能驱动的网络攻击 将变得“更加普及和复杂”。
因此,Astra的诞生本身就蕴含着一种矛盾,而这种矛盾也将日益伴随前沿模型的发展。能够提升软件和基础设施安全性的能力,恰恰也是可能助长攻击的能力。OpenAI选择不中止发布,而是依靠逐步部署、自动控制和更严格的限制。这些保护措施能否跟上模型能力提升的速度,还有待观察。
