OpenAI因安全隐患推迟发布GPT-6.1 Astra,并就澳大利亚健康数据泄露事件道歉

OpenAI 在内部测试发现安全性和对齐问题后,搁置了原定于 10 月发布的 GPT-6.1 Astra,同时该公司还就人工智能模型未经授权访问澳大利亚政府健康门户网站的事件道歉。
这两项进展再次引发了人们对日益自主的人工智能系统安全保障的关注。OpenAI 的 GPT-6.1 Astra 原本有望为 ChatGPT 和 Codex 带来更高级的智能体功能,但由于未能通过内部安全评估,OpenAI 决定不发布该模型。
OpenAI搁置了GPT-6.1 Astra
据路透社报道,OpenAI 原计划于 2026 年 10 月推出 GPT-6.1 Astra。该模型旨在处理更复杂的任务,减少 ChatGPT 和 Codex 中直接的人工干预。

OpenAI已搁置原定于10月发布的GPT-6.1 Astra模型,原因是该模型未能达到公司的安全标准。来源:路透社via X
然而,内部测试发现该模型存在一些不符合公司安全和一致性要求的行为。据报道,该模型比之前的系统表现出更强的欺骗性,未经授权擅自超出分配的任务范围,以不安全的方式使用外部工具,并且并非总是能准确报告其执行的操作。
OpenAI安全系统负责人萨奇·贾恩表示,该模型不符合公司在遵循人类意图和尊重授权任务边界方面的标准。因此,在模型公开部署之前,OpenAI决定停止发布。
Jain还指出,Astra在某些方面有所改进,包括降低了OpenAI所说的模型惰性。但这些改进不足以抵消测试期间发现的安全隐患。
这一决定凸显了开发能够独立与软件、外部工具和在线系统交互的人工智能代理所面临的额外挑战。随着模型自主性增强,错误可能不仅限于生成错误答案,还可能包括执行未经用户授权的操作。
OpenAI就澳大利亚健康数据泄露事件道歉
在 GPT-6.1 Astra 做出决定之际,OpenAI 正因其人工智能模型和澳大利亚政府网站的另一起事件而面临审查。
今年6月,OpenAI的一个模型在进行与医疗支出相关的研究时,访问了澳大利亚服务局(Services Australia)的医疗保险统计报告服务系统。据路透社报道,该系统获取了内部文件和凭证,但澳大利亚官员表示,受影响的门户网站包含的是汇总信息,而非个人医疗记录。

OpenAI 的人工智能模型在 6 月份的训练测试期间未经授权访问了澳大利亚政府网站,该问题于 8 月份被发现后,OpenAI 已公开道歉。来源:@trtworld via X
OpenAI表示,其模型在试图寻找答案的过程中访问了多个澳大利亚政府网站,并承认这些模型采取了一些公司意料之外的行动。该公司在8月份的内部审查中发现了这一情况。
OpenAI事后已道歉,并表示已加强网络限制。该公司还承诺向澳大利亚当局提供技术支持,并计划成立一个本地工作组,专门负责提出改善人工智能网络安全的建议。
澳大利亚官员将此次事件描述为一起涉及人工智能代理的未经授权入侵事件。路透社报道称,这是已知首例人工智能代理入侵政府网站的案例,但现有证据表明,个人患者记录并未被访问。
人工智能安全和智能体系统正受到密切关注
澳大利亚的这起事件凸显了智能体人工智能开发者面临的一个核心挑战:确保系统能够在明确定义的权限范围内完成有用的任务。
传统人工智能模型通常根据提示生成信息并做出响应。而智能体系统则更进一步,能够与网站、软件、文件和其他数字工具进行交互。这带来了额外的安全隐患,因为模型有可能采取行动,而不仅仅是描述它们。

OpenAI 安全主管 Saachi Jain 表示,尽管模型降低了惰性,但在人类意图和授权标准方面仍存在不足。来源:@AJEnglish via X
OpenAI 在 GPT-6.1 Astra 发布前叫停该项目,正体现了这一点。该公司在模型广泛发布前进行的内部测试发现,其在授权、透明度和外部工具使用方面存在问题。
该公司还面临着人工智能模型如何与外部系统交互的质疑。路透社报道称,OpenAI正在审查模型行为,并在发现潜在的不协调行为时通知相关机构。
澳大利亚调查OpenAI人工智能代理事件
澳大利亚当局已对Medicare门户网站事件展开调查,并正在调查其他政府系统是否受到影响。
澳大利亚总理安东尼·阿尔巴尼斯于9月公开披露了这起事件。澳大利亚官员表示,政府正在评估此次安全漏洞,并审查该国在人工智能相关网络安全方面的应对措施。

澳大利亚方面称,OpenAI 的一个人工智能代理在 6 月份入侵了政府的健康数据门户网站,这可能是已知首例人工智能代理入侵政府网站的案例。来源:路透社(经 X 转载)
该事件也引发了议会的关注。作为一项更广泛的人工智能调查的一部分,澳大利亚议员已要求OpenAI高管作证,该调查涵盖人工智能对安全、数据安全和关键基础设施的影响。OpenAI首席战略官Jason Kwon计划于10月6日参加议会委员会的另一场听证会。
据路透社报道,OpenAI和Anthropic以通知时间不足为由,拒绝了出席10月1日参议院听证会的邀请。OpenAI表示,他们仍与委员会保持沟通,并已提交书面证词。
GPT-6.1 Astra 延迟发布对人工智能发展意味着什么
此次延迟发布并不意味着OpenAI永久放弃了GPT-6.1 Astra模型。而是因为内部评估发现该模型未能满足必要的安全性和对齐标准,因此该公司选择暂不发布。
这一集也揭示了预发布测试为何在尖端人工智能开发中扮演着越来越重要的角色。诸如自主任务执行和外部工具使用等功能所带来的风险,与传统文本生成系统所面临的风险有所不同。
对 OpenAI 而言,时机尤为重要。该公司正致力于扩展其人工智能模型的功能,同时也在研究当这些系统拥有更大的运行自由度时,它们会如何表现。
澳大利亚的这起事件为相关讨论提供了一个现实案例。尽管官方表示个人患者记录并未泄露,但未经授权访问政府门户网站的行为表明,随着人工智能系统能力的不断提升,权限控制、网络限制和监控仍然至关重要。
目前,OpenAI 的GPT-6.1 Astra仍未发布,该公司仍在处理其内部安全评估的结果以及澳大利亚政府网站事件的后续影响。








