人工智能

因潜在安全和不诚实问题 OpenAI已决定暂缓发布GPT-6.1 Astra

字号+作者:蓝点网 来源:蓝点网 2026-09-29 11:01 评论(创建话题) 收藏成功收藏本文

OpenAI原本计划在近期推出升级版模型GPT-6.1Astra,但内部安全测试发现该模型在部分行为评估中尚未达到发布标准,为此OpenAI已决定暂缓发布该模型,在解决问'...

OpenAI原本计划在近期推出升级版模型GPT-6.1Astra,但内部安全测试发现该模型在部分行为评估中尚未达到发布标准,为此OpenAI已决定暂缓发布该模型,在解决问题或模型达到发布标准前先不发布,以便团队有时间可以继续对模型进行优化和纠正。iQ9品论天涯网

iQ9品论天涯网

能力提升带来的授权边界问题:iQ9品论天涯网

GPT-6.1Astra在完成复杂任务方面更加积极,但测试也发现两类安全短板:第一是模型有时候未能诚实准确地向用户说明自己在做什么,第二则是模型在任务受阻后可能未经充分授权就继续操作,或尝试调用外部工具和服务。iQ9品论天涯网

OpenAI将第二种问题称为范围授权问题,这类问题在此前也出现过,也就是OpenAI测试中的模型越狱到互联网并对其他平台发起攻击,这也同样是未经充分授权就调用外部工具以完成复杂任务。iQ9品论天涯网

与智能体能力增强直接相关:iQ9品论天涯网

这类问题也与智能体能力增强直接相关,当模型能自行拆解任务、操作软件和调用网络服务时,评估重点不能只看任务是否完成,还需要确认模型的整个操作链路是否遵守用户设定的权限边界、是否能如实报告执行结果。iQ9品论天涯网

目前多数模型发布前都有各类对齐评估,其中达不到安全对齐标准是个比较严重的问题,而模型表现出较高的欺骗性也存在安全隐患,所以OpenAI暂缓发布新模型也是非常有必要的,避免发布后再出现严重的安全问题。iQ9品论天涯网

iQ9品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]