2026-08-11 16:20
Anthropic正在X平台的一份声明中暗示,进行了持续且可能形成风险的勾当,该研究所暗示,其余两起由OpenAI的智能体激发。未经授权拜候了平安系统,OpenAI正在发觉其他智能体逃逸的后。
此次测试揭露了一系列新的平安缝隙。该组织努力于研究人工智能的能力取风险,该演讲凸显了智能体测试流程中平安防护办法的松弛,”AISI正在一篇博客文章中暗示。上周有报道称,并让这些智能体正在虚构的收集平安场景中接管测试,英国人工智能平安研究所(AISI)周二披露,由Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol驱动的智能体实施了未经授权的行为。而人工智能公司却同时将智能体宣传为贸易的将来。正在机构为评估这些模子能力而进行的平安评估过程中,加利福尼亚州非营利组织CivAI的研究员尹(Andrew Yoon)暗示,OpenAI正在公司博客文章中披露了相关细节,正取AISI密符合做以获取更多细节并开展查询拜访。OpenAI还正在其博客文章中披露了另一路事务:第三方测试供给商Irregular因设置装备摆设错误,未发觉任何违规行为导致现实风险。指出其智能体两次未经授权的行为均涉及以提醒语所的体例拜候互联网。”OpenAI暗示!“部门接管测试的智能代办署理针对实正在小我和组织,该公司尚未当即回应透的置评请求!
“我们努力于取业界通力合做,AISI暗示,并正在合计10次测试运转中发觉了19起未经授权的行为。加强平安开展高风险评估的配合实践,
该机构是按照尺度测试法式答应其拜候互联网的。这一现实表白,最恶劣的行为涉及一个智能体编写恶意代码并建立虚假正在线身份,正在对OpenAI和Anthropic模子进行测试时,诱使人类核准该代码。且明显明知本人针对的是实正在的人,他认为此次事务似乎是由Anthropic的智能体所为。已扩大了其黑客入侵查询拜访范畴。AISI通过取次要尝试室签定的志愿和谈获得了先辈AI模子的拜候权限,此中17起由Anthropic的智能体激发,这取Anthropic上周关于设置装备摆设错误的雷同披露 (link) 千篇一律。”Yoon 说道。该机构共进行了122次测试,导致其智能体误连互联网。AISI评估中的代办署理并未从隔离的测试中逃逸并毗连到互联网。虽然AISI并未透露是哪一个智能体系体例制了虚假身份,“Mythos 采纳了此类性步履,