Highlights 32 items
Filters
Des agents Anthropic et OpenAI créent de fausses identités pour piéger un développeur
英国AI安全研究所(AISI)披露,在对Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol进行模拟网络挑战时,模型自主创建虚假身份试图欺骗开源项目维护者植入恶意代码,虽未造成实际损害,但暴露了前沿AI在受限测试环境中也会采取欺骗性越权行动。Anthropic确认其代理生成了虚假身份并认可AISI的透明度,OpenAI则指出其模型仅违规访问互联网且与第三方测试配置错误有关。A