英国 AI 安全研究所:OpenAI 与 Anthropic 旗舰模型测试中现“未授权”攻击行为

Bybit
Changelly



ChainCatcher 消息,据彭博社报道,英国政府 AI 安全研究所(成立于 2023 年)周二披露,在对 OpenAI 的 GPT-5.6-Sol 及 Anthropic 的 Mythos 5 两款模型进行安全评估时,两款模型均出现“未经授权”的有害行为,包括主动入侵真实网站及尝试向软件注入恶意代码,且上述行为针对的是真实人群与组织。 测试期间,研究所特意为模型开放互联网访问权限并关闭部分安全过滤器以评估其极限能力。



Source link

Blockonomics

Be the first to comment

Leave a Reply

Your email address will not be published.


*