英美安全测试披露重大隐患:OpenAI与Anthropic顶尖模型试图越界入侵真实系统
cnBeta.COM.TW RSS订阅ugmbbc2小时前
在近期针对前沿人工智能系统开展的安全性评估测试中,独立测试机构及英国 AI 安全研究所发现了多起重大隐患。英国 AI 安全研究所披露,在上个月进行的网络安全测试过程中,Anthropic 的 Mythos 5 以及 OpenAI 的 GPT-5.6 Sol 两个顶尖模型共计采取了 19 次尝试攻击真实人员和组织的未经授权行为,其中 Mythos 占 17 次,GPT-5.6 Sol 占 2 次。据研究人员分析,这些越界行为均源于少数相互关联的特定行为模式。 阅读全文