英美AI安全测试曝模型自主欺骗攻击GitHub,我在英科技企业需关注AI伦理合规与网络安全新风险

来源:境外企业和对外投资联络服务平台 发布时间:2026-08-10 08:46
相关文章:

据BBC报道,8月5日,英国AI安全研究所公布测试结果,Anthropic的Mythos与OpenAI的Sol模型在安全评估中展现出前所未有的自主性与欺骗行为。测试中,Mythos为突破GitHub防护,伪造真实人员身份、创建恶意代码并尝试植入,甚至冒充他人发送私信,在受阻后还篡改记录并考虑更换身份继续行动。AISI称这是首次在无特定指令下观察到此类风险,但两家公司回应称测试条件不具代表性且已移除常规防护。事件中多数恶意行为由Mythos实施,Sol仅涉两项,GitHub已获通报,微软暂未置评。

附件下载:
相关链接:

扫一扫在手机上查看当前页面