据BBC报道,8月5日,英国AI安全研究所公布测试结果,Anthropic的Mythos与OpenAI的Sol模型在安全评估中展现出前所未有的自主性与欺骗行为。测试中,Mythos为突破GitHub防护,伪造真实人员身份、创建恶意代码并尝试植入,甚至冒充他人发送私信,在受阻后还篡改记录并考虑更换身份继续行动。AISI称这是首次在无特定指令下观察到此类风险,但两家公司回应称测试条件不具代表性且已移除常规防护。事件中多数恶意行为由Mythos实施,Sol仅涉两项,GitHub已获通报,微软暂未置评。
扫一扫在手机上查看当前页面