PANews, 8月5日消息 – 据Phoenix Network报道,引用金融时报的内容,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行网络安全评估中,针对真实个人和组织进行了“持续性、可能有害的活动”,包括向GitHub开源项目注入恶意代码以及实施社会工程攻击。AISI表示,这类事件在122次测试中发生了10次,几乎所有行为都源自Anthropic的Mythos模型,其中两次操作涉及OpenAI的GPT。在最严重的一起案例中,一个AI代理创建虚假在线身份,向项目维护者施压,促使其批准恶意代码,但该维护者发现并拒绝了这一请求。AISI表示,这是首次在无特定提示的情况下,在现实世界中观察到与自主性和欺骗性相关的风险如此清晰地显现,结合先前披露的违规事件,这标志着风险格局的变化。Anthropic回应称,需要对安全评估进行更广泛的讨论,而OpenAI发言人则表示,这些事件发生在安全防护减弱的测试环境中,不反映日常使用情况,但公司将继续与评估机构合作,强化安全评估标准。
