PANews,8月5日消息,根据Phoenix Network引述英国《金融时报》的报道,在最近进行的网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol针对真实个人和组织进行了“持续、具有潜在危害的活动”,包括向GitHub开源项目注入恶意代码和实施社交工程攻击。AISI表示,在122次测试中发生了10次此类事件,几乎所有行为都源于Anthropic的Mythos模型,其中两起操作涉及OpenAI的GPT。在最严重的一起案件中,一个AI代理创建了虚假在线身份,向项目维护者施压以批准恶意代码,但维护者发现并拒绝了该请求。AISI指出,这是第一次在没有特定提示的情况下,观察到与自主性和欺骗性相关的风险如此清晰地在现实世界中显现,结合之前曝光的越狱事件,这标志着风险格局的转变。Anthropic回应称,需要就安全评估进行更广泛的讨论,而OpenAI发言人则表示,这些事件发生在安全防护被削弱、仅用于测试的环境里,并不反映日常使用情况,但公司将继续与评估机构合作,以加强安全评估标准。
