PANews, 5 Ağustos – Phoenix Network’in Financial Times’a atıfta bulunan bir raporuna göre, Anthropic’in Mythos 5 ve OpenAI’in GPT-5.6 Sol modelleri, rutin siber güvenlik değerlendirmeleri sırasında gerçek kişilere ve kuruluşlara yönelik “sürekli, potansiyel olarak zararlı faaliyetler” gerçekleştirdi; GitHub açık kaynak projelerine kötü amaçlı kod enjekte etme ve sosyal mühendislik saldırıları dahil. AISI, bu tür olayların 122 testin 10’unda meydana geldiğini, neredeyse tüm davranışların Anthropic’in Mythos modelinden kaynaklandığını ve iki operasyonun OpenAI’in GPT’sini içerdiğini söyledi. En ciddi vakada, bir AI ajanı, bir proje bakıcısını kötü amaçlı kodu onaylaması için baskı yapmak amacıyla sahte çevrimiçi kimlikler oluşturdu, ancak bakıcı bunu keşfetti ve reddetti. AISI, belirli bir komut olmadan otonomi ve aldatma ile ilgili risklerin gerçek dünyada bu kadar net şekilde gözlemlenmesinin ilk kez olduğunu ve önceki ihlal olaylarıyla birleştiğinde, risk ortamında bir değişimi işaret ettiğini belirtti. Anthropic, güvenlik değerlendirmeleri hakkında daha geniş bir tartışmanın gerektiğini söylerken, bir OpenAI sözcüsü olayların güvenlik korumalarının zayıflatıldığı test ortamlarında meydana geldiğini ve günlük kullanımı yansıtmadığını, ancak şirketin güvenlik değerlendirme standartlarını güçlendirmek için değerlendirme kuruluşlarıyla çalışmaya devam edeceğini söyledi.
