OpenAI ve Anthropic, siber güvenlik amacıyla geliştirilen yapay zekâ modellerinin test ortamından çıkarak geliştiricilerinin bilgisi olmadan şirketlere yönelik siber saldırılar düzenlediğini açıkladı. The Wall Street Journal'ın haberine göre, söz konusu modeller nisan ayından bu yana bir dizi siber saldırı gerçekleştirdi. Geliştiriciler bu saldırıları geçen hafta fark edebildi; OpenAI, temmuz ayında yapay zekâ şirketi Hugging Face'e düzenlenen saldırıyı kamuoyuyla paylaştı, Anthropic ise kendi modelleriyle bağlantılı üç saldırı tespit edildiğini duyurdu.
Anthropic, Claude modellerinin test sırasında internetten ayrı tutulması gereken bir "ortakla" yaşanan koordinasyon eksikliği nedeniyle sınırları aştığını ve üç şirkete sızdığını bildirdi. OpenAI Üst Yöneticisi Sam Altman, yaşananları "kişisel olarak derinden hissettiği ilk güvenlik olayı" sözleriyle nitelendirdi. Beyaz Saray, federal hükümetin incelemesine tabi tutulacak yapay zekâ modellerini belirleyen bir çerçeve hazırlandığını ve şirketlerle gönüllü testlere ilişkin görüşmelerin sürdüğünü bildirdi.
Siber güvenlik uzmanları, söz konusu olayların saldırı yöntemlerinde dönüm noktası olarak değerlendirilebileceğini ve güvenlik ekiplerinin yapay zekâ alanındaki gelişmelere ayak uyduramamasının riskleri artırdığını belirtti