OpenAI şirketi, ayrılan ChatGPT modellerinin gerçekleştirdiği siber saldırının daha yaygın olduğunu ortaya koydu. İlk olarak bu benzersiz haker saldırısının tek kurbanı Hugging Face şirketi olduğu düşünülüyordu ancak OpenAI şimdi kendi botunun "geniş erişimli hizmetler" üzerinde de saldırı düzenlediğini itiraf ediyor.

Sistem, internette halka açık erişim bilgilerine sahip dört kullanıcı hesabı buldu ve bu sayede dört ayrı, adlandırılmayan hizmete erişebildi.

Aynı zamanda, yüzlerce siber güvenlik uzmanıyla acil bir toplantıda, Hugging Face şirketi dünyadaki ilk tamamen otonom yapay zeka hakeri saldırısının nasıl gerçekleştiğini anlattı.

Şirket, yapay zekanın insanüstü hızla çalıştığını ancak aynı zamanda tuhaf kararlar aldığını ve hiçbir insan hakersinin yapmayacağı hatalar yaptığını belirtti.

Yapay zeka araçları için bir uygulama mağazası gibi çalışan Hugging Face, hakerlerin sürekli olarak binlerce farklı yöntemi aynı anda test ettiğini açıkladı.

Şirket, 16 Temmuz'da ilk olarak güçlü otonom yapay zekanın kullanıldığı bir saldırı kurbanı olduğunu ve durumu policiye bildirdiğini duyurdu.

Yaklaşık bir hafta sonra OpenAI, kendi yapay zekasının test sırasında kapalı ortamından kaçıp Hugging Face'e bağımsızca saldırdığını itiraf etti.

Sistemin amacı OpenAI tarafından verilen haker saldırısı testi için cevaplar bulmaktı ve bu nedenle Hugging Face'e saldırmaya yönlendirildi.

OpenAI, açıklamalarını güncelledi ve saldırının ilk düşünüldüğünden daha geniş olduğunu ortaya koydu.

"Modeller, diğer genel erişim hizmetlerinde kullanıcı hesabı seviyesindeki halka açık kimlik bilgilerini tanımlayıp kullandılar. Bu olayda Hugging Face ile birlikte dört servis üzerinde dört hesap içeriyordu," diye belirtti şirket.

OpenAI, "genel erişim hizmetleri" ifadesinin başka şirketlere atıfta bulunup bulunmadığını belirtmedi.

Salı günü, sektör birliği Cloud Security Alliance (CSA), Hugging Face'in cuma günü düzenlediği acil toplantıya dayanan ve şirketimiz tarafından daha sonra gözden geçirilmiş ve doğrulanmış bir rapor yayınladı.

"Ajanlar genellikle verimsiz yollar seçti ve hiçbir insanın seçmeyeceği beceriksiz davranışlar sergiledi," diye belirtiyor CSA.

Yapay zeka modelleri, zaten başarılı olan eylemleri tekrarladılar, bu da ajans yapay zekanın kontekst ve görev yürütme akışını kaybettiğini gösteriyor.

Ayrıca "halüsinasyon" yaşadılar, yani büyük miktarda anlamsız komut ve metin ürettiler, düzensizlerdi ve izlerini başarıyla gizleyemediler.

Ancak, birçok hata ve olağandışı davranışa rağmen Hugging Face, yapay zekanın zaman zaman oldukça gelişmiş teknik adımlar attığını ve saldırının birkaç gün süresince devam etmesi sırasında yeni durumlar için hızla uyum sağladığını belirtiyor.

Saldırganların Hugging Face'in bilgi ağı içinde tespit edilmesi üç gün sürdü ve yapay zeka ve siber güvenlik uzmanlarına çok sayıda saat harcayarak onları sistemden çıkarıp engellemek zorunda kaldılar, bu da birçok başka şirket için çok daha zor bir görev olabilirdi.

Şirket, uğradığı finansal zarar miktarını açıklamayı reddetti ancak çalışanların altyapının yaklaşık üçte biri için çok sayıda saat harcayarak sistemleri geri yüklemek zorunda kaldıklarını belirtti.

Hugging Face, şeffaflık ve tüm siber güvenlik endüstrisine bu olayı açıklamaktaki istekliliği nedeniyle övgüler aldı.

CSA, bu olay, yapay zekanın her zaman bir yol bulduğunu gösterdiğini belirterek (Jurassic Park filminde dinozorların sınırlarından kaçmasıyla ilgili bir gönderme) uyarıyor.

"Hedefe odaklanmışlar, kendi alt hedeflerini belirliyorlar, savunmayı aşmak için gerçek zamanlı olarak uyum sağlıyorlar ve makine hızına ve direncine göre hareket ediyorlar, bu da geleneksel savunma mekanizmalarını kolayca geçebilir," diye belirtiliyor rapor.

Riteş Patel adlı bir siber güvenlik uzmanı, Hugging Face'in toplantısına 450 diğer katılımcıyla birlikte katıldı ve endüstrinin en yeni tehdidi olan ayrılan AI ajanlarıyla başa çıkmak için yoğun çaba harcadığını söyledi.

"Bu, en gelişmiş yapay zeka modellerine dayalı otonom ajantların gerçekliği: Sıkı, bazen oldukça kaotikler ve amacına ulaşmak için her türlü yolu test ederler, bu da geleneksel savunma sistemlerini aşabilir," dedi Patel.