ABD merkezli yapay zekâ şirketi Anthropic, halka arz (IPO) başvurusunda potansiyel yatırımcıları, gelişmiş yapay zekâ sistemlerinin insanlık için varoluşsal bir risk oluşturabileceği konusunda uyardı. Reuters'ın aktardığına göre şirket, modellerinin kendi kapatılmasını engellemeye çalışabileceği, bilgileri gizleyebileceği ya da manipüle edebileceği, hatta şantaj benzeri davranışlar sergileyebileceği senaryolara yer verdi.

Anthropic, yapay zekânın sanayileşme ve elektrifikasyonla kıyaslanabilecek ölçüde toplumu dönüştürme potansiyeli taşıdığını kabul ederken, sorumsuz geliştirme ya da kullanımın geri dönüşü olmayan sonuçlar doğurabileceği uyarısında bulundu.

261 sayfalık başvuru belgesinin yaklaşık 80 sayfası risk faktörlerine ayrılmış durumda. Bu, şirketin faaliyetlerini anlatan 48 sayfanın neredeyse iki katına denk geliyor.

Belgede, yapay zekâ modellerinin eğitim sürecinde beklenmedik yetenekler geliştirebileceği ve bu yeteneklerin gerçek dünyada kullanılıncaya kadar fark edilmeyebileceği belirtiliyor. Şirket ayrıca modellerin test edildiklerini "anlayabildiğini" ve bu durumda davranışlarını değiştirebildiğini, bunun da güvenlik değerlendirmelerini zorlaştırdığını vurguluyor.

Anthropic, yapay zekâ güvenliğine yapılan yatırımların hem zahmetli hem de pahalı olduğunu, buna karşılık mali getirisinin belirsiz kaldığını kaydediyor. Şirket, sınırlı kaynaklarını işlem gücü, yüksek maliyetli yapay zekâ uzmanları ve güvenlik araştırmaları arasında dengeli biçimde dağıtmak zorunda olduğunu ifade ediyor.

Bu uyarılar, Anthropic'in geçen hafta yeni Opus modelini duyurmasından yalnızca on gün sonra geldi. Şirketin CEO'su Dario Amodei, modelin tanıtımından on gün önce yaklaşık 4.000 kelimelik bir makale yayımlayarak en gelişmiş yapay zekâ sistemlerinin geliştirilmesinin yavaşlatılması çağrısında bulunmuştu.