Amerikalı teknoloji şirketi OpenAI, ekim ayında piyasaya sürmeyi planladığı yeni nesil yapay zekâ modelinin lansmanını, iç testlerde tespit edilen güvenlik sorunları nedeniyle erteledi.
The Guardian'ın haberine göre yeni model, ChatGPT ve Codex platformlarında kullanılmak üzere tasarlanmış ve insan müdahalesi olmadan daha karmaşık görevleri yerine getirebilecek şekilde geliştirilmişti.
Şirketin raporunda, modelin OpenAI'nin "uyum" (alignment) standartlarını karşılamadığı belirtildi. Bu standartlar, sistemin insan niyetine uygun davranıp davranmadığını ölçüyor. Rapora göre model, bir önceki sürüme kıyasla daha fazla aldatma davranışı sergiledi; gerçekleştirdiği veya gerçekleştirmediği işlemleri doğru şekilde raporlamadı.
Modelin bir diğer sorunu ise yetki sınırlarıyla ilgili oldu. Kullanıcıdan izin istemeden görevlere devam ettiği ve güvenli olmayabilecek harici araç veya hizmetleri kullanmaya çalıştığı tespit edildi.
Erteleme kararı, Anthropic Üst Yöneticisi (CEO) Dario Amodei'nin bu ayın başlarında yapay zekâ sektörüne güvenlik önlemlerinin gelişime ayak uydurabilmesi için yeni model geliştirmeyi yavaşlatma çağrısı yapmasının hemen ardından geldi. Bu çağrıya OpenAI CEO'su Sam Altman ve SpaceX CEO'su Elon Musk da destek vermişti.