Günümüzde giderek daha fazla insan, sohbet botları veya doğrudan internet arama motorları aracılığıyla yapay zekanın verdiği cevaplarla sorularını yanıtlıyor. Ancak, ikna edici ve otoriter görünen bir cevap, otomatik olarak güvenilir olduğu anlamına gelmez.
Bir sorun, yapay zekanın farklı türdeki cevapları neredeyse aynı şekilde sunmasıdır. Bazı cevaplar basit bir kaynak bulunarak doğrulanabilirken, diğerleri yorumlama, kişisel koşulların değerlendirilmesi veya sorunun amacının dikkatli bir şekilde düşünülmesini gerektirir.
Metnin yazarı, Virginia Üniversitesi'nde görev yapan ve kütübeciler arasında yapay zeka yeteneklerini geliştirme ve yapay zekâ eğitimi veren üniversite kütüphanecisi ve dekan, AI sistemlerinin cevaplarını dört geniş kategoriye göre incelemeyi önermektedir: gerçekçi, yorumlayıcı, yapısal ve stratejik.
Gerçekçi cevaplar kanıtlara dayanarak bir iddia sunar. Bu tür sorular örneğin, Belgrad Üniversitesi'nin kuruluş yılı veya altın elementin kimyasal sembolü gibi olabilir.
Bu tür cevaplarda en önemli şey, iddiayı ilgili kaynaktan kontrol etmektir. AI bir kaynak belirtmişse, o kaynağa doğrudan bakmak, yapay zekanın verdiği cevabı kanıt olarak kabul etmekten daha iyidir.
Yorumlayıcı cevaplar için durum farklıdır. Burada kanıtlar vardır ancak sadece bir olası sonuç yoktur.
Örneğin, "Gençler için ekran önünde geçen süre ne kadar çok?" veya "Uzaktan çalışma verimliliği artırıyor mu?" gibi sorular, çeşitli kanıtların ve bunların nasıl yorumlandığına bağlı olarak farklı cevaplara yol açar.
Gençler ve ekran süresi hakkında bir soruya Google'ın başlangıç cevapı iki saat sınır olarak belirtti, ancak daha sonra pediatristlerin tavsiyelerinin ekran kullanımı kalitesi ve bağlamına daha fazla önem verdiğini ekledi.
Amerikan Pediatri Akademisi, gençler için ekran süresine kesin bir sınır belirtemez, bunun yerine ekranın sağlayabileceği içerik türü ve aktiviteye vurgu yapar. Bu tür sorular yorumlama gerektirir, sadece gerçekleri kontrol etmek yeterli değildir.
Hangi kanıtları AI vurguladığı, neyi göz ardı ettiği ve farklı bir sonuç için var mı? "Farklı bir sonuca dair en güçlü kanıtlar nelerdir?" gibi ek sorular sormak faydalıdır.
Yapıcı cevaplar ortaya çıkarılmaz, yaratılır.
Bu durum, yapay zekâdan bir motivasyon mektubu, cenaze konuşması, zaman çizelgesi veya bir paragrafın düzenlenmesi talep ettiğinde ortaya çıkar. Bu tür durumlarda tek bir doğru sonuç yoktur.
Cevap, amaç, hedef kitle ve stile göre değerlendirilmelidir. Örneğin, cenaze konuşması dilbilgisi açısından mükemmel olabilir ancak kişinin söyleyeceği gibi gelmeyebilir. Aile üyelerine etki yaratmayabilir veya anıt edilen kişiyi doğru şekilde yansıtmayabilir.
Dördüncü kategori stratejik cevaplardır, yani ne yapacağımızı tavsiye eden sorular, örneğin aspirin almalı mıyım? veya ev mi almalıyım? Bu tür cevaplar hedefler, riskler ve kişisel koşullara bağlıdır.
Aspirin hakkında bir soruya Google, tıbbi bilgiler sunmuş, riskleri vurgulamış ve sağlık uzmanıyla görüşmeyi tavsiye etmiştir. Ayrıca yaş, sağlık geçmişi ve kanama riski gibi faktörlere göre daha kesin bir cevap verebilir.
Bu tür cevaplarda eksik olan bilgiler, riskler ve uzman tavsiyesinin gerekli olup olmadığı kontrol edilmelidir.
Yapay zekanın verdiği cevaplar, bağlam sunmaları, olası komplikasyonlara işaret etmeleri ve kullanıcı daha fazla bilgi verdiğinde kendilerini uyarlamalarına göre faydalıdır.
Sorun, aynı metinde cevap türünün değişebilmesidir. Tıbbi rehberliklerin aktarılması, bir kişinin özel durumuna nasıl uygulandıklarını değerlendirmek farklıdır, ancak AI her iki durumu da eşit derecede ikna edici bir şekilde sunabilir.
Bu nedenle, bir cevabın doğru olup olmadığı yerine "Bu cevap türü nedir?" sorusunu sormak önemlidir. Bu, kaynağın kontrol edilip edilmeyeceği, farklı yorumların aranıp aranmayacağı veya uzman tavsiyesine başvurulup başvurulmayacağı konusunda karar vermenize yardımcı olur.