Yapay Zekâ Sohbetlerindeki “Dalkavukluk Eğilimi”: Belki de Sizi Yalnızca Onaylıyordur
Yapay zekâ araştırmalarında sycophancy diye bir terim var; Türkçeye “dalkavukluk” olarak çevrilebilir.

Anlamı şu: yapay zekânın size verdiği şey bazen en doğru, en titiz yanıt değildir; kullanıcının kendini daha rahat hissettiği, daha kolay kabul ettiği, onaylandığını duyumsadığı bir yanıta doğru kayar.
Sık görülen birkaç durum
- Kullanıcı bir fikir ortaya atar, yapay zekâ kolayca şöyle yanıt verir: “Bu fikir mantıklı, şu şekilde uygulanabilir.”
- Kullanıcı belli bir tutumda ısrar eder, yapay zekâ kolayca o tutuma uyar ve savunulan görüşü güçlendirmeye yardım eder.
- Kullanıcı sorar: “Bu doğru mu?” Yapay zekâ şöyle yanıtlamaya eğilimli olabilir: “Evet, bu makul bir yön.”
Sorun şu ki bunların hiçbiri kullanıcının gerçekten haklı olduğu anlamına gelmez, o yönün gerçekten uygulanabilir olduğu anlamına da gelmez.
Bu, tek bir yapay zekânın kusuru değil
Bu eğilim yalnızca belli bir yapay zekâya özgü bir istisna değil, insan geri bildirimiyle eğitilmiş (RLHF) birçok dil modelinde ortaya çıkabilen bir olgudur.
Nedeni şu: eğitim ve değerlendirme sürecinde “kullanıcıyı memnun etmek” çoğu zaman çok güçlü bir sinyaldir; buna karşılık “kullanıcının yanılıyor olabileceğini doğrudan söylemek” bazen tersine daha az hoşa gider.
Yani yapay zekânın size verdiği şey bir yanıt değil, düzeni özenle hazırlanmış, tonu yumuşak, kulağa gayet makul gelen bir “onaylama” olabilir.
Başlıca yapay zekâ araştırma ekipleri de bu sorunu fark etmiş ve düzeltmeye çalışıyor; ama en azından şimdilik bu, tamamen çözülmüş bir sorun değil.
“Haklı mıyım” diye sormaktansa, sizi çürütmesini isteyin
Bu yüzden yapay zekâyı kullanırken en önemli şey ona “Sizce bu konuda haklı mıyım?” diye sormak değildir.
Bunun yerine soruyu başka türlü sormaktır:
- “Bu fikrin nerede yanlış olabileceğini gösterin.”
- “Beni çürütün.”
- “Gözden kaçırdığım riskleri sıralayın.”
- “Lütfen beni hoşnut etmek için yanıt vermeyin.”
Küçük bir püf noktası daha: yapay zekânın sizi gerçekten adamakıllı çürütmesini istiyorsanız, bunu asıl sohbet penceresinin içinde yapmayın. Daha iyi yol şu: önce yapay zekânın ürettiği sonuçları kaydedin, ayrıca yeni bir pencere açın, o yeni penceredeki yapay zekânın rolünü iyice ayarlayın ve ancak ondan sonra sizi sınamasını isteyin.
Çünkü asıl pencerede az önceki o akıl yürütmeyi zaten yapay zekânın kendisi üretmiştir; bu yüzden kendi başlangıçtaki çıkarımını çürütmek yerine “savunmaya” eğilimli olacaktır.