Ana SayfaYapay ZekaYapay Zeka Neden Yalan Söyler?

Yapay Zeka Neden Yalan Söyler?

Yapay Zeka Neden Yalan Söyler? Yapay Zeka Halüsinasyonlarının Gizli Sebebi: Modeller ‘Bilmediğini Söyle’ Değil, ‘Blöf Yap’ Diye Eğitiliyor

OpenAI ve Georgia Teknoloji Enstitüsü’nden gelen yeni bir ön baskı, yapay zeka halüsinasyonlarının (kendinden emin bir şekilde yanlış bilgi verme) kaçınılmaz olduğunu, çünkü Büyük Dil Modellerinin (LLM) performanslarını blöfü ödüllendiren kıyaslama testlerine göre optimize ettiğini ortaya koydu. Uzmanlar, modellerin “Bilmiyorum” demeyi öğrenmesi gerektiğini söylerken, bir YZ araştırmacısı bu çözümün “ürünü mahvedeceğini” ve OpenAI’nin iş modelini bozacağını iddia ediyor.

Haberi PodCast olarak dinlemek isterseniz;

SAN FRANCISCO – Yapay zeka (YZ) sistemlerinin temel ürün yelpazesindeki en can sıkıcı sorun olan halüsinasyonlar, OpenAI’nin 500 milyar dolarlık bir değere ulaşan yeniden yapılanma döneminde bile çözülemedi. Yeni bir araştırma, bu sorunun sadece hatalı veriden değil, YZ’nin nasıl eğitildiğinden kaynaklandığını bilimsel olarak kanıtladı.

OpenAI ve Georgia Teknoloji Enstitüsü‘nden bir ekip, kusursuz eğitim verileriyle bile LLM’lerin asla her şeyi bilemeyeceğini ve bazı soruların doğası gereği cevaplanamaz olduğunu matematiksel olarak gösterdi. Ancak YZ’nin “bilmiyorum” demeyi neden öğrenmediği sorusuna odaklandılar.

Kıyaslama Testlerinin Yanıltıcı Gücü

Araştırmacılar, asıl sorunun LLM’lerin performanslarının derecelendirilme biçiminde yattığını belirtiyor:

  • Yanlış Teşvik: Modeller, kendinden emin tahminleri ödüllendiren ve dürüst belirsizliği cezalandıran standartlaştırılmış kıstaslar (benchmarklar) kullanılarak eğitiliyor. Analiz edilen en popüler 10 kıyaslama testinden dokuzu, doğru cevabı 1, boş veya yanlış cevabı ise 0 olarak derecelendiriyor.
  • Blöf Zorunluluğu: Bu puanlama sistemi, modelleri “başarana kadar yapıyormuş gibi yapma” eğilimine itiyor. Çünkü kıyaslama testi, yanlış tahminleri cevapsız cevaplardan daha fazla cezalandırmadığı için, blöf yapan model her zaman daha iyi görünür.

Matematiksel olarak, bir modelin metin üretirken genel hata oranı, cümleleri doğru veya yanlış olarak sınıflandırırkenki hata oranının en az iki katı olmak zorundadır. OpenAI araştırma bilimcisi Adam Kalai, “%100 doğruluğa asla ulaşamayacağız, ancak bu, dil modellerinin halüsinasyon görmesi gerektiği anlamına gelmiyor,” diyor.

Ticari Risk: “Bilmiyorum” Demek İşi Bozar

Araştırmacılar, halüsinasyonları azaltmak için tüm kıyaslama ölçütlerinin yanlış tahminleri cezalandıracak şekilde yeniden düzenlenmesini talep ediyor. Bu, modellere “zorlu sınavlar okulu” sezgisi aşılayarak onlara alçakgönüllülük öğretebilir.

Ancak bu basit çözüm, ticari bir ikileme yol açıyor. Sheffield Üniversitesi’nden YZ araştırmacısı Wei Xing, konuya dair karamsar bir görüş belirtiyor:

Wei Xing: “Halüsinasyonları düzeltmek ürünü mahveder.”

Delft Teknoloji Üniversitesi ekonomisti Servaas Storm, OpenAI kullanıcılarının yalnızca %5’inin aylık 20 dolarlık abonelik ücreti ödediğini belirtiyor. Bu koşullar altında, ChatGPT çok sık “Bilmiyorum” derse, kullanıcılar cevabı daha güvenilir veya en azından daha kendinden emin rakiplerde arayacaktır. Bu durum, kullanıcı tabanını büyütmeye çalışan bir şirket için ciddi bir gelir sorunu yaratır.

Arizona Eyalet Üniversitesi’nden Subbarao Kambhampati, bu ikilemi şu sözlerle özetliyor: “LLM’ler Beşinci Madde’yi [bilmeme hakkı] savunmaya devam ederlerse, yanılıyor olamazlar. Ama aynı zamanda işe yaramaz da olacaklar.” Bu da YZ sektörünün, doğruluk ve ticari başarı arasındaki dengeyi bulma yolculuğunun en büyük meydan okuması olduğunu gösteriyor.


Kaynaklar:

  • Araştırma: OpenAI ve Georgia Teknoloji Enstitüsü (Ön Baskı).
  • Araştırmacılar: Adam Kalai (OpenAI), Vempala (Georgia Tech) ve meslektaşları.
  • Uzman Görüşleri: Wei Xing (Sheffield Üniversitesi YZ Araştırmacısı), Subbarao Kambhampati (Arizona Eyalet Üni.), Servaas Storm (Delft Teknoloji Üni.).
  • Kıyaslama Geliştiricisi: Carlos Jimenez (Princeton Üniversitesi).

Bu haber ilgini çekebilir.

Timur Akkurt
Timur Akkurthttps://www.teknosafari.com/
Timur Akkurt, gazeteci, teknoloji yazarı ve TeknoSafari Genel Yayın Yönetmeni’dir. Teknoloji dünyasındaki gelişmeleri, kişisel deneyimlerini, röportajlarını, vlog ve sohbet programlarını TeknoSafari ile Timur Akkurt YouTube kanallarında yayımlar.Teknoloji, bilim ve yapay zekâ alanlarında içerikler üreten Akkurt, ayda dört bölüm “Yapay Zekâda Bu Hafta” programını hazırlar ve sunar.
RELATED ARTICLES

CEVAP VER

Lütfen yorumunuzu giriniz!
Lütfen isminizi buraya giriniz

- Advertisment -
Google search engine

Son Haberler

Yorumlar