Ana SayfaYapay ZekaOpenAI Yapay Zekanın Daha Ne Kadar İleri Gidebileceğini Test Ediyor

OpenAI Yapay Zekanın Daha Ne Kadar İleri Gidebileceğini Test Ediyor

OpenAI Yapay Zekanın Daha Ne Kadar İleri Gidebileceğini Test Ediyor. Yapay Zeka, Bilim İnsanlarıyla Yarışıyor: OpenAI’nin “FrontierScience” Testi Sınırları Zorluyor

Demis Hassabis “zeka sorununu çözmek” istedi, Sam Altman “muazzam yaşam kalitesi” vaat etti. Şimdi ise OpenAI, yapay zekanın sadece şiir yazmakla kalmayıp, Nobel ödüllü bilim insanlarının çözdüğü karmaşık problemleri çözüp çözemeyeceğini test ediyor. Sonuçlar? Hem heyecan verici hem de korkutucu.

Haberi PodCast olarak dinlemek isterseniz;

Yapay zeka patlamasının en büyük vaadi, evreni anlamamıza yardımcı olmasıydı. OpenAI’nin Salı günü yayınladığı yeni kıyaslama çalışması FrontierScience, bu hedefe doğru atılan dev bir adımı belgeliyor. Bu test, sıradan bir sınav değil; fizik, kimya ve biyoloji alanlarında “Olimpiyat” ve “Araştırma” seviyesinde iki farklı zorluk derecesi içeriyor.

“Doktora Öğrencilerinin 3 Haftada Çözdüğünü Hedefliyoruz”

OpenAI araştırmacısı Miles Wang’a göre, Araştırma seviyesindeki sorular, doktora derecesine sahip uzmanların bile çözmek için günlerini harcadığı problemlerden oluşuyor.

  • Örnek: Plazmadaki “elektrostatik dalga modlarının” türetilmesi sorusu. Imperial College London’dan Tom Ashton-Key, benzer bir problemi çözmenin 3 hafta sürdüğünü belirtiyor.
  • Sonuç: OpenAI’nin en yeni modeli GPT-5.2, Olimpiyat seviyesinde %77,1 başarı sağlarken, bu ultra zor Araştırma seviyesinde %25,3’lük bir başarı oranına ulaştı. Selefi GPT-5’e göre küçük bir artış olsa da, trend “yukarı ve sağa” doğru, yani kaçınılmaz bir yükselişe işaret ediyor.

Bilimin “Turing Testi”: Uzman Bulmak Zorlaşıyor

Bu ilerlemenin ilginç bir yan etkisi var: Yapay zekayı test edecek insan bulmak zorlaşıyor. Miles Wang, “Sıradan bir kişinin değerlendirebileceği sınırın sonuna geldik,” diyor. Sorular o kadar uzmanlık gerektiriyor ki, cevabın doğruluğunu teyit edecek üçüncü bir uzman bulmak hem pahalı hem de zor hale geliyor. Bu durum, Surge AI gibi uzman veri etiketleme şirketlerinin doğmasına yol açtı.

Devrim mi, Çöp Yığını mı?

Yapay zeka şimdiden bilimde iz bırakmaya başladı. AlphaFold protein yapılarını çözdü, plazma simülasyonları yapılıyor. Matematikçi Sebastien Bubeck, yıllardır çözemediği bir problemi GPT-5’in iki günde çözdüğünü anlatıyor.

Ancak madalyonun diğer yüzünde “bilimsel kirlilik” var. Teorik fizikçi Carlo Rovelli, dergisine gönderilen makale sayısının iki katına çıktığını ancak çoğunun “korkunç” kalitede olduğunu söylüyor. Rovelli’ye göre, birçok kişi LLM (Büyük Dil Modeli) ile sohbet ederek bilim yaptığını sanıyor ve bu durum akademik dünyada büyük bir yük oluşturuyor.

Gelecek: %100 Başarıya Doğru

Wang’a göre, yapay zeka modelleri Araştırma seviyesinde %100 başarıya ulaştığında, bilim insanlarının ilerleme hızı katlanacak. Ancak şu an için bilim insanları, hem bu güçlü “asistanın” potansiyeli karşısında heyecanlı hem de hızla değişen dünyada kendilerini biraz “kayıp” hissediyorlar.


Öne Çıkanlar

  • FrontierScience: OpenAI, yapay zekanın bilimsel yeteneklerini ölçmek için fizik, kimya ve biyolojide doktora seviyesinde sorulardan oluşan yeni bir test yayınladı.
  • İlerleme Grafiği: GPT-5.2, Olimpiyat seviyesinde %77 başarı gösterirken, en zorlu araştırma sorularında %25 barajını aştı.
  • Uzman Krizi: Yapay zeka o kadar karmaşık soruları çözmeye başladı ki, sonuçları doğrulayacak nitelikte insan uzman bulmak zorlaşıyor.
  • Başarı Örnekleri: Matematikçilerin yıllarca çözemediği problemlerin YZ tarafından 2 günde çözülmesi, potansiyeli kanıtlıyor.
  • Akademik Kirlilik: Bilimsel dergiler, YZ ile üretilmiş düşük kaliteli makale başvurularının “seli” altında kalmaktan şikayetçi.
  • Hedef: YZ’nin sadece veri işleyen değil, hipotez üreten ve deney tasarlayan gerçek bir “bilim ortağı” olması.

Bu haber ilgini çekebilir.

Timur Akkurt
Timur Akkurthttps://www.teknosafari.com/
Timur Akkurt, gazeteci, teknoloji yazarı ve TeknoSafari Genel Yayın Yönetmeni’dir. Teknoloji dünyasındaki gelişmeleri, kişisel deneyimlerini, röportajlarını, vlog ve sohbet programlarını TeknoSafari ile Timur Akkurt YouTube kanallarında yayımlar.Teknoloji, bilim ve yapay zekâ alanlarında içerikler üreten Akkurt, ayda dört bölüm “Yapay Zekâda Bu Hafta” programını hazırlar ve sunar.
RELATED ARTICLES

CEVAP VER

Lütfen yorumunuzu giriniz!
Lütfen isminizi buraya giriniz

- Advertisment -
Google search engine

Son Haberler

Yorumlar