Home Yapay Zeka Anthropic, Claude Opus 4.5 ile Hem Fiyatı Kırdı Hem Rekorları

Anthropic, Claude Opus 4.5 ile Hem Fiyatı Kırdı Hem Rekorları

0

Yapay zeka arenasında sular bir an olsun durulmuyor. Google’ın Gemini 3 Pro ve OpenAI’nin GPT-5.1-Codex-Max modellerini tanıtmasının üzerinden henüz bir hafta geçmişken, Anthropic sessizliğini bozdu ve şimdiye kadarki en güçlü modeli Claude Opus 4.5‘i sahneye çıkardı.

Anthropic’in açıkladığı verilere ve bağımsız kıyaslamalara göre bu yeni model, sadece performansıyla değil, radikal şekilde düşürülen maliyetleriyle de sektördeki dengeleri değiştirmeye aday. Geliştiriciler için maliyetleri üçte birine indiren bu hamle, yapay zeka entegrasyonunu hızlandırabilir.

Daha Ucuz, Daha Hızlı ve “Planlı”

Ağustos ayında yayınlanan önceki model Claude Opus 4.1, güçlü olmasına rağmen pahalıydı (girdi için milyon token başına 15$, çıktı için 75$). Opus 4.5 ile Anthropic agresif bir fiyatlandırma stratejisine giderek bu rakamları girdi için 5$, çıktı için 25$ seviyesine çekti. Bu, %60’ın üzerinde bir indirim anlamına geliyor.

Teknik tarafta ise Anthropic, modelin “alt acenteleri” (sub-agents) yönetme yeteneğine vurgu yapıyor. Bu sayede model, karmaşık görevleri parçalara bölerek farklı birimlere dağıtabiliyor ve aynı anda birden fazla kod tabanı üzerinde çalışabiliyor. Ayrıca masaüstü uygulamasına gelen “Plan Modu”, Claude’un kod yazmaya başlamadan önce geliştiriciye açıklayıcı sorular sormasını ve bir yol haritası çıkarmasını sağlıyor.

Kodlama Arenasında Yeni Şampiyon

Yapay zeka modellerinin kodlama yeteneklerini ölçen ve sektör standardı kabul edilen SWE-bench verified test sonuçları, liderlik koltuğunun el değiştirdiğini gösteriyor:

  • Claude Opus 4.5: %80,9 (Zirve)
  • GPT-5.1-Codex-Max (OpenAI): %77,9
  • Gemini 3 Pro (Google): %76,2

Bu veriler, Opus 4.5’in rakiplerini geride bırakarak şu an için en yetenekli kodlama asistanı olduğunu kanıtlıyor.

Sanal Otomat İşletmeciliğinde Gümüş Madalya

İlginç bir kıyaslama testi olan ve bir yapay zekanın ticari zekasını ölçen Vending-Bench-2 (Sanal Otomat İşletmeciliği) testinde ise sonuçlar rekabetin ne kadar yakın olduğunu gösteriyor. Andon Labs tarafından yapılan testte, simüle edilen bir yılın sonunda:

  • Gemini 3 Pro: 5.478,16 $ kâr
  • Claude Opus 4.5: 4.967,06 $ kâr
  • Claude Sonnet 4.5: 3.838,74 $ kâr

Google bu alanda liderliği elinde tutsa da, Anthropic’in yeni modeli selefine göre büyük bir sıçrama yaparak “girişimci ruhunu” geliştirdiğini kanıtladı.

Öne Çıkanlar ve Kritik Veriler

  • Fiyat Devrimi: Opus 4.5, önceki versiyona göre yaklaşık 3 kat daha ucuz (Girdi: 5$, Çıktı: 25$).
  • Kodlama Liderliği: SWE-bench testinde %80,9 puanla GPT-5.1 ve Gemini 3 Pro’yu geride bıraktı.
  • Sonsuz Hafıza: Konuşmalar uzadığında sistem geçmişi otomatik özetleyerek “token limiti” sorununu ortadan kaldırıyor.
  • Plan Modu: Kod yazmadan önce strateji belirleyen ve soru soran yeni bir özellik eklendi.
  • Rekabet Durumu: Ticari simülasyonlarda Google’ın Gemini 3 Pro’sunun hemen arkasında, güçlü bir ikinci sırada yer alıyor.

Bu haber ilgini çekebilir.

NO COMMENTS

LEAVE A REPLY

Please enter your comment!
Please enter your name here

Exit mobile version