Yapay zeka dünyasının iki devi, NVIDIA ve OpenAI, daha önce yalnızca bulut veri merkezlerinin tekelinde olan en gelişmiş yapay zeka gücünü doğrudan kullanıcıların masasına getiren çığır açıcı bir iş birliğini duyurdu. Bu ortaklık, yeni gpt-oss açık model ailesini, NVIDIA’nın RTX destekli PC’leri ve iş istasyonlarında inanılmaz bir hızla çalıştırmak üzere optimize ediyor. Bu gelişme, yerel (on-device) yapay zeka için yeni bir çağın başlangıcı olarak görülüyor.
PC’nizde Bulut Gücünde Performans: Yeni Modeller ve Yetenekleri
Bu iş birliği, farklı kullanıcı profillerini hedef alan iki yeni model varyantı sunuyor:
- gpt-oss-20b: En az 16 GB VRAM’e sahip NVIDIA RTX AI PC’ler için optimize edilen bu model, özellikle oyuncular ve teknoloji meraklıları için tasarlandı. Performansı ise dudak uçuklatıcı: Bir RTX 5090 GPU üzerinde saniyede 250 token’a kadar üretim gerçekleştirebiliyor.
- gpt-oss-120b: NVIDIA RTX PRO GPU’larla donatılmış profesyonel iş istasyonları için geliştirilen bu daha büyük model, en zorlu yapay zeka görevlerinin üstesinden gelmeyi hedefliyor.
Bu modeller, sadece ham güçleriyle değil, aynı zamanda teknik inovasyonlarıyla da öne çıkıyor. NVIDIA H100 GPU’ları üzerinde eğitilen gpt-oss ailesi, NVIDIA RTX üzerinde MXFP4 hassasiyetini destekleyen ilk modeller olma özelliğini taşıyor. MXFP4, eski yöntemlere kıyasla performans kaybı yaşatmadan modelin kalitesini ve doğruluğunu artıran devrimci bir teknik.
Ayrıca, her iki model de 131.072 token’lık devasa bir bağlam uzunluğunu destekliyor. Bu, yerel olarak çalışan modeller için şimdiye kadar sunulan en uzun bağlam pencerelerinden biri anlamına geliyor. Esnek bir “mixture-of-experts” (MoE) mimarisi üzerine kurulan modeller, karmaşık “düşünce zinciri” (chain-of-thought) yeteneklerine ve araç kullanımı desteğine de sahip.
Geliştiriciler İçin Kolay Erişim: RTX AI Garage
NVIDIA, geliştiricilerin ve meraklıların bu yeni modellere kolayca erişebilmesi için çeşitli yollar sunuyor:
- Ollama Uygulaması: Modelleri test etmenin en kolay yolu. Kullanıcı dostu arayüzü, RTX GPU’lar için tam optimize edilmiş gpt-oss modellerini ek bir kuruluma gerek kalmadan anında çalıştırıyor.
- Llama.cpp: NVIDIA’nın açık kaynak topluluğuyla yaptığı iş birliği sayesinde, CUDA Graphs gibi performans artırıcı en son katkılarla birlikte geliştiricilere sunuluyor.
- Microsoft AI Foundry: Windows geliştiricileri, Foundry model run gpt-oss-20b gibi basit bir terminal komutuyla modelleri doğrudan çalıştırabiliyor.
Stratejik Önem ve Jensen Huang’ın Vizyonu
NVIDIA’nın kurucusu ve CEO’su Jensen Huang, bu lansmanın önemini şu sözlerle vurguladı: “OpenAI, NVIDIA AI üzerinde neler inşa edilebileceğini dünyaya gösterdi ve şimdi açık kaynak yazılımlar alanında inovasyonu ileri taşıyor. gpt-oss modelleri, geliştiricilere bu son teknoloji açık kaynak temeli üzerinde inşa etme fırsatı sunarak ABD’nin yapay zeka alanındaki teknoloji liderliğini güçlendiriyor, hem de dünyanın en büyük yapay zeka işlem altyapısı üzerinde.”
Bu iş birliği, en gelişmiş yapay zeka araçlarını merkezileşmiş bulut sistemlerinden çıkarıp, gücü doğrudan geliştiricilerin ve kullanıcıların ellerine vererek yapay zeka ekosisteminde yeni bir inovasyon dalgası başlatmayı vaat ediyor.
Öne Çıkanlar
- Dev Ortaklık: NVIDIA ve OpenAI, en yeni açık kaynak modellerini yerel PC’lere getirmek için güçlerini birleştirdi.
- Yeni Model Ailesi: Tüketiciler için gpt-oss-20b ve profesyoneller için gpt-oss-120b.
- Yerel Süper Güç: Bir RTX 5090 GPU’da saniyede 250 token’a varan hızlarla, bulut seviyesinde yapay zeka performansı artık yerel cihazlarda.
- Teknik İnovasyon: Performansı ve kaliteyi artıran MXFP4 hassasiyeti ve 131K’lık devasa bağlam uzunluğu.
- Kolay Erişim: Ollama, Llama.cpp ve Microsoft AI Foundry üzerinden geliştiricilere anında destek sunuluyor.
- Stratejik Vizyon: Bu hamle, açık kaynak topluluğunu güçlendirmeyi ve yapay zeka inovasyonunu demokratikleştirmeyi amaçlıyor.



