AI Model Release Tracker, yeni modellerin sadece pazarlama kampanyalarıyla değil, gerçek performanslarıyla da ölçülmesini sağlıyor. Bu sayede hangi modellerin zamanınıza değdiğini kolayca görebilirsiniz.
Claude Opus 4.8 – Anthropic (28 Mayıs 2026)
Opus 4.8, Opus 4.7’nin yerini aynı fiyatla alıyor ve aynı maliyetin üçte birinde daha hızlı yürütme modları sunuyor. Anthropic’in diğer modelleri gibi, 4.8 kodlama yeteneklerine odaklanıyor; iki kodlama benchmark’inde 4.7’yi geride bıraktı ancak OpenAI GPT‑5.5’in seviyesine tam olarak ulaşamadı. Şirket, modelin “kullanıcı özerkliğini destekleme ve kullanıcının çıkarlarını gözetme” gibi prososyal özelliklerde yeni rekorlar kırdığını belirtiyor, ancak bu tanımlar hâlâ net değil.
Anthropic, model güvenliği ve yorumlanabilirliğe her zaman öncelik vermişti; Opus 4.8 bu vurguyu daha da artırıyor. Opus 4.7’nin %92 dürüstlük oranı olduğuna göre, 4.8’in uyumsuzluk oranının “önemli ölçüde” daha düşük olduğunu iddia etmesi, güvenlik standartlarının yükseldiğini gösteriyor. Ayrıca, Anthropic bu oranı Claude Mythos Preview ile kıyaslamış.
GPT‑5.5 Instant – OpenAI (5 Mayıs 2026)
OpenAI, yeni GPT‑5.5 Instant sürümünün önceki GPT‑5.3 Instant’tan daha az kelime kullandığını ve özellikle tıp, hukuk ve finans gibi yüksek riskli konularda %52,5 daha az sahte iddia ürettiğini duyurdu.
Bu model, ChatGPT’nin varsayılan modeli olarak GPT‑5.3’ün yerini alıyor. Hallucination’ların azalması, geniş kitlelerin yanlış bilgiye maruz kalma riskini düşürerek özellikle sağlık gibi kritik alanlarda büyük önem taşıyor.
Nemotron 3 Nano Omni – Nvidia (28 Nisan 2026)
Nvidia’nın açık Nemotron ailesinin en yeni üyesi, çoklu modalite girişini destekliyor; yani tek bir “görüş‑eylem” döngüsünde görsel, ses ve metin verilerini aynı anda işleyebiliyor. Böylece ayrı modellerle çalışmak zorunda kalan ajanların iş akışları hızlanıyor, bağlam kaybı azalıyor ve inference maliyetleri düşüyor.
GPT‑5.5 – OpenAI (23 Nisan 2026) – Expert Score: 93/100
ZDNET test uzmanı David Gewirtz, GPT‑5.5’e A‑ (A minus) notu verdi. Model, GPT‑5.4’e göre daha hızlı ve daha iyi kodlama yetenekleri sergiliyor; kavram tanımlama, bilimsel araştırma ve faktüel doğruluk konularında belirgin bir gelişme gösteriyor.
Modelin tam bir devrim olmadığı, ancak sadece iki ay içinde 5.4’ten 5.5’e geçiş yapılması, OpenAI’ın model güncellemelerini giderek daha hızlı bir ritimde sunduğunu gösteriyor.
ChatGPT Images 2 – OpenAI (23 Nisan 2026)
Sora adlı video üretim modelini kapattıktan kısa bir süre sonra OpenAI, Images 2’yi duyurdu. Test uzmanı David Gewirtz, henüz resmi bir Expert Score vermese de, modelin eğlenceli, büyük bir adım ve iş amaçlı kullanımda gerçekten faydalı olduğunu belirtti.
Bu hamle, OpenAI’ın tüketici odaklı AI ürünlerinden bir miktar uzaklaşarak, görüntü üretimini kurumsal AI içinde daha stratejik bir konuma taşıma niyetinde olduğunu gösteriyor.
Claude Opus 4.7 – Anthropic (16 Nisan 2026)
Opus 4.7, Opus 4.6’dan kısa bir sürede çıktı ve dürüstlük, düşük süsleme (sycophancy) ve hallucination açısından yeni rekorlar kırdı. Ayrıca yeni Claude Security aracının temelini oluşturdu.
Claude Mythos (Preview) – Anthropic (7 Nisan 2026)
Mythos, henüz halka açık olmayan bir model. Anthropic, modelin çok güçlü olduğundan dolayı normal bir dağıtım stratejisi izlemediğini ve bunu bir medya fırtınası yarattığını belirtti.
Yorum Yap