Jay Peters
Anthropic, Claude Opus 4.8’i Perşembe günü piyasaya sunuyor ve modelin “dürüstlüğünü” vurguluyor. Şirket, tüm modellerini “doğruyu söyleyecek şekilde” eğitiyor; yani desteklenemeyen iddialardan kaçınıyor. Ancak AI modellerinin genel bir sorunu, bazen yetersiz kanıtlara rağmen sonuçlara atlamaları ve kendilerini kesin bir şekilde sunmalarıdır.
Anthropic’e göre, erken test kullanıcıları Opus 4.8’in “çalışmasıyla ilgili belirsizlikleri işaretleme ihtimalinin daha yüksek olduğunu ve desteklenmeyen iddialarda bulunma olasılığının daha düşük olduğunu” belirtiyor. Şirketin değerlendirmelerinde Opus 4.8, bir önceki sürümüne göre kodda hataları fark etmeden geçirme olasılığı yaklaşık 4 kat daha düşük.
Dürüstlük iyileştirmelerinin yanı sıra, Opus 4.8 ile kullanıcılar Claude’un bir göreve ayırdığı çaba miktarını kontrol edebiliyor. Daha yüksek çaba gerektiren yanıtlar daha fazla token tüketecek, bu da kullanıcıların rate limitlerini daha yavaş tüketmek istediklerinde düşük çaba yanıtları seçebilecekleri anlamına geliyor.
Anthropic ayrıca “dynamic workflows” adlı bir özelliği araştırma önizlemesi olarak başlatıyor. Bu özellik sayesinde Claude, daha büyük görevleri üstlenebilecek. Dynamic workflows ile Claude işi planlayıp tek bir oturumda yüzlerce paralel alt ajan çalıştırabiliyor (Opus 4.8 ile ajanlar daha uzun süre çalışabiliyor). Sonrasında çıktıları doğrulayıp kullanıcıya geri bildirim sağlıyor.
Yorum Yap