Anthropic Opus 5'i yayımladı: uzun soluklu ajanlar için yeni sürüm
Anthropic, 24 Temmuz 2026'da Claude Opus 5'i yayımladı. Şirket modeli, uzun soluklu ajanları çalıştıran Opus katmanı için bir sıçrama olarak tanımlıyor ve kendi üst seviye modeli Fable 5'in cephe seviyesindeki yeteneğini yarı fiyatla sunduğunu söylüyor. Fiyatlama bir önceki Opus sürümüyle aynı kalıyor.
Opus katmanı iki ay içinde yenilendi
Anthropic, Claude Opus 5'i kendi haber sayfasında duyurdu ve modeli tüm platformlarında kullanıma açtı. Şirketin tanımı net: bu sürüm, uzun soluklu ajanları çalıştıran Opus katmanı için bir seviye değişimi. Öne çıkarılan alanlar kodlama ve bilgi işi; şirket ayrıca modelin bilimsel araştırma tarafında, organik kimya ve protein analizi gibi konularda güçlü olduğunu, etkileşimli görselleştirmeler ve üç boyutlu modeller üretebildiğini aktarıyor. Sürüm, Opus 4.8'in mayıs sonundaki çıkışından yaklaşık iki ay sonra geldi.
Doğrulayarak ilerleyen bir çalışma biçimi
Anthropic'in paylaştığı değerlendirme iddiaları şöyle: model, kodlama ve bilgi işi ölçümlerinde Frontier-Bench ve GDPval-AA'da önde; yeni problem çözme değerlendirmesi ARC-AGI 3'te sıradaki modelin üç katı puan alıyor; Zapier AutomationBench'te sıradaki modele göre 1,5 kat başarı oranına ulaşıyor; bilgisayar kullanımını ölçen OSWorld 2.0'da Fable 5'in sonucunu maliyetin yaklaşık üçte biriyle geçiyor. Şirketin altını çizdiği davranış ise ajan tarafında belirleyici olan şey: model kendi çıktısını doğruluyor ve başarana kadar üzerinde tekrar tekrar çalışıyor.
Fiyatlama milyon token başına 5 dolar giriş ve 25 dolar çıkış olarak duyuruldu, yani Opus 4.8 ile aynı seviyede; iki buçuk kat hız sunan hızlı mod ise iki katı ücretle çalışıyor. Sektör basınındaki değerlendirmelerde iki nokta daha öne çıkıyor: güvenlik sınıflandırıcılarının Fable 5'e kıyasla belirgin biçimde daha az devreye girmesi bekleniyor ve kısıtlanan istekleri hata döndürmek yerine daha küçük modellere yönlendiren Otomatik Yedekler adlı bir beta özellik geliyor.
Ajan ekonomisi maliyetle değil, tamamlanan işle ölçülüyor
Uzun soluklu ajanlarda asıl gider tek bir yanıt değil, bir işi bitirene kadar harcanan toplam token. Bu yüzden model başına birim fiyat tek başına yanıltıcı olabiliyor: aynı işi daha az denemeyle ve daha az geri dönüşle tamamlayan bir model, kâğıt üzerinde daha pahalı görünse bile toplamda daha ucuza gelebiliyor. Anthropic'in bu sürümde öne çıkardığı doğrulayarak ilerleme davranışı da tam bu hesabı hedefliyor.
İkinci nokta erişim sürtünmesi. Kurumsal kullanımda ajanların takılıp kalması çoğu zaman yetenek eksikliğinden değil, akışın ortasında gelen ret yanıtlarından kaynaklanıyor. Kısıtlanan isteği hata yerine daha küçük bir modele yönlendiren yaklaşım, akışın kopmaması adına anlamlı. Üçüncüsü ise hız ile maliyet arasındaki tercihin artık bir ayar haline gelmesi: aynı model, işin aciliyetine göre farklı ekonomilerle çalıştırılabiliyor.
Türkiye'deki işletmeler için anlamı
Model sürümleri hızlı değişiyor, kurulan sistem ise kalıcı. Türkiye'deki işletmeler için pratik sonuç şu: bir ajan projesini tek bir model sürümüne göre tasarlamak yerine, model değişebilir kabul edip akışı buna göre kurmak gerekiyor. Sağlayıcıyı ve sürümü yapılandırmadan seçilebilir hale getiren bir yapı, her yeni sürümde işi baştan yazmayı önlüyor.
İkinci pratik sonuç ölçüm. Ajan kurmanın maliyeti artık büyük ölçüde deneme sayısına bağlı olduğu için, hangi görevin kaç adımda ve ne kadar tokenla bittiğini görmeden karşılaştırma yapmak mümkün değil. Kendi süreçlerinizden seçeceğiniz üç beş temsili görev üzerinde iki modeli aynı koşullarda çalıştırmak, herhangi bir tanıtım metninden daha fazla bilgi verir. Üçüncüsü sınırlar: modelin ne kadar yetenekli olduğundan bağımsız olarak, ödeme, iptal ve fiyat taahhüdü gibi geri dönüşü zor adımların insan onayında kalması gerekiyor. Türkçe çıktı kalitesi ve KVKK uyumlu veri işleme de her sürüm değişiminde yeniden test edilmeli.
UNALSOFT açısı
Bizim okumamız değişmiyor: sürüm haberleri hızlı akıyor, işi taşıyan şey modelin adı değil etrafındaki iskelet. Hangi görevin ajana bırakıldığı, hangi adımın insan onayına takıldığı, hata anında ne olduğu ve sonucun nasıl ölçüldüğü belirleyici. Agentic AI tarafında kurduğumuz yapı, model sağlayıcısını değiştirilebilir bir parça olarak görüyor; böylece yeni bir sürüm çıktığında kazanç anında test edilebiliyor, sistem yeniden yazılmıyor.
Kaynaklar
Anthropic, "Claude Opus 5" duyurusu · TechCrunch, "Anthropic launches Opus 5"
Model değişir, sistem kalır.
Hangi işin ajana uygun olduğunu kendi süreçleriniz üzerinden birlikte ölçelim.