Claude Opus 5 çıktı
Anthropic, 24 Temmuz 2026’da Claude Opus 5’i kullanıma açtı. Şirketin duyurusuna göre model, üst seviyedeki Claude Fable 5’in yetkinliğine yaklaşıyor ve bunu maliyetin yarısında yapıyor. Claude Max’te yeni varsayılan model oldu, Claude Pro’da ise en güçlü seçenek olarak sunuluyor.
Duyurudaki vurgu bu kez hız veya fiyat değil. İki başlık öne çıkıyor: uzun soluklu işlerde dayanıklılık ve muhakeme.
Görsel: Anthropic, “Introducing Claude Opus 5”, 24 Temmuz 2026.
Uzun soluklu işler
Model saatler süren görevlerde çalışmayı sürdürebiliyor. Hata aldığında durmak yerine toparlanıyor, engelin etrafından dolaşıyor ve iş boyunca kendi çıktısını denetleyerek önceki modellerin kaçırdığı sorunları yakalıyor. Anthropic, kodlama değerlendirmesi Frontier-Bench v0.1’de Opus 4.8’in performansını iki katından fazlasına çıkardığını, bunu görev başına daha düşük maliyetle yaptığını belirtiyor.
Bunu somutlaştıran bir örnek var. Bir görevde modele bir makine parçasının teknik resmi veriliyor ve bu resmi 3D FreeCAD modeline dönüştürecek kodu yazması isteniyor. Ancak görev, modelin resmi doğrudan göremeyeceği şekilde kurgulanmış. Opus 5, geometriyi ham piksellerden çıkarmak için kendi görüntü işleme hattını yazıyor ve parçayı yeniden inşa ediyor. Aynı kurulumda başka hiçbir model beş denemede sonuca ulaşamıyor.
Benzer bir örnek finans tarafından geliyor. Bir mühendis, yeni bir borsa için piyasa verisi akışını tek oturumda kurmak üzere modeli kullanıyor. Önceki modeller, mühendisin ayrıntılı planlarıyla bile bu işi tamamlayamıyor. Doğrulama yapacak canlı bir veri akışı bulunmadığı için Opus 5 kendi test düzeneğini kuruyor ve kodunun borsa verisini doğru ayrıştırdığını böyle kontrol ediyor.
Yatay eksen modelin çaba ayarını gösteriyor. Görsel: Anthropic, “Introducing Claude Opus 5”, 24 Temmuz 2026.
Muhakeme
İkinci vurgu, modelin karar verme tarzında. Tahmin yürütmek yerine daha sık açıklayıcı soru soruyor, hatalı talimata itiraz ediyor ve uygulamaya geçmeden önce yaptığı işin sonuçlarını değerlendiriyor.
Erken erişim kullanıcılarının aktardıkları da bu yönde. Bir kullanıcı, mimari yeniden kurgulama oturumunda önerdiği bir tasarıma modelin itiraz ettiğini, ısrar edilince fikrini değiştirmediğini anlatıyor. Model bunun yerine önerinin değerli kısmını ayırıyor, itirazını tek bir tasarım sorusuna indiriyor ve iyi tarafı koruyup kusuru gideren bir orta yol öneriyor.
Değerlendirme sonuçları
Anthropic’in paylaştığı diğer sonuçlar arasında şunlar var. Daha önce görülmemiş türden problemleri ölçen ARC-AGI 3’te modelin skoru, kendisinden sonra gelen en iyi modelin üç katı. İş süreçlerini baştan sona tamamlamayı ölçen Zapier AutomationBench’te başarı oranı, aynı görev maliyetinde en yakın rakibin yaklaşık 1,5 katı. Bilgisayar kullanımı testi OSWorld 2.0’da ise Fable 5’in en iyi sonucunu maliyetin üçte biri civarında geçiyor.
Akademik kullanım açısından en dikkat çekici kısım bilimsel araştırma tarafı. Model, Anthropic’in yaşam bilimleri değerlendirmelerinin tamamında Opus 4.8’i geçiyor. En belirgin ilerleme organik kimyada, spektroskopi verisinden molekül yapısı çıkarma görevinde 10,2 puan. Protein dizisindeki değişimlerin işlevi nasıl etkilediğini tahmin etme görevinde ise artış 7,7 puan. Anthropic, güvenlik önlemleri Opus 4.8 ile benzer olduğu için bunun genel erişime açık en yetenekli bilimsel araştırma modeli olduğunu belirtiyor.
Hizalama ve güvenlik
Anthropic, yayın öncesi otomatik davranış denetiminde bunun bugüne kadarki en hizalı modeli olduğunu belirtiyor. Şirkete göre model, Claude’un anayasasına Opus 4.8, Sonnet 5 ve Fable 5’ten daha iyi uyuyor, aldatıcı davranış oranı en düşük seviyede kalıyor ve kötüye kullanıma yönlendirilmeye en dirençli model konumunda.
Otomatik davranış denetiminde Opus 5, genel hizasız davranış ölçümünde 2,3 puan alıyor. Bu, Anthropic’in son modelleri arasındaki en düşük değer. Görsel: Anthropic, “Introducing Claude Opus 5”, 24 Temmuz 2026.
Güvenlik tarafında model, hem biyoloji araştırması hem saldırı odaklı siber güvenlik alanında Mythos 5’in gerisinde kalıyor. Güvenlik açıklarını bulma konusunda Mythos 5’e yaklaşıyor, ancak bu açıkları somut bir siber tehdide dönüştürme konusunda belirgin biçimde geride.
Erişim ve fiyat
Opus 5 bugün tüm platformlarda erişilebilir. Fiyat Opus 4.8 ile aynı kaldı, milyon girdi tokeni 5 dolar, milyon çıktı tokeni 25 dolar. Geliştiriciler Claude API üzerinde claude-opus-5 model adıyla kullanmaya başlayabiliyor. Varsayılan hızın yaklaşık 2,5 katında çalışan bir Fast modu da sunuluyor.
Değerlendirme
Buradaki tabloların hepsi tek bir yöne işaret ediyor. Yetkinlik artışı artık tek adımlı sorulara verilen doğru cevaplarda değil, uzun ve çok adımlı işlerin baştan sona takip edilebilmesinde ölçülüyor. FreeCAD örneğinde dikkat çekici olan modelin doğru cevabı bulması değil, doğru cevaba ulaşmak için kendisine bir yöntem kurması. Aynı şey borsa verisi örneğinde de geçerli, model doğrulama imkânı bulamadığında doğrulama imkânını kendisi üretiyor.
Araştırma iş akışlarında zorlayıcı olan da tam olarak bu. Bibliyometrik analizden literatür taramasına, veri temizliğinden görselleştirmeye kadar yaptığımız işlerin çoğu, bir soruya cevap vermekten çok bir süreci sonuna kadar yürütmeyi gerektiriyor. Bir Scopus çıktısındaki isim eşleştirmesini düzeltmek, yüzlerce PDF’i indeksleyip sorgulanabilir hale getirmek, bir sıralama metodolojisini adım adım yeniden kurmak. Bunların hiçbiri tek istekle bitmiyor, hepsinde kritik olan modelin nerede takıldığını fark edip yön değiştirebilmesi.
Muhakeme vurgusu da bu açıdan anlamlı. Bir aracın hatalı talimata itiraz etmesi, ilk bakışta bir sürtünme gibi görünür. Oysa uzun bir analiz zincirinde en pahalı hata, yanlış varsayımın on adım boyunca sessizce taşınmasıdır.
Kaynak: Anthropic, “Introducing Claude Opus 5”, 24 Temmuz 2026. https://www.anthropic.com/news/claude-opus-5
Bu yazıdaki tüm sayısal karşılaştırmalar ve grafikler Anthropic’in söz konusu duyurusundan alınmıştır ve bağımsız olarak doğrulanmamıştır. Görsellerin hakları Anthropic PBC’ye aittir, haber değeri taşıyan bilgi aktarımı amacıyla kaynak gösterilerek kullanılmıştır.




