Yapay Zekâ

Claude Opus 5.5, uzun ve karmaşık işlerde maliyet iddiasıyla geldi

Yeni üst model, kesintisiz muhakeme gerektiren görevlerde daha güçlü sonuçları daha düşük tipik görev maliyetiyle sunmayı amaçlıyor.

Mizan Haber Teknoloji Servisi· 2 dk okuma

Duyuru / olay tarihi:

Şehir maketi üzerinde bir robot kolla birlikte çalışan tasarımcıyla karmaşık AI görevlerini anlatan yapay zekâ görseli.
Mizan Haber · Yapay zekâyla üretilmiş temsilî görsel. Gerçek olay veya ürün fotoğrafı değildir.

Anthropic, 22 Eylül 2026'da Claude Opus 5.5'i tanıttı. Şirket, birçok işte Fable 5.1 seviyesine yaklaşan yeni modelin, Opus 5'e göre tipik görev maliyetini yüzde 40 azalttığını bildiriyor. Bu, şirketin test düzeneklerinden çıkan bir karşılaştırma; bütün kullanıcıların faturasında aynı düşüşün yaşanacağına dair garanti değil.

Yeni API tarifesi, milyon giriş tokenı başına 4 dolar, çıkış başına 20 dolar ve önbellekten okuma başına 0,20 dolar olarak açıklanıyor. Tarifedeki değişiklik ile görev sırasında kullanılan token miktarı ayrı unsurlar. Birini bilmek, uzun bir kod dönüşümünün toplam maliyetini tek başına hesaplamaya yetmiyor.

Opus ürün sayfası modeli karmaşık işler için konumlandırıyor. METR de kendi sitesinde Opus 5.5 için bağımsız, yayın öncesi değerlendirme kaydını yayımlıyor. Bir dış değerlendirme bulunması yararlı bir bağlam sunuyor; ancak bu kayıt, modelin her alanda kusursuz veya risksiz olduğuna dair kapsamlı bir onay sayılamaz.

Uzun görevlerin toplam maliyeti

Editoryal açıdan Opus'un sınavı, çok aşamalı iş boyunca kararların tutarlı kalması. Bir kod tabanını yeni bir yapıya taşırken ilk dosyayı doğru değiştirmek yeterli olmayabilir. Değişikliklerin birbirini bozmaması, varsayımların belgelenmesi ve mevcut davranışın korunması, işin tamamına yayılan bir değerlendirme gerektirir.

Bu tür kullanımda görev tarifinin kalitesi de önemli. Ekibin hangi dosyalara dokunulabileceğini, hangi çıktının kabul edileceğini ve hangi aşamada insan incelemesi gerektiğini önceden belirlemesi gerekir. Modelin güçlü olduğu iddiası, eksik talimatın yarattığı belirsizliği ortadan kaldırmaz; aksine daha çok işlem yapılmasını sağlayabilir.

Fiyat düşüşünü anlamak için yalnızca kısa sohbet örnekleriyle karar vermek yanıltıcı olur. Uzun görevlerin yeniden başlatılma sayısı, ara sonuçların kontrolü ve son çıktının düzeltilmesi birlikte ölçülmeli. Aynı işi daha az denemede tamamlayan sistem, daha pahalı bir token tarifesinde bile farklı bir sonuç verebilir.

Önbellek fiyatı, tekrar kullanılan büyük bağlamlar için ayrıca dikkat çekiyor. Bunun gerçek faydası, uygulamanın neyi yeniden gönderdiğine ve hangi bölümün önbelleğe alınabildiğine bağlı. Her belgeyi baştan üreten bir iş akışı ile ortak bir kod tabanı üzerinde ilerleyen süreç, aynı maliyet davranışını göstermeyebilir.

Opus 5.5'in duyurusu, üst modellerde rekabetin yalnızca yetenek artışıyla ilerlemediğini gösteriyor. Bizce daha güçlü muhakemeyi daha geniş bir iş grubuna ekonomik biçimde taşıyabilmek de belirleyici olacak. Buna ilişkin sağlam karar, gösterim videosundan değil, ekibin kendi uzun görevlerini tamamlayan kontrollü denemelerden çıkar.

Kaynaklar

Kaynak kontrolü: 2026-10-03. Metin yapay zekâ desteğiyle hazırlanmıştır.

■ MİZAN HABER