Anthropic, Opus 5.5'i 22 Eylül 2026'da yayımladı

Claude Opus 5.5daha çok iş, daha az token

Claude 5.5 ailesinin ilk modeli. Çoğu işte Claude Fable 5.1 seviyesine ulaşıyor, çalıştırma maliyeti Opus 5'ten %40 düşük ve çıktıyı %30'dan fazla hızlı üretiyor.

22 Eyl
2026 sürümü
Claude 5.5 ailesinin ilk modeli
4 $ / 20 $
API giriş / çıkış
Milyon token başına, Opus 5'in 5 $ / 25 $ seviyesinden indi
medium
Varsayılan effort
Varsayılanı high olan Opus 5'ten bir kademe düşük
1 M / 128 K
Bağlam / en fazla çıktı
Pencere Opus 5 ile aynı, bilgi kesimi Haziran 2026

Artık Felo Arama'da

Belgelerin tamamını verin, sonra sorun.

Claude Opus 5.5, uzun girdili işler için Felo Arama'da kullanılabilir: dosyalar arasında sayıları karşılaştırmak, bir iddiayı kaynağına kadar izlemek ve başkasına olduğu gibi aktarabileceğiniz bir yanıt üretmek.

Opus 5.5'i Felo Arama'da dene

01

Bağlamın tamamını tut

1 milyon token'lık bağlam penceresi ve Haziran 2026'ya kadar bilgi. Uzun bir yazışma, baştan sona bir depo ya da bir belge seti tek bir işte kalıyor.

02

Sonucu değil, sayıyı doğrula

Anthropic'in iç testinde 18 raporun 16'sı kalite eşiğini geçti. Uydurulmuş tek bir sayı ya da alıntı işi baştan sona düşürecekti.

03

Ne yaptığını ve neye ihtiyacı olduğunu söyle

Anthropic modelin iletişim biçimini yeniden tasarladı: en önemli bilgi başta geliyor ve rapor neyin bittiğini, neyin bulunduğunu, neyin açık kaldığını açıkça yazıyor.

Hızlı kılavuz

Felo'da Claude Opus 5.5'e geçin

Claude Opus 5.5, hesabınızdaki diğer önde gelen modellerle birlikte model seçicisinde görünür.

Model seçiciyi açın, Claude Opus 5.5'i seçin ve işe aynı çalışma alanında başlayın.

Opus 5.5'in farkı

Maliyet düşüşünün kendisi bir özellik.

Anthropic daha yüksek bir benchmark puanı yerine verimliliği öne çıkarıyor: iş başına daha az token, token başına daha düşük fiyat ve tipik iş yüklerinde %40 daha az maliyet. Saatlerce çalışan bir ajanı bırakıp gitmeyi karşılanabilir kılan şey tam olarak bu.

01

Dağınık işi bitir

Anthropic, bir erken test kullanıcısının 200.000 satırlık kod tabanını üç saatten kısa sürede denetleyip düzelttiğini aktarıyor; Opus 5 aynı işte 20 saatten fazla harcamış ve 2,5 kat daha fazla token kullanmış.

02

Hatayı birleştirmeden önce yakala

Deloitte, en düşük effort kademesinde bile Opus 5.5'in kod incelemesinde bilinen hataların %72'sini yakaladığını bildirdi; Opus 5 high kademesinde %56'da kalmış ve daha çok yanlış alarm üretmiş.

03

Kullanılabilir bir rapor bırak

Metinleri daha kısa ve daha iyi yapılandırılmış. Box, doğruluk kaybı olmadan yanıtların %40 daha az uzun olduğunu ve Opus 5'in üçte biri kadar token kullanıldığını bildirdi.

Model seçimi

Bir token'ın maliyetiyle yanlış yapmanın maliyetini karşılaştırın.

Aşağıdaki fiyatlar milyon token başına resmî genel API tarifeleridir; Felo abonelik ya da kullanım fiyatları değildir. Effort satırı en az fiyat satırı kadar önemli: aynı istem, modellerin başladığı kademeye göre çok farklı maliyete gelebilir.

Karar ölçütü
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
API fiyatı / milyon token
4 $ giriş / 20 $ çıkış
10 $ giriş / 50 $ çıkış
5 $ giriş / 25 $ çıkış
10 $ giriş / 50 $ çıkış
Önbellek okuma / milyon token
0,20 $, giriş fiyatının 0,05 katı
0,25 $, giriş fiyatının 0,025 katı
0,50 $, standart 0,1 katı
Sağlayıcıya ve önbellek katmanına göre değişir
Varsayılan effort
medium. Uyarlanabilir düşünme her zaman açık ve kapatılamıyor.
high. Uyarlanabilir düşünme her zaman açık.
high. Düşünme high ve altındaki kademelerde kapatılabiliyor.
Her istekte çağıran taraf belirliyor
Nerede karşılığını veriyor
Orta segment fiyatla uzun süreli ajan kodlama, kod incelemesi ve bilgi işi.
En zor muhakeme ve en uzun ajan koşuları; Opus 5.5 daha yüksek effort'ta bile yetmediğinde.
Önceki Opus referansı. Gerçek kullanılabilirliği ve gecikmeyi kendi trafiğinizde karşılaştırın.
OpenAI'nin amiral gemisi segmenti, fiyat aralığının en üstünde.

Yukarıdaki genel API tarifeleri ve varsayılanlar 23 Eylül 2026'da Anthropic'in Claude Opus 5.5 duyurusu, Claude Platform model sayfaları ve OpenAI'nin GPT-6 Astra sayfasıyla karşılaştırıldı. Token fiyatı toplam iş maliyetinin yalnızca bir parçası. Anthropic'in verimlilik iddiası tipik iş yüklerinde %40 maliyet düşüşü; bu da token başına daha düşük fiyatla iş başına daha az token'ı birlikte içeriyor.

Anthropic'in yayımladığı sonuçlar

Opus 5.5 nerede önde, nerede değil.

Anthropic kendi sayılarını Fable 5.1, Opus 5, GPT-6 Astra ve GPT-5.6 Sol ile yan yana yayımladı. Aşağıdaki dört grafikten ikisi tek başına doğruluk yerine doğruluğun iş başına maliyete oranını gösteriyor, çünkü Anthropic'in yaptığı karşılaştırma tam olarak bu.

Anthropic'in Claude Opus 5.5 için Fable 5.1, Opus 5, GPT-6 Astra ve GPT-5.6 Sol ile yayımladığı karşılaştırma tablosu

Yayımlanan karşılaştırmanın tamamı

Ölçülen beş model için ajan kodlama, bilgi işi, iş akışları, disiplinler arası muhakeme, bilimsel araştırma, bilgisayar kullanımı ve grafik okuma.

Anthropic'in Claude Opus 5.5 için yayımladığı ajan kodlama grafikleri

Ajan kodlama

Terminal-Bench 4.0, FrontierCode v1.1 ve CursorBench 4.0, iş başına maliyete karşı doğruluk olarak çizildi.

Anthropic'in Claude Opus 5.5 için yayımladığı bilgi işi grafikleri

Bilgi işi

44 mesleği kapsayan GDPval-AA v2.1, AutomationBench ve Perplexity'nin veri toplama benchmark'ı WANDR.

Anthropic'in Claude Opus 5.5 için yayımladığı bilgisayar kullanımı ve muhakeme grafikleri

Bilgisayar kullanımı ve muhakeme

OSWorld 2.0, Humanity's Last Exam ve Chartography; sonuncusu bir grafikten değer okuma doğruluğunu ölçüyor.

Anthropic'in Claude Opus 5.5 için yayımladığı iş başına maliyete karşı doğruluk grafikleri

İş başına maliyete karşı doğruluk

Anthropic'in temel iddiası her bedele daha yüksek puan değil, deneme başına maliyetin çok altında aynı ya da daha iyi puanı almak.

Üretici tarafından yayımlanan sayılar. Aksi belirtilmedikçe Anthropic, Opus 5.5'i max effort'ta uyarlanabilir düşünmeyle çalıştırdı ve üretim korumaları açıkken değerlendirdi. Bu korumalar devreye girdiğinde siber güvenlik işlerini Opus 4.8, biyoloji işlerini Opus 5 tamamladı; bu da o benchmark'larda yayımlanan Opus 5.5 sayılarını büyük olasılıkla düşürüyor. GPT-6 Astra ve GPT-5.6 Sol sayıları OpenAI'nin bildirdiği değerlerdir. Üreticiler arası benchmark farkları gerçek dünyadaki farklar için zayıf bir göstergedir; Anthropic'in bu sayılar hakkında söylediği de budur.

Opus 5'i hâlihazırda çalıştırıyorsanız

Mevcut kodu bozan dört değişiklik.

Anthropic, hâlihazırda Claude Opus 5 üzerinde çalışan entegrasyonlar için dört kırıcı değişiklik sıralıyor; buna hiçbir isteği başarısız kılmadan yanıt biçimini değiştiren beşinci bir değişiklik de ekleniyor. Model kimliğini değiştirmeden önce okumaya değer, çünkü dördünün üçü sessizce bozulmak yerine 400 hatası döndürüyor.

01

Düşünme artık kapatılamıyor

Opus 5'te düşünme high ve altında kapatılabiliyordu. Opus 5.5'te her zaman açık ve hem kapatma hem de elle token bütçesi 400 hatası döndürüyor. Tek denetim effort oldu ve varsayılan değer high yerine medium'a indi.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

Zorunlu araç kullanımı reddediliyor

tool_choice "any" ya da belirli bir araç adıyla ayarlandığında 400 hatası döner; token sayım uç noktası da buna dahil. auto ile katı araç kullanımını ya da yapılandırılmış çıktıyı birleştirin ve aracın ne zaman kullanılacağını istemde belirtin.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Düşünme blokları üreten modele bağlı

Her düşünme bloğu onu üreten modeli kaydediyor. Opus 5.5, Opus 5 ile daha eski Opus, Sonnet ve Haiku modellerinin bloklarını okuyabiliyor; Fable ve Mythos'unkileri okuyamıyor. Bir yönlendirici konuşmayı başka modele taşırsa sonraki turlar önceki muhakeme olmadan çalışır.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 düşünmeyi korur; diğer modeller kaybeder

04

Eski bilgisayar kullanımı aracı kaldırıldı

Claude API ve Google Cloud'da computer_20251124 aracı 400 hatası döndürüyor. Yerine computer_toolset_20260801 araç setini bildirin, beta başlığını kaldırın ve ajan döngüsünü member tool_use bloklarına uyarlayın. Amazon Bedrock'ta eski araç çalışmaya devam ediyor.

computer_20251124 -> computer_toolset_20260801

Effort artık düşünmenin tek denetimi

Düşünme kapatılamadığına göre ayarlanacak şey effort. Opus 5.5 beş kademeyi de destekliyor ve Opus 5'in bir kademe altında, medium'da başlıyor. Anthropic'in önerisi, bir ayarı taşımak yerine kendi değerlendirmelerinizde baştan tarama yapmak ve yüksek kademelerde max_tokens'ı geniş tutmak; çünkü düşünme metni döndürülmese bile düşünme token'ları bu sınıra sayılıyor.

Kademe
Varsayılan
Anthropic'in önerdiği kullanım
low
Hayır
Bir miktar yetenek kaybıyla en verimli kademe. Anthropic bunu basit işler ve alt ajanlar için öneriyor.
medium
Evet
Opus 5.5'in varsayılanı. Anthropic'e göre kodlama ve bilgi işi değerlendirmelerinde high kademedeki Opus 5'e eşit ya da ondan iyi.
high
Hayır
Diğer Claude modellerinin çoğunda varsayılan. Karmaşık muhakeme ve zor kodlama problemleri.
xhigh
Hayır
30 dakikayı aşan, token bütçesi milyonlara çıkan uzun soluklu ajan ve kodlama işleri.
max
Hayır
Token harcaması sınırlanmadan ulaşılabilen en derin muhakeme. Kalite artışını ölçtüğünüz işlere saklayın.

Effort katı bir token bütçesi değil davranışsal bir sinyal: düşük kademede model gerçekten zor problemlerde yine düşünür, yalnızca yüksek kademeye göre daha az. Anthropic ayrıca aynı kademede Opus 5.5'in tur başına Opus 5'ten daha fazla düşündüğünü, bunun xhigh ve max'ta en belirgin olduğunu belirtiyor; Opus 5'ten taşınan bir ayar daha uzun ve daha pahalı turlar üretecek.

Nereye oturuyor

Başında beklenemeyecek kadar uzun işler.

Opus 5.5, bir iş saatler sürdüğünde, bir kişinin akılda tutamayacağı kadar çok dosyaya yayıldığında ya da başka birinin kontrol etmesi gereken bir çıktı ürettiğinde karşılığını veriyor. Bunlar Anthropic'in ve ilk test kullanıcılarının anlattığı işler; genel sohbet istemleri değil.

Depo genelinde taşıma ve denetim

İlk akla yatkın yamada durmak yerine, testler geçene kadar değişikliği büyük bir deponun tamamına taşımak. Anthropic, bir test kullanıcısının 680.000 satırlık taşımayı bir günden kısa sürede bitirdiğini aktarıyor.

Gerçek hatayı bulan kod incelemesi

Anthropic'in aktardığı test kullanıcısı Column, birkaç commit önce yanlış modellenen bir üçüncü taraf entegrasyonu için dış belgelere bakarak bir hatayı yakaladığını bildirdi.

Finansal ve belge analizi

Önce modeli, sonra tek sayfalık özeti üretmek ve çekinceleri korumak. Anthropic, bir birleşme analizinin 63 dakikada tamamlandığını, Opus 5'te bunun 93 dakika sürdüğünü ve maliyetin yarısı olduğunu aktarıyor.

Uzun süre çalışan ajan ekipleri

Alt ajanlara devrediyor ve hızını bir zaman bütçesine göre ayarlıyor. Anthropic'in önerisi, çok ajanlı bir yapıya geçen süre sinyali vermek; böylece sıraya dizilmek yerine paralelleşiyor.

Uzun süren bir işte deneyin

01

Gerçek bağlamı getir

İşe yarar bir yanıtın hesaba katması gereken depoyu, belgeleri ve gereksinimleri ekleyin. 1 milyon token'lık pencere tam bunun için var.

02

Tamamlanma koşulunu yaz

İşin bitmiş sayılması için neyin doğru olması gerektiğini söyleyin. Anthropic'in gözetimsiz çalışmalar için önerisi, işin parçalarını modelin güncellediği bir kontrol listesinde tutmak.

03

Bitmiş çıktıyı karşılaştır

Aynı işi Felo'da Opus 5.5, Opus 5 ve Fable 5.1 üzerinde çalıştırın. Yalnızca yanıtı değil testleri, çekinceleri ve token tüketimini de karşılaştırın.

Claude Opus 5.5 hesabınızın model seçicisinde göründüğünde seçin.

Opus 5.5'i Felo'da dene

Claude Opus 5.5 hakkında sık sorulanlar

Claude Opus 5.5, Anthropic'in uzun süreli ajan kodlama ve bilgi işi için geliştirdiği model; 22 Eylül 2026'da Claude 5.5 ailesinin ilk modeli olarak yayımlandı. Anthropic'e göre çoğu işte Claude Fable 5.1 seviyesine ulaşıyor ve çalıştırma maliyeti Claude Opus 5'ten %40 düşük.

Uzun işi daha düşük fiyata çalıştırın.

Claude Opus 5.5'i Felo'da diğer önde gelen modellerin yanına koyun, sonra saatler sürdüğü için ertelediğiniz işte deneyin.

Opus 5.5'i Felo'da dene

Felo AI Arama'dan başlayın ve modeli kullanılabilir olduğu yerde seçin.