Alesta WEB

Kısa cevap: Anthropic Eylül sonunda iki yeni model çıkardı. Claude Opus 5.5 (22 Eylül), şirketin en güçlü modeli Fable 5.1 seviyesinde performansı Opus 5'ten yaklaşık %40 daha düşük maliyetle sunuyor; fiyatı milyon token başına 4 $ girdi / 20 $ çıktı. Claude Sonnet 5.5 (28 Eylül) ise Sonnet 5'e göre %30 daha hızlı ve maliyeti %30'a kadar daha düşük; fiyatı 2 $ / 10 $. İkisinde de 1 milyon token bağlam ve 128 bin token çıktı var. API'yi kullananlar için önemli not: iki modelde de "düşünme" klasik yolla kapatılamıyor ve zorunlu araç seçimi (tool_choice: any/tool) 400 hatası veriyor (Claude Sonnet 5.5, Claude Opus 5.5 API guide).
Yeni modeller ve fiyatlar (Claude model pricing)
Anthropic'in model ailesi üç kademeden oluşuyor: en üstte en yetenekli Fable, ortada güçlü ve dengeli Opus, günlük işler için hızlı Sonnet. En küçük ve en ucuz model hâlâ Haiku 4.5. Eylül ayında üç kademe de yenilendi: Fable 5.1 1 Eylül'de, Opus 5.5 22 Eylül'de, Sonnet 5.5 28 Eylül'de geldi.
| Model | API kimliği | Bağlam | Girdi / Çıktı ($ / 1M token) |
|---|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 | 1M | 10 / 50 |
| Claude Opus 5.5 | claude-opus-5-5 | 1M | 4 / 20 |
| Claude Opus 5 | claude-opus-5 | 1M | 5 / 25 |
| Claude Sonnet 5.5 | claude-sonnet-5-5 | 1M | 2 / 10 |
| Claude Haiku 4.5 | claude-haiku-4-5 | 200K | 1 / 5 |
Opus 5.5'in token fiyatı Opus 5'e göre %20 düşük; Anthropic'in "%40 daha ucuz çalışır" iddiası, aynı işi daha az token harcayarak bitirmesinden de geliyor. Sonnet 5.5'in token fiyatı ise Sonnet 5 ile aynı; maliyet kazancı yine daha verimli token kullanımından. Önbellekten okunan girdi (prompt caching) iki modelde de milyon token başına 0,20 $.
Hangi modeli ne zaman seçmeli?
- Sonnet 5.5: yüksek hacimli işler, müşteri destek sohbeti, metin sınıflandırma ve özetleme, gündelik kod yardımı. Hız ve fiyat önemliyse ilk tercih.
- Opus 5.5: çok adımlı ajan (agent) görevleri, büyük kod tabanında değişiklik, uzun belge analizi, hatanın pahalı olduğu işler. Anthropic'in API için önerdiği varsayılan model.
- Fable 5.1: en zor akıl yürütme ve saatler süren otonom görevler. Fiyatı Opus'un 2,5 katı; gerçekten gerektiğinde.
- Haiku 4.5: çok basit, hıza duyarlı ve maliyetin belirleyici olduğu işler.
Pratik yöntem: aynı görevi gerçek örneklerle iki modelde deneyip "tamamlanan iş başına maliyet"e bakmak. Ucuz model daha çok tekrar deneme gerektiriyorsa toplamda pahalıya gelebilir.

Düşünme ve effort ayarı
Yeni modellerde düşünme (thinking) her zaman açık ve "uyarlanabilir": model, sorunun zorluğuna göre ne kadar düşüneceğine kendisi karar veriyor. Geliştiricinin elindeki ana kontrol output_config.effort parametresi: low, medium, high, xhigh, max.
- Opus 5.5'te varsayılan
medium; Opus 5'tehighidi. Opus 5'ten geçenler kalite farkı görürse önce effort'u açıkçahighyapmalı. - Sonnet 5.5'te varsayılan
highama seviyeler yeniden ayarlandı. Ajan ve kod işleri içinmedium, sohbet içinlowile başlayıp ölçmek öneriliyor.
Effort, düşünme derinliğini ve toplam token harcamasını birlikte belirliyor. Basit işlerde düşük effort hem daha hızlı hem daha ucuz; zor işlerde yüksek effort daha az hata demek.
API'de kırılan davranışlar
| Davranış | Opus 5.5 | Sonnet 5.5 |
|---|---|---|
thinking: {type: "disabled"} | 400 hatası; effort'u düşürün | 400 hatası; yerine {type: "between_tools"} |
budget_tokens | 400 hatası | 400 hatası |
tool_choice: any / tool | 400 hatası | 400 hatası |
| Asistan mesajıyla ön doldurma (prefill) | Desteklenmiyor | Desteklenmiyor |
Zorunlu araç seçimi kaldırıldığı için, "modeli şu aracı çağırmaya zorla" diye yazılmış kod güncellenmeli. Önerilen yol: tool_choice: auto kullanmak, araç tanımına strict: true ekleyerek argümanların şemaya uymasını garanti etmek ve istemde hangi aracın kullanılacağını açıkça yazmak. Amaç yalnızca JSON çıktı almaksa yapılandırılmış çıktı (output_config.format) daha doğru araç.
Bir de güvenlik sınıflandırıcıları var: model bir isteği reddederse yanıt HTTP 200 döner ama stop_reason değeri "refusal" olur. Yanıt içeriğini okumadan önce bu alanı kontrol etmek gerekiyor.
Basit bir örnek istek
Python SDK ile Sonnet 5.5'e orta effort'la bir özetleme isteği:
import anthropic
client = anthropic.Anthropic() # ANTHROPIC_API_KEY ortam değişkeninden okunur
yanit = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=16000,
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "Bu sözleşmenin ana maddelerini özetle: ..."}],
)
if yanit.stop_reason == "refusal":
print("İstek reddedildi")
else:
for blok in yanit.content:
if blok.type == "text":
print(blok.text)Model kimliklerine tarih eki eklenmiyor; claude-sonnet-5-5 ve claude-opus-5-5 olduğu gibi kullanılıyor.
Maliyeti düşürmenin yolları
- İstem önbelleği (prompt caching): her istekte tekrar eden uzun sistem talimatı ya da belge önbelleğe alınırsa, o kısım normal fiyatın çok altında faturalanır.
- Doğru effort: her işe
highvermek yerine iş türüne göre ayarlamak. - Toplu işlem (Batch API): anlık yanıt gerekmeyen işler yarı fiyatına çalışır.
- Model kademesi: önce daha güçlü modeli düşük effort'ta denemek; çoğu zaman eski nesil bir modelin yüksek effort'undan iyi sonuç veriyor.
Önceki nesil için yazdığımız Claude Sonnet 4.7 ve Anthropic SDK rehberindeki önbellek mantığı yeni modellerde de geçerli; değişen, düşünme ayarlarının yerini effort'un alması. Alesta WEB olarak yapay zekâ destekli içerik ve otomasyon özelliklerini haber yazılımımızda ve özel web projelerinde kullanıyoruz; entegrasyon için bize yazabilirsiniz.
Sık sorulan sorular
Claude Sonnet 5.5 ne zaman çıktı?
28 Eylül 2026'da. Opus 5.5 ise 22 Eylül 2026'da duyuruldu.
Sonnet 5.5'in fiyatı ne kadar?
Milyon girdi tokeni için 2 $, milyon çıktı tokeni için 10 $. Sonnet 5 ile aynı.
Opus 5.5 mi Sonnet 5.5 mi?
Yüksek hacimli, hız öncelikli işler için Sonnet 5.5; çok adımlı ve hatanın pahalı olduğu işler için Opus 5.5.
Eski kodum yeni modelde çalışır mı?
Çoğu istek çalışır. Ama thinking: disabled, budget_tokens, zorunlu tool_choice ve asistan ön doldurması kullanan kod 400 hatası alır; güncellenmesi gerekir.
Bağlam penceresi ne kadar?
Fable 5.1, Opus 5.5 ve Sonnet 5.5'te 1 milyon token; tek yanıtta en fazla 128 bin token çıktı.
Kaynaklar (References)
Kapak fotoğrafı: Growtika / Unsplash

