Claude Haiku 5.5: agent iş yükleri için daha düşük token maliyeti
Anthropic, 7 Ekim 2026’da Claude Haiku 5.5’i duyurdu: yüksek hacimli özet, sınıflandırma, veritabanı sorgusu ve canlı destek gibi iş yükleri için konumlandırılan, şirketin en hızlı ve en yetenekli küçük modeli. Ortalama çalıştırma maliyeti Haiku 4.5’e kıyasla yaklaşık %75 daha düşük (Anthropic iddiası).
Ana Gelişme
Haiku 5.5, Opus 5.5 ve Sonnet 5.5 ile birlikte kodlama işlerinde alt agent olarak da kullanılabiliyor; browser use ve hız hassas senaryolar hedefleniyor.
API fiyatlandırma (1M token, ≤100K / >100K prompt) — Anthropic tablosu:
| Tür | ≤100K | >100K |
|---|---|---|
| Input | $0.10 | $0.50 |
| Output | $0.50 | $2.50 |
| Cache read | $0.01 | $0.05 |
| Cache write | $0.125 | $0.625 |
Ayrıca Sonnet 5.5 cache read fiyatı milyon token başına 0.10’a indi (%50); Anthropic, çoğu agentic iş yükünde Sonnet maliyetinin yaklaşık %20 azalacağını öngörüyor. Max ve Team abonelerine aylık 500 arası havuzlanmış API kredileri geliyor.
Model claude-haiku-5-5 kimliğiyle AWS, Google Cloud ve Microsoft Azure üzerinde; Python/TypeScript SDK’larında computer use ve browser use (beta) destekleniyor.
Neden Önemli?
Coding agent ve destek botları üretimde çoğu zaman en çok token tüketen katman Haiku sınıfı modellerde yoğunlaşıyor. Haiku 5.5, GPT-6 Luna haftasıyla çakışan fiyat rekabetinde birim ekonomiyi doğrudan etkiliyor.
Seçim rehberi (özet):
- Haiku 5.5: Yüksek hacim, düşük gecikme, özet/sınıflandırma, destek, alt agent.
- Sonnet 5.5: Daha karmaşık reasoning ve uzun bağlam; cache indirimi agent döngülerinde belirgin.
- Opus 5.5: En zor görevler; maliyet üst sınır.
Teknik Detaylar
Anthropic’in paylaştığı benchmark örnekleri (kaynak: şirket): GDPval-AA v2.1’de 1620 vs Haiku 4.5’te 735; OSWorld 2.1’de %72,4 vs %15,7. Bu rakamlar üretici değerlendirmesidir.
Haiku 5.5, ilk Haiku sınıfı ayarlanabilir effort (çaba) ayarına sahip. Güvenlikte siber koruma Haiku 4.5’ten daha kısıtlayıcı; savunma amaçlı görevlerde Sonnet 5.5’ten daha geniş bir izin verildiği belirtiliyor.
Bağlam
Aynı gün OpenAI ChatGPT’de GPT-6 kitle lansmanını yaptı. API tarafında maliyet optimizasyonu Haiku 5.5 ile, tüketici deneyimi GPT-6 ile yarışıyor; agent harness tasarımında model seçimi ve cache stratejisi kritik hale geliyor.
Sonraki Adımlar
Ekipler mevcut Haiku 4.5 pipeline’larını fiyat ve latency A/B testiyle Haiku 5.5’e taşımalı; Sonnet cache indirimiyle birlikte çok adımlı agent maliyet modelini yeniden hesaplamak mantıklı.
Kaynaklar
- Introducing Claude Haiku 5.5 (Anthropic)