Claude’un Yeni Tokenizer’ı Token Sayısını Şişiriyor: Efektif Fiyat Nasıl Değişiyor?
anthropic, claude-sonnet-5 ve ilgili model hattıyla gelen yeni tokenizer’ı nedeniyle aynı metin yaklaşık 1,0–1,35× daha fazla token’a bölünüyor. Şirket bu aralığı kabul ediyor. Üçüncü taraf Playcode ölçümlerinde TypeScript üzerinde GPT-5.x’e göre 1,73×’e varan farklar görüldü; metodolojiye bağlı. Liste fiyatı sabit kalsa bile efektif llm-pricing değişiyor.
Ana Gelişme
Sonnet intro fiyatı milyon token başına 10 olarak 31 Ağustos 2026’ya kadar sürüyor; ardından 15’e çıkacak. Tokenizer şişmesi, intro dönemindeki “ucuz” görünümü de etkiliyor: daha fazla token, aynı iş için daha yüksek fatura demek. The Register’ın aktardığı analizlerde Opus 4.8’in GPT-5.x token baseline’ına normalize edildiğinde efektif maliyetin yaklaşık 37,50 seviyesine gelebileceği belirtiliyor — bu da üçüncü taraf normalizasyonu.
Cross-vendor karşılaştırma yapan ekipler (ör. Ploy’un GPT-5.6 Sol’ü Opus 4.8’den ucuz/hızlı bulması) sticker price yerine token ekonomisine bakıyor. token-economics okuryazarlığı production migration kararının parçası haline geliyor.
Neden Önemli?
Türk AI builder ekipleri için bu haber aksiyonel: 31 Ağustos deadline’ı bütçe planını etkiliyor. “Anthropic zam yaptı” diye tek cümlelik çerçeve yanlış; doğru ayrım sticker vs effective cost. Aynı prompt’un farklı tokenizer’larda farklı faturalara dönüşmesi, benchmark ve A/B maliyet testlerini zorunlu kılıyor.
Teknik Detaylar
Pratik checklist:
- Aynı corpus’ta eski vs yeni Claude tokenizer token sayısını ölçün
- GPT-5.x / alternatiflerle normalize /MTok değil)
- Intro 10 penceresinin 31 Ağustos’ta kapandığını takvime işleyin
- TypeScript/kod ağırlıklı workload’larda Playcode benzeri sapmaların daha yüksek olabileceğini varsayın
- Migration kararını latency + quality + effective $ ile birlikte alın
Warning
Playcode çarpanları üçüncü taraf ve corpus’a bağlıdır; evrensel sabit değildir.
Bağlam
claude fiyatlandırma tartışması uzun süredir liste fiyatına odaklanıyordu. Tokenizer değişikliği, görünmeyen vergi gibi davranıyor. OpenAI karşılaştırmaları da bu yüzden yeniden yapılıyor: aynı İngilizce/TS dosyası farklı vendor’da farklı token sayısına map oluyor.
Sonraki Adımlar
31 Ağustos öncesi production ekipleri maliyet projeksiyonunu güncellemeli. Anthropic dokümantasyonundaki ~%30 daha fazla token uyarısını faturalama modeline gömmek, sürpriz faturayı azaltır. Karar: model kalitesi hâlâ öndeyse efektif primi ödemek; değilse vendor mix’i gözden geçirmek.