Kuaishou KwaiKAT, KAT-Coder-V2.5’i yayınladı: 100 bin+ doğrulanabilir repo ortamı
kuaishou bünyesindeki KwaiKAT ekibi, KAT-Coder-V2.5’i duyurdu. Model, tek tur kod üretmek yerine 100.000’den fazla doğrulanabilir repository ortamında eğitiliyor. Tez net: agentic-coding-environments — ölçekten çok ortam ve ödül altyapısı. Servis modeli StreamLake üzerinden; ayrı bir open-weight varyant olan KAT-Coder-V2.5-Dev ise Hugging Face’te Apache-2.0 ile yayımlandı.
Ana Gelişme
Teknik rapora (arXiv 2607.05471) göre AutoBuilder, çok dilli repoları sandbox ortamına dönüştürüyor; inşa başarı oranı %16,5’ten %57,2’ye çıkarılarak 12 dilde 100k+ doğrulanabilir ortam üretilmiş. Görev üçlüsü: açıklama, çalıştırılabilir ortam, validation testleri — patch ancak testleri geçince doğru sayılıyor.
KwaiKAT raporuna göre, birleşik Claude Code harness altında servis edilen V2.5 PinchBench’te 94,9 ile lider; SWE-Bench Pro’da 65,2 ile Opus 4.8’in (69,2) hemen ardından ikinci. Bunlar satıcı/harness eşleşmeli skorlar; bağımsız üçüncü taraf onayı bu yazının kapsamı dışında. Dev open-weight kartı (35B toplam / 3B aktif MoE) ayrı bir modeldir — servis bench rakamlarıyla karıştırılmamalı.
Neden Önemli?
Türk geliştiriciler için coding-agents pazarında “yeni bir coder model” gürültüsünden ayrışan nokta altyapı tezi. open-weight-models isteyenler Dev’i HF’den deneyebilir; üretim skorlarına bakanlar StreamLake servisini ve harness uyarısını birlikte okumalı. Ortam > ölçek çerçevesi, agent yarışında veri ve sandbox kalitesinin parametre sayısından daha belirleyici olabileceğini hatırlatıyor.