OpenAI Decisions API: Agent izleme maliyetini 100 kat düşürebilir mi?

OpenAI, DevDay 2026’da Decisions API’yi duyurdu. API, TypeSafe AI’ın Jev sınıflandırma modeline fonksiyonel olarak benziyor ve agent action monitoring’i frontier LLM maliyetinin çok altında yapmayı vaat ediyor. TypeSafe CEO’su Diogo Almeida, “clone wars başladı” diye yorumladı.

Ana Gelişme

Decisions API, Luna modeline önceden tanımlı seçenek setleri sunarak yapılandırılmış sınıflandırma yapıyor. Görüntü kategorileri veya agent davranışları arasında olasılık çıktıları üretiyor — kalibre edilmiş karar modelinin tipik işlevi.

Jev ile benzerlik açık: her iki ürün de LLM tabanlı “süper sınıflandırıcı” olarak tasarlandı. Temel fark, Decisions API’nin OpenAI ekosistemi içinde native entegrasyon sunması.

Demo verilerine göre agent action monitoring maliyeti:

  • Jev ile: yaklaşık $2.94
  • Frontier LLM ile: yaklaşık $372

Bu karşılaştırma, System One sınıfı modellerin agent güvenliği için ekonomik olarak sürdürülebilir olduğunu gösteriyor — ancak OpenAI’nin resmi pricing’i henüz doğrulanmadı.

Neden Önemli?

Hugging Face olayı ve rogue agent vakalarının ardından OpenAI, agent güvenlik altyapısını güçlendiriyor. Trajectory-level monitoring ve misalignment monitoring, her agent aksiyonunu ayrı bir modelle kontrol etmeyi gerektiriyor; frontier LLM ile bu maliyetli.

Decisions API ve Jev, agent eval monitoring mimarisinde “gözcü model” katmanını ucuzlatıyor. Teoride, Hugging Face saldırısı gibi olaylar bu tür izleme ile önlenebilirdi.

Teknik Detaylar

System One modelleri (jev, decisions-api), frontier modellerin genel amaçlı reasoning yerine dar sınıflandırma görevlerine optimize edildi. Yüksek hız ve düşük maliyetle olasılık çıktıları üretiyorlar.

Almeida, eski OpenAI RL mühendisi olarak Jev’i Eylül başında piyasaya sürdü. OpenAI’nin iki hafta sonra benzer bir API duyurması, frontier lab’lerin güvenlik altyapısını hızla inşa ettiğini gösteriyor.

OpenAI Decisions API pricing ve bağımsız benchmark doğrulaması henüz mevcut değil. Demo maliyet karşılaştırması ( 372) doğrulanmamış veri olarak değerlendirilmeli.

Bağlam

TypeSafe AI ve OpenAI arasındaki “clone wars” tartışması, agent güvenlik pazarının henüz olgunlaşmadığını gösteriyor. AI agent security ekosisteminde izleme araçları kritik önem kazanıyor.

Sonraki Adımlar

Decisions API’nin genel erişime açılma takvimi ve pricing modeli DevDay sonrası duyurulması bekleniyor. Bağımsız benchmark sonuçları, maliyet iddialarını doğrulayacak.


Kaynaklar