NVIDIA Nemotron 3 Ultra: 550B Açık MoE Model ve Ücretsiz Agent Toolkit Computex’te Tanıtıldı

nvidia, GTC Taipei’de nemotron-3-ultra’yı duyurdu — 550 milyar parametreli (55B aktif) açık ağırlıklı MoE model. 4 Haziran 2026’da Hugging Face, OpenRouter ve build.nvidia.com üzerinden erişilebilir olacak. Ücretsiz Agent Toolkit (NemoClaw orchestration, OpenShell runtime, CUDA-X agent skills) ile birlikte sunuluyor. Artificial Analysis Intelligence Index’te 48 puanla ABD açık modellerinde lider; ancak Çin’in Kimi K2.6’sı (54) gerisinde kalıyor.

Ana Gelişme

Model: 550B toplam / 55B aktif MoE; hybrid SSM+MoE mimarisi
Erişim: 4 Haziran — Hugging Face, OpenRouter, build.nvidia.com
Agent Toolkit: NemoClaw, OpenShell, CUDA-X agent skills — ücretsiz
Throughput iddiası: 300+ token/s (NVIDIA pazarlama iddiası)
Ortaklar: Cadence, CrowdStrike, Palantir, Siemens, Foxconn

Neden Önemli?

open-weight-models ekosisteminde Nemotron 3 Ultra, Türk geliştiricilerin self-host veya API üzerinden erişebileceği frontier sınıfı bir model. us-china-ai-competition bağlamında ABD’nin açık model liderliği iddiası, Kimi K2.6 benchmark farkıyla sınırlanıyor.

Lisans Apache 2.0 değil — kullanım koşulları Hugging Face release günü doğrulanmalı. 5x inference hızı ve %30 maliyet düşüşü iddiaları NVIDIA kaynaklı.

Bağlam

computex-2026’da intel Xeon 6+ ile birlikte donanım-yazılım stack’i yeniden şekilleniyor. NVIDIA’nın açık model stratejisi, GPU talebini artırma amacı taşıyor — ücretsiz model + ücretli inference altyapısı.

Sonraki Adımlar

4 Haziran release günü Hugging Face erişimi ve bağımsız benchmark sonuçları doğrulanmalı. Self-host maliyeti vs API fiyatlandırması Türk ekipleri için değerlendirme konusu.


Kaynaklar