Summary
Moonshot AI (Beijing) launched Kimi K3 on July 16, 2026 — a 2.8-trillion-parameter MoE model with 1M-token context and native vision, billed as the world’s largest open-source AI model. API is live (15 per M tokens); full weights promised July 27. Self-reported and Artificial Analysis benchmarks place it near Claude Fable 5 and GPT-5.6 Sol on several agentic/coding evals while still trailing top proprietary models overall. Timed ahead of WAIC Shanghai; includes Kimi Code CLI updates and a 48-hour autonomous chip-design demo.
PreScreening Notes
- Score 9 / priority critical: Claimed largest open-source model (2.8T MoE) with live API and near-frontier evals is a major product launch.
- Product release news (July 16); AI domain; VentureBeat; prior pipeline has Kimi K2 Copilot mentions only — not this K3 launch.
- Pass: open-weights race + coding/agentic benchmarks highly relevant; note vendor-claimed benchmarks for later analysis.
Evaluation Report
News Value
- Timeliness: Fresh (July 16 launch; weights due July 27) — peak news cycle.
- Impact: High for open-weight developers, inference hosts, and anyone tracking China open-model race; scale claim (2.8T) resets the open-weights ceiling.
- Prominence: Moonshot is a major Chinese frontier lab; Artificial Analysis third-party ranking adds signal beyond vendor marketing.
- Proximity: Strong for Turkish AI/developer audience — coding/agentic evals, API pricing, and upcoming self-host option.
- Novelty: Genuine — first claimed ~3T-class open model; not a rehash of K2 coverage.
Audience Fit
- Primary fit: AI enthusiasts and software developers building with open models / coding agents.
- Actionable: API access now; July 27 weights as the inflection for independent eval and local hosting.
- Connects to ongoing wiki threads on open-weights race and US–China AI competition.
Risk & Ethics
-
Full weights are not yet public (promised July 27). Until then, "open-source / open-weight" framing is prospective; Artificial Analysis currently treats the live API as proprietary hosted.
- Vendor and AA benchmarks should be labeled as early/independent-but-limited; no public model card/download at launch.
- Avoid overstating parity with Claude Fable 5 / GPT-5.6 Sol — sources note it trails top proprietary systems overall.
Publication Strategy
- Format:
deep-dive(1200+ words) — architecture claims, benchmark caveats, open-weights race context, WAIC timing, pricing vs Opus-class APIs. - Suggested wiki: moonshot-ai, open-weight-models, mixture-of-experts, us-open-weights-race-2026, artificial-analysis.
Suggested Angle
Türk geliştirici ve AI okurları için açı: “En büyük açık model” iddiası şu an API + vaat edilen ağırlıklar; asıl kırılma 27 Temmuz ağırlık çıkışı. Makale, fiyatlandırma ve coding/agentic benchmark’ları öne çıkarırken vendor iddialarını bağımsız doğrulama bekleyen çerçevede tutmalı; Çin açık-ağırlık yarışı ve Inkling/DeepSeek bağlamıyla konumlandırmalı.
Source Analysis
Primary: VentureBeat launch feature. Corroboration: MarkTechPost (architecture/MoE routing), CryptoBriefing (Jul 27 Modified MIT weights), Trilogy AI (AA proprietary classification + OpenRouter), Yahoo Finance (market reaction, valuation context).
Research Notes
Additional sources
- 2026-07-17-moonshot-kimi-k3-marktechpost — 16/896 experts, KDA/AttnRes, benchmark split
- 2026-07-17-moonshot-kimi-k3-cryptobriefing — Modified MIT; Jul 27 weights
- 2026-07-17-moonshot-kimi-k3-trilogyai — AA ranks ~4th; hosted = proprietary until weights
- 2026-07-17-moonshot-kimi-k3-yahoo-finance — rival stocks lower; >$20B May raise
Facts verified
- Launch date Jul 16, 2026; 2.8T MoE; 1M context; API live — multi-source confirmed
- Weights scheduled Jul 27 — company WeChat / secondary consensus
- Trails top proprietary overall while competitive on select coding/agent evals — consistent across VB/Yahoo/MarkTechPost
Unverified / caveats
- Exact pricing tiers vary by outlet (15 common; MarkTechPost lists additional tier)
- “Largest open-source” is prospective until weights ship
- Chip-design 48h demo is vendor anecdote — not independently audited
Broader context
Fits us-open-weights-race-2026 and same-week waico/WAIC diplomacy. Demand-side pair: fireworks-ai Series D on open-model inference economics.
Related wiki
kimi-k3, moonshot-ai, kimi-delta-attention, open-weight-models, mixture-of-experts, artificial-analysis, us-open-weights-race-2026, us-china-ai-competition, waico, world-ai-conference, chinese-ai, frontier-models, fireworks-ai, open-model-inference
Editorial Notes
Decision: Approved for deep-dive (1200+ words).
Approved angle: API live + July 27 weights as the real inflection; frame “largest open-source” as prospective until weights ship. Position in open-weights race (Inkling/DeepSeek) and same-week WAIC/WAICO diplomacy. Pair demand-side with Fireworks Series D.
Reporting instructions:
- Lead with scale (2.8T MoE), API pricing (15), and Artificial Analysis context — label vendor vs independent benchmarks.
- Must include > [!warning] that full weights are promised Jul 27, not public yet; AA treats hosted API as proprietary until then.
- Do not claim parity with Claude Fable 5 / GPT-5.6 Sol overall; competitive on select coding/agent evals only.
- Chip-design 48h demo = vendor anecdote, not audited — one sentence max or omit.
- Cross-link fireworks-ai and waico briefly for Shanghai-week context.
Headline suggestions (TR):
- Moonshot Kimi K3: 2.8T parametreli model API’de; açık ağırlıklar 27 Temmuz’da
- Dünyanın en büyük açık modeli mi? Kimi K3’te iddia, ağırlıklar ve benchmark gerçeği
- Kimi K3 çıktı: 1M bağlam, coding benchmark’ları ve açık-ağırlık yarışındaki yeri
Must-include key points:
- Jul 16 API launch; Jul 27 weights (Modified MIT per sources)
- 2.8T MoE, 1M context, native vision
- Trails top proprietary overall; competitive on select evals
- Pricing and self-host implication after weights
Draft Article
Moonshot Kimi K3: 2.8T parametreli model API’de; açık ağırlıklar 27 Temmuz’da
moonshot-ai, 16 Temmuz 2026’da kimi-k3 modelini duyurdu: 2.8 trilyon parametreli mixture-of-experts mimarisi, 1 milyon token context ve native vision. Şirket bunu “dünyanın en büyük açık kaynak AI modeli” diye konumlandırıyor; API şu an canlı (15 per million tokens bandı). Asıl kırılma noktası ise 27 Temmuz’da vaat edilen full weights — Modified MIT altında.
Tam ağırlıklar henüz kamuya açık değil (vaat: 27 Temmuz 2026). Bu tarihe kadar “open-source / open-weight” çerçevesi ileriye dönüktür. Artificial Analysis, canlı hosted API’yi weights çıkana kadar proprietary olarak sınıflandırıyor.
Ana Gelişme
VentureBeat’e göre Kimi K3, Şanghay’daki world-ai-conference öncesinde piyasaya sürüldü. API kimi.com üzerinden OpenAI SDK uyumlu; Google hesabı veya telefonla erişim mümkün. Fiyatlandırma yaygın aktarımda input 15/M; cached input $0.30/M. Ağustos 12’ye kadar promo rebate duyuruldu.
MarkTechPost teknik özetinde model 896 experttan 16’sını aktive eden sparse MoE olarak geçiyor. Mimari iddialar: kimi-delta-attention (KDA, hybrid linear attention) ve Attention Residuals (AttnRes). Her iki teknik daha önce açık araştırma olarak GitHub’da yayımlanmıştı. Context window 1M token; “thinking mode” her zaman açık olarak anlatılıyor.
CryptoBriefing, full open weights’in 27 Temmuz’da Modified MIT lisansı altında geleceğini ve teknik raporun daha sonra çıkacağını aktarıyor. Trilogy AI, Artificial Analysis’in mevcut hosted K3’ü proprietary saydığını; bağımsız self-host ve üçüncü taraf eval’in weights sonrası başlayacağını vurguluyor.
Benchmark’lar: vendor vs bağımsız sinyal
VentureBeat’in derlediği skorlarda (şirket + artificial-analysis / public board):
- GDPval-AA v2: 1.687 — Claude Fable 5 Max (1.815) ve GPT-5.6 Sol Max (1.747,8) gerisinde 3.; Claude Opus 4.8’in (1.600) önünde
- AA-Briefcase: 1.527 — Fable 5 Max gerisinde 2.; GPT-5.6 Sol Max’in önünde
- BrowseComp: 91.2/100 long-horizon bilgi aramada SOTA iddiası
- Arena.AI Frontend Code Arena: #1 (1.679 Elo)
- Coding/automation bench’lerde seçili liderlikler (SWE Marathon, Program Bench vb. self-report)
Yahoo Finance ve SCMP hattı tutarlı: Moonshot, genel performansta en güçlü proprietary sistemlerin gerisinde kaldığını kabul ediyor; seçili coding/agentic eval’lerde rekabetçi sonuçlar iddia ediyor. Bu yüzden “Claude Fable 5 / GPT-5.6 Sol ile eş seviye” iddiası doğru çerçeve değil.
Chip-design 48 saatlik demo şirket anekdotu olarak geçiyor; bağımsız denetim yok — burada bir cümleyle not edilip bırakılıyor.
Benchmark okurken üç katman ayırmak gerekir: (1) vendor self-report (Program Bench, SWE Marathon liderlikleri), (2) Artificial Analysis / public board skorları (GDPval, Briefcase), (3) henüz yapılamayan bağımsız weight-loaded eval. Üçüncü katman 27 Temmuz’a kadar kapalı; bu yüzden “frontier’i geçti” iddiası erken. Tersine, coding arena liderliği ve seçili agentic bench’ler API kullanıcıları için şimdiden deneme gerekçesi olabilir — kontrollü A/B ile.
Neden Önemli?
open-weight-models yarışında ölçek tavanı yeniden çiziliyor: 2.8T MoE, DeepSeek V4 Pro (~1.6T) sınıfının üstüne çıkma iddiası. Türk geliştiriciler için iki fazlı hikâye var:
- Şimdi: API ile coding/agentic denemeler, fiyat karşılaştırması (Opus-class API’lere göre daha düşük band)
- 27 Temmuz sonrası: self-host, bağımsız eval, open-model-inference sağlayıcılarında hosting
Talep tarafında aynı hafta fireworks-ai Series D’si, açık model inference ekonomisinin unicorn ölçeğine çıktığını gösteriyor. Diplomasi tarafında waico ve WAIC, Çin’in yalnızca model değil yönetişim kurumu da kurduğunu hatırlatıyor — us-china-ai-competition ve us-open-weights-race-2026 aynı tabloda.
Teknik Detaylar
Ölçek ve routing
- Toplam parametre: 2.8T MoE
- Aktif expert (MarkTechPost): 16 / 896
- Context: 1M token; native vision
Ürün hattı (VentureBeat)
- K3 flagship (15)
- K2.7 Code ve K2.6 daha düşük fiyat bandı
- Kimi Code CLI güncellemeleri (subagents, background tasks, plan mode); VS Code / Cursor / Zed entegrasyonu
Lisans ve erişim
- API: canlı
- Weights: 27 Temmuz (Modified MIT — ikincil kaynaklar)
- Model card / download: lansmanda yok
Fiyat katmanları outlet’ler arasında hafif farklılık gösterebiliyor; 15 bandı en sık tekrarlanan rakam. MarkTechPost ek tier’lar da listeliyor — vendor-reported olarak okunmalı.
Bağlam: açık ağırlık yarışı ve Şanghay haftası
Moonshot 2023’te Yang Zhilin tarafından kuruldu; DeepSeek R1 sonrası kullanıcı sıralamasında gerileme, ardından K2 / K2.5 ile open-source pivot anlatısı VentureBeat’te özetleniyor. K3, Inkling/DeepSeek hattıyla birlikte ABD–Çin frontier-models rekabetinin açık tarafını büyütüyor.
chinese-ai ekosisteminde WAIC haftası ürün + diplomasi birleşimi: Kimi K3 lansmanı, MiniMax ve Huawei demoları ile aynı atmosferde; waico ise 29 ülkenin imzaladığı bağımsız IGO. Bu, “model çıkarmak yetmez, kural koyma masasına da otur” stratejisinin somut hali.
Self-host ve altyapı etkisi
Weights çıktığında altyapı sorusu değişir: 2.8T MoE’yi kim, hangi GPU cluster ve hangi serving stack ile taşıyacak? Trilogy AI, self-host için önerilen ölçeğin en az 64 accelerator span’i olduğunu not ediyor — bu, “laptop’ta indirip çalıştır” hikâyesi değil, kurumsal / neocloud sınıfı deployment. fireworks-ai ve benzeri open-model-inference oyuncuları tam burada: ucuz açık model + ölçekli serving. Geliştirici ekipleri için karar ağacı:
- Kapalı API maliyeti yüksekse K3 API denemesi (15 bandı, cached input ile)
- Veri egemenliği / offline gereksinimi varsa 27 Temmuz weights + self-host veya neocloud
- Production için vendor bench’e değil, kendi eval setine bakmak
- OpenRouter üzerinden
moonshotai/kimi-k3erişimi (Trilogy AI) geçici deneme kanalı olabilir; yine hosted = henüz açık ağırlık değil
Artificial Analysis sıralaması (~4. sıra bandı, Trilogy AI özeti) erken sinyal; weights sonrası yeniden ölçüm şart. Arena.ai Code WebDev liderliği iddiası coding odaklı ekipler için cazip; genel bilgi ve uzun ufuk görevlerinde GDPval/Briefcase skorları daha dengeli okunmalı.
Fiyatlandırma ve ürün ekosistemi
VentureBeat’in ürün hattı özeti, Moonshot’un tek modele değil katmanlı portföye oynadığını gösteriyor: K3 flagship, daha ucuz K2.7 Code / K2.6, ve Kimi Code CLI (subagents, background tasks, plan mode). CLI’nin VS Code, Cursor ve Zed entegrasyonu, Türk geliştirici iş akışına doğrudan dokunuyor — özellikle agentic coding denemelerinde. OpenAI SDK uyumu, mevcut client kodunun az değişiklikle taşınmasını kolaylaştırır.
Promo rebate (Ağustos 12’ye kadar, yüksek top-up’larda voucher) kısa vadeli API denemelerini ucuzlatabilir; uzun vadeli TCO hesabında yine de output token maliyeti ve thinking-mode’un token şişirmesi dikkate alınmalı. MarkTechPost’taki ek fiyat katmanları outlet’ler arası tutarsızlığı hatırlatır: sözleşmeden önce resmi fiyat sayfası kontrol edilmeli.
Rekabet ve piyasa tepkisi
Yahoo Finance, Kimi K3 lansmanının rakip AI hisselerinde baskı yarattığını aktarıyor — haberin piyasa algısı “açık taraf da frontier’e yaklaşıyor” yönünde. Moonshot’un kendi çerçevesi ise daha temkinli: seçili coding/agentic eval’lerde rekabet, genel frontier’de hâlâ geride. Bu ayrım, abartılı “ABD modellerini geçti” manşetlerinden kaçınmak için kritik.
open-source-llm tarihinde DeepSeek R1, K2 ve Inkling gibi adımlar tavanı sürekli yukarı çekti. K3’ün 2.8T iddiası parametre yarışını görünür kılar; asıl kalite sinyali ise weights sonrası bağımsız SWE, agent ve long-context eval’lerde netleşecek. Şirketin ~$1.5B fonlama / yükseltilmiş değerleme arayışı (VentureBeat bağlamı) da açık ağırlık stratejisinin ticari ayağını gösterir.
Sonraki Adımlar
27 Temmuz weights çıkışı, bağımsız benchmark’lar, model card ve lisans metninin netleşmesi izlenecek. API kullanıcıları fiyat/kalite trade-off’unu kendi workload’larında ölçmeli; “en büyük açık model” sloganını weights gelene kadar iddia olarak tutmalı. Teknik rapor gecikirse, Mimari iddialar (KDA / AttnRes scaling) peer review olmadan vendor claim olarak kalır.
Aynı haftanın diğer parçaları — waico diplomasisi ve Fireworks fonlaması — K3’ü yalnız bir model lansmanı değil, açık ekosistemin arz–talep–yönetişim üçgeninde okutuyor. Pratik takip listesi: (1) Hugging Face / resmi repo’da weights hash ve lisans, (2) Artificial Analysis’in hosted→open geçiş notu, (3) Fireworks / Together sınıfı host’larda K3 serving fiyatı, (4) kendi coding eval suite’inizde A/B.