Summary
Reports (The Information / TechTimes, July 21, 2026) say Google is developing an internal server chip codenamed Frozen v2 that hardwires Gemini’s neural-network architecture into silicon while keeping weights updateable. Engineers project 6–10× tokens-per-watt vs latest TPUs; deployment targeted as early as 2028. Parallel to TPU 8t/8i, not a replacement; likely Google-internal Gemini inference only, not a Cloud commercial product. Project remains unconfirmed by Google; Alphabet stock rose on the news amid a severe compute capacity crunch (~$462B Cloud backlog).
Source Analysis
- Primary leak: The Information (paywalled); secondaries: TechTimes (pipeline primary), 2026-07-21-google-frozen-v2-tnw, 2026-07-21-google-frozen-v2-yahoo-cnbc, 2026-07-21-google-frozen-v2-ndtv
- Google position: Non-confirmation; teams “experiment”; not every lab project reaches production
- Cross-check: Efficiency 6–10× (TNW/Yahoo/CNBC/TechTimes) vs 6–8× (NDTV Profit) — unresolved
Unverified leak — do not present as announced product.
Research Notes
Additional sources
- TNW synthesis of The Information + Reuters/Bloomberg Law pickup (2026-07-21-google-frozen-v2-tnw)
- Yahoo/CNBC with spokesperson quotes (2026-07-21-google-frozen-v2-yahoo-cnbc)
- NDTV Profit (6–8× range) (2026-07-21-google-frozen-v2-ndtv)
Verified vs unverified
- Verified: Secondary amplification; Alphabet share reaction reported; Google non-confirmation quotes
- Unverified: Project existence, 6–10×/6–8× efficiency, 2028 timeline, Cloud backlog figures as causal link
Broader context
Fits custom-ai-silicon / model-specific-inference-silicon trend alongside jalapeno-chip and sohu-chip. Capacity crunch narrative ties to compute-scarcity.
Related wiki
frozen-v2, model-specific-inference-silicon, google, gemini, inference-chip, gpu-infrastructure, compute-scarcity, custom-ai-silicon, google-frozen-v2-gemini-chip
Editorial Notes
- Approved angle: Model-specific inference silicon trend — reported Frozen v2 hardwires Gemini architecture; unconfirmed leak framed against compute scarcity / custom-AI-silicon race.
- Format: standard (confirmed)
- Reporting instructions:
- Must frame as unverified The Information leak; Google has not confirmed (spokesperson: teams experiment; not every project reaches production).
- Efficiency: report 6–10× as common secondary range and note 6–8× (NDTV) inconsistency; label as engineer projections, not benchmarks.
- Parallel to TPU 8t/8i, not a replacement; likely internal Gemini inference only, not Cloud SKU.
- 2028 deployment = reported target. Do not present as announced product.
- Timeliness: Alphabet Q2 earnings ~July 22 may add color — do not invent earnings commentary; no confirmation as of approval check.
- Headline suggestions (TR):
- Rapor: Google, Gemini mimarisini silikona gömen Frozen v2 çipini geliştiriyor
- Frozen v2 sızıntısı: Gemini’ye özel inference çipi ve doğrulanmamış verimlilik iddiaları
- Google’ın model-özel AI silikonu: Frozen v2 henüz resmi değil, TPU’nun yerine geçmiyor
- Mandatory points: The Information origin; Google non-confirmation; 6–10× vs 6–8× caveat; 2028 target; internal/Gemini-only framing; compute-scarcity context without overclaiming Cloud backlog causality.
Draft Article
Rapor: Google, Gemini mimarisini silikona gömen Frozen v2 çipini geliştiriyor
The Information kaynaklı haberlere göre google, iç kod adı frozen-v2 olan bir sunucu çipi geliştiriyor: gemini ailesinin neural-network mimarisini silikona gömüp ağırlıkları (weights) güncellenebilir bırakmayı hedefliyor. TechTimes, The Next Web, Yahoo Finance/CNBC ve NDTV Profit aynı sızıntıyı aktardı. Google projeyi resmi olarak doğrulamadı; sözcü ekiplerin sürekli deney yaptığını ve her laboratuvar projesinin üretime geçmediğini belirtti.
Bu haber, açıklanmış bir ürün lansmanı değil; doğrulanmamış bir sızıntı çerçevesinde okunmalı.
Ana Gelişme
Frozen v2’nin tasarım fikri, genel amaçlı esneklik yerine tek bir model ailesine kilitlemek. İlk “Frozen” yaklaşımında eğitilmiş weights doğrudan circuite yakılması düşünülmüş; tek model sürümüne bağlı bir çipin ömrü aylarla ölçülebileceği için bu yol terk edilmiş. v2’de transformer blokları, attention head’ler, hidden dimension’lar ve feed-forward düzeni gibi mimari iskelet silikonda sabitlenirken weights güncellenebilir kalıyor. Mimari korunursa sonraki Gemini sürümleri aynı donanımda çalışabilir.
Mühendis projeksiyonlarına göre çip, Google’ın en son inference-chip / TPU nesline kıyasla watt başına 6–10 kat token çıktısı vaat ediyor. NDTV Profit aynı iddiayı 6–8 kat olarak aktardı; aralık tutarsızlığı çözülmedi. Bu rakamlar bağımsız benchmark değil, projelere aşina mühendislerin öngörüsü.
Dağıtım hedefi raporlarda 2028 olarak geçiyor. Frozen v2, Nisan 2026’da duyurulan TPU 8t (training) ve TPU 8i (inference) hattının yerine geçmiyor; paralel bir inference yolu. Gemini’ye hardwire edildiği için Google Cloud’da satılacak bir SKU olması beklenmiyor; üretim hacmi TPU seviyesinin altında kalabilir.
Neden Önemli?
Haber, compute-scarcity ve custom-ai-silicon yarışına oturuyor. Sundar Pichai’nin 2026 birinci çeyrek kazanç çağrısında “yakın vadede compute kısıtlıyız” demesi ve Cloud backlog’unun yaklaşık 462 milyar dolara yükseldiği raporları, kapasite baskısını çerçeveliyor. TechTimes’ın aktarımına göre Google, Mart 2026 civarında Meta’ya istediği Gemini kapasitesinin tamamını veremediğini bildirmiş; Haziran 2026’da ise köprü kapasite için SpaceX’e aylık yaklaşık 920 milyon dolar karşılığında ~110.000 Nvidia GPU erişimi anlaşması yapılmış. Bu satırlar kapasite krizinin boyutunu anlatır; Frozen v2’nin backlog’u tek başına çözdüğü iddiası doğrulanmış değildir — nedensellik abartılmamalı.
Model-özel silikon trendi yalnız Google’a özgü değil. jalapeno-chip ve sohu-chip gibi girişimler de aynı model-specific-inference-silicon yönünde ilerliyor: genel GPU/TPU esnekliğinden tek model ailesine optimize edilmiş verimliliğe kayış. Frozen v2 doğruysa, hiperscaler’ların “her modele uyan çip” döneminden “kendi frontier modeline gömülü silikon” dönemine geçişinin bir örneği olur — henüz kanıtlanmamış bir örnek.
Yazılım ve AI altyapı okuyucusu için pratik anlam: inference maliyeti ve watt başına token, eğitimden sonra ölçeğin asıl kısıtı haline geliyor. Mimariyi silikona gömmek, esneklik pahasına verim satın almak demek. Gemini mimarisi köklü değişirse Frozen v2 nesli demode olabilir; bu yüzden “architecture sabit, weights güncellenebilir” ayrımı tasarımın can damarı.
Teknik Detaylar
- Hardwired: mimari (architecture), weights değil
- Güncellenebilir: model ağırlıkları; mimari sabit kaldığı sürece
- Kapsam: Gemini-family inference; training hattı değil
- Ticari durum: Cloud ürünü değil; iç kullanım odaklı keşif
- Paralel hat: TPU 8t/8i devam eder; Frozen v2 TPU’nun yerini almaz
- Verimlilik: yaygın ikincil aralık 6–10×; NDTV 6–8× — mühendis projeksiyonu, benchmark değil
Jeff Dean’in liderliğindeki orijinal Frozen fikrinin weights’i yakmaya dayanması, v2’nin neden mimariye kaydığını açıklıyor: weights her sürümde değişir, mimari daha yavaş evrilir. Bu, compute-capital tartışmasında sermayeyi daha uzun ömürlü bir varlık sınıfına bağlama çabası olarak da okunabilir — yine sızıntı çerçevesinde.
Bağlam
Alphabet hisseleri sızıntı günü gün içi %3,7’ye varan yükseliş gösterip seansı yaklaşık %1,51 artışla kapattı; piyasa tepkisi ikincil raporlarda yer alıyor, proje varlığının kanıtı değil. Alphabet’in 22 Temmuz 2026 ikinci çeyrek kazanç açıklaması ek renk getirebilir; onay anında Google’dan resmi doğrulama yoktu ve bu yazı kazanç yorumu uydurmaz.
The Information paywall’lu birincil sızıntı kanalı; TechTimes ve diğerleri amplifikasyon. Google sözcüsünün CNBC’ye verdiği “ekipler sürekli deney yapıyor / her lab projesi üretime geçmez” çizgisi, ne doğrulama ne kesin yalanlama. Okuyucu için güvenli çerçeve: rapor edilen iç proje, üretime çıkmama olasılığı açık.