Eigen RadarYapay Zekâ
Analiz

Nvidia yeni çıkarım hamlesini megavat başına 30 kat iş iddiasına bağlıyor

Nvidia Vera Rubin için megavat başına 30 kata kadar artış bildirirken, Cerebras aynı yongayı hızlandırdı; Groq 3 LPX de Nebius ile seri üretime geçti.

Yapay Zekâ··Akşam
Karanlık bir veri merkezinde tek bir parlak sunucu rafından çok sayıdaki işlem rafına yayılan ışık akışları, çıkarım yoğunluğu ile enerji verimliliğini simgeliyor.

Vera Rubin için megavat başına 30 kat iddiası

Nvidia, Vera Rubin NVL72'nin eylemci yapay zekâ çıkarımında GB300 NVL72'ye göre megavat başına 30 kata kadar daha çok iş yapabildiğini bildiriyor. Şirket bu sonucu, SemiAnalysis'in InferenceX takımındaki açık kaynaklı AgentX başarımıyla ölçtü. AgentX, önceden kaydedilmiş kodlama oturumlarını yeniden oynatıyor; uzun bağlamlı hazırlık ile araç çağrıları arasındaki boşlukları hesaba katıyor. Nvidia aynı yazıda GB300 NVL72'nin DeepSeek V4-Pro üzerinde H200 NVL8'e göre megavat başına 15 kata kadar daha çok iş yaptığını ve milyon belirteç başına gideri 10 kata kadar düşürdüğünü söylüyor. Bunlar Nvidia'nın kendi ölçümleri; şirket Vera Rubin karşılaştırmasının SemiAnalysis incelemesini beklediğini belirtiyor.[1]

Cerebras aynı yongaya daha çok güç veriyor

Cerebras'ın CS-4 sistemi, önceki kuşaktaki 5 nanometrelik WSE-3 yongasını koruyor. Şirket yongayı değiştirmek yerine saat hızını yükseltti, güç ve soğutmayı artırdı. Tek kabinde iki yerine üç gofret bulunuyor. Şirket kullanıcı başına saniyede 4.400 belirtece kadar çıkıldığını ve Nvidia grafik işlemcili düzeneklere göre 30 kata kadar hız sağlandığını bildiriyor. Bu karşılaştırmalar Cerebras'ın kendi ölçümleri. İddiaları inceleyen SemiAnalysis çözümlemecileri ağ tarafındaki kazancı sınırlı buldu. Gofret başına bellek 44 gigabaytta kalıyor; habere göre OpenAI, Codex Spark için Cerebras donanımını kullanıyor.[2]

Groq 3 LPX seri üretimde

Nvidia'nın Hot Chips 2026'da duyurduğu Groq 3 LPX çıkarım hızlandırıcısı seri üretime geçti; ilk üretim müşterisi bulut sağlayıcısı Nebius Group N.V. oldu. Hızlandırıcı Vera Rubin veri merkezi düzeneğinin bir uzantısı olarak konumlandırılıyor ve tam kabinde 256 birime kadar destek veriyor. Artificial Analysis ölçümlerinde Gemma 4 31B, 100.000 belirteçlik bağlam penceresiyle saniyede 3.400 belirtece ulaştı. Nvidia, Groq Inc. teknolojisini Aralık 2025'te 20 milyar dolar karşılığında lisanslamış; kurucu Jonathan Ross ile başkan Sunny Madra'yı da işe almıştı. Şirket fiyat veya genel erişim tarihi açıklamadı.[3]

Kaynakça

  1. Haber kaynağıNVIDIA Developer BlogVera Rubin megavat başına 30 kat iş vaat ediyor, ölçüm Nvidia'nın kendi↩
  2. Haber kaynağıTHE DECODERCerebras hızı yongayı değiştirmeden ikiye katladı↩
  3. Haber kaynağıSiliconANGLEGroq 3 LPX seri üretime geçti, ilk alıcı Nebius↩