Referans tasarımdan hacimli dağıtıma

AMD, Helios tasarımını 2025'te açıkladı ve Ocak 2026'da CES sahnesinde gösterdi. AMD'nin kendi ürün sayfası onu satılık bir ürün değil, OEM ve ODM ortaklarının sistem kuracağı açık bir referans tasarım olarak tanımlıyor. Tasarım 72 MI455X GPU ve 31 TB HBM4 öngörüyor; hacimli dağıtımlar 2026'nın ikinci yarısı için bekleniyor.[1], [2]

AMD'nin Vera Rubin üstünlüğü iddiası da aynı iş yükünün ölçülmüş sonucu değil. Dipnot, Haziran 2026'da AMD Performance Labs tarafından farklı veri türlerinde hesaplanan tepe teorik değerleri Vera Rubin NVL72 ile karşılaştırıyor; yapılandırmaların üreticiye göre değişebileceğini ayrıca belirtiyor. Yazılım, hassasiyet, gecikme hedefi ve tüm tesis gücü sabitlenmeden bu tablo gerçek bir eğitim ya da çıkarım hızını kanıtlamaz.[1]

Beş kat, neye karşı?

AMD ve Cerebras'ın ortak tasarımı istem ile uzun bağlam işleme işini Helios'a, düşük gecikmeli çözümleme ve belirteç üretimini Wafer-Scale Engine'e ayırıyor. 'Beş kata kadar' verimlilik sayısı ölçülmüş bir Nvidia karşılaştırması değil: şirket dipnotuna göre Temmuz 2026 modellemesi, Kimi 2.6 1T'de benzer etkileşim düzeyinde Helios artı WSE'yi yalnızca WSE yapılandırmasıyla karşılaştırıyor. İlk erişim Cerebras Cloud üzerinden 2026'nın ikinci yarısı için planlanıyor.[3]

Yayımlanan modelleme, Kimi 2.6 1T üzerinde Helios ile WSE bileşiminin yalnızca WSE kullanan yapılandırmaya karşı şirketlerin hesapladığı verimlilik farkını gösteriyor; ilk Cerebras Cloud erişimi 2026'nın ikinci yarısı için planlanıyor. Üretim değerini belirleyecek ölçüler ise bağlam uzunluğu, sayısal hassasiyet ve etkileşim hedefi sabitken veri aktarım yükü, sürdürülen çıktı ve tesis düzeyi enerji tüketimi olacak. Bu değerler, modellenen tepe avantajının müşteri iş yüklerinde tekrarlanabilir bir kazanıma dönüşüp dönüşmediğini gösterecek.[3]