Önizleme hangi iş yükünde, hangi kütüphanede
NVIDIA, Vera Rubin NVL72'yi MLPerf Inference v6.1 Closed Division önizlemesine soktu. Qwen3-VL'de GB300 NVL72'ye göre en fazla 3,7 kat çıktı, yığın vLLM ve Dynamo; DeepSeek-R1'de en fazla 2,5 kat, yığın TensorRT-LLM. Rakamlar 6.1-0106 ve 6.1-0074. 288 GPU'luk GB300 koşusu yüzde 99 ölçek verimi. Gönderim sonrası GPT-OSS-120B satırı henüz doğrulanmadı. 13 Ağustos'ta iki NVIDIA hızının ortak paydası yoktu; bugün payda var: adlı iş yükü, adlı kütüphane, önizleme basamağı.[1], [4]
Önizleme gönderimi, şirketin seçtiği kapalı bölüm ve yazılım yığınındaki çıktıyı bildiriyor. Aynı megavatı bağımsız bir müşteri rafında, aynı gecikme hedefinde görmek ayrı bir basamak. Rakamları aynı paydaya getirelim: 3,7 kat Qwen3-VL'ye bağlı, 2,5 kat DeepSeek-R1'e; ikisini tek bir "Vera daha hızlı" cümlesinde eritmek paydayı yine kaybeder.[1]
Kumaş taslağı ve kira, ölçülen rafın yanına gelmez
Aynı 24 saatte Cornelis Active Compute Fabric'i, Delos Data ise her yönde yaklaşık 8 TB/s dediği 30 Tbps'lik G/Ç kalıbını anlattı. Yazı, NVIDIA ve AMD hızlandırıcılarını 3,6 TB/s'te durduruyor ve kalıbın ne zaman sürüleceğini bütünleşmeye bağlıyor. The Register, ölçek büyütme yarışına giren iki taslağı böyle çerçeveliyor. Ölçek büyütme kumaşı, ölçülen rafı daha geniş bir sıra hızlandırıcıya bağlayan bir sonraki darboğaz adayı; sevk edilen silikon bu sayfalarda yok.[2], [1]
Anthropic, Queensland Western Downs'ta 32 milyar dolarlık önerilen bir veri merkezinin bir parçasını kiralamak için anlaşma imzaladı; Avustralya'daki ilk anlaşması, FIRB onayına bağlı. ABC metninde megavat yok. Kira, sözleşme basamağında duruyor. Okunacak sonraki olay, aynı Qwen3-VL ve DeepSeek-R1 sınırında bağımsız bir müşteri MLPerf tekrarıdır.[3], [1]