Rafın geçtiği eşik
CoreWeave’in Vera Rubin NVL72 duyurusundaki somut basamak, Cognition’ın sistemi üretim çıkarımında kullanması. Küme eylül başında kuruldu; Cognition mühendisleri kendi SWE-2 iş yüklerinde GB200 NVL72 kümesine karşı deneme yaptı. Aradaki fark bir sevkiyat vaadi ile müşteri çalışması arasındadır. Yine de hizmet sınırlı erişimde: bir müşterinin çalışan kümesi, bulutun bütün müşterileri için hazır ve ayrılmış kapasite anlamına gelmiyor.[1]
Cognition’ın bildirdiği toplam belirteç üretimi, SWE-2 çıkarımında 4,8 kat; pekiştirmeli öğrenme işinde çıktı belirteci üretimi 3,8 kat arttı. Bu iki paydanın işi farklı. İlk sonuç, kodlama aracısının çıkarım yükünde iki raf kuşağını karşılaştırıyor. İkinci sonuç başka bir çalışma düzenine ait. Bu sayıları tek bir genel Vera Rubin hızı gibi okumak, iş yükü ve ölçüm sınırını kaybettirir. Şirketin daha önceki DeepSeek R1 için megavat başına bildirdiği sonuç da üçüncü ve ayrı bir deneydir.[1]
Ölçümden kapasiteye
Aynı yönetim araçlarıyla GB200, GB300 ve Vera Rubin kümelerini çalıştırmak CoreWeave için gerçek bir işletme avantajı olabilir. Müşteri yeni donanımı kendi araç zincirini baştan kurmadan kullanabildiğinde devreye alma aralığı kısalabilir. Alternatif açıklama da açık: Cognition’ın kendi iş yükü ve ekibinin hazırlığı geçişi özellikle hızlandırmış olabilir. Duyuru, başka müşterilerde aynı sürenin ya da aynı başarımın tekrarlandığını ölçmüyor.[1]
Bundan sonraki ölçülebilir basamak, farklı müşterilerin tanımlanmış iş yükleriyle Vera Rubin üzerinde düzenli hizmete alınması ve erişimin sınırlı kümenin ötesine genişlemesidir. Bir rafın çalıştığı artık açıklanmış durumda; bu rafın kaç müşteriye, hangi gecikme hedefiyle ve ne kadar süreyle hizmet verdiği ise duyuruda yer almıyor. Bu yüzden 4,8 katlık sonuç, Cognition’ın bildirdiği üretim sınaması olarak değerli; bütün bulut filosunun verimlilik bilançosu olarak kullanılamaz.[1]