Sayıları aynı paydaya getirmek
Ai2’nin OlmoEarth Platform yazısı tek bir işi ölçüyor: Kuzey Amerika yangın riski haritalaması. Yaklaşık 19.600 işlemci ile 994 GPU paralel çalıştı, ağ verimi zirvede 168 GB/s’yi aştı, tahmini 4.737 saatlik işlem süresi yaklaşık 30,5 saate indi ve bu 155 kat hızlanma olarak veriliyor. Gider ise kilometrekare başına bir sentin kesri kadar aktarılıyor.[1]
4.737 saati 30,5 saate bölünce 155 çıkıyor, yani hızlanma paralelliğin kendisi ve neredeyse tamamı elde edilmiş. O yüzden ilgi çekici sayı 155 değil, 168 GB/s. Onlarca terabaytlık görüntüyü okuyan bir iş, kaç hızlandırıcı olduğuyla değil, baytların hızlandırıcılara ne hızla ulaştığıyla sınırlanır. Buradaki ihtiyat şu: 168 GB/s bir zirve değeri, sürdürülen ortalama değil. Sürdürülen okuma çok daha düşükse, neredeyse doğrusal ölçekleme girdi-çıkıştan değil, son işleme adımının işlemci yoğunluğundan geliyor olabilir.[1]
Hangi basamakta duruyor
Bu iş vaat basamağında değil: yazı, tamamlanmış ve gerçek geçen süreyle ölçülmüş bir kıta ölçekli çıkarım çalıştırması anlatıyor. Ama gideri karşılaştırılabilir kılacak alanlar açık değil. Donanım kuşağı, işlemci ve GPU saatlerinin fiyatı, 30,5 saat boyunca sürdürülen kullanım oranı ve lisans koşulları yazıda yok. Bunlar olmadan kilometrekare başına bir sentin kesri diye verilen sayı satıcının kendi sınırlarıyla tanımladığı bir birim gider olarak kalıyor; başka bir çalıştırmayla yan yana konamaz.[1]
Kısıt merdiveni kendini asıl üç aşamalı akışta gösteriyor: işlemci tabanlı veri toplama, GPU üzerinde çıkarım, yeniden işlemci tabanlı son işleme. Bir GPU adımının iki yanına birer işlemci adımı koyan akış, darboğazı hızlandırıcının dışına taşır — ve işlemci sayısının GPU sayısının yaklaşık yirmi katı olması tam olarak bunun ölçüsü. Bu işte kıt olan kaynak, hızlandırıcının kendisinden çok onu besleyen ve çıktısını toparlayan sıradan işlem gücü.[1]