Yapay zekâ geliştiricileri hızlandırıcıların ötesinde işlemciye, paketlemeye ve daha hızlı çalıştırmaya yöneliyor
Haberler, eylemci iş yüklerini yeniden öne çıkan sunucu işlemcisi istemiyle bağlıyor; Google'ın TPU'su için AMD'nin işlemci ve paketleme birikimini değerlendirdiği aktarılıyor. Anthropic'in Decart için önerdiği alım, model çalıştırmayı hızlandırdığı bildirilen yazılımı ekleyebilir; bu gelişmeler altyapı yarışının genişlediğine işaret ediyor.
Yapay Zekâ··Sabah
Eylemci hatlar sunucu işlemcisini yeniden talep ediyor
Eylemci yapay zekâ hatları, baskıyı hızlandırıcıların yanında sıradan sunucu işlemcisine de geri getiriyor. AMD başkan yardımcısı Madhu Rangarajan, IEEE Spectrum'a gerçekçi bir eylemci hattındaki 8 aşamanın 7'sinin tümüyle işlemci üzerinde çalıştığını söyledi. Talep arz tarafında da görünüyor: Intel istemci işlemcisi üretimini kısıp sunucu tarafına yöneldi ve sunucu işlemcilerinin en az yıl sonuna kadar tükendiğini söylüyor; AMD ise sunucu işlemcisi öngörüsünü 2 katına çıkardı. Spectrum'un andığı 2 çalışma darboğazı sayılarla koyuyor: sıralama düzenlemeleri sürekli yük altında uçtan uca gecikmeyi 1,8 kata kadar azaltıyor, işlemci çekirdeği eklemek ilk belirtece kadar geçen süreyi yaklaşık 1,5 ile 7 kat düşürüyor. Arm ve Qualcomm eylemci işlere yönelik işlemciler duyurdu, Nvidia Vera işlemcisine öncelik verdi; Amazon Web Services tarafında da işlemci sunucusu kapasitesi için bekleme sürelerinin, yapay zekâ yükleri bulutu zorladıkça uzadığı aktarılıyor. Hızlandırıcı hâlâ önemli; çevresindeki orkestrasyon da artık silikon için yarışıyor. Eylemci iş yükü bu yüzden sunucu işlemcisini yeniden planlama listesinin başına yazdırıyor.[2]
Aktarılan onuncu nesil TPU, AMD paketlemesi ve çekirdeklerine bakıyor
Hızlandırıcı tarafında SemiAnalysis'in aktardığı ve Tom's Hardware'in yazdığı piyasa söylentisi, Google'ın onuncu sürüm TPU için AMD ile çalıştığını öne sürüyor. Çözümleyicilere göre çekim, gelişmiş paketleme ile SoIC birikimi ve pekiştirmeli öğrenme işlerinin sürekli talep ettiği işlemci çekirdekleri; düzenleme AMD'nin özel bir yapay zekâ hızlandırıcısındaki ilk gerçek payı olur. Google 9 hızlandırıcı neslini yonga tasarımcısı Broadcom ile üretti; dolayısıyla sıradan bir TPU tasarımı için AMD'ye ihtiyacı yok. Aktarılan bilgi, Google'ın kendi sistemlerindeki eğilimle de örtüşüyor: çıkarım için tasarlanan TPU 8i makinelerinde her 2 hızlandırıcıya 1 Axion işlemci düşüyor, yedinci nesilde ise 4 hızlandırıcıya 1 Xeon düşüyordu. Ne Google ne de AMD projeyi doğruladı. Söylenti tutarsa sonraki TPU nesli salt bir hızlandırıcıdan çok, eylemcilerin uyardığı matris motorlarının yanında ana bilgisayar çekirdeklerini tutan bir paket olarak çiziliyor. Haber doğrulanmamış piyasa konuşması olarak kalıyor; imzalanmış bir tedarik sözleşmesi yok.[1]
Anthropic model çalıştırmayı hızlandıran yazılıma yöneliyor
Yazılım da aynı yarışın içinde. Calcalist'e göre Anthropic ile İsrailli girişim Decart, Decart'ı yaklaşık 7 milyar dolar değerleyen bir anlaşmada ileri taslakları karşılıklı iletti; ödemenin ağırlığı Anthropic hissesi olacak ve imzanın eylül başına kadar atılması bekleniyor. Nvidia daha yüksek bir değerleme önerdi, Decart'ın kurucuları ile öncü yatırımcısı Sequoia Capital yine de Anthropic'i tercih etti. Decart Eylül 2023'te kuruldu, yaklaşık 100 kişi çalıştırıyor ve 450 milyon dolar topladı; yazılımının modelleri 8 kata kadar hızlandırdığı aktarılıyor ve şirket robotikte kullanılan gerçek zamanlı video üretimi de geliştiriyor. Son turda yaklaşık 4 milyar dolar değerlendi; yerleşik bir yinelenen gelir akışı olmadan proje bazlı çalışıyor. Satın alma gerçekleşirse Anthropic'in İsrail'deki ilk geliştirme merkezi kurulacak. İşlemci kıtlığı, melez TPU paketleme söylentisi ve önerilen çalıştırma yazılımı alımı, altyapı yarışını tek bir hızlandırıcı markasının ötesine taşıyor: geliştiriciler çok adımlı yapay zekâ işini yürüten her katmanda zaman satın alıyor. Hız yalnızca yongada değil, paketlemede ve yazılımda da aranıyor.[3], [2], [1]