Aynı birim, iki ayrı payda

OpenAI, GPT-5.6 Sol'u Cerebras donanımında çalışan Ultrafast kipinin ön sürümüne aldı ve saniyede en fazla 750 çıktı belirteci veriyor. Aynı hafta Fransız girişim Kog, kurulu veri merkezi GPU'larında 2 milyar parametreli Laneformer 2B modeliyle istek başına saniyede 3.000 belirtece ulaştığı bir gösterim yaptı. İki sayı da saniyedeki belirteç sayısını ölçüyor.[1], [2]

Aynı birimi taşımaları iki sayıyı karşılaştırılabilir kılmıyor. Kog'un sayısı 2 milyar parametreli bir modele ve tek isteğe ait; OpenAI'nin sayısı öncü bir akıl yürütme modeline ait. Donanım da ortak değil: bir yanda Cerebras silikonu, öbür yanda AMD MI300X ile Nvidia H200 gibi kurulu GPU'lar var. Payda ortak olmadan saniyedeki belirteç sayısı bir sıralama üretmiyor.[1], [2]

Ölçümü kimin yaptığı da iki tarafta aynı. Ultrafast kipinin hız sayıları OpenAI'den geliyor ve bağımsız bir ölçüme atıf yapılmıyor. Kog'un saniyede 3.000 belirteç ile 30 kat hız sayıları da şirketin kendi ölçümü; bağımsız bir başarım karşılaştırması verilmiyor. Her iki sayı da üretici beyanı basamağında duruyor.[1], [2]

Hangi basamakta duruyorlar?

Duyurulmuş hız ile teslim edilmiş hız arasındaki mesafe iki tarafta da açık. Ultrafast bir ön sürüm: erişim başlangıçta yalnızca API üzerinden ve seçili müşterilere açık, kapasite büyüdükçe genişletilecek, şirketler bir form üzerinden başvuruyor. Kog tarafında elde bir tohum turu, 11 kişilik bir ekip ve bir gösterim var; şirket A serisi turunu ilk büyük modelini 10 kat hızda çalıştırdıktan sonraya, eylül 2026'ya koyuyor.[1], [2]

Aynı basamak sırasını daha önce enerji kapasitesi duyurularını okurken de kullanmıştım; orada da ölçek farkı değil, duyurunun hangi basamakta durduğu ayırt edici olmuştu. Cerebras ortaklığının 10 milyar dolar tutarında olması da bir hız ölçümü yerine geçmiyor; para, kapasitenin hangi tarihte kime açılacağını söylemiyor.[1], [3]

Sayıyı ne doğrular?

Bu iki hızı aynı ölçeğe koyacak şey bellidir: aynı model, aynı duyarlık, aynı istek yapısı ve aynı gecikme hedefi altında üçüncü bir tarafın yaptığı ölçüm. Kog kendi takvimini eylül 2026'ya, ilk büyük modelini 10 kat hızda çalıştırmaya bağladı; OpenAI ise Ultrafast erişimini kapasiteye bağladı. Eylül sonuna kadar taraflardan biri bağımsız bir ölçüm yayımlarsa iki sayı karşılaştırılabilir hâle gelir, yayımlamazsa saniyedeki belirteç sayısı üretici beyanı olarak kalır.[1], [2]