Eigen RadarYapay Zekâ
Analiz

OpenAI hız katmanı açarken yapay zekâ fiyat yarışı orta sınıfa sıkıştı

OpenAI Cerebras üzerinde saniyede 750 belirtece ulaşan bir katman açtı, Kog mevcut GPU'ları hızlandırdı. Orta sınıf modellerdeki fiyat indirimleri, işlem giderinin donanım ve hizmet katmanına kaydığını gösteriyor.

Yapay Zekâ··Akşam
Karanlık bir hızlandırıcı salonunda mavi ve amber ışık darbeleri farklı donanım rafları arasından geçerek tek çıkışta birleşiyor.

Orta sınıfta indirim, üst sınıfta duran fiyat

Ars Technica'nın haberine göre OpenAI ve Anthropic, gideri kısmak isteyen müşteriler daha ucuz Çin modellerini denerken orta sınıf modellerinin fiyatını indiriyor. OpenAI, GPT-5.6 Luna'da fiyatı yüzde 80 düşürdü: milyon girdi belirteci başına fiyat 1 dolar düzeyinden 0,20 dolar düzeyine, milyon çıktı belirteci başına 6 dolar düzeyinden 1,20 dolar düzeyine indi. Anthropic, Claude Opus 5'i milyon girdi belirteci başına 5 dolar ve milyon çıktı belirteci başına 25 dolar fiyatla açtı; bu, Fable 5 modelinin yarı fiyatına denk geliyor ve Sonnet 5 için eylülde planlanan zam iptal edildi. Silicon Data'nın belirteç fiyat endeksinde önde gelen ABD laboratuvarlarının modelleri için ödenen fiyatlar temmuz ortasından bu yana neredeyse dörtte bir geriledi. İki laboratuvar bazı kurumsal müşterileri sabit abonelikten kullanıma dayalı faturalandırmaya geçirirken DoorDash ile Airbnb faturayı tutmak için Çin yapımı modelleri kullanmaya başladıklarını söylüyor. Duyurulan belirteç fiyatları doğrudan karşılaştırmaya elverişli değil: Artificial Analysis, orta çabadaki Opus 5'in başarım ve görev başına gider bakımından azami çabadaki Moonshot Kimi K3 ile eşleştiğini, azami çabadaki GPT-5.6 Luna'nın azami çabadaki DeepSeek V4 Flash ile eşleştiğini ama görev başına neredeyse iki kat pahalıya geldiğini buldu. Hostinger'ın yapay zekâ teknoloji lideri Mantas Lukauskas, en iyi modellerin fiyatlarının sabit ya da yükselen seyrettiğini söyledi ve değişiklikleri, iki laboratuvarın en gelişmiş ürünlerinin fiyatını koruyup koruyamayacağının ilk gerçek sınavı olarak niteledi.[1]

Cerebras üzerinde Ultrafast katmanı

The Decoder'ın yazdığına göre OpenAI, GPT-5.6 Sol'u Cerebras donanımında çalışan ve saniyede en fazla 750 çıktı belirtecine ulaşan Ultrafast kipinin ön sürümüne aldı. Kip, standart hızın en fazla 2,5 katını kabaca iki katı fiyata sunan mevcut Fast Mode'un üzerinde duruyor ve API üzerinden seçili müşterilere açık. Cerebras, 2026'nın başında OpenAI ile 10 milyar dolar değerinde bir ortaklık imzalamıştı. Hız sayıları OpenAI'den geliyor ve bağımsız bir ölçüme atıf yapılmıyor; kapasite büyüyene kadar erişim sınırlı kalıyor, şirketler bir form üzerinden başvurabiliyor. OpenAI kipi olay müdahalesi, finansal işlem izleme, müşteri desteği, e-ticarette kişiselleştirme ve etkileşimli araştırma işleri için öneriyor. Orta sınıf belirteç indirimleri fiyatı aşağı çekerken, Ultrafast katmanı gecikmeyi ve çıktı hızını ayrı bir ücretli hizmet yüzeyi hâline getiriyor. Okur için ayrım net: aynı model ailesinde daha ucuz orta katman ile daha hızlı, kapasite kısıtlı bir donanım katmanı yan yana satılıyor. Hangi işin hangi katmana sığacağı, duyurulan saniye başına belirteç sayısından çok, erişim kuyruğu ve görev başına toplam gidere bağlı kalıyor.[2]

Mevcut GPU'lardan daha fazla çıkarım

TechCrunch'ın haberine göre Gaël Delalleau'nun kurduğu Fransız girişim Kog, halihazırda kurulu veri merkezi GPU'larından, AMD MI300X ve Nvidia H200 dahil, daha yüksek çıkarım verimi almayı hedefleyen Kog Inference Engine yazılımını geliştirmek için tohum turu topladı. Turun eş liderliğini Varsity VC üstlendi; Bpifrance, French Tech 2030 programı ve Scaleway da destek verdi. Gösterimde düzenek, 2 milyar parametreli Laneformer 2B modeliyle saniyede 3.000 belirtece ulaştı; şirket 30 kat daha hızlı çıkarımdan söz ediyor. İki sayı da Kog'un kendi ölçümü, bağımsız bir başarım karşılaştırması verilmiyor. Delalleau, École Polytechnique'te katıhâl fiziği okudu, daha önce Stribe'ı kurdu ve DEFCON bayrak kapmaca finallerine dört kez kaldı. Ekip 11 kişi; şirkete göre mayıstaki teknik ön sürüm 200'den fazla iş bağlantısı getirdi. Orta sınıf model indirimleri, Cerebras hız katmanı ve mevcut GPU'yu zorlayan yazılım birlikte okunduğunda tablo kayıyor: işlem gideri yalnızca model kartındaki belirteç fiyatından ibaret kalmıyor, donanım seçimi ve hizmet katmanı da faturayı belirliyor. Üst sınıf modellerde fiyatın yerinde durduğu bir ortamda, orta katmandaki rekabet hız ve verim iddialarını donanım ile yazılım tarafına itiyor. Bağımsız ölçüm eksikliği hem Ultrafast hem Kog iddialarında duruyor; yine de yön, çıkarımın fiyat savaşının orta sahasında yoğunlaştığını gösteriyor.[3], [1], [2]

Kaynakça

  1. Haber kaynağıArs Technicaİndirimler orta sınıf modellere geldi, üst sınıfta fiyat yerinde duruyor↩1↩2
  2. Haber kaynağıThe DecoderOpenAI, GPT-5.6 Sol için Cerebras donanımında üçüncü bir hız katmanı açtı↩1↩2
  3. Haber kaynağıTechCrunchFransız girişim, bugünkü GPU'lardan daha yüksek çıkarım hızı almaya çalışıyor↩