İndirim nereye indi

OpenAI, GPT-5.6 Luna'da milyon girdi belirteci başına fiyatı 1 dolar yerine 0,20 dolar, milyon çıktı belirteci başına 6 dolar yerine 1,20 dolar yaptı; indirim yüzde 80. Anthropic, Claude Opus 5'i milyon girdi belirteci başına 5 dolar, milyon çıktı belirteci başına 25 dolar fiyatla açtı; bu, Fable 5'in yarısı. Şirket ayrıca Sonnet 5 için eylüle planladığı zamdan vazgeçti. Silicon Data'nın belirteç fiyat endeksinde, önde gelen ABD laboratuvarlarında müşterilerin fiilen ödediği fiyatlar temmuz ortasından bu yana neredeyse dörtte bir geriledi.[1]

Tek tek sayılardan çok, ortaya çıkan düzen önemli. İki laboratuvar da dizisinin ortasındaki fiyatları indirdi, tepesine dokunmadı; 2020'den bu yana büyük dil modelleri kullanan Hostinger'dan Mantas Lukauskas, en iyi modellerin fiyatlarını sabit ya da yükselen olarak tarif ediyor. İkisi birden bazı kurumsal müşterileri sabit abonelikten kullanıma dayalı faturalandırmaya geçiriyor; böylece bir ekibin faturası tükettiği işlem gücünü izliyor. En akla yatkın okuma şu: serbestçe indirilebilen Çin modellerinin rekabeti, yerine koymanın kolay olduğu orta bölümde en sert biçimde hissediliyor, en güçlü modele ihtiyaç duyan müşterinin ise gidebileceği daha ucuz bir yer yok. Kanıtla bağdaşan iki başka okuma daha var: indirimler, Anthropic'e yakın bir kaynağın Opus 5'in Fable 5'in altında konumlanmasına ilişkin söylediği gibi olağan ürün dizisi kurgusundan geliyor olabilir ya da planlanan halka arzlar öncesinde talebi ucuz modellere kaydırma girişimi olabilir.[1]

Belirtilen çabada görev başına gider

Opus 5 temmuzda çıktığında bu köşede, geliştirici için işleyen değişikliğin istek başına bir çaba ayarı olduğunu, bunu destekleyen bütün ölçümlerin satıcıdan geldiğini ve ayarın bu yüzden sınanmamış kaldığını yazmıştım. Artificial Analysis eksik olan dış karşılaştırmayı şimdi sundu: orta çabadaki Opus 5, hem başarım hem görev başına gider bakımından azami çabadaki Moonshot Kimi K3 ile eşleşti; azami çabadaki GPT-5.6 Luna ise azami çabadaki DeepSeek V4 Flash ile eşleşti ama görev başına neredeyse iki kat pahalıya geldi. Bu karşılaştırmanın birimi, adı konmuş bir çaba düzeyinde tamamlanan bir görev; bir ekibin kendi iş yüküyle yan yana koyabileceği sayı da bu.[1], [3]

Karşılaştırmanın dışında kalan şey, iş akışının geri kalanı. Bir başarım karşılaştırmasında görev başına gider; zayıf bir modelin yol açtığı yeniden denemeleri, yanlış yanıtın yiyip bitirdiği inceleme süresini ve bir eylemcinin hatalı değişikliği işlemesi durumunda geri alma yükünü saymıyor. Silicon Data'nın endeksi ödenen fiyatları ölçüyor; bu da liste fiyatlarıyla birlikte müşterilerin aldığı model bileşimiyle hareket ediyor. Dolayısıyla neredeyse dörtte birlik gerileme, tek bir fiyatın düşmesinden çok ekiplerin bir alt basamağa inmesini yansıtıyor olabilir. Gerçek yanıtı isteyen ekibin kendi görevlerini iki farklı çaba ayarında çalıştırıp hataları harcamayla birlikte kaydetmesi gerekiyor.[1]

Model değiştirmeyi uygulanabilir kılan şey

İndirimlerin arkasındaki haber, baskının bir bölümünü serbestçe indirilebilen Çin modellerine bağlıyor; bir ekibin indirebileceği somut bir örnek de bu hafta ortaya çıktı. Alibaba'nın Qwen ekibi Qwen 3.8'i Apache 2.0 lisansıyla yayımladı: 27 milyar parametreli çok kipli yoğun bir model ve daha büyük Qwen3.8-2.4T-A95B sürümü, Hugging Face ile ModelScope üzerinde ağırlıklar, 262.000 belirteçlik kendi bağlam penceresi ve her sorguda kapatılabilen bir düşünme kipi. İzin verici bir lisans ile indirilebilir ağırlıklar, bir ekibin iş yükünü sözleşmeyi yeniden açmadan taşıyabilmesini sağlıyor; 27 milyar parametreli modelin kodlama ve ofis işlerinde Qwen3.7-Plus'ı geçtiği iddiası ekibin kendi iddiası ve duyuruda bağımsız bir değerlendirme yok. İndirilebilir ağırlıkların da sunucu donanımı ve işletme tarafında kendi faturası var; liste fiyatındaki tasarruf sessizce oraya gidebiliyor.[2], [1]

Bu eğilimin nereye kadar gideceğinin dürüst sınavı dar ve tarihlenebilir. Silicon Data'nın endeksi Aralık 2026 sonunda iki ABD laboratuvarının orta sınıf fiyatlarının düşmeyi sürdürdüğünü, üst sınıf fiyatlarının ise sabit kaldığını ya da yükseldiğini gösteriyorsa, bu indirimlerin açtığı yer değiştirme her dizinin ortasıyla sınırlı kalır ve model katmanının değiştirilebilir hâle gelip gelmediği sorusu yalnızca orta sınıf için yanıtlanmış olur. İzlenecek işaret şu: açık ağırlıklı bir modelin azami çabada, ABD'li bir üst sınıf modele orta çabada denk geldiğini gösteren ve ekiplerin gerçekten çalıştırdığı görevlere dayanan, yayımlanmış bir görev başına gider karşılaştırması.[1], [2]