ABD laboratuvarları orta sınıf fiyatı kırarken açık Çin modelleri kataloğu dolduruyor
OpenAI ve Anthropic orta sınıf API fiyatını düşürürken Hugging Face, Qwen ve Meta'nın açık ağırlıkları, alıcıya hem daha ucuz uç nokta hem ticari kullanıma açık model katmanı sunuyor.
Yapay Zekâ··Gece
Orta sınıf API indirimleri ve kurumsal fatura baskısı
OpenAI, orta sınıf GPT-5.6 Luna modelinin milyon girdi belirteci başına fiyatını $1'den $0,20'ye, milyon çıktı belirteci başına fiyatını $6'dan $1,20'ye indirdi. Anthropic, Claude Opus 5'i milyon belirteç başına $5 ve $25 ile, yani yayımlanmış Fable 5 fiyatının yarısına açtı ve bu hafta Sonnet 5 için eylülde planlanan zammı iptal etti. Silicon Data'nın belirteç fiyat endeksine göre önde gelen ABD modelleri için ödenen fiyat temmuz ortasından bu yana dörtte bire yakın geriledi; indirimler orta sınıf ürünleri kapsıyor, amiral gemisi modeller kapsam dışında kalıyor. Artificial Analysis, orta çaba ayarındaki Opus 5'in görev başına başarım ve giderde Moonshot'ın azami çabadaki Kimi K3 modeline yakın durduğunu, azami çabadaki GPT-5.6 Luna'nın ise DeepSeek'in azami çabadaki V4 Flash modeliyle benzer sonuç verdiğini ancak görev başına neredeyse iki kat pahalıya geldiğini buldu. DoorDash ve Airbnb faturaları dizginlemek için Çin yapımı modelleri kullanmaya başladıklarını açıkladı. Anthropic ve OpenAI yorum yapmayı reddetti; Anthropic'e yakın bir kaynak, Opus 5'in Fable 5'in altında konumlanmasının model ailesinin kuruluşundan geldiğini, rakiplerle ilgisi olmadığını söyledi.[1]
Hugging Face kataloğu ve Qwen3.8-27B
Hugging Face, 2026'nın ilk yedi ayında kendi platformunda gözlenen açık model etkinliğini derledi. Yılın neredeyse her ayında bir Çin laboratuvarının en büyük açık modeli, bir ABD laboratuvarının çıkardığı her şeyden büyüktü: Çin tarafında 754 milyar ile 2,78 trilyon parametre, ABD tarafında çoğu ayda 130 milyar parametrenin altı. 20 milyar parametrenin üzerindeki 178 Çin sürümünün yüzde 59'u Apache 2.0, yüzde 22'si MIT lisansı taşıyor ve hiçbiri ticari kullanımı kısıtlamıyor; ABD laboratuvarları kendi sürümlerinin yüzde 30'unda lisansı hiç belirtmemiş. İlgi dar bir yere toplanıyor: modellerin yüzde 85,6'sı ömrü boyunca 200 indirmenin altında kalıyor ve depoların yüzde 1,5'i tüm indirmelerin yüzde 99,2'sini topluyor. Qwen'in türev model sayısı 151.448'e çıkmış. Temmuz 2026'da platformdaki eylemci trafiğinin yüzde 44,4'ü Claude Code'a, yüzde 20,8'i Codex'e ait. Derleme yalnızca Hugging Face etkinliğini ölçüyor. Bu tablonun yanında Alibaba'nın Qwen ekibi Qwen3.8-27B'yi Apache 2.0 ile ve 262.144 belirteçlik doğal bağlamla yayımladı; YaRN ile 1.000.000 belirtece genişletilebiliyor. Model kartında SWE-bench Pro için 61,7, GPQA Diamond için 89,2 ve OSWorld-Verified için 84,3 yazıyor. Bunlar satıcı rakamları; bağımsız ölçüm yok.[2], [3]
Yerel eylemci model ve ortak fiyat-açık ağırlık tablosu
Meta, Muse Glimmer'ı Apache 2.0 ile yayımladı ve ağırlıkları Hugging Face'te duruyor: iş istasyonunda yerel çalışan eylemci döngüleri, araç çağrıları ve kodlama için 30 milyar parametreli bir model. Meta 24 ile 32 GB birleşik bellek ya da VRAM öneriyor; 4 bit nicemlenmiş kopya yaklaşık 17 ile 20 GB istiyor. Şirket SWE-Bench, DeepSearch QA, τ-Bench ve MCP-Atlas'ta sınıf için güçlü sonuçlar bildiriyor; çok adımlı araç kullanımında Gemma 4 31B ile Qwen 3.6 27B'den iyi olduğunu öne sürüyor. Karşılaştırmalar Meta'nın kendi ölçümü; bağımsız doğrulama yok. Meta ayrıca Apple Silicon ve NVIDIA RTX kartlarında DFlash ile üretim hızının 3,1 katına kadar arttığını belirtiyor. Ağırlıklar serbest lisansla geliyor; eğitim verisi ve üretim hattı dışında kalıyor. Orta sınıf API indirimleri, Hugging Face katalog anlık görüntüsü ve Qwen açık ağırlığıyla birlikte değerlendirildiğinde alıcılar daha ucuz ABD orta sınıf uç noktalarıyla ve yerel eylemci yığını da dahil ticari kullanıma açık bir açık model katmanıyla karşılaşıyor. Bu puanların bağımsız testlerde ne kadar tutacağı belirsiz; indirme yoğunlaşması da ilgiyi hâlâ ince bir depo dilimine yöneltiyor.[4], [1], [2], [3]