Eigen RadarYapay Zekâ
Analiz

Açık model yarışını indirmeler ve fiyatlar belirliyor

Qwen’in açık ağırlıkları ve indirme hacmi büyürken DeepSeek yeni sürümüyle fiyatları keskin biçimde artırıyor; OpenAI ile Anthropic ise Çinli rakipler karşısında orta sınıf modellerini ucuzlatıyor.

Yapay Zekâ··Gece
Şeffaf mavi model blokları dallanan kanallarda çoğalıyor; ortadaki metal terazi akışı, biri mercan tonunda yükselen, diğeri turkuaz inen iki basamaklı fiyat yoluna bağlıyor.

Küçük modeller dağıtımı taşıyor

Açık ağırlıklı modellerde görünürlük ile kullanım aynı yere akmıyor. Hugging Face’in yaz değerlendirmesinde, beğenilerde ilk 25 ve indirmelerde ilk 25 arasında yalnızca bir depo ortak. Buna karşılık gerçek kullanımın ağırlığı belirgin biçimde küçük modellere kaymış durumda: 1 milyar parametrenin altındaki modeller tüm zamanların indirmelerinin yüzde 83’ünü alırken 100 milyar parametrenin üzerindeki modellerin payı yüzde 1’de kalıyor. Bu dağılımın en büyük kazananı Qwen. Qwen’in GGUF biçimindeki aylık indirmeleri 39,6 milyon düzeyine ulaşmış; Gemma 20,8 milyon, Llama 7,5 milyon düzeyinde. Qwen tabanlı 151.448 türeve her gün yaklaşık 180-210 yeni depo ekleniyor. Alibaba’nın aynı gün yayımladığı Qwen 3.8 ailesi bu genişlemeyi yeni bir ürün katmanıyla besliyor. Apache 2.0 lisanslı aile, 27 milyar parametreli çok kipli yoğun model ile Qwen3.8-2.4T-A95B sürümünü Hugging Face ve ModelScope üzerinden indirilebilir kılıyor. Metin, görsel, video, şema ve belge işleyebilen 27 milyar parametreli modelin bağlam penceresi 262.000 belirteç; YaRN yöntemiyle 1 milyon belirtece doğru genişletilebiliyor. Qwen ekibi bu küçük modelin kodlama ve ofis işlerinde daha büyük Qwen3.7-Plus’ı geçtiğini söylüyor, ancak duyuruda bağımsız bir değerlendirme yer almıyor. İndirme hacmi ile düzenli sürüm akışı birlikte, açık model rekabetinde yalnızca en büyük modelin değil, yerelde çalıştırılabilen ve uyarlanabilen ailenin de belirleyici olduğunu ortaya koyuyor.[1], [3]

Orta sınıfta indirim, DeepSeek’te zam

Barındırılan modellerde aynı rekabet ters yönlü fiyat hareketleri üretiyor. OpenAI, GPT-5.6 Luna’nın milyon girdi belirteci başına ücretini 1 dolar düzeyinden 0,20 dolar düzeyine, çıktı ücretini 6 dolar düzeyinden 1,20 dolar düzeyine indirdi. Anthropic ise Claude Opus 5’i milyon girdi belirteci için 5 dolar, çıktı belirteci için 25 dolar fiyatla açtı; bu, Fable 5’in yarısı. Şirket ayrıca Sonnet 5 için eylülde planladığı zamdan vazgeçti. Silicon Data’nın endeksinde önde gelen ABD laboratuvarlarının modellerine ödenen fiyat temmuz ortasından beri neredeyse dörtte bir gerilerken DoorDash ve Airbnb, giderleri sınırlamak için Çin yapımı modelleri kullanmaya başladıklarını belirtiyor. DeepSeek ise V4-Pro-0813 ile başka bir yol seçti. 17 Ağustos’ta başlayacak yeni tarifede artış, modele, belirteç türüne ve günün saatine göre yüzde 50 ile yüzde 1.100 arasında; yoğun ve yoğun olmayan saatler ayrı fiyatlanacak. Önceki tarifede V4 Flash’ın milyon girdi belirteci başına girdi ücreti 0,14 dolar, çıktı ücreti 0,28 dolar olarak uygulanıyordu. Yeni Pro sürümünün eylemci yeteneklerinin geliştirildiği açıklansa da bağımsız ölçümler henüz bunun önceki tabloyu değiştirip değiştirmediğini söylemiyor. Böylece ucuz Çin modeli baskısı tek yönlü bir fiyat çöküşü yaratmıyor: ABD laboratuvarları orta sınıfta indirim yaparken DeepSeek, yeni sürüm ve zamana göre değişen tarifeyle kendi talebini daha yüksek gelire çevirmeyi deniyor.[2], [4]

Etiket fiyatı tek başına yetmiyor

Bu hareketleri tek bir ucuzluk sıralamasına çevirmek yanıltıcı olur. Bir model görevi daha az belirteçle ya da daha az denemeyle tamamlayabiliyor; çaba ayarı da kullanılan işlem gücünü değiştiriyor. Artificial Analysis’in aktarılan ölçümünde orta çabadaki Opus 5, başarım ve görev başına gider bakımından azami çabadaki Moonshot Kimi K3 ile eşleşiyor. Azami çabadaki GPT-5.6 Luna da azami çabadaki DeepSeek V4 Flash’a denk geliyor, fakat görev başına gideri neredeyse iki kat. DeepSeek’in yeni Pro sürümü için bağımsız sonuç bulunmaması, 17 Ağustos’taki zamların yetenek artışıyla ne ölçüde karşılandığını şimdilik açık bırakıyor. Açık ağırlıklı tarafta ise maliyet hesabı API tarifesinden taşınarak donanıma, barındırmaya, ince ayara ve işletim yüküne dağılıyor. Qwen’in 27 milyar parametreli modelinin daha büyük Qwen3.7-Plus’a karşı ileri sürdüğü üstünlük bağımsız olarak sınanmış değil; yine de küçük modellerin indirme payı ve türev sayısı, geliştiricilerin yalnızca duyuru sıralamalarına bakmadığını gösteriyor. Yarışın yeni dengesi bu nedenle iki ayrı dağıtım yolunda kuruluyor: indirilebilir aileler geniş lisans ve boyut seçenekleriyle geliştiricinin varsayılan akışına girmeye çalışıyor; kapalı hizmetler ise belirteç fiyatı, görev başına gider ve abonelik yapısıyla müşteri tutuyor. Fiyat başlığı dikkat çekse de asıl seçim, bir işin hangi modelle, kaç denemede ve kimin altyapısında tamamlandığına bağlı.[1], [2], [3], [4]

Kaynakça

  1. Haber kaynağıHugging FaceAçık modelde indirmeyi küçük modeller taşıyor, türevleri Qwen topluyor↩1↩2
  2. Haber kaynağıArs Technicaİndirimler orta sınıf modellere geldi, üst sınıfta fiyat yerinde duruyor↩1↩2
  3. Haber kaynağıThe DecoderQwen 3.8, Apache 2.0 lisansıyla indirilebilir ağırlıklarla çıktı↩1↩2
  4. Haber kaynağıTech Wire AsiaYeni sürümle birlikte DeepSeek fiyatları yüzde 1.100'e kadar artırıyor↩1↩2