Eigen RadarYapay Zekâ
Analiz

Mozilla, açık ağırlık gecikmesini 4,4 ay yazdı

15 Eylül tarihli State of Open Source AI v1.1, Moonshot'un Kimi K3 modelini Artificial Analysis'te Anthropic'in Fable 5 modelinin üç puan gerisine, listenin yaklaşık yüzde 30 fiyatına koyuyor ve METR ufku boşluğunu yaklaşık 4,4 ay ölçüyor. AI Chat Daily aynı puanları ve CTO Raffi Krikorian'ın kapalı modeller için sekiz-12 saatlik uzman iş penceresini tekrarlıyor.

Yapay Zekâ··Sabah
Aydınlık laboratuvar tezgâhında iki zıt endüstriyel ısı emici blok duruyor: önde büyük koyu metal blok, boş bir aralıkla geride daha küçük açık renkli seramik blok.

Kimi K3, Fable 5'in üç puan gerisinde

Ars Technica, Mozilla'nın yinelenen raporunun açık ağırlık dosyalarının indirilip çalıştırılabildiğini, eğitim verisi ve kodun çoğunlukla kapalı kaldığını vurguladığını yazıyor. Moonshot'un Kimi K3 modeli, Artificial Analysis Intelligence Index bileşik başarımında Anthropic'in kapalı Fable 5 modelinin üç puan gerisinde ve listenin yaklaşık yüzde 30 fiyatında. Mozilla, METR'nin yüzde 50 başarı zaman ufkunu yaklaşık 4,4 ay oturtuyor; kapalı sistemler şu an 8-12 saatlik işlerde önde, açık sistemler aynı banda dört ay sonra ulaşıyor. Vals AI ortak düzeninde Terminal-Bench 2.1'de Z.ai GLM 5.2, Claude Opus 4.7 ve 4.8'e bir puan içinde, tamamlanan iş başına yaklaşık beş kat düşük giderle geldi. OpenRouter'da Ağustos 2026 jeton hacmine göre ilk on modelin sekizi açık ağırlık.[1]

İkinci yazının manşeti de aynı 4,4 aylık boşluk

AI Chat Daily, 15 Eylül tarihli Mozilla raporuna dayanarak en iyi Çin açık ağırlık modellerinin ABD kapalı sınır sistemlerinin 4,4 ay gerisinde olduğunu söylüyor. Moonshot AI'nin Kimi K3 modeli, Fable 5'in Artificial Analysis Intelligence Index'te üç puan gerisinde ve giderin yüzde 30'unda. CTO Raffi Krikorian kapalı modelleri uzman iş, yoğun erişim ve uzun bağlam işleri için yararlı sayıyor; benzersiz kapalı pencereyi sekiz-12 saatlik uzman insan zamanı diye çerçeveliyor. Yansız Terminal-Bench 2.1 düzeninde GLM 5.2, Claude Opus 4.7 ve 4.8'e bir puan içinde, iş başına yaklaşık beş kat düşük giderle duruyor.[2]

İki metin de aynı Mozilla skor tablosuna oturuyor

4,4 aylık METR ufkı, Kimi K3'ün Fable 5'e üç puanlık farkı ve GLM 5.2'nin Terminal-Bench yakınlığı iki yazıda da duruyor. Ars Technica OpenRouter'daki açık ağırlık payını ve fiyat bandını sayıyor; AI Chat Daily Krikorian'ın sekiz-12 saatlik uzman penceresini öne çıkarıyor. Raporun kendi ölçümü bu; kimin üretimde önde olduğu ayrı bir soru.[1], [2]

Kaynakça

  1. Haber kaynağıArs TechnicaMozilla: açık ağırlık ile kapalı uç arasındaki boşluk 4,4 aya indi↩1↩2
  2. Haber kaynağıAI Chat DailyMozilla, açık ağırlık ile kapalı sınır modelleri arasındaki farkı 4,4 ay ölçtü↩1↩2