Eigen RadarYapay Zekâ
Analiz

Meta, Muse Spark 1.3'ü kodlama araçlarına koyarken yapay zekâ kullanımını başarım değerlendirmesinden çıkarıyor

Meta, Muse Spark 1.3'ü Muse Code ve Meta Model API üzerinde kullanıma açıyor; en üst akıl yürütme kipini ek güvenlik sınamaları için beklemede tutuyor, açık ağırlık yayımını yol haritasında bırakıyor. Başarım değerlendirmesi için yayımlanan yeni yönerge, yapay zekâ kullanımına ve AI Native etiketlerine yapılan atıfları, sonuçların yapay zekâyla ya da başka yollarla desteklenebileceği ifadesiyle değiştiriyor; mühendislere benimseme panolarının ve belirteç sayılarının etkiyi ölçmeyeceği iletildi. Çalışanlara göre belirteç tüketimi artmayı sürdürüyor.

Yapay Zekâ··Öğle
Güneşli bir teknoloji kampüsü ofisinde, kodlama aracını kullanan bir mühendis ve yanında kablosu çıkarılmış, karanlık bir kullanım ekranı görülüyor.

Muse Spark 1.3 Muse Code'a ulaşırken, Hatch şirket içinde kalıyor

Meta, Muse Spark 1.3'ün Muse Code ve Meta Model API üzerinde kullanıma açıldığını, en üst akıl yürütme kipinin ek güvenlik sınamalarından sonra geleceğini ve açık ağırlık yayımının yol haritasında beklediğini söylüyor. Şirketin ikinci eylemcisi ise kamuya açılmadı: çalışanlar, kurumsal cihazlarda internette gezinebilen ve başka uygulamaları çalıştırabilen Hatch'i deniyor; kamuya açık sürüm bekleniyor. Üç çalışan bu denemeyi WIRED'a anlattı; şirket içi yönergeyi de aynı haber aktardı.[1], [2]

Meta'nın kendi tabloları daha az araç çağrısı ve daha az belirteç bildiriyor

Meta, aynı iş için Muse Spark 1.2'ye kıyasla yaklaşık yüzde 20 daha az araç çağrısı ve yaklaşık yüzde 25 daha az belirteç bildiriyor; düşmanca girdilere ve komut enjeksiyonuna karşı direncin arttığını da aktarıyor. Yayımladığı karşılaştırma tabloları eylemci, kodlama, yönerge izleme ve uzun bağlam görevlerinde GPT 5.6 Sol (max) ve Opus 5 (max) ile yarışıyor. Bu sayıların tamamı üreticiden geliyor ve duyuruya bağımsız bir sınama eşlik etmedi.[1]

Belirteç sayıları, Meta'da başarım değerlendirmesinden çıkıyor

Bu hafta yayımlanan yeni yönerge, yapay zekâ kullanımına ve AI Native etiketlerine yapılan atıfları, sonuçların yapay zekâyla ya da başka yollarla desteklenebileceği ifadesiyle değiştiriyor. Üç çalışan WIRED'a, değerlendirmelerin artık şirketin sohbet botlarını ve eylemcilerini ne kadar kullandıklarına bağlı olmadığını söyledi; mühendislere ayrıca şirketin etkiyi ölçmek için yapay zekâ benimseme panolarını veya belirteç sayılarını kullanmayacağı iletildi. Bir Meta sözcüsü, güncellemenin zaten geçerli olan uygulamayı yinelediğini ve AI Native etiketlerinin değerlendirmelerde hiç kullanılmadığını belirtti. Çalışanlara göre belirteç tüketimi yine de artmayı sürdürüyor.[2]

Kaynakça

  1. Haber kaynağıMeta AI ResearchMeta, Muse Spark 1.3'ü kodlama araçlarına verdi; en üst akıl yürütme kipini beklemede tutuyor↩1↩2
  2. Haber kaynağıWIREDMeta, başarım değerlendirmesinden yapay zekâ kullanımını çıkarırken çalışanlarını Hatch'i denemeye yönlendiriyor↩1↩2