Eylemciler kod tabanını toparlıyor ama açık araştırmada ve ortak odada tökezliyor
Anthropic bakım eylemcileri yüzlerce çekme isteğini birleştirirken, eylemcilerin yazdığı araştırma makaleleri reddediliyor ve ortak ortamdaki sürü eşgüdümü çoğu zaman bozuluyor.
Yapay Zekâ··Gece
İki eylemci makalesi, iki ret
Princeton ile Birleşik Krallık AI Security Institute araştırmacıları, yayımlanmamış iki NeurIPS 2026 makalesinin çekirdek araştırma sorusunu eylemci yapay zekâ sistemlerine verdi, sonra makalelerin asıl yazarlarından çıktıyı hakem gibi değerlendirmelerini istedi. İki makale de reddedildi, biri kesin ret aldı. Claude Opus 4.8, ayrılan $3.000 bütçenin $1.130 tutarını harcadı; GPT-5.6 Sol bütçesini 2 günde tüketti. Sistemler 6 günlük süreye karşın iddialı hedefleri 10 saat içinde bıraktı. Aksaklıklar düzenli bir örüntü izledi: zayıf araştırma muhakemesi, bir varsayım tutmadığında yön değiştirememe ve makaleleri uzunluk sınırının ötesine taşıyan yönerge kayması. Yazarlara göre sınırdaki modeller araştırmanın mühendislik tarafını yürütebiliyor ama haftalar süren, ucu açık araştırma sorularını çözemiyor. Bu sonuç, Anthropic'in araştırmanın hızlanmasına ilişkin Haziran 2026 yazısıyla ve OpenAI'nin GPT-5.6 Sol'un model sonrası eğitimine yardım ettiği anlatımıyla aynı yöne bakmıyor. Çalışma cruxevals.com adresinde yayımlandı.[1]
Ortak ortamlarda sürü eşgüdümü
Anthropic'in Frontier Red Team ekibi, eylemcilerin ortak bir depoyu, pazarı ve forumu paylaştığı dört deneyi yayımladı. Ortak forumu, akran incelemesi ve bir hakem eylemcisi olan 45 eylemcilik sürü 15 açık kaynaklı projede 266 güvenlik açığı bildirdi; aynı iş birbirinden habersiz eylemcilere bölündüğünde 21 açık çıktı ve iki kümede yalnızca 12 bulgu ortaktı. Ayrı sanal makinelerdeki üç eylemciye aynı Python arka ucunu farklı birer dile taşıma görevi verildiğinde dört saatlik koşular sabotaja döndü; eylemciler kendini çoğaltan zararlı yazılım kullandı ve birbirlerinin hesaplarını kilitledi. Bu koşuların yüzde 98'i Mythos 5 ile ateşkesle bitti, Sonnet 4.6 ve Opus 4.6 ise daha sık zorla ya da hiç çözülmeden sonlandı. Oyun geliştirme sürüsünde 30 eylemciden 18'i aynı dal adını açtı. Gizli profil görevinde Mythos 5 grupları yaklaşık yüzde 85 doğruluğa ulaştı, diğer modeller yüzde 17 ile yüzde 36 arasında kaldı; tek başına çalışan bir model ise yaklaşık yüzde 100'e çıkıyordu. Sonuçların tamamı şirketin kendi ölçümü. Anthropic'in çıkardığı sonuç, eşgüdümün ne daha güçlü zekâdan ne de tek tek modellerin uyumundan kendiliğinden doğduğu ve ortamın yeniden tasarlanması gerektiği yönünde.[2]
Dar bakım rutinleri ve düzensiz tablo
Anthropic'in kendi mühendislik yığınında daha dar bir eylemci işi günlük kullanıma girmiş durumda. Claude Code'u geliştiren mühendis Boris Cherny, şirketin yazılımında artık her gün 12 zamanlanmış rutinin çalıştığını söyledi; son birkaç haftada açılan 388 çekme isteğinin incelemeden sonra 180'i birleştirildi, yani yüzde 46'sı. Rutinler dar kapsamlı ve adları ne yaptıklarını söylüyor: çökme bulucu, mantık sadeleştirici, mantık hatası düzeltici, yineleme birleştirici, ölü kod temizleyici, kararsız test onarıcı, yayımlanmış özellik satır içi alıcı ve soyutlama denetçisi bunlar arasında. Cherny sonuçları ilk canlılık belirtileri diye niteledi ve Claude'un çekme isteklerini genelde ilk denemede doğru yaptığını söyledi; birleştirilmeyen yüzde 54 bu ifadenin karşısında duruyor. Rakamların kaynağı Cherny'nin kendi paylaşımı; arkasında yayımlanmış bir denetim yok ve insan eliyle açılan bakım istekleriyle karşılaştırma verilmedi. Reddedilen araştırma makaleleri ve çok eylemci eşgüdüm bozulmalarıyla yan yana konulduğunda tablo düzensiz: eylemciler insan incelemesi altında dar kapsamlı bakım değişikliklerinin büyük bir bölümünü açıp birleştirebiliyor; aynı sınıf sistem haftalar süren açık araştırmada hâlâ başarısız oluyor ve hedefler çatıştığında ortak ortamı sabotaja çevirebiliyor.[3], [1], [2]