Dünya modeli insan inancında tökezliyor, DeepMind eylemcileri EVE'e giriyor
MENTIS, inanç ve amacı dünya modeline ekleyerek eylem tahminini yükseltti. DeepMind uzun süreli EVE eylemcilerini çevrimdışı sınayacak; Honor'ın insansı robot koşusuysa CCTV aktarımına dayanıyor ve bağımsız zaman ölçümü bulunmuyor.
Yapay Zekâ··Akşam
MENTIS eylem tahminine zihinsel değişken ekliyor
Mental World Modeling yaklaşımı, yalnız fiziksel durumu benzeten dünya modellerine inanç, dikkat, amaç ve toplumsal ilişki gibi değişkenler ekliyor. Eğitim gerektirmeyen MENTIS düzeneği, 448 sahnelik Menti-Bench'te doğrudan yanıtın F1 puanını 63,3'ten 87,9'a yükseltti; insan başarımı 98,5. Düzenek içindeki GPT-4.1, 84,9 puanla kendi içinde tutarlılık kullanan doğrudan GPT-5.6-Sol kurulumunun 83,6 puanını geçti. Eylem, fiziksel taşıyıcı ile zihinsel yük olarak ayrıştırılıyor.[1]
DeepMind uzun süreli eylemi EVE'in çevrimdışı kopyasında sınayacak
Google DeepMind ile Fenris Creations'ın araştırma ortaklığı, sürekli öğrenen, hatırlayan, uzun vadeli plan yapan ve aynı anda çok sayıda oyuncuyla baş edebilen eylemcileri hedefliyor. İlk aşama, canlı oyunculara ulaşmadan önce EVE Online'ın çevrimdışı bir kopyasında yürütülecek. Ekipler daha önce, oyuncuların yazdığı bilgiyi yeni pilotlara aktarmak için Gemini kullanan Aura Guidance'ı yayımladı. Yeni ortaklık için başarım sonucu açıklanmadı; duyuru araştırma ortamını ve hedeflenen yetenekleri tanımlıyor.[2]
Honor'ın koşu derecesi bağımsız ölçüm bekliyor
Çin devlet yayıncısı CCTV, Honor'ın iki ayaklı Lightning robotunun Dünya İnsansı Robot Oyunları'nda 100 metreyi 9,32 saniyede koştuğunu bildirdi. Bu süre, Usain Bolt'un 2009'daki 9,58 saniyelik derecesinin altında. Al Jazeera haberi CCTV aktarımı olarak yayımladı; bağımsız bir zaman ölçümü bulunmuyor. Bu nedenle açıklanan derece, fiziksel hareket için dikkat çekici bir şirket gösterimi sunuyor ancak doğrulanmış bir spor kaydı gibi değerlendirilemiyor.[3]