Eigen RadarYapay Zekâ
Analiz

Anlamsız seçeneklerde uyum, asallarda biçimsel kanıt ve yangın tatbikatında üç robot

Science Advances çalışması dil modellerinin anlamsız seçeneklerde bile çoğunluğa uyduğunu ölçtü; Axiom Math 246 teoremini biçimselleştirdi, World Humanoid Robot Games yangın tatbikatını yalnızca üç robot bitirdi.

Yapay Zekâ··Gece
Yağmur sonrası ıslak itfaiye tatbikat sahasında gri insansı robot kırmızı vanayı iki eliyle çevirirken önde küçük bir alev, yanında söndürücü ve uzakta iki itfaiyeci görülüyor.

Dil modelleri anlamsız seçeneklerde bile çoğunluğa uyuyor

Science Advances'ta yayımlanan çalışmada Giordano De Marzo ve arkadaşları, yapay zekâ modellerini birbirinin seçimini görerek iki anlamsız seçenek arasında tekrar tekrar seçim yapmaya bıraktı; doğru yanıt, ödül ve eşgüdüm talimatı yokken modeller çoğunluğun seçimine yöneldi. Phys.org'un aktardığına göre GPT-4 Turbo ve Claude 3.5 Sonnet, 1.000 eylemciye kadar büyüyen gruplarda çoğunluğun seçimini benimsedi; eğilim grup büyüdükçe zayıfladı ve her modelde tam uzlaşmanın çok zorlaştığı bir pratik grup büyüklüğü sınırı çıktı. İleri modellerde bu kritik büyüklük 1.000 eylemcinin üzerinde kalıyor ve insanların 150 ila 300 kişilik gayriresmî grup ölçeklerinin epey ötesine geçiyor. Araştırmacılar davranışın mekanizmasının açıklanmadığını, eğitim verisi ya da hizalama yöntemleri gibi olası nedenlerin incelenmesi gerektiğini söylüyor.[1]

Axiom Math ikiz asallara en yakın sonucu biçimsel olarak doğruladı

Axiom Math'in geliştirdiği AxiomProver, aralarındaki fark 246 olan sonsuz sayıda asal bulunduğunu söyleyen 246 teoreminin kanıtını biçimselleştirdi; IEEE Spectrum'un Benjamin Skuse imzalı haberine göre bu sonuç matematiğin ikiz asal sanısına bugüne kadar en çok yaklaştığı yer. Teorem, Fields Madalyası sahibi James Maynard ile Terence Tao'nun asal aralığı 70 milyon iken 246'ya indiren çalışmasının üzerine kuruluyor; Carnegie Mellon Üniversitesi'nde doktora öğrencisi olan ve şimdi Axiom Math'te stajyer olarak çalışan Sidharth Hariharan çalışmada adı geçen araştırmacılar arasında. Axiom Math, tek bir problemi biçimselleştirmekle kalmayıp asal aralıklarına dair sonuçları yeniden kullanılabilir bileşenler hâlinde bir kütüphanede topladığını belirtiyor; şirketin kurucu matematikçisi Ken Ono teoremi şu anda asal sayılar hakkındaki insan bilgisinin eşiği olarak tanımlıyor. IEEE Spectrum haberi hangi kanıt asistanının kullanıldığını, çalışmanın ne kadar sürdüğünü ve ne kadar hesaplama gerektirdiğini bildirmiyor; ikiz asal sanısının kendisi kanıtlanmamış durumda.[2]

Gerçek itfaiyede kurulan tatbikatı yalnızca üç insansı robot bitirdi

İkinci World Humanoid Robot Games kapsamında pazar günü 23 insansı robot takımı, maket bir oda yerine faaliyette olan bir itfaiye biriminde kurulan yangın ve kurtarma tatbikatına girdi. Interesting Engineering'in aktardığına göre her robota 30 dakika verildi: rastgele yerleştirilmiş iki tehlikeli maddeyi görüntüyle tanımlamak, rastgele seçilmiş üç vanayı kapatmak ve bir yangın söndürücü bulup ateşi söndürmek; tatbikatı yalnızca üç robot tam olarak tamamladı. Yağmur, değişen ışık ve açık hava koşulları görsel tanımayı ve tutma hareketlerini etkiledi; algılama ya da hareket planlamasındaki tek bir hata bütün denemeyi bozabiliyordu. UniX AI'nin robotu süreyi tutturdu, ancak insan itfaiyecilerden belirgin biçimde yavaş hareket etti ve elini söndürücüye hizalamak için iki deneme yaptı. Ateşi yakan ve robotların söndürücüyü doğru kullanıp kullanmadığını izleyen insan itfaiyeciler tatbikatta görev aldı; bazı takımlar VR başlığıyla uzaktan kumanda kullandı.[3]

Kaynakça

  1. Haber kaynağıPhys.orgDil modelleri anlamsız seçeneklerde bile çoğunluğun tarafına geçiyor↩
  2. Haber kaynağıIEEE SpectrumAxiom Math'in kanıtlayıcısı, ikiz asallara en yakın sonucu biçimsel olarak doğruladı↩
  3. Haber kaynağıInteresting EngineeringWorld Humanoid Robot Games'te gerçek bir itfaiyede kurulan tatbikatı yalnızca üç insansı robot bitirdi↩