Hassabis, sınır yapay zekâ laboratuvarlarında bağımsız denetimi destekledi
Google başbilimcisi Demis Hassabis, Dario Amodei'nin sınır laboratuvarlarına çalışan düzeyinde sürekli erişimi olan bağımsız değerlendiriciler yerleştirme önerisini destekledi. The Decoder ve EL PAÍS, Hassabis'in yönü doğru bulurken ayrıntıların geliştirilmesi gerektiğini söylediğini; Google araştırmacısı Peyman Milanfar'ın ise hız sınırı gerekçesine karşı çıktığını bildiriyor.
Yapay Zekâ··Öğle
Hassabis yönü destekliyor, ayrıntıyı açık bırakıyor
Google DeepMind'ın kurucu ortağı ve Google'ın başbilimcisi Demis Hassabis, Dario Amodei'nin sınır yapay zekâ laboratuvarlarında kalıcı dış değerlendiriciler bulundurma önerisinin doğru yöne işaret ettiğini yazdı. The Decoder ile EL PAÍS, Hassabis'in ayrıntıların hâlâ geliştirilmesi gerektiğini de belirttiğini aktarıyor. Bu destek, önerinin bütün uygulama koşullarında uzlaşma sağlandığı anlamına gelmiyor; ortak nokta, laboratuvarların kendi güvenlik beyanlarının dışarıdan sürekli incelenmesi.[1], [2]
Öneri dönemsel sınamadan sürekli erişime geçiyor
Amodei'nin ilk adımı, METR gibi dış değerlendirme kuruluşlarına çalışan düzeyinde sürekli erişim vermek. Böyle bir düzen, yalnızca yayımlanmaya hazır modeli sınamak yerine etkin geliştirme süreçlerini ve güvenlik uygulamalarını da izleme iddiası taşıyor. Hassabis bu yaklaşımı, Google'ın sınır yapay zekâ için sektör çapında bir standartlar organı önerisiyle ilişkilendirdi. Kaynaklar erişimin hukuki kapsamını, gizli bilginin nasıl korunacağını veya değerlendiricilerin yaptırım gücünü açıklamıyor; uygulamanın ölçüsü bu ayrıntılara bağlı kalıyor.[1], [2]
Hız sınırının gerekçesi tartışmalı kalıyor
Google araştırmacısı Peyman Milanfar, güvenilir biçimde kendini geliştiren sistemlerin yavaş, sönümlü ve kararlılık sınırları içinde kalacağını savunarak dışarıdan konmuş bir hız sınırına gerek olmadığını söyledi. Bu itiraz, bağımsız denetimin yararlı olup olmadığıyla model ilerlemesinin yavaşlatılıp yavaşlatılmamasını ayırıyor. Hassabis denetim yönünü desteklerken Milanfar tehlikenin teknik varsayımını sorguluyor. Kaynakların gösterdiği sonuç tam bir sektör uzlaşması değil; aynı öneri içinde erişim, ölçüm ve hız konusunda süren bir ayrışma.[1], [2]