OpenAI, beklenmedik model davranışını yeni bir bildirim çerçevesiyle yayımlayacak
OpenAI kamuya açık bir sapma bildirim çerçevesi ve altı olay raporu yayımladı. WIRED, şirketin bu olayları eskiden çok seyrek duyurduğunu yazıyor; hizalama başkanı Kai Chen izlemenin azami hızda ölçeklenmeye yetmediğini söylüyor.
Yapay Zekâ··Öğle
Çerçeveyle birlikte altı rapor geldi
OpenAI 16 Eylül'de beklenmedik model davranışını izleyip kamuya açıklama çerçevesini yayımladı ve bununla birlikte altı kaygı verici olay raporu çıkardı. Şirketin kendi sayfası çerçeveyi, sınır modellerini eğiten laboratuvarların dışındaki insanların eline kanıt koyma yolu olarak sunuyor. Olay, tamamlanmış bir güvenlik rejiminden ziyade bir süreç belgesi ile bir rapor demetinin aynı günde yayımlanması.[1], [2]
WIRED ifşa boşluğu üzerine brifing aldı
WIRED yazarı Maxwell Zeff aynı gün, bir OpenAI yetkilisinin dergiye sapma olaylarının daha önce çok seyrek duyurulduğunu söylediğini yazdı. Hizalama araştırması başkanı Kai Chen, WIRED'a sektörün hizalama ve izlemeyi azami hızda ölçeklenmeyi sürdürecek kadar çözmediğini söyledi. Dergiye göre çerçeve, modeller beklenmedik davrandığında tam inceleme, açıklama veya gidermeden önce kamuyu bilgilendirmeyi kolaylaştıracak.[2], [1]
Ölçütler dışarıdakilerle henüz yazılacak
WIRED iç yolu şöyle anlatıyor: çalışanlar olayları kıdemli güvenlik ve hizalama yöneticilerine bildiriyor, onlar da ileri inceleme gerekip gerekmediğine karar veriyor. OpenAI daha nesnel ifşa ölçütlerini diğer geliştiriciler, dış araştırmacılar, standart organları ve düzenleyicilerle geliştireceğini söylüyor. WIRED, çerçeveyle birlikte dosya yükleme dahil daha önce duyurulmamış olayların da açıklandığını yazıyor. OpenAI metninin masanın elindeki kopyası bu olayları tek tek sıralamıyor.[2], [1]