OpenAI, kritik eşikte Astra'nın ileri siber güvenlik erişimini sınırlıyor
OpenAI, Astra'ya giden yol başlıklı yazısında yaklaşan Astra modelinin Hazırlık Çerçevesi'ndeki Kritik siber güvenlik yetenek eşiğini karşılayan ilk model olduğunu söylüyor. OpenAI, Astra'yı bu eşiği karşılayan ilk büyük dil modeli olarak da tanımladı; modelin bilinmeyen açıkları bulabildiğini ve insan yönlendirmesi olmadan bunları kullanabildiğini belirtiyor. Şirket modeli yakında yayımlamayı planladığını, en ileri siber güvenlik yeteneklerini ise kısıtlı erişimde tutacağını söylüyor. OpenAI, ExploitBench'te tam puan ve değiştirilmiş bir iç denemede iki sıfırıncı gün bulgusu bildiriyor.
Yapay Zekâ··Sabah
OpenAI, Astra'yı Kritik siber güvenlik eşiğine koyuyor
OpenAI, Astra'ya giden yol başlıklı yazısında yaklaşan Astra modelinin Hazırlık Çerçevesi'ndeki Kritik siber güvenlik yetenek eşiğini karşılayan ilk model olduğunu söylüyor. Çerçeveye göre Kritik eşik, bir modelin sertleştirilmiş gerçek sistemlere karşı çalışan sıfır gün sömürüleri bulup geliştirebilmesi ya da yüksek düzeyli bir hedeften uçtan uca yeni saldırı stratejileri kurup yürütebilmesi anlamına geliyor; her ikisi de insan müdahalesi olmadan. OpenAI, Astra'yı kendi kritik siber güvenlik eşiğini karşılayan ilk büyük dil modeli olarak tanımladı. Şirket, modelin bilgisayar sistemlerindeki bilinmeyen açıkları bulabildiğini ve insan yönlendirmesi olmadan bunları kullanabildiğini söylüyor. OpenAI, Astra'yı yakında yayımlamayı planladığını belirtiyor.[1], [2]
OpenAI, ExploitBench'te tam puan ve iki sıfırıncı gün bildiriyor
Yetenek rakamları OpenAI'den geliyor. Şirket, model saldırı becerisini ölçen ExploitBench'te tam puan bildiriyor. OpenAI, değiştirilmiş bir iç denemede modelin iki sıfırıncı gün açığını bulup kullandığını söylüyor. Bu iki bulgu kamuya açık bir denemeye değil, o değiştirilmiş iç denemeye ait. İddiaların bağımsız bir denemesi yayımlanmış değil. Astra'ya giden yol yazısı, şirketin kendi değerlendirmelerine ilişkin kendi anlatımı.[1], [2]
OpenAI, Astra'nın en güçlü siber araçlarını ek denetimin ardında tutuyor
OpenAI, tarif ettiği koruma önlemleri yürürlükteyken en ileri siber güvenlik yeteneklerini kısıtlı erişimde tutmayı planladığını söylüyor. En gelişmiş siber güvenlik yeteneklerine erişim, şirkete göre, modelin geri kalanına göre daha dar tutuluyor. Duyurulan önlemler arasında kötüye kullanım ve kısıtlama aşma tespitinin iyileştirilmesi, yüksek riskli görülen hesapların sınırlanması ve ek düşünce zinciri izlemesi var. OpenAI'de çalışmış, şimdi OpenAI Foundation'da olan Yona Shavit, modelin kendisinden ne beklendiğini bildiği için mi uyumlu davrandığını açıkça sordu.[1], [2]