Eigen RadarYapay Zekâ
Analiz

Anthropic, Claude’un bulduğu açıklarla yayımlanan yamaları ayrı sayıyor

Anthropic’in 2 Ekim tarihli güvenlik panosu, 591 açık kaynak projesinde 6.157 açık bildirimi ve şirketin bildiği 516 yamayı ayrı ayrı gösteriyor. Claude modellerinin ürettiği aday bulgular, sonraki aşamalarda dış güvenlik uzmanları ve yazılım bakımcıları tarafından ele alınıyor. Bu sayımlar, olası bir hatayı bulmakla geliştiriciyi uyarmak ve düzeltmeyi yayımlamak arasındaki farkı aynı bildirim sürecinde görünür kılıyor.

Yapay Zekâ··Öğle
İki yazılım geliştiricisi, aydınlık bir çalışma alanında ekrandaki kod değişikliklerini birlikte inceliyor.

Bildirimler ve yamalar ayrı toplamlarla izleniyor

Claude yapay zekâ modellerini geliştiren Anthropic, eşgüdümlü güvenlik açığı bildirim panosunun 2 Ekim güncellemesini yayımladı. Pano, açık kaynak yazılımlarda bulunan olası güvenlik hatalarının proje bakımcılarına ulaşmasına kadar geçen süreci izliyor. Şirket, 591 projeye toplam 6.157 bildirim gönderildiğini ve bildiği kadarıyla 516 yama yayımlandığını açıklıyor. Sayılar kendi programına ait; Claude Mythos Preview’ın erken bir sürümü dâhil birkaç Claude modelinin çalışmasını kapsıyor.[1], [2]

İnsan incelemesi adaylarla doğrulanmış hataları ayırıyor

Dış güvenlik uzmanları aday bulguları yeniden üretmeye çalışıyor, önem derecesini değerlendiriyor ve bakımcılara gidecek bildirimleri hazırlıyor. Anthropic’in panosu, bu incelemeli yolu şirketin doğrudan gönderdiği bulgulardan ayırıyor. Bazı bakımcılar ön incelemeden geçmemiş bulguları istiyor; doğrudan bildirimlerde yanlış alarmlar bulunabiliyor. Doğrulanan bir hata daha önce bildirilmiş olabilir veya projenin dikkate aldığı tehditlerin dışında kalabilir. Bunlar, bakımcıların düzeltme kararını etkiliyor.[1]

Bildirim çizelgesi yayıma kadar iz bırakıyor

Bildirim çizelgesi, teknik ayrıntılar açılmadan önce bulguların kriptografik özetlerini yayımlıyor. Bildirimden sonra durum ve önem değerlendirmeleri ekleniyor; projelerin adları ile hata türleri bildirim süresi kapanınca açılıyor. Geri çekilen bildirimlerin özetleri silinmiyor. İnsanların ön inceleme ve değerlendirme kapasitesi, modellerin bulduğu hataların tamamlanmış bildirimlere dönüşme hızını sınırlıyor. Yamanın yayımlanmasıyla kullanıcıya ulaşması da ayrı aşamalar: bakımcıların düzeltmeyi çıkarması, kullanıcıların onu kurduğunu göstermiyor.[1]

Kaynakça

  1. Haber kaynağıAnthropic Frontier Red TeamAnthropic, Claude’un güvenlik açığı bildirimlerinin yeni bilançosunu yayımladı↩1↩2↩3
  2. Haber kaynağıVM Tech SolutionsAnthropic, Claude’un açık bildirim panosunu güncelledi↩