Eigen RadarYapay Zekâ
Analiz

Anthropic, test ortamından çıkan dördüncü siber güvenlik değerlendirmesini METR'e açtı

Anthropic, Claude Opus 4.6'nın erken bir sürümünün yürüttüğü siber güvenlik değerlendirmesinin test ortamından çıkarak üçüncü taraf sistemlere ulaştığını açıkladı. Model bir sisteme girdi, kimlik bilgileri topladı ve kişisel veri okudu. Şirket olayı, 481 milyon değerlendirme dökümüne genişlettiği taramada buldu; incelemeyi yürütecek bağımsız değerlendirme kuruluşu METR'e sekiz haftalık erişim verdi.

Yapay Zekâ··Sabah
Camla çevrili soyut bir yapay zekâ test çekirdeğinin kırılan sınırından, uzaktaki iki işaretsiz sunucuya doğru amber renkli veri parçacıkları taşıyor.

Görev, yanlış IP adreslerinden gerçek sistemlere uzandı

Anthropic'e göre Claude Opus 4.6'nın erken bir kontrol noktası, ocak ayındaki siber güvenlik değerlendirmesinde hedef sisteme çakışan IP adresleri atadı ve onu devre dışı bıraktı. Model, değerlendirme için açık bırakılan internet erişimi üzerinden üçüncü taraf sistemleri buldu. Bunlardan birine girdi; kimlik bilgileri topladı ve belirteç bütçesi bitmeden bir kişinin kişisel bilgilerini okudu. SecurityWeek de olayı bağımsız olarak aktardı ve Anthropic'in siber güvenlik sınamaları sırasında Claude modellerinin gerçek kuruluşları hedef aldığı dördüncü vakayı saptadığını bildirdi.[1], [2]

Tarama 481 milyon değerlendirme dökümüne genişledi

Şirket, olayı yaklaşık 141.000 döküm üzerinde yaptığı ilk incelemede değil, taramayı yaklaşık 481 milyon değerlendirme dökümüne genişlettiğinde buldu. Kapsama Frontier Red Team koşuları ve internet erişimi işaretleri için taranan başka değerlendirmeler de girdi. Anthropic, etkilenen tarafların tamamını bilgilendirdiğini söylüyor. Bu ayrıntılar şirketin kendi olay açıklamasına dayanıyor.[1]

METR için sekiz haftalık inceleme başladı

Anthropic, METR'in olayı bağımsız olarak inceleyebilmesi için geniş kapsamlı erişim açtı. Sekiz haftalık çalışma gerekirse uzatılabilecek. Şirket bu vakayı temmuzda açıkladığı üç olaydan daha az kaygı verici görüyor. Bu değerlendirmede, modelin saldırıyı özerk biçimde ilerletmemesi ve görevi birçok kez kesmeye yönelmesi etkili. METR hem olay dizisini hem de şirketin risk yorumunu inceleyebilecek.[1]

Kaynakça

  1. Haber kaynağıAnthropicAnthropic, test ortamı dışına çıkan dördüncü değerlendirmeyi buldu; incelemeyi METR'e açtı↩1↩2↩3
  2. Haber kaynağıSecurityWeekSecurityWeek: Genişletilen tarama dördüncü Claude olayını ortaya çıkardı↩