Eigen RadarYapay Zekâ
Analiz

OpenAI, korunan akıl yürütmeyi çıkarmaya yönelik girişimi açıkladı

OpenAI, modellerinin korunan iç akıl yürütmesini çıkarmaya yönelik temmuz girişimini kamuya açıkladı. Şirket çekirdek bir kümeyi Kimi geliştiricisi Moonshot AI ile ilişkili kişilere bağlıyor; bütün operatörlerin kimliği ise belirsiz. Açıklama hesap kısıtlarını ve teknik önlemleri de içeriyor. Verilen istek sayıları, başarıya ulaşmış çıkarımları değil girişimleri ölçüyor. Yeni gelişme saldırının gerçekleşmesi değil, kamuya duyurulması.

Yapay Zekâ··Öğle
Test tezgâhındaki bilgisayar donanımının yanında duran güvenlik analisti.

Eylüldeki açıklama temmuz faaliyetini anlatıyor

OpenAI, modellerinin korunan iç akıl yürütmesini çıkarmaya yönelik eşgüdümlü girişimi 30 Eylül’de açıkladı. Şirket, çekirdek bir kümeyi Kimi modelini geliştiren Moonshot AI ile ilişkili kişilere bağlıyor. Bütün operatörlerin tek bir aktöre bağlı olup olmadığı ise OpenAI’ye göre belirsiz.[1], [2]

OpenAI’ye göre gözlenen en erken faaliyet 1 Temmuz’da başladı. 24 ve 25 Temmuz’da 4.000’den fazla kullanıcıdan gelen 16.000 istekle yükseldi. Şirket, 15.000’den fazla kullanıcıdan oluşan ilişkili kümeyi 28 Temmuz’a kadar durdurduğunu söylüyor. Bu rakamlar başarıya ulaşmış çıkarımları değil, çıkarma girişimlerini sayıyor.[1]

Konuşma içeriği çıkarma girişiminde kullanıldı

Anlatılan yöntemde bir konuşmadaki şifreli akıl yürütme başka konuşmaya taşınıyor; modelden bunu çözmesi ve metne dönüştürmesi isteniyordu. OpenAI, operatörlerin şifrelemeyi kırmadığını, bir veri tabanını ele geçirmediğini ve saklanan kullanıcı konuşmalarına doğrudan erişmediğini belirtiyor. Bağımsız araştırmacılar da modeller arası geçiş ve konuşma sıkıştırmasıyla ilgili yollar bildirdi; şirket bunların gerçek olduğunu doğruladı.[1]

Hesap ve çıktı denetimleri sıkılaştırıldı

OpenAI, hesap yasakları ve kısıtları uyguladı; yeni hesap açma denetimlerini güçlendirdi ve akıl yürütmenin yeniden kullanılmasına karşı korumalar ekledi. Akış halindeki çıktılarda denetimler uygulandı. Bulgular, öncü model geliştiricilerinin işbirliği kuruluşu Frontier Model Forum üzerinden sektör ortaklarıyla paylaşıldı. Eylüldeki duyuru önceki faaliyeti ve önlemleri açıklıyor; o ay başlayan yeni bir girişim bildirmiyor.[1]

Kaynakça

  1. Haber kaynağıOpenAIOpenAI, akıl yürütme çıkarma girişimini açıkladı; Moonshot bağlantısı ileri sürüyor↩1↩2↩3↩4
  2. Haber kaynağıCellCogOpenAI, gizli akıl yürütmeyi çıkarmaya yönelik temmuz girişimini açıkladı↩