Masadaki iki metin
Elde iki metin var. Birincisi, OpenAI'nin 8 Eylül'de yayımladığı açıklama metni ile Lean dilinde biçimselleştirilmiş ispat. Şirketin matematikçisi Sébastien Bubeck'e göre bu ispatı üreten modelin eğitimi 28 Ağustos'ta başladı; 1.000'den fazla eylemci 50 saati aşkın süre çalıştı ve sayı 10.000'e kadar çıktı. Araştırma başkanı Mark Chen gereken işlem gücünü milyonlarca dolarlık bir gider olarak tarif etti. İspat hakemli bir dergide yayımlanmadı; ortada şimdilik incelenmeyi bekleyen bir metin duruyor.[1]
İkincisi, Tristan Buckmaster'ın itirazı. NYU'daki matematikçi, Anthropic araştırmacısı Levent Alpöge ile hazırladıkları ön bulguları pazartesi günü paylaştıklarını ve ilerlemelerine dair bilginin OpenAI'ye geçtiğini söylüyor. Buckmaster'a göre OpenAI araştırmacısı Sébastien Bubeck, uzlaşma önerilerinden birinde Alpöge'nin adının künyeden çıkarılmasını istedi; Bubeck bu iddiayı sosyal medyada reddetti. Buckmaster ayrıca şirket yöneticilerine ikilinin Codex günlük kayıtlarına erişilip erişilmediğini sorduğunu, modelin kullanıcı verisine bakmadığı yanıtını aldığını, eğitime ilişkin sorularının ise yanıtsız kaldığını aktarıyor.[2]
Şirketin kendi cümlesindeki açıklık
En dikkate değer cümle OpenAI'nin kendi yazısında geçiyor. Şirket, Levent Alpöge ve Tristan Buckmaster'ın çalışmalarındaki önceliğini tanıdığını belirtiyor ve ihtimali düşük görmekle birlikte, ikilinin ürünlerini kullanmasından türeyen kimliksizleştirilmiş verinin modellerini iyileştirmiş olmasını dışlayamadığını yazıyor. Bu cümle bir suçlamayı kabul etmiyor. Yaptığı iş daha dar: bir veri akışının ucunun açık kaldığını şirketin kendi ağzından tescil ediyor.[1]
Bu iki yanıt iki ayrı soruya karşılık geliyor. Bubeck ve şirket yöneticileri ikilinin istemlerinin okunmadığını ve çalışmanın kamuya açılmadan görülmediğini söylüyor; bu, doğrudan bir okuma iddiasına verilmiş bir yanıt. Yazıdaki cümle ise ürün kullanımından türeyen kimliksizleştirilmiş verinin modele girmiş olabileceğini açık bırakıyor. İki ifade birbiriyle çelişmiyor ve yan yana geldiklerinde bile bir veri akışını kapatmıyor. Bunun sıradan bir açıklaması da var: büyük bir eğitim havuzunda tek bir kullanıcının katkısını geriye doğru izlemek şirketin kendisi için de pratikte zor olabilir. Böyle bir durumda eksik olan şey izlenebilir bir döküm olur ve kötü niyet varsayımına gerek kalmaz.[1], [2]
Boşluğu kapatacak belge
Bu boşluğun biçimi tanıdık. 26 Temmuz'daki damıtma yazısında da tarif edilmiş bir yöntem vardı ve dayanağı görülebilir bir belgeye bağlanmamıştı; erişimle eğitim verisi arasındaki mesafe orada da kapanmadan kalmıştı. Buradaki fark, aynı mesafenin bu kez şirketin kendi cümlesiyle işaretlenmesi. Bir iddianın gücü, onu sınayacak belgenin varlığına bağlı kalıyor.[3], [1]
Bunu sınayacak belge dar ve adı konabilir: bu modelin eğitim havuzuna hangi ürün kullanım verisinin girdiğini, hangisinin dışarıda bırakıldığını tarihiyle gösteren bir veri kaynağı beyanı. OpenAI 31 Aralık 2026'ya kadar böyle bir beyan yayımlarsa, Buckmaster'ın sorusu bir açıklama tercihi olmaktan çıkıp denetlenebilir bir konuya dönüşür; yayımlamazsa elde yine iki taraflı bir anlatı kalır.[1]