GPT-6 Astra, Copilot’a gelirken güvenlik ölçümleri de tartışmaya açıldı
GitHub, GPT-6 Astra’yı ücretli Copilot katmanları ve desteklenen düzenleyiciler genelinde kullanıma açtı. Aynı modelle ilgili güvenlik haberi, sistem belgesindeki daha düşük halüsinasyon ve direnç sonuçlarının gizli istem enjeksiyonları karşısındaki açıklarla birlikte okunması gerektiğini gösteriyor. Dağıtım kademeli ilerliyor.
Yapay Zekâ··Sabah
Copilot kapsamı genişliyor
GitHub, GPT-6 Astra’yı Copilot Pro+, Max, Business ve Enterprise kullanıcıları için genel kullanıma açtı. Değişiklik günlüğüne göre model Visual Studio Code, Visual Studio, JetBrains geliştirme ortamları, Xcode, Eclipse, Copilot CLI, kodlama ajanı, github.com ve GitHub Mobile üzerinde seçilebiliyor. GitHub, dağıtımın kademeli ilerlediğini, bu nedenle modelin her hesapta hemen görünmeyebileceğini belirtiyor. Bu erişim listesi, duyurunun yalnızca tek bir düzenleyiciyle sınırlı olmadığını gösteriyor. Kullanıma açma, ücretli Copilot katmanları için duyuruldu. GitHub’ın metni modelin bu yüzeylerde seçilebildiğini söylüyor; hesapların erişim zamanı içinse kademeli dağıtım uyarısını koruyor.[2]
Uzun görevler için şirket açıklaması
GitHub, Astra’yı uzun ufuklu, özerk kodlama ve ajan görevleri için konumlandırıyor. Şirketin kendi testlerine dayanan açıklamasında modelin görev boyunca planlama ve doğrulama yaptığı, tanılama ile denetimi bir arada yürüttüğü ve işi bitirmeden önce sonuçlarını doğruladığı söyleniyor. GitHub ayrıca Astra’nın önceki OpenAI modellerine göre uzun soluklu kodlamada daha az adımda daha güçlü sonuç verdiğini aktarıyor. Ancak bu sayılar satıcının kendi denemelerinden geliyor. Değişiklik günlüğü bağımsız bir kıyaslama adı vermiyor. Bu nedenle duyuru, GitHub’ın test anlatımını sunuyor; bağımsız performans ölçümü olarak tanımlamıyor.[2]
Güvenlik ölçümlerindeki sınır
The Decoder’ın sistem belgesine dayandırdığı haber, Astra’nın GPT-5.6 Sol’a göre daha az olgusal hata bildirdiğini ve doğrudan istem enjeksiyonlarına karşı yüzde 99,99 savunma sonucu verdiğini aktarıyor. Aynı haberde Gray Swan’ın IPI Arena değerlendirmesinde dolaylı enjeksiyonlardaki başarısızlık oranı yüzde 8,5 olarak yer alıyor. Haberin ayrıntısında uyarlanabilir, birkaç turlu saldırılarda direncin yaklaşık yüzde 67’ye düştüğü de belirtiliyor. Bu ölçümler, GitHub’ın Copilot erişim duyurusundan ayrı bir güvenlik hesabı sunuyor. Dolayısıyla Copilot’a dağıtım haberi ile güvenlik haberi aynı modelle ilgilidir; ancak uzun görev performansı için GitHub’ın kendi testleri, enjeksiyon sonuçları içinse sistem belgesine dayanan ayrı raporlama vardır.[1], [2]