Eigen RadarYapay Zekâ
Analiz

GPT-6.1 Sol kullanıma açıldı; Bedrock erişimi de başladı

OpenAI’nin GPT-6.1 Sol modeli 29 Eylül’de kullanıma açıldı; Amazon aynı gün modeli Bedrock hizmetine ekledi. AWS, yazılım geliştirme, belge işleme ve bilgisayar kullanımı gibi çok adımlı görevleri hedefliyor. Duyurudaki görev gideri ve başarım karşılaştırmaları OpenAI’nin ölçümlerine dayanıyor; gerçek üretim sonucu ise kuruma ve göreve bağlı.

Yapay Zekâ··Öğle
Veri merkezi rafına ağ kablosu bağlayan bir mühendis.

Yeni model, yeni erişim yolu

OpenAI, GPT-6.1 Sol modelini 29 Eylül’de kullanıma açtı; Amazon da aynı gün modeli Bedrock hizmetinde genel kullanıma sundu. Bağımsız haber modelin çıkışını doğruluyor, AWS duyurusu ise Bedrock erişimini belgeliyor. Bedrock, kuruluşların farklı modelleri uygulamalarına bağlayabildiği yönetilen bulut hizmeti. AWS modeli yazılım geliştirme, bilgisayar kullanımı ve belge işleme gibi çok adımlı işler için konumlandırıyor. Böylece kuruluşlar, yeni modeli AWS’nin mevcut erişim ve yönetim araçları üzerinden deneyebiliyor. Modelin duyurulması ile her kuruluştaki iş akışının güvenilir biçimde tamamlandığının gösterilmesi ayrı konular.[1], [2]

Görev nasıl hesaplanıyor

AWS, eylemcinin bir işi tamamlarken bilgi toplayıp araç kullandığını, bir hatadan döndüğünü ve sonucunu denetlediğini anlatıyor. Her adım yeni model çağrısı veya insan müdahalesi gerektirebilir. Bu nedenle şirket, bir görevin giderini yalnızca belirteç başına fiyatla açıklamanın eksik olduğunu savunuyor. Bedrock duyurusu, Codex’in GPT-6.1 Sol’u bu hizmet üzerinden kullanacak biçimde ayarlanabildiğini de belirtiyor. AWS’nin Agent Toolkit aracı geliştiricileri AWS belgelerine, arayüzlerine ve hizmetlerine bağlıyor. Bunlar kurulabilecek çalışma yolları; ekiplerin gerçek adım, gider ve inceleme yükü kendi kullanımına göre değişir.[1]

Başarım iddiasının kapsamı

AWS, DeepSWE v1.1 adlı yazılım geliştirme karşılaştırmasında GPT-6.1 Sol’un GPT-6 Astra’ya görev başına yaklaşık beşte bir giderle benzer puan aldığını OpenAI ölçümü olarak aktarıyor. Aynı açıklamada önceki GPT-6 Sol sonucuna göre 6,4 puanlık artış belirtiliyor. Bu sayılar satıcı kaynaklıdır ve belirli değerlendirme koşullarıyla sınırlıdır. Bedrock üzerinden genel erişim, modelin bir kurumsal uygulamaya teknik olarak bağlanabilmesini sağlar. Gerçek hata oranı, toplam gider ve insanın müdahale yükü ancak o uygulamanın kendi iş akışında ölçülerek anlaşılabilir; duyuruda böyle bir üretim değerlendirmesi yok. AWS’nin anlatımında bir eylemci işi bitirene kadar birden fazla araca başvurabiliyor ve sonucu yeniden sınayabiliyor. Böyle bir çalışma düzeninde düşük birim fiyat, başarısız deneme ve ek inceleme maliyetlerini tek başına açıklamaz. Şirketin Bedrock üzerinden sunduğu erişim, kurumların zaten kullandığı bulut denetimleriyle model çağrılarını yönetmesine olanak tanıyor. Araç çağrılarının doğruluğu ve hata sonrası toparlanma ise ayrıca ölçülmesi gereken sonuçlardır.[1]

Kaynakça

  1. Haber kaynağıAWS Machine Learning BlogGPT-6.1 Sol, Amazon Bedrock üzerinden kullanıma açıldı↩1↩2↩3
  2. Haber kaynağıTechCrunchOpenAI, GPT-6.1 Sol modelini kullanıma açtı↩