Eigen RadarYapay Zekâ
Analiz

TwelveLabs, Pegasus’a işi yapan kişinin gözünden video çözümlemeyi ekledi

TwelveLabs, kişinin veya robotun bakış açısından çekilmiş görüntüleri destekleyen Pegasus 1.6’yı çıkardı. Model, videoları yapılandırılmış açıklamalara ve zaman bilgisi taşıyan etiketlere dönüştürüyor; robot ekiplerinin veri hazırlaması kullanım alanları arasında. Güncelleme, mevcut bağlantıdan fotoğraf çözümlemeyi de sağlıyor ve kişiyle nesne tanımayı değiştiriyor. Geliştiriciler, fotoğrafla videoyu aynı model ve yönergelerle işleyebiliyor; önceki araçlarla yeni görüntü türlerini kullanabiliyor.

Yapay Zekâ··Gece
Arkadan görülen bir kişi, göğüs kamerası takılıyken masada küçük parçalarla çalışıyor.

Pegasus, işi yapan kişinin çektiği görüntüleri işliyor

Video anlama modelleri geliştiren TwelveLabs, birinci kişi görüntülerini destekleyen Pegasus 1.6’yı 6 Ekim’de çıkardı. Bu çekim biçiminde kamera, etkinliği yürüten kişinin veya makinenin bakış açısını izliyor. Pegasus, videoyu yapılandırılmış metne ve zaman bilgisi taşıyan etiketlere dönüştürüyor. Robot çalışmalarına yönelik kullanım, ekiplerin bu görüntüleri hazırlamasını ve incelemesini kapsıyor.[1], [2]

Vücuda takılan kameralar farklı bir bakış açısı sağlıyor

Önceki Pegasus kullanımlarında, güvenlik kamerası veya film çekimi gibi sahneye dışarıdan bakan görüntüler öne çıkıyordu. TwelveLabs, yeni örnekler arasında vücuda takılan kameraları, robot üzerindeki kameraları ve uzaktan yönetilen sistemleri sayıyor. Şirket, kişi ve nesnelerin tanınmasını da geliştirdiğini belirtiyor. Hareket görüntülerini etiketlemek, medya arşivlerini düzenlemek ve güvenlik görüntülerini incelemek açıklanan kullanım alanları; iyileşme değerlendirmesi geliştiriciye ait.[1]

Fotoğraflar mevcut video bağlantısından işlenebiliyor

TwelveLabs’a göre geliştiriciler artık fotoğrafları da video için kullanılan bağlantı ve model üzerinden gönderebiliyor. Şirket, ürün fotoğraflarıyla ürün videolarını veya ekran görüntüleriyle ekran kayıtlarını birlikte işlemeyi örnek veriyor. Mevcut kullanıcılar aynı geliştirme araçlarını ve yönergeleri kullanmayı sürdürüyor. Güncelleme, uygulamaların alabileceği görüntü türlerini ve işledikleri videoların bakış açısını genişletiyor. Duyuruda bu etiketlerin robotların görev tamamlama yeteneğini artırdığını ortaya koyan bağımsız bir çalışma sunulmuyor.[1]

Kaynakça

  1. Haber kaynağıTwelveLabsTwelveLabs, Pegasus 1.6’ya birinci kişi görüntüsü ve fotoğraf çözümlemesi ekledi↩1↩2↩3
  2. Haber kaynağıTokenPostTwelveLabs, birinci kişi videosunu çözümleyen Pegasus 1.6’yı çıkardı↩