Eigen RadarYapay Zekâ
Analiz

Google'ın yeni çeviri yazı modeli, daha dinlerken konuşmayı temizliyor

Gemini 3.5 Transcribe, 85'ten fazla dilde konuşmayı biçimlenmiş metne çevirirken dolgu sözcüklerini ve konuşmacının kendi düzeltmelerini ayıklıyor. Particle'ın Radar ürünü, 130.000'den fazla sesli yayını eylemcilerin sorgulayabildiği bir dizine dönüştürüyor. Amazon'un Las Vegas tesisindeki kitap tarama işi ise fiziksel yayınların veri kaynağına dönüşürken ortaya çıkan belirsizliği görünür kılıyor.

Yapay Zekâ··Sabah
Bir mikrofonun, renkli ve dağınık ses akışını saydam bir filtreden geçirip boş, düzenli metin parçalarına dönüştürdüğü kavramsal sahne.

Gemini 3.5 konuşmayı dinlerken düzenliyor

Gemini 3.5 Transcribe'ın akışlı ve akışsız sürümleri Gemini API'de genel kullanıma açıldı. Model, 85'ten fazla dilde konuşmayı biçimlenmiş metne çeviriyor; dolgu sözcüklerini ve konuşmacının kendi düzeltmelerini ayıklayıp en çok üç konuşmacıyı etiketliyor. Artificial Analysis, ortalama sözcük hata oranını akışlı sürümde yüzde 4,0, akışsız sürümde yüzde 2,6 ölçtü. FLEURS başarım ölçümünde oranlar sırasıyla yüzde 5,50 ve yüzde 5,04 oldu. Google, sonuçlanmış çeviri yazıya ulaşma süresinin önceki modele göre yüzde 70 kısaldığını söylüyor. Özel sözcük listesi en çok 1.000 terim alırken üçten fazla konuşmacı desteği deneysel kalıyor.[1]

Radar, sesli yayınları eylemcilerin sorgusuna açıyor

Particle'ın Radar ürünü, sesli yayın bölümlerini konuşmacı etiketleriyle çeviri yazıya döküyor; öne çıkan bölümleri ve konuşulan kişileri, şirketleri, markaları ve ürünleri çıkarıyor. Dizin, Apple'ın 135 kategorideki Top 200 listelerine giren yayınların tamamı dâhil 130.000'den fazla sesli yayını kapsıyor ve her gün 20.000 yeni bölüm alıyor. Web araması bireysel kullanıcıya açık olsa da şirketin sunduğu API ve MCP sunucusu, yapay zekâ eylemcilerinin bu malzemeyi doğrudan sorgulamasını sağlıyor. Particle, müşterileri arasında gazetecileri, araştırmacıları, veri satıcılarını, yapay zekâ arama platformlarını ve serbest fonları sayıyor.[2]

Amazon tesisinde kitaplar tarandıktan sonra atılıyor

404 Media'nın görüştüğü bir çalışan, Amazon'un Las Vegas'taki VGT3 tesisinde makinelerin gelen kitapların sırtını kestiğini, yaklaşık 20-25 yüksek hızlı tarayıcının gevşeyen sayfaları dijitalleştirdiğini ve kâğıtların ardından atıldığını anlattı. Çalışana göre malzemeler arasında yeni ve mühürlü kitaplar, kütüphane tasfiyelerinden gelen ciltler, Almanca, Rusça ve Japonca yayınlar ile University of London belgeleri vardı. Yayının daha önce bir nadir kitap sevkiyatına koyduğu takip cihazı da aynı tesise ulaşmıştı. 404 Media, taranan verinin hangi yapay zekâ şirketine gittiğini saptayamadı; Amazon haber için açıklama yapmadı.[3]

Kaynakça

  1. Haber kaynağıGoogleGoogle'ın yeni çeviri yazı modeli, daha dinlerken dolgu sözcüklerini ayıklıyor↩
  2. Haber kaynağıTechCrunchEylemciler için kurulan bir sesli yayın dizini, 130.000 yayını API ve MCP üzerinden açıyor↩
  3. Haber kaynağı404 MediaAmazon'un kitapları yapay zekâ eğitimi için tarayıp imha ettiği deponun içi↩