Eigen RadarYapay Zekâ
Analiz

Bodhan AI, Hint dillerinde eğitime dört açık model getiriyor

Bodhan AI ile AI4Bharat; konuşma tanıma, metinden konuşma, makine çevirisi ve optik karakter tanıma için dört açık ağırlıklı model yayımladı. Analytics India Magazine ile ETEducation, dil kapsamlarını ve egemen altyapıda sunulan arayüzlerin eğitim uygulamalarına nasıl açıldığını aktarıyor. Kaynaklar ayrıca modellerin NVIDIA Nemotron ailesi üzerinde kurulduğunu belirtiyor.

Yapay Zekâ··Öğle
Aydınlık bir üniversite dil laboratuvarında öğrenciler, kavisli masadaki mikrofon, hoparlör, karşılıklı konuşma düzeneği ve kart tarayıcıyla çalışıyor.

Dört görev, dört dil kapsamı

Bodhan AI ile AI4Bharat, Hint dillerinde eğitim araçları geliştirmek isteyenler için dört açık ağırlıklı model yayımladı. Konuşma tanıma modeli 27 dili, metinden konuşma modeli 23 dili, makine çevirisi modeli 22 dili ve optik karakter tanıma modeli 23 dili destekliyor. Analytics India Magazine, paketleri öğrenciler ve öğretmenler için dijital kamu malı olarak tanımlıyor. ETEducation da aynı dört görevi ve dil sayılarını bildiriyor. Böylece yayın, tek bir genel amaçlı model yerine ses, çeviri ve belge okuma işlerini ayrı modellerle kapsıyor.[1], [2]

Açık ağırlıkların yanında barındırma

İki haber, modellerin açık ağırlıklarla sunulmasının yanında barındırılan arayüzlere de sahip olduğunu aktarıyor. ETEducation, arayüzlerin egemen altyapıda çalıştığını; kuruluşların temel yetenekleri sıfırdan geliştirmeden Hint dillerinde uygulama kurmasının hedeflendiğini yazıyor. Analytics India Magazine ise barındırmada veriyi kimliksizleştiren yordamların kullanıldığını belirtiyor. Bu düzen, ağırlıkları kendi ortamında çalıştırmak isteyen geliştiriciler ile doğrudan arayüz kullanmak isteyen eğitim kurumlarına iki ayrı erişim yolu açıyor. Kaynaklar, gerçek kullanım ölçeğine ilişkin bir sayı vermiyor.[1], [2]

Nemotron'dan eğitim uygulamasına

Modeller NVIDIA'nın açık Nemotron ailesi üzerine kuruldu. Her iki haber de eğitim ve sunum katmanında NeMo, TensorRT-LLM ve vLLM bileşenlerini adlandırıyor. ETEducation, konuşma tanıma modelinin bölgesel lehçe ve aksanları kapsayacak biçimde sonradan eğitildiğini aktarıyor. Analytics India Magazine, AI4Bharat'tan Mitesh Khapra'nın ses ve görü modellerini dijital kamu altyapısı üzerinde erişime açılan kamu malları diye nitelendirdiğini bildiriyor. Somut ürün sınırı, yayımlanan görevler ve dil kapsamlarıdır; haberler sınıf başarımı ya da bağımsız bir doğruluk ölçümü sunmuyor.[1], [2]

Kaynakça

  1. Haber kaynağıAnalytics India MagazineBodhan AI ile AI4Bharat, Hint dilleri için dört açık ağırlıklı konuşma ve görü modeli yayımladı↩1↩2↩3
  2. Haber kaynağıETEducationBodhan AI, 27 Hint dilini kapsayan dört açık yapay zekâ modelini yayımladı↩1↩2↩3