Meta meluncurkan Omnilingual Automatic Speech Recognition (ASR), sebuah paket model yang dirancang untuk menerjemahkan ucapan menjadi teks pada lebih dari 1.600 bahasa di seluruh dunia. Inisiatif ini ditujukan untuk memperluas akses teknologi pengenalan suara, khususnya bagi komunitas linguistik yang selama ini kurang terlayani oleh sistem ASR konvensional.

Secara teknis, Omnilingual ASR menggunakan pendekatan berbasis pemodelan akustik dan bahasa yang dilatih menggunakan data ucapan berskala besar. Sistem ini mencakup model dengan parameter besar untuk akurasi tinggi serta versi yang lebih ringan untuk kebutuhan komputasi terbatas. Meta juga menyediakan kemampuan few-shot learning, yang memungkinkan pengguna menambahkan dukungan bahasa baru hanya dengan menyediakan sampel audio dan teks dalam jumlah kecil tanpa proses pelatihan ulang model secara penuh.

Paket model ini tersedia secara terbuka melalui repositori GitHub dan platform Hugging Face di bawah lisensi terbuka. Pengembang dapat mengintegrasikan Omnilingual ASR ke dalam aplikasi mereka untuk kebutuhan transkripsi, aksesibilitas, dan pelestarian bahasa. Peluncuran ini menjadi bagian dari upaya Meta dalam membangun infrastruktur kecerdasan buatan yang lebih inklusif terhadap keragaman bahasa global.