Aller au contenu

Meta publie une reconnaissance vocale open source pour plus de 1 600 langues

Meta a publie Omnilingual ASR, une suite open source de reconnaissance vocale couvrant plus de 1 600 langues, dont plus de 500 jamais prises en charge auparavant, sous licence permissive.

Intelligence ArtificielleÉquipe éditoriale GNGV5 min de lecture

Meta a publie Omnilingual ASR, une suite de modeles open source de reconnaissance vocale automatique capables de transcrire la parole dans plus de 1 600 langues, dont plus de 500 qui, selon l entreprise, n avaient jamais ete prises en charge par aucun systeme. Les modeles et outils ont ete publies en novembre 2025 et mis a disposition gratuitement dans un depot de code public, abaissant la barriere pour que chercheurs et communautes developpent des technologies vocales pour des langues longtemps ignorees du marche.

A titre de comparaison, les systemes les plus utilises prennent generalement en charge environ 100 a 125 langues. La portee d Omnilingual ASR est bien plus large, et l equipe l a concu pour etre extensible : grace a une technique d apprentissage en contexte sans exemple prealable, le systeme peut etre oriente vers une nouvelle langue avec seulement quelques paires audio-texte, sans reentrainement complet. La suite va de modeles compacts pour appareils peu puissants a un modele de 7 milliards de parametres.

Fait important, les langues peu desservies n ont pas ete recoltees sur le web. Meta a rassemble des enregistrements communautaires via des partenariats locaux remuneres, en travaillant avec des organisations et des locuteurs dans des regions d Afrique et d Asie du Sud, et a publie un corpus de parole pour des centaines de langues a faibles ressources.

Des reserves subsistent. La precision varie fortement selon la langue. La reconnaissance vocale souleve aussi des questions de confidentialite et de consentement. Malgre tout, ouvrir des outils fonctionnant dans 1 600 langues est une avancee notable vers l inclusion numerique.

Sources

Continuer la lecture