Reconnaître les dialectes arabes et transcrire la darija marocaine, même quand la conversation passe au français ou à l’anglais : voilà les deux premières réalisations annoncées par le Maroc et Mistral AI. Leur publication en open source est prévue prochainement.
L’annonce du ministère de la Transition numérique et de la Réforme de l’administration date du 29 septembre 2026. Elle donne un premier aperçu concret du partenariat signé avec l’entreprise française le 12 septembre 2025.
Ces travaux font partie de la stratégie Maroc Digital 2030 et de la feuille de route AI Made in Morocco. Leur intérêt est concret : développer des outils capables de traiter la langue que les gens parlent réellement.
Pourquoi la darija pose un vrai défi à l’IA
La darija, c’est l’arabe dialectal parlé au Maroc. Un système performant en arabe standard n’est pas automatiquement aussi efficace avec les différents dialectes. La diversité linguistique et le manque de données adaptées restent des difficultés pour la reconnaissance vocale.
À cela s’ajoutent les changements de langue au milieu d’un échange. Une conversation peut passer de la darija au français, puis intégrer une expression anglaise. Ce phénomène porte un nom : l’alternance linguistique, ou code-switching.
Pour une IA, reconnaître chaque langue séparément et suivre ces changements dans une même phrase sont deux problèmes différents. Il faut restituer les mots sans perdre le fil de ce qui est dit.
C’est précisément ce type d’échange que le modèle vocal annoncé cherche à prendre en charge. Sur le papier, l’objectif est bien choisi : permettre aux utilisateurs de parler naturellement.

Deux modèles, deux tâches bien précises
Le premier outil est un classificateur d’identification de la langue. Sa mission est de distinguer plusieurs dialectes arabes, dont la darija marocaine.
Ce type de composant peut aider une application à choisir le traitement adapté à la langue détectée. Identifier un dialecte est une étape utile pour construire ensuite des services de transcription ou de traduction.
Le second modèle repose sur Voxtral, la technologie audio de Mistral AI. Il est adapté à la reconnaissance automatique de la parole en darija. Autrement dit, il transforme ce qui est prononcé en texte, avec une prise en charge annoncée des passages entre arabe, français et anglais.
Les développeurs pourront s’appuyer sur ces composants pour concevoir leurs propres applications, lorsque les modèles seront accessibles.
Voxtral, ça sert à quoi exactement ?
Mistral a présenté ses premiers modèles Voxtral en juillet 2025. Cette famille comprend aujourd’hui plusieurs outils consacrés à la transcription, à la compréhension audio et à la génération de voix.
Il faut donc regarder la fonction précise de chaque modèle. Ici, le livrable marocain annoncé concerne la transcription de la parole.
Pour construire un assistant capable d’écouter une demande puis de répondre oralement, on peut combiner plusieurs composants : un modèle transcrit la voix, un modèle de langage prépare la réponse et un outil de synthèse vocale la prononce.
La qualité de la transcription compte dès la première étape. Si la demande est mal retranscrite, le reste du système risque de partir sur une mauvaise interprétation.
Cyberattaque CNSS au Maroc : Le Gouvernement Réagit… en Fermant Tout ?!
ça changera quoi au quotidien ?!!
Imaginez une personne qui décrit oralement un problème avec une livraison. Elle emploie la darija, quelques mots français et le nom anglais d’un produit. Une transcription adaptée pourrait aider un service client à traiter sa demande.
On peut aussi envisager des sous-titres pour des vidéos, des archives d’entretiens consultables par recherche ou des interfaces permettant de dicter un message.
Ces exemples sont des pistes d’application. Chacun demandera une intégration et des tests adaptés à son usage.
L’intérêt, pour une startup ou une équipe de recherche, serait de disposer d’une base technique réutilisable pour travailler sur ces besoins locaux.
Peut-on déjà télécharger ces modèles ?
Le communiqué annonce une mise à disposition en open source, mais précise aussi que les outils seront disponibles prochainement. Il ne fournit pas de lien de téléchargement ni de date précise.
Le principe de l’open source est de permettre à d’autres équipes d’utiliser et d’adapter ces outils. Pour les développeurs, il faudra connaître les modalités concrètes de publication : les fichiers accessibles, la documentation, les conditions de réutilisation et les moyens nécessaires pour les faire fonctionner.
L’accès aux modèles permettra aussi de les évaluer sur des enregistrements variés. Accents, débit rapide, bruit de fond, noms propres et changements de langue : c’est sur ces détails que leur utilité se jouera.
Le communiqué ne présente pas de taux d’erreur ni de comparaison chiffrée pour la version darija. Un nom, un montant ou une adresse mal transcrits peuvent suffire à compliquer une demande. Voilà le test concret qui attend ces outils.
