Guide d’utilisation du service de traduction du SMT (version BETA)


Caractère automatisé du traitement par l’IA

Le Service de Traduction repose sur un Système d’IA : toute traduction est produite de manière entièrement automatisée par un modèle de traduction neuronale. Le Modèle est issu de l’affinage de modèles de traduction neuronale alimentés par des corpus de Terminologies de santé de référence.

Fonctions du service IA

Le Service est accessible depuis le site du SMT, via la page « Traducteur médical basé sur l’IA » du menu «Services » .

Il permet, dans sa version actuelle :

  • la traduction automatique de termes du domaine de la santé, de l’anglais vers le français , selon le modèle de traduction sélectionné par l’Utilisateur parmi ceux mis à disposition par l’ANS ;
  • la saisie directe d’un terme à traduire, ou le chargement d’un fichier Excel (.xls, .xlsx) contenant une liste de textes à traduire, chaque ligne du fichier correspondant à un texte distinct (le texte devant figurer dans la première colonne) ;
  • l’affichage de la proposition de traduction et, sur option, de son Score de confiance (« Métriques d’évaluation ») et de traductions alternatives classées par niveau de confiance décroissant (« Traductions multiples ») ;
  • pour la traduction par fichier, la restitution d’un fichier Excel de résultats comportant, selon les options retenues,
  • l’affichage des Scores de confiance et les traductions alternatives, ainsi que, lorsque ces informations sont disponibles, les termes proches et le parent dans la hiérarchie.
  • l’affichages des sources terminologiques de référence dont sont issues les termes traduits;
  • la fonction de recueil d’évaluation de l’Utilisateur sur la qualité des traductions et les nouvelles propositions de traduction
  • la fonction de blocage de données sensibles

Lors de l’exécution d’une demande de traduction, le contenu soumis fait l’objet d’un contrôle des entrées, incluant la détection de données personnelles, puis est traduit par le moteur de traduction fondé sur le Modèle IA. Les retours formulés par les Utilisateurs sur les traductions sont conservés dans une base de feedbacks dédiée.

Figure 2 – Architecture fonctionnelle du Service.

Méthodes et modèle IA

Le Service repose sur un pipeline IA de construction et d’évaluation en cinq étapes, allant de la constitution d’un corpus de terminologies de référence jusqu’à l’évaluation des traductions par les experts terminologiques du CGTS, résumé par le schéma ci-dessous.

Figure 1 – Pipeline du Service, de la constitution du corpus à l’évaluation experte.

Le modèle de traduction utilisé est le modèle de NLP open source NLLB-200 proposé par Meta AI sur lequel nous avons couplé avec les données d’entraînement avec les terminologies de reférence disponibles dans le SMT dans sa version française traduite par nos experts en sémantique au CGTS.

Données utilisées

Les données corpus de terminologies selon les standards nationaux et internationaux.

Ensemble de donnéesVersion Volumétrie
ATCv 2026-026946
CIM11_MMSv 2026-0236984
CISP-2v 2019-051434
EMDNv1.28344
CIM-10-FR PMSIv 2025-01-0111443
ICFv 2026-011665
NCITv 2309d.1.0106602
ORDOv 2023-0715859
SMSVersion : 2026-0225888
SNOMED Edition françaiseVersion juillet 2025215769

Validation du Modèle

Le Modèle a fait l’objet d’évaluations de correspondance par rapports aux traductions de référence (« gold standards ») proposées par les experts terminologiques du CGTS.

Lors de la dernière campagne d’évaluation (janvier 2026), portant sur 755 termes répartis en sept catégories de données, le taux de correspondance exacte entre la traduction produite par le Modèle retenu et une traduction de référence a été le suivant :

Catégorie de donnéesTermes évaluésCorrespondance exacte IA vs gold standard
Maladies, constats cliniques et troubles17548,00 %
Anatomie, structures corporelles et échantillons8145,58 %
Organismes vivants12258,20 %
Actes, procédures et interventions médicales14632,14 %
Substances chimiques, pharmaceutiques, biologiques et médicaments15130,46 %
Ensemble des catégories75542,20 %
Figure 3 – performance du modèle de traduction IA en fonction des catégories de données

Une traduction qui ne correspond pas exactement à la référence n’est pas nécessairement erronée (elle peut notamment constituer une variante ou un synonyme acceptable). Les métriques complémentaires mesurées lors de cette même campagne sur l’ensemble des 755 termes confirment la proximité des traductions produites avec la référence : médiane des distances de Levenshtein de 3,0, médiane des similarités de Levenshtein de 0,90 et médiane de l’indicateur « sac de mots » de 0,71. Il n’en demeure pas moins qu’au regard de ces résultats, aucune traduction produite par le Service ne peut être présumée conforme à la terminologie de référence sans vérification.

Marquage et Indicateurs de confiance

Afin de rendre perceptible le caractère automatisé et probabiliste des traductions, l’interface du Service affiche, pour chaque résultat :

  • un Score de confiance associé à la traduction proposée, calculé automatiquement par le Modèle IA et affiché lorsque l’option « Score de confiance » est activée ; ce score est matérialisé par un code couleur allant du vert, pour les niveaux de confiance les plus élevés, au rouge, pour les plus faibles ;
  • un Score de confiance pour chacune des traductions alternatives, lorsque l’option « Traductions multiples » est activée, les propositions étant classées par ordre décroissant de confiance ;
  • lorsque ces informations sont disponibles, la mise en évidence des termes spécialisés au sein du texte traduit, ainsi que les champs lexicaux, termes proches et sources terminologiques du SMT correspondants.

Ces indicateurs constituent une information de transparence sur la difficulté de traduction et sur la fiabilité estimée du résultat. Ils ne constituent en aucun cas une garantie d’exactitude : un Score de confiance élevé n’exonère pas l’Utilisateur de l’obligation de validation humaine.

Evaluation des traductions et amélioration continue

L’interface du Service permet à l’Utilisateur d’évaluer chaque traduction proposée, y compris les traductions alternatives, au moyen d’un retour positif ou négatif. Tout retour négatif s’accompagne obligatoirement d’une proposition de traduction alternative et d’un commentaire expliquant en quoi la traduction proposée n’est pas satisfaisante.

Ces nouvelles propositions de traductions/remarques sont enregistrées dans une base de feedbacks dédiée.

Aucune donnée personnelle relative à l’Utilisateur à l’origine du retour n’y est enregistrée.

L’ANS consulte régulièrement ces retours afin d’identifier les champs lexicaux et domaines médicaux insuffisamment bien traduits, et d’améliorer le Modèle IA et le Service en conséquence.

En soumettant un retour, l’Utilisateur participe à l’amélioration du modèle IA; il autorise l’ANS à l’exploiter librement à ces fins d’amélioration.

Bonnes pratiques d’utilisation

Le Service de traduction fourni par l’ANS peut comporter des erreurs associées au contexte d’usage, il peut ne pas être adapté à un besoin particulier, une validation humaine est toujours nécessaire.

  • La qualité du Contenu soumis (orthographe, abréviations, contexte) peut altérer de manière significative la qualité du Contenu traduit.
  • L’Utilisateur s’engage à ne faire figurer aucune donnée à caractère personnel dans ses propositions de traduction et commentaires.
  • Validation humaine : Toute utilisation d’un Contenu traduit à des fins professionnelles, et en particulier toute réutilisation dans un contexte de soin, de documentation médicale, de production réglementaire ou de publication, doit être précédée d’une relecture et d’une validation par une personne disposant des compétences linguistiques et métier appropriées. Les Scores de confiance et indicateurs affichés par le Service ont vocation à orienter et prioriser cette relecture, non à s’y substituer.
  • Tout Contenu traduit restitué par le Service est, par construction, un contenu généré par intelligence artificielle et doit être traité comme tel par l’Utilisateur, notamment lorsqu’il est réutilisé, diffusé ou intégré dans d’autres documents.

Limitation technique

L’utilisation du Service est soumise aux limites suivantes :

  • en mode texte, le texte soumis ne peut excéder 200 caractères ; ce contrôle est réalisé dans l’interface et vérifié côté serveur ;
  • en mode fichier, seuls les fichiers Excel (.xls, .xlsx) sont acceptés et la taille du fichier est plafonnée ; un fichier trop volumineux ou non conforme n’est pas traité ;
  • au sein d’un fichier, toute ligne en erreur (texte trop long, présence de données personnelles, etc.) n’est pas traduite ; le motif de non-traduction est indiqué dans une colonne dédiée du fichier de résultats ;
  • L’ANS se réserve le droit de limiter le débit des requêtes, de mettre en file d’attente ou de rejeter des demandes en cas de sollicitation excessive du Service, afin d’en préserver la disponibilité pour l’ensemble des Utilisateurs.
  • Le Service est réservé à un usage conforme à sa finalité : l’aide à la compréhension et à la traduction de terminologies de santé. Tout usage automatisé excédant un comportement humain raisonnable, toute tentative de contournement des mesures de sécurité (y compris du module de détection de données personnelles), ainsi que toute utilisation du Service pour développer, entraîner ou commercialiser un service de traduction concurrent, sont interdits.