Un traducteur XML traduit le texte lisible par l'homme situé entre les balises tout en préservant le balisage lui-même — ainsi, le fichier renvoyé est un XML bien formé que votre système peut ingérer, dans plus de 280 langues.
Vous indiquez à l'agent de localisation de logiciels de Smartcat quels éléments et attributs contiennent du texte traduisible — via XPath, une seule fois — et tout ce qui se trouve en dehors de ces chemins reste inchangé.
Nous avons rapidement constaté que Smartcat offrait exactement ce dont nous avions besoin : une mémoire de traduction, une plateforme centrale pour notre flux de travail, et la fin des e-mails interminables ou de la gestion fastidieuse de multiples fichiers. Tout — et tout le monde — fonctionne désormais ensemble au même endroit.
”Découvrir l'étude de cas →
La traduction XML consiste à traduire le contenu textuel d'un fichier XML tout en maintenant ses balises lisibles par machine. L'agent de localisation de logiciels de Smartcat utilise un analyseur XML configurable plutôt que de faire des suppositions.
Une exigence structurelle : le fichier doit contenir des éléments répétitifs, car chaque répétition devient un segment source.
Téléversez un fichier .xml ou plusieurs à la fois, y compris les exportations récurrentes.
Le XML est porteur de sens à des endroits qu'un traducteur polyvalent ne peut distinguer de la prose. Quatre choses se brisent :
Le mode de défaillance n'est pas une mauvaise traduction — c'est un fichier que votre import rejette à 17 h le jour du déploiement.
Concernant le comportement des entités et de l'encodage, nous préférons tester un fichier d'échantillon avec vous plutôt que de faire de vaines promesses. La configuration de l'analyseur prend en charge les deux éléments configurables — la traduction des balises et des attributs, et CDATA.
Règles que vous définissez une seule fois, par XPath
Pointez l'analyseur sur les éléments formant des segments dans la structure de votre fichier, ainsi que des chemins séparés pour les nœuds intraduisibles, les identifiants de chaînes, les commentaires et les limites de longueur par segment.
Configurez votre flux de produits, votre export CMS ou votre contenu d'aide une seule fois — chaque futur fichier ayant ce format suivra les mêmes règles.
Mettre à jour les segments par ID sans annuler les affectations
Le format XML est l'une des deux seules familles de formats — avec PO/Serge — où une version plus récente peut mettre à jour les segments par ID sans annuler les assignations de tâches.
Pour tous les autres formats, le remplacement d'un document permet de récupérer les traductions de la mémoire de traduction, mais annule les tâches, ce qui nécessite de réassigner les linguistes. La mise à jour ainsi que le re-téléversement consomment tous deux des Smartwords pour la retraduction.
Correspondance de mémoire de traduction par identifiant de clé à 103 %
Les identifiants de chaîne sont mappés selon leur propre chemin et utilisés pour une correspondance clé-ID à 103 %, là où les formats de document standard plafonnent à une correspondance contextuelle à 102 %.
Les commentaires peuvent être mappés de la même manière et présentés comme contexte de segment pour les réviseurs.
Plus de 280 langues, sortie bien formée
La structure n'est jamais modifiée, donc ce qui revient s'analyse syntaxiquement sans problème. Vous choisissez les langues cibles ; le balisage reste tel qu'il a été rédigé.
Les noms d'éléments et les noms d'attributs ne sont jamais traduits. Tout le reste est facultatif par défaut :
Valeurs d'attribut — non traduites à moins que vous ne désigniez cet attribut comme formateur de segment, vous pointez donc vers label et jamais vers id ou une valeur d'énumération.
Nœuds de texte — traduits lorsqu'ils forment des segments, et vérifiés par rapport à votre mémoire de traduction et à votre glossaire. Les nœuds intégrés non traduisibles peuvent être exclus par leur propre chemin.
Sections CDATA — configurable. Lorsque l'option Protéger les balises HTML dans les sections CDATA est activée, le code HTML situé à l'intérieur des sections CDATA est remplacé par des balises Smartcat ; lorsqu'elle est désactivée, ces balises apparaissent sous forme de texte modifiable.
Identifiants de chaîne et commentaires — chacun mappé par son propre chemin.
Limites de longueur — paramétrables par segment lorsqu'un schéma en aval plafonne un champ.
Cochez ou décochez la case CDATA en toute connaissance de cause, car si elle est désactivée, un traducteur peut modifier votre balisage.
La seule exigence structurelle concerne les éléments répétitifs : chaque répétition devient un segment, ainsi un document ponctuel sans structure répétitive n'est pas adapté à l'analyseur personnalisé.
Apportez un exemple d'exportation lors d'un entretien individuel avec notre équipe.
Le Marketplace de Smartcat vous met en relation avec des réviseurs expérimentés dans votre secteur d'activité ou votre marché cible. Utilisez notre système de mise en relation basé sur l'IA ou explorez les profils par spécialisation et évaluations.
XLIFF et TMX sont également du XML, et tous deux sont pris en charge. XLIFF dispose de son propre flux de travail et de sa propre page, l'éditeur de traduction XLIFF — et veuillez noter que Smartcat importe les formats XLIFF 1.2 et 2.0, tandis que l'exportation se fait uniquement en 1.2.
Vous localisez aussi du JSON ou du YAML ? Même projet, même mémoire de traduction — les ressources linguistiques sont associées au niveau du projet et s'appliquent à chacun de ses documents, avec une MT accessible en écriture par combinaison linguistique.
Si vous pilotez cela depuis l'IC, l'API prend en charge les mêmes plus de 50 formats que la plateforme :
XML, Android XML, RESX, LOCJSON, JSON, TJSON, YML, INC, INX, STRINGS et PROPERTIES parmi eux.
L'API de localisation logicielle exporte également json, structured-json, yaml, structured-yaml, ios-strings et android-xml.
Les exécutables et les scripts sont bloqués pour des raisons de sécurité.
Il n'y a aucune limite quant au nombre de fichiers pouvant être inclus dans un projet, de sorte qu'une exportation complète de paramètres régionaux est téléversée sous la forme d'un travail unique partageant un glossaire et une mémoire de traduction.
Le découpage n'a toujours pour seul but que la vitesse sur un seul très gros fichier, jamais le nombre de fichiers que vous envoyez.
Si vous livrez le même export XML à chaque version, la différence qui compte est ce qui se passe lors du deuxième téléversement.
Les traductions sont reportées et les linguistes restent assignés au lieu d'être réinvités à chaque sprint.
La création, la traduction, la révision et la livraison restent centralisées sur une seule plateforme, avec l'automatisation des étapes répétitives et des Smartwords consommés uniquement pour la retraduction.
Texte traduit, balises intactes, vos propres règles sur ce qui est considéré comme du texte — dans plus de 280 langues, avec des agents d'IA effectuant le travail au niveau de l'analyse syntaxique.
Gratuit pendant 15 jours avec 15 000 Smartwords et un accès complet aux fonctionnalités de traduction, sans carte de crédit.
Smartcat est une plateforme mondiale de contenu alimentée par l'IA conçue pour les entreprises qui ont besoin de faire évoluer leur contenu multilingue sur différents marchés.
Il réunit les agents IA, les mémoires de traduction et la collaboration humaine au sein d'un système unique, aidant les équipes à traduire des fichiers XML et d'autres contenus plus rapidement et plus précisément.
Un fichier XML (Extensible Markup Language) est un format textuel flexible qui organise et stocke des données à l'aide de balises personnalisées.
Il est conçu pour être lu aussi bien par les humains que par les machines, ce qui le rend utile pour structurer l'ensemble des éléments, des paramètres d'application aux supports de formation.
Les fichiers XML sont partout — du développement d'applications et de la localisation de sites Web aux systèmes de gestion de contenu (CMS) et aux plateformes d'apprentissage en ligne.
Ils sont le véritable moteur de la structuration de contenu et de l'échange de données entre les logiciels, les plateformes et les systèmes.
Le XML permet de garder des données complexes organisées et portables, c'est pourquoi on le retrouve dans la configuration d'applications, les exports de CMS, les flux de produits, les modules d'e-learning et le contenu SCORM.
Les équipes qui le traduisent sont généralement des équipes d'ingénierie, de contenu produit et de localisation, travaillant à partir d'un fichier généré selon un calendrier défini par un autre système.
Les agents d'IA sont des outils d'automatisation spécifiques à des tâches et adaptés aux flux de travail.
Les agents de Smartcat, comme l'agent de localisation de logiciels, sont conçus pour traiter les formats structurés comme le XML — en préservant l'intégrité des balises et en appliquant vos glossaires, afin que la localisation s'adapte à grande échelle sans l'intervention de développeurs.
Ils apprennent également des retours humains, ce qui favorise les gains de productivité et de qualité, même dans les flux de travail d'entreprise complexes.[1]
Oui, et le contrôle est le mécanisme plutôt qu'un paramètre simplement greffé par-dessus. Dans la configuration de l'analyse XML, vous indiquez un XPath pour les éléments formant des segments, et un nœud formant un segment peut être un élément, un attribut ou du texte.
Un attribut est traduit uniquement si vous le pointez — ainsi, label devient un segment tandis qu'id et les valeurs d'énumération n'entrent jamais dans l'éditeur. Vous pouvez également indiquer des chemins distincts pour les nœuds intraduisibles, les identifiants de chaînes, les commentaires et les limites de longueur.
Téléversez le fichier, puis définissez ce qui compte comme du texte.
La structure n'est jamais modifiée par le modèle d'analyse : les noms d'éléments et d'attributs restent inchangés, et seuls les nœuds ciblés par votre XPath deviennent des segments modifiables.
Le texte traduit est réécrit dans la structure d'origine, de sorte que le téléchargement est un XML bien formé avec la même structure que le fichier que vous avez envoyé.
Oui. Le format XML d'Android est pris en charge, et dans un projet de localisation logicielle, vous pouvez importer et exporter des chaînes avec leurs identifiants de clé — tout comme pour JSON, YAML et .strings d'iOS — ainsi <string name="checkout_cta"> conserve son name et R.string.checkout_cta est résolu dans chaque langue.
Les clés plurielles sont prises en charge au niveau du projet : une clé peut être créée avec toutes ses formes plurielles, et les pluriels sont exportés sous forme de chaînes compatibles avec ICU MessageFormat.
XML standard, XML Android, XLIFF et TMX, ainsi que des schémas personnalisés grâce à la configuration de l'analyse XML.
L'importation XLIFF prend en charge les versions 1.2 et 2.0, tandis que l'exportation se fait uniquement en 1.2, et XLIFF dispose de son propre flux de travail sur la page Éditeur de traduction XLIFF.
Pour un schéma personnalisé, l'analyseur est configuré une fois par structure de fichier plutôt que deviné — et il a besoin d'éléments répétitifs sur lesquels se segmenter.
Vous décidez, à l'aide d'une case à cocher : Protéger les balises HTML dans les sections CDATA. Vérifié, les balises HTML à l'intérieur du bloc CDATA sont remplacées par des balises Smartcat, afin que les traducteurs puissent les déplacer sans les altérer. Si elles ne sont pas cochées, ces balises apparaissent sous forme de texte modifiable. Pour tout ce qui est traité par une machine, laissez la case cochée.
Non — c'est un traducteur, pas un convertisseur de format. Il traduit le JSON et le XML chacun dans leur propre format ; consultez le traducteur JSON pour les fichiers de paramètres régionaux.
Oui — voir « Mettre à jour les segments par ID sans annuler les attributions » ci-dessus pour savoir ce qui se passe lors du deuxième téléversement.
Pour les pipelines, l'API Smartcat téléverse des fichiers et récupère des traductions, fonctionne de manière asynchrone avec des rappels de notification afin qu'une étape de build n'ait pas à attendre et interroger le système, et dispose d'une CLI pour le CI/CD. Trois conditions préalables :
Chaque méthode partage une limite de 4 requêtes par seconde, et la documentation est publique sur developers.smartcat.com.
Oui — chaque modification et révision est suivie dans l'Éditeur Smartcat. Vous pouvez revenir à des versions antérieures ou comparer les mises à jour entre les différents ensembles de langues, ce qui permet de maintenir la cohérence de la localisation au fil des versions.
Smartcat est conforme à la norme SOC 2 Type II. Les fichiers sont chiffrés en transit et au repos, les espaces de travail sont isolés par compte et les accès sont basés sur les rôles. Les détails se trouvent sur la page de sécurité.
La bonne formation provient du modèle d'analyse syntaxique — la structure n'est jamais modifiée.
La validité d'un schéma est en partie une propriété du contenu, et la traduction modifie le contenu : un champ que votre XSD limite à 40 caractères peut déborder, car l'allemand est couramment plus long que l'anglais.
Il existe un véritable contrôle précisément pour cela : la configuration de l'analyseur vous permet de définir des limites de longueur sur les segments, afin que les traducteurs voient le plafond pendant qu'ils travaillent plutôt qu'après l'échec de l'importation. Exécutez votre propre validation de schéma sur les premiers fichiers par paire de langues.
La traduction est mesurée en Smartwords, les répétitions faisant l'objet d'une remise, et la tarification varie en fonction du volume plutôt que du format de fichier.
Chaque forfait commence par 15 jours gratuits avec 15 000 Smartwords et un accès complet aux fonctionnalités de traduction, sans carte de crédit.
Pas abordé ici ? Réserver une démo — un échange individuel avec un ingénieur en localisation, sans engagement.
Oui. Téléversez et traduisez des fichiers XML directement depuis votre navigateur grâce à l'agent de localisation de logiciels de Smartcat — sans aucun téléchargement ni configuration manuelle.
Plus de 280 langues, y compris les dialectes et les écritures de droite à gauche.
Le plafond publié est global plutôt que spécifique au XML :
La contrainte concerne la taille par fichier, et non le nombre de fichiers que vous envoyez.
MIT News. (2024). Des chercheurs du MIT développent un entraînement à l'efficacité pour des agents IA plus fiables. news.mit.edu