Carnet · Note 003 · Contenu

L’IA laisse une empreinte différente dans chaque langue

Si tu traduis une liste anglaise de « mots qui sentent l’IA », tu obtiens une liste inutile. Un éditeur allemand ne repère pas les mêmes tics qu’un éditeur polonais.

Serhat Belen

Fondateur, BLN Global · · 6 min de lecture

Réponse courte

Si tu traduis dans une autre langue une liste anglaise de « mots d’IA », elle ne te servira à rien. Chaque langue a ses propres tics. En allemand, c’est la construction de la phrase qui gêne. En arabe, ce sont les erreurs de préposition héritées de la traduction. On a créé une liste pour chacune des neuf langues et mesuré 181 tournures sur 113 mille mots. Aucun dépassement. Mais réussir un contrôle ne suffit pas à bien écrire.

Le texte de ce site a été écrit en turc, puis décliné en neuf langues. Pas traduit. Réécrit pour chacune. Ça change tout: l’odeur de traduction et l’odeur d’IA finissent souvent dans la même phrase.

Les listes de « mots d’IA » qui circulent en ligne visent l’anglais : creuser, tissage, quand tout va vite. Traduire cette liste en allemand ne sert à rien. Ce qui fait tiquer un lecteur allemand, ce n'est pas le mot, structureest.

Chaque langue a sa corde

Pour l’anglais, tout le monde a déjà la liste : creuser, tissage, fluide, quand tout va vite. Ces mots, tout le monde les connaît. Le problème : la liste vise l’anglais.

En allemand, ce n’est pas le mot qui gêne le lecteur structuredır : empiler les noms à la place des verbes, se cacher dans le passif. En dialecte, autre chose accroche. En arabe, c'est encore différent. Le signal le plus net, c'est l'erreur de préposition qui fuit de la traduction. Elle montre que le texte n'a pas été écrit, mais traduit.

Nous avons bâti les listes des 9 langues une par une, à partir de leurs guides d'écriture et des débats entre éditeurs. On ne publie pas ces listes, elles font partie de ce qu'on vend au client. La vraie info n'est pas la liste : Traduire la liste anglaise ne suffit pas.

Le point commun: dans chaque langue, 'tel' est le motif le plus facile à retenir. Le modèle l’a appris par cœur parce que c’est ce qui revient le plus dans les textes.

Mesurer n’a rien à voir avec lire

Une fois la liste prête, impossible de se contenter d'une relecture à l'œil. Il y a 150 pages. On a écrit un contrôle qui compte les motifs. Voici le résultat :

EN · 15 pages · 13028 mots · conforme DE · 15 pages · 11968 mots · conforme FR · 15 pages · 13947 mots · conforme ES · 15 pages · 13298 mots · conforme IT · 15 pages · 13276 mots · conforme NL · 15 pages · 12730 mots · conforme PL · 15 pages · 11937 mots · conforme RU · 15 pages · 11544 mots · conforme AR · 15 pages · 11254 mots · conforme total des dépassements : 0
9 langues, 181 motifs, 112.982 mots. « Propre », ça veut dire : aucun motif n’a dépassé le seuil.

L’erreur vient de l’outil : il réduit le texte à une seule ligne

Au premier audit, les pages allemandes ont déclenché une alerte sur les tirets dans le texte. Le texte était correct. L'outil se trompait. En extrayant le texte du HTML, il remplaçait les balises par des espaces. Toute la page finissait sur une ligne et le signe entre un libellé et sa description semblait faire partie du texte.

s = re.sub(r'<[^>]+>', '\n', s) # balise = limite de bloc
Les balises sont devenues des fins de ligne, pas des espaces. La fausse alerte a disparu.

Deuxième fausse alerte : les guillemets polonais

Contrôle du polonais prenait ce caractère pour un signe d’IA. En polonais, c’est pourtant le guillemet fermant : „…”. Donc l’outil, la langue juste signalait cette graphie comme une erreur.

On a resserré la règle: la citation anglaise glissée dans le texte polonais est bien un signal, pas le guillemet fermant de la langue. Sur ce site, c’est la deuxième fois que la même leçon tombe: même dans l’audit d’accessibilité, un quart des alertes étaient fausses. Corriger le texte avant l’outil, c’est casser ce qui était juste.

Réussir l’audit ne veut pas dire que le texte est bon

Zéro infraction ne veut pas dire que le texte est bon. Cela indique seulement qu'aucun motif connu n'a été trouvé. Un texte peut passer toutes les listes et rester plat.

Le contrôle sert à ça: attraper ce qui t’a échappé et empêcher une même formule de s’installer en silence sur cent cinquante pages. Pour juger si le texte se lit bien, il faut encore une personne qui parle la langue. L’outil ne décide pas à sa place. Il lui fait gagner du temps.

Pour appliquer la même rigueur au produit AdForge rédige des pubs Tu peux regarder la page : là aussi, chaque texte généré passe un seuil avant publication.

FAQ

Pourquoi ne pas traduire la liste anglaise des mots d’IA ?

Ça ne marche pas. Cette liste rassemble des mots propres à l'anglais. En allemand, ce qui gêne le lecteur n'est souvent même pas un mot, mais la façon de construire la phrase. Une liste traduite attrape les mauvais signaux et laisse passer les vrais.

Si ton texte passe le contrôle, tu peux publier ?

Le contrôle dit seulement qu’il n’a pas trouvé de tournures connues. Un texte peut éviter toutes les listes et rester plat. Son rôle: repérer ce qui échappe à l’œil et empêcher une formule de se répandre en douce sur des centaines de pages. Pour savoir si ça se lit bien, il faut encore quelqu’un qui parle la langue.

Google pénalise-t-il les contenus générés par l’IA ?

Le mode de production compte moins que le but et la qualité. Google classe la production massive de contenus pour manipuler le classement dans sa politique antispam. Mais il n'interdit pas l'automatisation elle-même et te conseille de la signaler clairement quand elle a du sens.

Que faire quand un outil d’audit affiche une alerte ?

Commence par vérifier l’alerte. Chez nous, l’audit du polonais prenait le guillemet fermant propre à la langue pour une erreur. Sur les 24 alertes de contraste de l’audit d’accessibilité, 6 étaient aussi fausses. Une alerte avance une hypothèse, elle ne prouve rien. Corriger sans vérifier peut casser ce qui fonctionnait.

Sources

Projets liés