Supprimer les caractères invisibles
Collez un texte, récupérez-le sans caractères de largeur nulle, espaces exotiques, traits d'union conditionnels, contrôles bidi ni lettres sosies, avec un compteur par catégorie et chaque caractère retiré surligné. Rien ne quitte votre navigateur.
Rien n'est envoyé à un serveur : le texte reste dans votre navigateur, l'outil fonctionne hors ligne une fois la page chargée. Ctrl+Entrée lance le traitement.
- Retire U+200B à U+200D, U+2060, U+FEFF (largeur nulle), U+00AD (trait d'union conditionnel), U+202A à U+202E et U+2066 à U+2069 (bidi), les contrôles C0/C1, les sélecteurs de variante et les caractères tag
- Transforme les espaces insécables et exotiques (U+00A0, U+202F, U+2000 à U+200A, U+3000) en espace normale et garde les retours à la ligne
- Remplace les sosies cyrilliques et grecs (а, е, о, р, с, ο...) seulement dans les mots qui mélangent les alphabets : le russe ou le grec réel n'est pas touché
- Les caractères pleine chasse et les lettres mathématiques sont ramenés en ASCII si vous cochez ces cases
- Chaque catégorie peut être conservée : l'outil la compte alors et la montre dans la vue surlignée sans la modifier
Ce que l'outil trouve et retire
Un caractère invisible est un point de code qui n'occupe aucune place à l'écran ou qui ressemble trait pour trait à un caractère courant. Ils arrivent par copier-coller depuis des pages web, des PDF, des interfaces de chat et certains outils d'IA, et ils cassent les recherches, les correspondances de tableur, les URL, le code et les diffs. L'outil parcourt le texte une fois, position par position, et traite neuf familles :
| Catégorie | Exemples | Action par défaut |
|---|---|---|
| Largeur nulle | U+200B espace de largeur nulle, U+200C, U+200D liant, U+2060 gluon de mots, U+FEFF indicateur d'ordre des octets | Retiré |
| Espaces | U+00A0 insécable, U+202F insécable étroite, U+2007 espace tabulaire, U+3000 espace idéographique | Espace normale |
| Trait d'union conditionnel | U+00AD, invisible tant que la ligne ne coupe pas | Retiré |
| Contrôles bidi | U+200E, U+200F, U+202A à U+202E, U+2066 à U+2069 | Retiré |
| Caractères de contrôle | U+0000 à U+001F sauf tabulation et retours à la ligne, U+007F à U+009F | Retiré |
| Sélecteurs de variante et tags | U+FE00 à U+FE0F, U+E0000 à U+E007F | Retiré |
| Lettres sosies | Cyrillique а е о р с у х, grec ο ν | Lettre latine, mots mixtes seulement |
| Pleine chasse | A B C, 1 2 3, ! | ASCII |
| Lettres mathématiques | 𝗕 𝗼 𝗅 𝗱 (sans empattement gras), 𝘺 (italique) | ASCII |
Le liant U+200D n'est retiré que s'il ne colle pas deux emoji entre eux : les drapeaux et les emoji de famille restent entiers. Les tabulations et les retours à la ligne ne sont jamais touchés.
Mode d'emploi
- Collez le texte, ou cliquez sur Essayer avec un exemple pour voir un paragraphe piégé.
- Décochez une catégorie pour la garder : elle sera quand même comptée et surlignée, marquée comme gardée.
- Cliquez sur Nettoyer. Le résultat s'affiche avec un compteur par catégorie, un diff avant/après et le texte d'origine avec chaque occurrence surlignée et son point de code au survol.
- Copiez le résultat, téléchargez-le en .txt ou copiez un lien qui transporte vos réglages (jamais votre texte).
Pourquoi ces caractères comptent
Un espace de largeur nulle dans une adresse e-mail la fait rebondir. Une insécable entre deux nombres empêche un tableur de les lire. Un trait d'union conditionnel dans une référence produit casse une recherche. Les inversions bidi peuvent faire lire un nom de fichier à l'envers, un truc connu du hameçonnage. Des lettres cyrilliques dans un mot latin, c'est ainsi qu'on fabrique des domaines sosies et qu'on fait passer un texte entre les mailles d'un filtre de mots. Certaines interfaces d'IA laissent aussi des espaces de largeur nulle ou des insécables étroites dans ce qu'elles produisent : c'est pour cela qu'on passe un texte ChatGPT dans un nettoyeur avant de le publier. La page ChatGPT watermark remover explique ce que ces caractères sont, et ne sont pas.
Quand il vous faut plus
Si le texte porte aussi des résidus de Markdown, des guillemets courbes et des tirets cadratins, le nettoyeur de texte IA enchaîne ce balayage et les autres corrections en une passe. Pour ne remplacer que les tirets, utilisez l'outil supprimer les tirets cadratins. La version anglaise propose en plus un inspecteur Unicode qui liste chaque caractère avec son nom et son bloc.
Rien de tout cela ne touche un watermark statistique : cette marque vit dans le choix des mots et survit à tout nettoyage de caractères. Si c'est votre question, le suppresseur de watermark Claude explique ce qui s'applique.
Confidentialité
L'outil est un script qui s'exécute dans votre navigateur une fois la page chargée. Votre texte n'est envoyé ni à unmarker.io ni à personne, il n'est ni stocké ni journalisé. Seul le clic sur le bouton est compté, anonymement, pour savoir que l'outil sert.
Unmarker est un produit indépendant, sans lien avec Anthropic et non approuvé par elle.
Les questions qu'on nous pose
Qu'est-ce qu'un caractère invisible ?
Un point de code Unicode qui ne s'affiche pas (espace de largeur nulle, gluon de mots, indicateur d'ordre des octets, trait d'union conditionnel, contrôles bidi) ou qu'on ne distingue pas d'un caractère normal (espace insécable, a cyrillique). Ils survivent au copier-coller et cassent recherches, liens, code et correspondances.
L'outil retire-t-il les espaces insécables ?
Oui, quand la case Espaces est cochée (par défaut). U+00A0, U+202F et les autres espaces Unicode deviennent une espace normale. Les retours à la ligne et les tabulations sont conservés.
Va-t-il abîmer un texte russe ou grec ?
Non. Les lettres sosies ne sont remplacées qu'à l'intérieur de mots qui mélangent le latin et un autre alphabet, ou de mots entièrement composés de sosies dans un texte majoritairement latin. Une phrase en russe reste telle quelle.
Puis-je voir ce qui a été retiré ?
Oui. L'onglet Avant montre le texte d'origine avec chaque occurrence surlignée, sa catégorie en couleur et son point de code au survol. L'onglet Diff montre le changement ligne par ligne.
Mon texte est-il envoyé quelque part ?
Non. Tout s'exécute dans votre navigateur ; la page fonctionne hors ligne une fois chargée. Rien n'est stocké ni journalisé.
Cela retire-t-il un watermark d'IA ?
Non. Les caractères de largeur nulle ne sont pas ce qu'Anthropic ou Google utilisent pour marquer un texte d'IA ; ces marques sont statistiques, dans le choix des mots. Voyez le suppresseur de watermark Claude pour cette question.