Aucun upload, 100 % local, sans compte

Nettoyeur de texte Unicode

Collez du texte, voyez exactement quels caractères cachés sont présents, et retirez ceux que vous choisissez.

Comment fonctionne Nettoyeur de texte Unicode

Le nettoyeur de texte Unicode détecte et retire une liste fixe et nommée de caractères invisibles ou faciles à manquer dans un texte brut : espace, joint et anti-joint à largeur nulle et le word joiner, caractères de contrôle bidirectionnel, trait d'union conditionnel, espaces insécables ou atypiques, et (en option) guillemets courbes redressés en ASCII simple. Collez du texte, voyez exactement lesquels ont été trouvés et en quel nombre, choisissez quoi retirer, et copiez le résultat nettoyé. Rien de ce que vous collez n'est envoyé où que ce soit.

C'est un détecteur et un outil de retrait pour un ensemble SPÉCIFIQUE et documenté de caractères, pas un scanner de texte généraliste et pas un détecteur de texte généré par IA : il rapporte les signaux qu'il trouve réellement (un compte par catégorie), et un résultat propre signifie seulement que ces caractères précis sont absents de ce texte, rien de plus et rien sur qui ou quoi l'a produit.

Comment utiliser Nettoyeur de texte Unicode, étape par étape

  1. Collez le texte que vous voulez vérifier dans la zone de saisie.
  2. Consultez les compteurs affichés à côté de chaque catégorie de caractère (largeur nulle, contrôle bidi, trait d'union conditionnel, espaces atypiques, guillemets courbes).
  3. Activez les catégories à retirer, et éventuellement l'option « réduire les espaces et lignes vides répétés ».
  4. Copiez le texte nettoyé depuis la zone de sortie.

Cas d'utilisation courants

  • Nettoyer un texte copié depuis un PDF ou une page web qui porte des traits d'union conditionnels invisibles ou un espacement atypique avant de le coller dans un document.
  • Vérifier une candidature ou un article collé pour repérer des caractères à largeur nulle cachés, parfois utilisés pour tromper les détecteurs de plagiat ou les compteurs de mots.
  • Normaliser les guillemets courbes en guillemets droits avant de coller du texte dans du code ou un système attendant une ponctuation ASCII simple.
  • Retirer les caractères de contrôle bidirectionnel restés après un copier-coller de texte mêlant gauche-à-droite et droite-à-gauche.

Questions fréquentes

Est-ce un détecteur de texte généré par IA ?

Non. Il détecte une liste fixe et nommée de caractères Unicode invisibles ou trompeurs (caractères à largeur nulle, contrôles bidi, trait d'union conditionnel, espaces atypiques, guillemets courbes), rien sur le style d'écriture, et un résultat propre ne prouve pas qu'un texte est écrit par un humain ou par une IA. Considérez-le uniquement pour ce qu'il est : un outil de nettoyage au niveau des caractères.

Mon texte est-il envoyé à un serveur pour être analysé ?

Non. La détection et le nettoyage s'exécutent entièrement dans votre navigateur via une reconnaissance de motifs JavaScript classique sur le texte saisi ou collé. Rien n'est transmis nulle part, et la page continue de fonctionner hors ligne une fois chargée.

Que sont exactement les « caractères à largeur nulle » ?

Des caractères qui n'occupent aucun espace visible : espace à largeur nulle (U+200B), anti-joint et joint à largeur nulle (U+200C/U+200D), le word joiner (U+2060), un espace insécable à largeur nulle en ligne/BOM (U+FEFF), et le séparateur de voyelle mongol (U+180E). Invisibles dans un rendu normal, ils comptent pourtant comme de vrais caractères.

Que sont les caractères de contrôle bidirectionnel (bidi) ?

Des caractères invisibles qui changent le sens du texte pour du contenu mêlant gauche-à-droite et droite-à-gauche : les marques gauche-à-droite et droite-à-gauche, la paire embedding/override, et l'ensemble des isolats directionnels. Restés après un copier-coller, ils peuvent causer un rendu ou un réordonnancement étrange plus tard.

Pourquoi redresser les guillemets courbes est-il optionnel, pas activé par défaut ?

Les guillemets courbes (« typographiques ») sont une typographie légitime et intentionnelle dans la plupart des textes, donc les retirer est un choix stylistique, pas le nettoyage de quelque chose de cassé ; c'est une option pour que le comportement par défaut ne touche que des caractères réellement invisibles ou problématiques.

Cet outil retire-t-il TOUS les caractères invisibles possibles en Unicode ?

Non. Il cible cette liste spécifique et documentée : caractères à largeur nulle, contrôles bidi, trait d'union conditionnel, espaces atypiques et guillemets courbes. Il ne prétend pas repérer toutes les catégories possibles de caractères cachés du standard Unicode.