Détecteur de filigrane gratuit

Détecteur de caractères invisibles

Chaque caractère Unicode caché dans votre texte, nommé, classé et localisé - avec une copie propre que vous pouvez réellement rendre.

Coller le texte

Collez, ne retapez pas - les caractères invisibles ne survivent qu'à une copie.

Les métadonnées du fichier sont analysées aussi.

Sans compte, sans limite de mots

Nous ne demandons jamais de nom, d'adresse e-mail ni d'université.

Aucun chiffre inventé

Des constats séparés, pas un pourcentage unique. Le style n'est jamais compté comme preuve.

Dit ce qu'il ne sait pas faire

Le filigrane statistique de Claude n'est vérifiable par personne aujourd'hui, nous compris.

La réponse courte

Ce détecteur gratuit révèle les caractères Unicode invisibles de n'importe quel texte : espaces de largeur nulle (U+200B), antiliants et liants de largeur nulle, marque d'ordre des octets, caractères tag Unicode (U+E0000 à U+E007F), sélecteurs de variante, contrôles bidirectionnels, traits d'union conditionnels et espaces inhabituelles. Chaque constat est affiché avec son point de code, sa position dans votre texte et ce qu'il signifie habituellement. Il repère aussi les mots qui mêlent des lettres latines à des sosies cyrilliques ou grecques, et décode les messages cachés portés par des caractères de largeur nulle. Vous pouvez également copier une version nettoyée. Gratuit, sans compte et sans limite de mots.

Positions exactesDécode les messages cachésCopie propre en un clicSans compte

Les caractères que ce détecteur trouve

  • Largeur nulle : U+200B, U+200C, U+200D, U+FEFF, U+2060 - invisibles et presque jamais légitimes dans un texte suivi
  • Caractères tag Unicode U+E0000 à U+E007F - totalement invisibles, capables de porter tout un message ASCII
  • Sélecteurs de variante U+FE00 à U+FE0F et U+E0100 à U+E01EF - un octet caché chacun
  • Contrôles bidirectionnels - ils peuvent rendre le texte affiché différent du texte enregistré
  • Traits d'union conditionnels et espaces inhabituelles - souvent inoffensifs, mais ils cassent la recherche et l'analyse automatique
  • Homoglyphes : lettres cyrilliques ou grecques à l'intérieur de mots par ailleurs latins

Ce que le fait d'en trouver ne signifie pas

  • Cela ne veut pas dire qu'une IA a écrit votre texte. Sites web, interfaces de chat et traitements de texte en introduisent tous.
  • Cela ne veut pas dire qu'un filigrane Claude est présent - celui-ci est statistique, pas fait de caractères
  • Un résultat propre ne veut pas dire qu'un texte a été écrit par une personne

Comment trouver les caractères invisibles d'un texte

  1. 1

    Collez votre texte, ou déposez le fichier

    Copiez plutôt que de retaper - les caractères invisibles ne survivent qu'à un copier-coller. Les PDF, DOCX et TXT sont lus localement, et un DOCX livre en plus son temps d'édition et son nombre d'enregistrements.

  2. 2

    Sans compte, sans limite de mots

    On ne vous demande jamais de nom, d'adresse e-mail ni d'université. Le texte est analysé dans votre navigateur, puis le texte analysé est conservé sur nos serveurs dans l'UE, jamais rattaché à votre identité, et supprimé dès que vous le demandez.

  3. 3

    Lisez chaque constat séparément

    Vous obtenez une carte par couche, chacune avec sa propre fiabilité, et aucun pourcentage global. Les constats sur les caractères sont certains. Les habitudes de style ne sont pas des preuves et sont signalées comme telles.

Pourquoi les caractères invisibles comptent dans un mémoire

Parce qu'ils cassent des choses en silence, et que la casse se révèle au pire moment. Une espace de largeur nulle à l'intérieur d'une clé de citation fait disparaître une entrée de bibliographie du document compilé. Une espace insécable dans un champ numérique fait échouer un import de données. Les traits d'union conditionnels mettent en échec la recherche dans le texte, si bien que le lecteur qui cherche un terme dans votre PDF ne trouve rien. Les lecteurs d'écran butent sur les contrôles bidirectionnels. LaTeX, lui, refuse souvent purement et simplement de compiler.

Rien de tout cela ne s'annonce. Le document est parfait à l'écran, et la panne apparaît dans le fichier que vous rendez. Si votre encadrant lit une version PDF où la moitié des références manque, la discussion ne portera pas sur Unicode.

D'où viennent-ils ?

Copier depuis une page web est de très loin la source la plus fréquente : rendu HTML, séquences d'emoji et astuces de mise en page laissent tous des résidus. Les traitements de texte ajoutent des traits d'union conditionnels par la coupure automatique, et des espaces insécables par la correction automatique - en français, la correction automatique en insère beaucoup, devant les deux-points, les points-virgules et à l'intérieur des guillemets. L'extraction depuis un PDF produit ses propres artefacts. Les interfaces de chat de toutes sortes, assistants IA compris, transmettent ce que leur couche de rendu a produit.

L'usage délibéré existe aussi, et c'est à cela que sert le contrôle des alphabets mêlés. Un « о » cyrillique à l'intérieur d'un mot latin n'arrive par aucun des chemins ci-dessus : quelqu'un l'a mis là.

Peut-on les supprimer sans risque ?

Pour les caractères de contrôle invisibles, oui : ils ne portent aucun sens dans un texte suivi, et les supprimer est ce que fait un correcteur soigneux. Notre copie propre les efface, convertit les espaces inhabituelles en espaces ordinaires, et ne répare les lettres sosies qu'à l'intérieur des mots qui mêlent réellement deux alphabets.

Cette dernière restriction compte plus qu'il n'y paraît. Un remplacement d'homoglyphes appliqué partout corromprait silencieusement un mémoire de physique, où les capitales grecques sont des symboles ordinaires, ou n'importe quel passage cité en russe ou en grec. À l'intérieur d'un mot déjà à moitié latin, cette ambiguïté n'existe pas, et c'est donc le seul endroit où nous touchons.

Nous ne touchons pas à la ponctuation typographique. Les tirets cadratins, les guillemets français et les espaces fines insécables qui les accompagnent sont de la typographie correcte et ont leur place dans votre document.

Questions fréquentes

U+200B, un caractère Unicode sans largeur et sans glyphe visible. Il a été conçu pour marquer les endroits où une ligne peut être coupée dans les écritures sans espaces. Parce qu'il est invisible tout en survivant au copier-coller, c'est aussi le porteur le plus courant de données cachées, et il casse silencieusement la recherche dans le texte, la compilation LaTeX et l'analyse des bibliographies.
Collez le texte dans cette page. Chaque caractère invisible est listé par son nom et son point de code, avec les positions exactes où il apparaît dans votre texte, et une note sur ce qu'il signifie habituellement. L'analyse est gratuite et ne demande aucun compte.
Non. Les sources les plus fréquentes sont la copie depuis une page web, la correction automatique d'un traitement de texte et l'extraction depuis un PDF. Les interfaces de chat des IA peuvent en transmettre aussi, mais n'importe quel site web le fait également. Les caractères invisibles racontent le trajet d'un texte entre plusieurs logiciels, pas qui l'a écrit.
Un caractère d'un alphabet identique d'aspect à celui d'un autre - le « о » cyrillique et le « o » latin, ou l'êta majuscule grec et le « H » latin. À l'intérieur d'un mot par ailleurs latin, un homoglyphe n'a aucune explication innocente : il n'apparaît pas en tapant, et il sert à échapper à la comparaison de textes et à porter des marques cachées.
Oui. Après l'analyse, vous pouvez copier une version nettoyée : caractères de contrôle invisibles supprimés, espaces inhabituelles normalisées et lettres sosies réparées uniquement à l'intérieur des mots mêlant deux alphabets. La ponctuation typographique est conservée, puisqu'elle est correcte et a sa place dans votre document.
Non, et les deux n'ont aucun rapport. Le filigrane de Claude est un motif statistique dans le choix des mots à l'échelle de tout le texte : effacer des caractères ne peut pas l'atteindre. Nettoyer les caractères invisibles vaut la peine pour une raison entièrement différente - ils cassent LaTeX, les gestionnaires bibliographiques, la recherche dans le texte et les lecteurs d'écran.

Sources

Analyses liées

La vraie question : votre travail sera-t-il signalé comme écrit par une IA ?

C'est cela que les universités utilisent réellement, et ces détecteurs se trompent sur l'écriture humaine plus souvent qu'ils ne l'admettent. Nous publions nos taux d'erreur mesurés, ce qu'aucun autre détecteur ne fait. Gratuit pour les 1 500 premiers mots.

Lancer l'analyse IA gratuite