Aller au contenu

Vérifications de texte et d'image Claude

Détecteur IA Claude pour texte et images

L'onglet Texte lit l'écriture elle-même, donc il fonctionne sur la prose anglaise de Claude avec ou sans filigrane : 99,5 % des textes IA détectés avec un taux de faux positifs de 5 % sur RAID, un benchmark public que nous n'exécutons pas, avec 11 attaques adversariales dans le jeu de test. Slop or Not ne lit pas le filigrane SynthID-Text de Claude, car Anthropic n'a pas publié le détecteur correspondant. L'onglet Photo lit les C2PA Content Credentials, indique la source qu'il reconnaît et évalue les pixels quand aucune provenance lisible ne résout le fichier. Les vérifications en ligne tournent sur le serveur Mac privé de Numen, à l'écart des entreprises d'IA externes, et sont supprimées après traitement ; les vérifications dans l'app iPhone et Mac s'exécutent sur l'appareil.

Filigrane Claude : fonctionnement et limites de ce qu'il prouve

Détecte 99,5 % des textes générés par IA avec un taux de faux positifs de 5 %, selon RAID, le benchmark public, pas selon nous.

Collez un paragraphe ou une thèse entière. Les apps iPhone et Mac n'ont ni plafond de mots ni budget mensuel de mots.

  • Collez du texte en anglaisDissertations scolaires, avis produits, légendes, articles et publications sur les réseaux sociaux jusqu'à 20 000 caractères.
  • RésultatUn verdict de probabilité, un score IA et une analyse de lisibilité.
  • ConfidentialitéSupprimé dès que la vérification est terminée. Nous ne conservons jamais votre texte.
Texte anglais uniquement. Supprimé après traitement.0/20000

Essayer un exemple

La détection d'IA est probabiliste. Les résultats peuvent varier avec les nouveaux modèles d'IA et les méthodes de contournement. Un texte humain au style formel peut être signalé comme de l'IA.

Évalué par un modèle transformer affiné, pas par un vérificateur de motifs de mots.

Ce qu'il vérifie

Lire l'écriture elle-même, sans clé de filigrane

Une vérification de texte qui lit l'écriture elle-même, donc un filigrane absent ou supprimé ne change rien : 99,5 % des textes IA détectés avec un taux de faux positifs de 5 % sur RAID, attaques adversariales incluses

Lecture des C2PA Content Credentials sur les images Claude, avec indication de la source quand Slop or Not en reconnaît une

Détection visuelle au niveau des pixels quand aucune provenance lisible ni aucun filigrane ne permet d'identifier le fichier

Bonnes utilisations

  • Vérifier une dissertation ou un devoir qui a peut-être été écrit avec Claude
  • Vérifier si une image Claude contient encore des Content Credentials C2PA
  • Vérifier une image Claude par ses pixels quand aucune provenance lisible ne permet de résoudre le fichier

Limites à connaître

  • Slop or Not ne lit pas le filigrane SynthID-Text de Claude, donc son verdict textuel est une probabilité de classification plutôt qu'une lecture de filigrane
  • La détection de texte fonctionne uniquement en anglais, et les passages courts, factuels, riches en code, relus ou réécrits laissent moins d'indices au classificateur
  • Les credentials C2PA peuvent être supprimés. Slop or Not les lit et indique la source reconnue ; le lecteur doit décider si cet historique pointe vers Claude. Même dans ce cas, cela appuie une implication ; cela ne prouve pas la paternité, la propriété, la véracité du contenu, l'origine IA de chaque pixel ni un historique inchangé

FAQ

Questions sur Détecteur d'IA Claude

Claude applique-t-il actuellement un filigrane à tous les textes ?

Pas nécessairement. Anthropic indique que les futurs modèles Claude généreront du texte filigrané et que les anciens modèles seront mis à jour dans les prochains mois. L'entreprise n'a pas publié de tableau de déploiement modèle par modèle, donc la date d'une réponse ne suffit pas à prouver la présence de la marque.

Slop or Not peut-il lire le filigrane textuel de Claude ?

Non, et il n'en a pas besoin. Anthropic indique que la marque de Claude est une version de SynthID-Text : un motif statistique secret créé par des choix de tokens ordinaires, lisible uniquement avec le détecteur d'Anthropic. Une lecture de filigrane cesse aussi de fonctionner dès que la marque est absente, supprimée ou éliminée par paraphrase. L'onglet Texte lit plutôt l'écriture elle-même, c'est pourquoi il a détecté 99,5 % des textes IA avec un taux de faux positifs de 5 % sur RAID, avec 11 attaques adversariales dans le jeu de test. Le verdict est une probabilité, pas une preuve.

Pourquoi les réponses courtes, factuelles ou riches en code sont-elles plus difficiles à marquer ?

La marque a moins de marge quand Claude a peu de choix de mots raisonnables. Anthropic indique que les échantillons courts, les passages factuels, le code et les corrections légères peuvent contenir trop peu de signal pour une lecture fiable. La même prudence s'applique aux résultats du classificateur sur les passages courts ou fortement modifiés.

Le filigrane textuel peut-il identifier qui a utilisé Claude ?

Anthropic indique que le filigrane textuel ne contient aucune information d'identification et ne peut pas être rattaché à une personne, une organisation ou une conversation. Il teste l'implication probable de Claude, pas l'identité de la personne qui a utilisé Claude.

Comment Slop or Not vérifie-t-il les images Claude ?

Claude utilise les C2PA Content Credentials pour les fichiers image pris en charge, pas SynthID pour les images. Une attestation est une métadonnée de provenance signée jointe au fichier, pas un filigrane intégré aux pixels. Slop or Not lit l'attestation, indique la source qu'il reconnaît et analyse les pixels quand le fichier ne contient aucune provenance lisible. Le lecteur décide si cet historique pointe vers Claude; l'absence d'attestation ne prouve rien.

Que prouve le résultat d'un détecteur Claude ?

Un credential peut appuyer une implication de Claude quand l'historique qu'il enregistre pointe vers Claude. Slop or Not lit le credential et indique la source reconnue ; le lecteur l'interprète, et une visionneuse C2PA dédiée peut afficher toute la chaîne signée. C2PA ne prouve pas qui a créé le fichier ni qui le possède, si son contenu est vrai, si chaque pixel est généré par IA, ni si l'historique est inchangé. Le résultat d'un classificateur de texte est une probabilité. Un filigrane ou un credential manquant ne prouve rien.

Les nettoyeurs de filigrane Claude fonctionnent-ils ?

Méfiez-vous de tout outil qui annonce aujourd'hui un résultat de filigrane Claude propre. WatermarkDetector.com recherche l'Unicode caché et l'espacement, mais la marque textuelle de Claude ne contient aucun caractère caché. watermarks-remover effectue un vrai nettoyage Unicode et des métadonnées, et peut réécrire le texte, mais sans le futur détecteur d'Anthropic, il ne peut pas prouver que le motif de choix de tokens a disparu. Retirer le C2PA d'une image laisse aussi ses pixels disponibles pour l'analyse.

Lancez la prochaine vérification sur votre iPhone ou Mac

L'app Slop or Not vérifie les images et le texte sur l'appareil, donc rien de ce que vous vérifiez ne quitte votre appareil.