Zum Inhalt springen

Claude-Text- und Bildprüfungen

Claude KI-Detektor für Text und Bilder

Der Text-Tab liest den Text selbst und funktioniert deshalb bei englischer Claude-Prosa mit oder ohne Wasserzeichen: 99,5% der KI-Texte erkannt bei einer Falsch-Positiv-Rate von 5% auf RAID, einem öffentlichen Benchmark, den wir nicht betreiben, mit 11 adversarial attacks im Testsatz. Slop or Not liest Claude's SynthID-Text-Wasserzeichen nicht, weil Anthropic den Detektor dafür nicht veröffentlicht hat. Der Foto-Tab liest C2PA Content Credentials, meldet die erkannte Quelle und bewertet die Pixel, wenn kein lesbarer Herkunftsnachweis die Datei auflöst. Online-Prüfungen laufen auf Numen's privatem Mac-Server, getrennt von externen KI-Unternehmen, und werden nach der Verarbeitung gelöscht; Prüfungen in der iPhone- und Mac-App laufen auf dem Gerät.

Claude-Wasserzeichen: wie es funktioniert und was es nicht beweist

Erkennt 99,5 % der KI-Texte bei einer Falsch-positiv-Rate von 5 %, bewertet von RAID, dem öffentlichen Benchmark, nicht von uns.

Füge einen Absatz oder eine ganze Abschlussarbeit ein. Die iPhone- und Mac-Apps haben kein Wortlimit und kein monatliches Wortbudget.

  • Englischen Text einfügenSchulaufsätze, Produktbewertungen, Bildunterschriften, Artikel und Social-Media-Posts mit bis zu 20.000 Zeichen.
  • ErgebnisEin Wahrscheinlichkeitsurteil, ein KI-Score und eine Lesbarkeitsanalyse.
  • DatenschutzWird gelöscht, sobald die Prüfung abgeschlossen ist. Wir speichern deinen Text nie.
Nur englischer Text. Wird nach der Verarbeitung gelöscht.0/20000

Beispiel ausprobieren

KI-Erkennung ist probabilistisch. Ergebnisse können je nach neuen KI-Modellen und Umgehungsmethoden variieren. Menschliche Texte, die förmlich klingen, können als KI markiert werden.

Bewertet von einem feinabgestimmten Transformer-Modell, nicht von einem Wortmuster-Checker.

Was geprüft wird

Den Text selbst lesen, kein Wasserzeichen-Schlüssel nötig

Eine Textprüfung, die den Schreibstil selbst liest, sodass ein fehlendes oder entferntes Wasserzeichen nichts ändert: 99,5 % der AI-Texte erkannt bei einer False-Positive-Rate von 5 % auf RAID, inklusive adversarial attacks

C2PA Content Credential-Auslesung bei Claude-Bildern, mit Meldung der Quelle, wenn Slop or Not eine erkennt

Visuelle Erkennung auf Pixelebene, wenn weder eine lesbare Herkunft noch ein Wasserzeichen die Datei auflöst

Gute Anwendungsfälle

  • Einen Aufsatz oder eine Aufgabe prüfen, die möglicherweise mit Claude geschrieben wurde
  • Prüfen, ob ein Claude-Bild noch C2PA Content Credentials enthält
  • Ein Claude-Bild anhand seiner Pixel prüfen, wenn keine lesbare Herkunft die Datei auflöst

Wichtige Grenzen

  • Slop or Not liest Claude's SynthID-Text-Wasserzeichen nicht aus, daher ist sein Texturteil eine Klassifikator-Wahrscheinlichkeit statt ein ausgelesenes Wasserzeichen
  • Texterkennung funktioniert nur auf Englisch, und kurze, sachliche, code-lastige, korrigierte oder umgeschriebene Passagen liefern weniger Hinweise für den Klassifikator.
  • C2PA-Credentials können entfernt werden. Slop or Not liest sie und meldet die erkannte Quelle; der Leser muss entscheiden, ob diese Historie auf Claude verweist. Selbst dann stützt sie eine Beteiligung; sie beweist keine Urheberschaft, kein Eigentum, keinen Wahrheitsgehalt des Inhalts, keinen AI-Ursprung jedes einzelnen Pixels und keine unveränderte Historie

FAQ

Claude KI-Detektor-Fragen

Versieht Claude derzeit jeden Text mit einem Wasserzeichen?

Nicht unbedingt. Anthropic sagt, dass künftige Claude-Modelle Text mit Wasserzeichen erzeugen werden und dass ältere Modelle in den kommenden Monaten aktualisiert werden. Es wurde keine Rollout-Tabelle Modell für Modell veröffentlicht, daher beweist allein das Datum einer Antwort nicht, dass die Kennzeichnung vorhanden ist.

Kann Slop or Not Claudes Text-Wasserzeichen auslesen?

Nein, und das muss es auch nicht. Anthropic sagt, Claude's Kennzeichen sei eine Version von SynthID-Text: ein geheimes statistisches Muster, das durch gewöhnliche Token-Auswahl entsteht und nur mit Anthropic's eigenem Detektor lesbar ist. Ein ausgelesenes Wasserzeichen funktioniert außerdem nicht mehr, sobald das Kennzeichen fehlt, entfernt wurde oder durch Paraphrasieren verschwunden ist. Der Text-Tab liest stattdessen den Schreibstil selbst, weshalb er 99,5 % der AI-Texte bei einer False-Positive-Rate von 5 % auf RAID mit 11 adversarial attacks im Testset erkannte. Das Urteil ist eine Wahrscheinlichkeit, kein Beweis.

Warum sind kurze, sachliche oder code-lastige Antworten schwerer zu kennzeichnen?

Die Kennzeichnung hat weniger Spielraum, wenn Claude nur wenige sinnvolle Wortoptionen hat. Anthropic sagt, dass kurze Beispiele, sachliche Passagen, Code und leichtes Korrekturlesen zu wenig Signal für eine sichere Auswertung enthalten können. Dieselbe Vorsicht gilt für Klassifikator-Ergebnisse bei kurzen oder stark bearbeiteten Passagen.

Kann das Text-Wasserzeichen erkennen, wer Claude verwendet hat?

Anthropic sagt, dass das Text-Wasserzeichen keine identifizierenden Informationen enthält und nicht zu einer Person, Organisation oder einem Chat zurückverfolgt werden kann. Es prüft auf wahrscheinliche Beteiligung von Claude, nicht darauf, wer Claude verwendet hat.

Wie prüft Slop or Not Claude-Bilder?

Claude verwendet C2PA Content Credentials für unterstützte Bilddateien, nicht image SynthID. Ein Nachweis besteht aus signierten Herkunftsmetadaten, die an die Datei angehängt sind, nicht aus einem in die Pixel eingebetteten Wasserzeichen. Slop or Not liest den Nachweis, meldet die erkannte Quelle und prüft die Pixel, wenn die Datei keine lesbare Herkunft enthält. Der Leser entscheidet, ob diese Historie auf Claude hinweist; ein fehlender Nachweis beweist nichts.

Was beweist ein Claude-Detektor-Ergebnis?

Ein Credential kann eine Beteiligung von Claude stützen, wenn die darin aufgezeichnete Historie auf Claude verweist. Slop or Not liest das Credential und meldet die erkannte Quelle; der Leser interpretiert es, und ein spezieller C2PA-Viewer kann die vollständige signierte Kette anzeigen. C2PA beweist nicht, wer die Datei erstellt hat oder besitzt, ob ihr Inhalt wahr ist, ob jedes Pixel AI-generiert ist oder ob die Historie unverändert ist. Das Ergebnis eines Text-Klassifikators ist eine Wahrscheinlichkeit. Ein fehlendes Wasserzeichen oder Credential beweist nichts.

Funktionieren Claude-Wasserzeichen-Entferner?

Sei skeptisch bei jedem Tool, das heute ein sauberes Claude-Wasserzeichen-Ergebnis meldet. WatermarkDetector.com scannt versteckten Unicode und Abstände, aber Claudes Textkennzeichnung enthält keine versteckten Zeichen. watermarks-remover führt echte Unicode- und Metadatenbereinigung durch und kann Text umschreiben, aber ohne Anthropics kommenden Detektor kann es nicht beweisen, dass das Token-Auswahlmuster verschwunden ist. Wenn C2PA aus einem Bild entfernt wird, bleiben die Pixel trotzdem für die Analyse verfügbar.

Nächste Prüfung auf deinem iPhone oder Mac ausführen

Die Slop or Not App prüft Bilder und Texte direkt auf dem Gerät, sodass nichts, was du prüfst, dein Gerät verlässt.