Przejdź do treści

Sprawdzanie tekstu i obrazów Claude

Detektor AI Claude do tekstu i obrazów

Karta Tekst analizuje sam tekst, więc działa na angielskiej prozie Claude ze znakiem wodnym lub bez niego: 99,5% tekstu AI wykryte przy 5% odsetku fałszywych alarmów na RAID, publicznym benchmarku, którego nie prowadzimy, z 11 atakami adversarial w zestawie testowym. Slop or Not nie odczytuje znaku wodnego Claude SynthID-Text, ponieważ Anthropic nie udostępnił jego detektora. Karta Zdjęcie odczytuje C2PA Content Credentials, zgłasza rozpoznane źródło i ocenia piksele, gdy plik nie zawiera czytelnych danych o pochodzeniu. Kontrole online działają na prywatnym serwerze Mac Numen, z dala od zewnętrznych firm AI, i są usuwane po przetworzeniu; kontrole w aplikacji na iPhone i Mac działają lokalnie na urządzeniu.

Znak wodny Claude: jak działa i czego nie dowodzi

Wykrywa 99,5% tekstów AI przy 5% odsetku fałszywych alarmów, według RAID, publicznego benchmarku, a nie według nas.

Wklej akapit albo całą pracę dyplomową. Aplikacje na iPhone i Mac nie mają limitu słów ani miesięcznego pakietu słów.

  • Wklej tekst po angielskuEseje szkolne, recenzje produktów, podpisy, artykuły i posty społecznościowe do 20 000 znaków.
  • WynikOcena prawdopodobieństwa, wynik AI i analiza czytelności.
  • PrywatnośćUsuwamy go od razu po zakończeniu sprawdzania. Nigdy nie przechowujemy Twojego tekstu.
Tylko tekst po angielsku. Usuwany po przetworzeniu.0/20000

Wypróbuj przykład

Wykrywanie AI opiera się na prawdopodobieństwie. Wyniki mogą się różnić w przypadku nowych modeli AI i metod omijania detekcji. Tekst napisany przez człowieka, który brzmi formalnie, może zostać oznaczony jako AI.

Oceniane przez dostrojony model transformerowy, a nie przez sprawdzanie wzorców słów.

Co sprawdza

Odczytuje sam tekst, bez klucza znaku wodnego

Kontrola tekstu, która analizuje sam tekst, więc brakujący lub usunięty znak wodny niczego nie zmienia: 99,5% tekstu AI wykryte przy 5% wyników fałszywie dodatnich w RAID, w tym ataki adwersarialne

Odczyt C2PA Content Credential w obrazach Claude, z podaniem źródła, gdy Slop or Not je rozpozna

Wykrywanie wizualne na poziomie pikseli, gdy ani czytelne pochodzenie, ani znak wodny nie pozwalają zidentyfikować pliku

Dobre zastosowania

  • Sprawdzanie eseju lub zadania, które mogło zostać napisane z użyciem Claude
  • Sprawdzanie, czy obraz Claude nadal zawiera C2PA Content Credentials
  • Sprawdzanie obrazu Claude po pikselach, gdy z pliku nie da się odczytać pochodzenia

Ograniczenia, które warto znać

  • Slop or Not nie odczytuje znaku wodnego SynthID-Text w Claude, więc jego werdykt tekstowy jest prawdopodobieństwem klasyfikatora, a nie odczytem znaku wodnego
  • Wykrywanie tekstu działa tylko po angielsku, a krótkie, faktograficzne, pełne kodu, sprawdzone lub przepisane fragmenty zostawiają mniej dowodów dla klasyfikatora
  • Poświadczenia C2PA można usunąć. Slop or Not je odczytuje i podaje rozpoznane źródło; czytelnik musi zdecydować, czy ta historia wskazuje na Claude. Nawet wtedy potwierdza to udział; nie dowodzi autorstwa, własności, prawdziwości treści, pochodzenia każdego piksela z AI ani niezmienionej historii

FAQ

Pytania o Detektor AI Claude

Czy Claude obecnie oznacza znakiem wodnym każdy tekst?

Niekoniecznie. Anthropic twierdzi, że przyszłe modele Claude będą generować tekst ze znakiem wodnym, a starsze modele zostaną zaktualizowane w najbliższych miesiącach. Nie opublikował tabeli wdrożenia dla poszczególnych modeli, więc sama data odpowiedzi nie dowodzi obecności oznaczenia.

Czy Slop or Not potrafi odczytać znak wodny tekstu Claude?

Nie, i nie musi. Anthropic twierdzi, że oznaczenie Claude jest wersją SynthID-Text: tajnym wzorcem statystycznym tworzonym przez zwykłe wybory tokenów, możliwym do odczytania tylko własnym detektorem Anthropic. Odczyt znaku wodnego przestaje też działać w chwili, gdy oznaczenia nie ma, zostało usunięte albo zniknęło po parafrazie. Karta Tekst zamiast tego analizuje sam tekst, dlatego wykryła 99,5% tekstu AI przy 5% wyników fałszywie dodatnich w RAID, z 11 atakami adwersarialnymi w zestawie testowym. Werdykt jest prawdopodobieństwem, nie dowodem.

Dlaczego krótkie, faktograficzne lub pełne kodu odpowiedzi trudniej oznaczyć?

Oznaczenie ma mniej miejsca do działania, gdy Claude ma niewiele rozsądnych wyborów słów. Anthropic twierdzi, że krótkie próbki, fragmenty faktograficzne, kod i lekka korekta mogą nieść zbyt mało sygnału do pewnego odczytu. Ta sama ostrożność dotyczy wyników klasyfikatora dla krótkich lub mocno edytowanych fragmentów.

Czy znak wodny tekstu może wskazać, kto użył Claude?

Anthropic twierdzi, że znak wodny tekstu nie zawiera informacji identyfikujących i nie da się go powiązać z osobą, organizacją ani czatem. Sprawdza prawdopodobny udział Claude, a nie to, kto użył Claude.

Jak Slop or Not sprawdza obrazy Claude?

Claude używa C2PA Content Credentials dla obsługiwanych plików obrazów, a nie SynthID dla obrazów. Poświadczenie to podpisane metadane pochodzenia dołączone do pliku, a nie znak wodny osadzony w pikselach. Slop or Not odczytuje poświadczenie, podaje rozpoznane źródło i sprawdza piksele, gdy plik nie zawiera czytelnego pochodzenia. Czytelnik decyduje, czy ta historia wskazuje na Claude; brak poświadczenia niczego nie dowodzi.

Co dowodzi wynik detektora Claude?

Poświadczenie może potwierdzać udział Claude, gdy zapisana w nim historia wskazuje na Claude. Slop or Not odczytuje poświadczenie i podaje rozpoznane źródło; czytelnik je interpretuje, a osobna przeglądarka C2PA może pokazać pełny podpisany łańcuch. C2PA nie dowodzi, kto jest autorem ani właścicielem pliku, czy jego treść jest prawdziwa, czy każdy piksel został wygenerowany przez AI ani czy historia pozostała niezmieniona. Wynik klasyfikatora tekstu jest prawdopodobieństwem. Brak znaku wodnego lub poświadczenia niczego nie dowodzi.

Czy narzędzia do usuwania znaku wodnego Claude działają?

Podchodź sceptycznie do każdego narzędzia, które dziś zgłasza czysty wynik znaku wodnego Claude. WatermarkDetector.com skanuje ukryty Unicode i odstępy, ale oznaczenie tekstu Claude nie zawiera ukrytych znaków. watermarks-remover wykonuje rzeczywiste czyszczenie Unicode i metadanych oraz może przepisywać tekst, ale bez nadchodzącego detektora Anthropic nie może dowieść, że wzorzec doboru tokenów zniknął. Usunięcie C2PA z obrazu nadal pozostawia jego piksele dostępne do analizy.

Uruchom następne sprawdzenie na iPhone lub Mac

Aplikacja Slop or Not sprawdza obrazy i tekst na urządzeniu, więc nic, co sprawdzasz, nigdy nie opuszcza Twojego urządzenia.