コンテンツへスキップ

Claudeのテキストと画像チェック

Claudeのテキストと画像向けAI検出

テキストタブは文章そのものを読み取るため、ウォーターマークの有無に関係なく英語のClaude文でも機能します。こちらでは実行していない公開ベンチマークRAIDで、テストセットに11種類の敵対的攻撃を含め、誤検出率5%でAI文章の99.5%を検出しました。Slop or NotはClaudeのSynthID-Textウォーターマークを読み取りません。Anthropicがその検出器を公開していないためです。写真タブはC2PA Content Credentialsを読み取り、認識した出所を報告し、読み取れる来歴でファイルを判定できない場合はピクセルをスコア化します。オンラインチェックは外部のAI企業から離れたNumenのプライベートMacサーバーで実行され、処理後に削除されます。iPhoneとMacアプリのチェックはオンデバイスで実行されます。

Claude透かし: 仕組みと証明できないこと

公開ベンチマークのRAIDによる評価で、AIテキストの99.5%を検出し、誤検出率は5%です。私たちによる評価ではありません。

段落ひとつでも、論文全体でも貼り付けられます。iPhoneとMacのアプリには単語数上限も月間の単語数枠もありません。

  • 英語のテキストを貼り付け学校のエッセイ、商品レビュー、キャプション、記事、SNS投稿に対応。最大20,000文字まで。
  • 結果確率による判定、AIスコア、読みやすさの分析。
  • プライバシーチェックが完了した時点で削除されます。テキストは保存しません。
英語テキストのみ。処理後に削除されます。0/20000

例を試す

AI検出は確率に基づくものです。結果は新しいAIモデルや回避手法によって変わることがあります。文体が硬い人間の文章がAIとして判定される場合もあります。

単語パターンのチェッカーではなく、ファインチューニング済みTransformerモデルでスコア化します。

チェック内容

文章そのものを読み取るため、透かしキーは不要

文章そのものを読み取るテキストチェックです。透かしがない、または削除されていても結果は変わりません。RAIDで5%の偽陽性率においてAIテキストの99.5%を検出し、敵対的攻撃も含まれています

Claude画像のC2PA Content Credentialを読み取り、Slop or Notが認識した場合はソースを報告

読み取り可能な来歴やウォーターマークでファイルを判定できない場合のピクセルレベルの画像検出

適した使い方

  • Claudeで書かれた可能性のある小論文や課題をチェックする
  • Claude画像にC2PA Content Credentialsがまだ含まれているかを確認する
  • 読み取れる来歴でファイルを解決できない場合、Claude画像をピクセルでチェック

知っておきたい制限

  • Slop or NotはClaudeのSynthID-Text透かしを読み取らないため、テキストの判定は透かしの読み取りではなく分類器の確率です
  • テキスト検出は英語のみです。短い文章、事実中心の文章、コードの多い文章、校正済みまたは書き換え済みの文章では、分類器の手がかりが少なくなります
  • C2PA認証情報は削除されることがあります。Slop or Notはそれを読み取り、認識したソースを報告します。その履歴がClaudeを指しているかどうかは読み手が判断する必要があります。それでも関与を裏付ける材料であり、作成者、所有権、内容の真偽、全ピクセルがAI由来であること、履歴が変更されていないことを証明するものではありません

FAQ

Claude AI検出ツールの質問

Claudeは現在すべてのテキストに透かしを入れていますか?

必ずしもそうではありません。Anthropicによると、今後のClaudeモデルは透かし入りテキストを生成し、旧モデルも今後数か月で更新される予定です。モデルごとの展開表は公開されていないため、応答日だけではマークが存在する証明にはなりません。

Slop or NotはClaudeのテキスト透かしを読み取れますか?

いいえ、必要もありません。Anthropicによると、ClaudeのマークはSynthID-Textの一種です。通常のトークン選択を通じて作られる秘密の統計的パターンで、Anthropic独自の検出ツールでのみ読み取れます。透かしの読み取りは、そのマークが存在しない、削除された、または言い換えられた瞬間に機能しなくなります。代わりにテキストタブは文章そのものを読み取るため、テストセットに11件の敵対的攻撃を含むRAIDで、5%の偽陽性率においてAIテキストの99.5%を検出しました。判定は確率であり、証明ではありません。

短い回答、事実中心の回答、コードの多い回答はなぜマークが難しいのですか?

Claudeに妥当な単語選択が少ない場合、マークが働く余地も少なくなります。Anthropicによると、短いサンプル、事実中心の文章、コード、軽い校正では、確信を持って読み取るには信号が少なすぎる場合があります。同じ注意は、短い文章や大幅に編集された文章に対する分類器の結果にも当てはまります。

テキスト透かしで誰がClaudeを使ったか特定できますか?

Anthropicによると、テキスト透かしには個人を識別する情報は含まれず、人物、組織、チャットに結び付けて追跡することはできません。判定するのはClaudeが関与した可能性であり、誰がClaudeを使ったかではありません。

Slop or NotはClaude画像をどのようにチェックしますか?

Claudeは対応する画像ファイルに、画像SynthIDではなくC2PA Content Credentialsを使用します。認証情報はファイルに付与された署名付きの来歴メタデータであり、ピクセルに埋め込まれたウォーターマークではありません。Slop or Notは認証情報を読み取り、認識したソースを報告し、ファイルに読み取り可能な来歴がない場合はピクセルをチェックします。その履歴がClaudeを示しているかどうかは、読み手が判断します。認証情報がないことは何の証明にもなりません。

Claude検出の結果は何を証明しますか?

記録された履歴がClaudeを指している場合、認証情報はClaudeの関与を裏付ける材料になります。Slop or Notは認証情報を読み取り、認識したソースを報告します。読み手がそれを解釈し、専用のC2PAビューアでは署名付きチェーン全体を確認できます。C2PAは、誰がそのファイルを作成したか、誰が所有しているか、内容が真実か、すべてのピクセルがAI生成か、履歴が変更されていないかを証明するものではありません。テキスト分類器の結果は確率です。透かしや認証情報がないことは何も証明しません。

Claude透かしクリーナーは機能しますか?

現時点でクリーンなClaude透かし結果を報告するツールには慎重になるべきです。WatermarkDetector.comは隠しUnicodeやスペースをスキャンしますが、Claudeのテキストマークには隠し文字は含まれていません。watermarks-removerは実際にUnicodeやメタデータをクリーンアップでき、テキストを書き換えることもできますが、Anthropicが今後提供する検出器なしでは、トークン選択パターンが消えたことを証明できません。画像からC2PAを削除しても、そのピクセルは引き続き分析できます。

次のチェックはiPhoneまたはMacで実行

Slop or Notアプリは画像とテキストをオンデバイスでチェックするため、確認した内容がデバイスの外へ出ることはありません。