跳至內容

Claude 文字與圖片檢查

Claude AI 文字與圖片偵測器

文字分頁會讀取文字本身,因此無論有沒有浮水印,它都能處理英文 Claude 文章:在 RAID(一個我們沒有參與執行的公開基準測試)上,以 5% 的誤報率捕捉到 99.5% 的 AI 文字,測試集中包含 11 種對抗性攻擊。Slop or Not 不會讀取 Claude 的 SynthID-Text 浮水印,因為 Anthropic 尚未釋出對應的偵測器。照片分頁會讀取 C2PA Content Credentials、回報它辨識出的來源,並在沒有可讀來源證明能判定檔案時為像素評分。線上檢查在 Numen 的私人 Mac 伺服器上執行,不經過外部 AI 公司,處理後即刪除;iPhone 和 Mac App 的檢查則在裝置端執行。

Claude 浮水印:運作方式與無法證明的事

在 5% 的誤報率下捕捉到 99.5% 的 AI 文字,由RAID,公開基準評分,而非由我們自行評分。

貼上一段文字或整篇論文。iPhone 和 Mac 版 App 沒有字數上限,也沒有每月字數預算。

  • 貼上英文文字學校作文、產品評論、說明文字、文章和社群貼文,最多 20,000 個字元。
  • 結果機率判定、AI 分數和可讀性分析。
  • 隱私檢查一完成就會刪除。我們絕不保留你的文字。
僅限英文文字。處理後即刪除。0/20000

試試範例

AI 偵測是機率性的。結果會因新的 AI 模型和規避方法而異。語氣正式的人類書寫可能被標示為 AI 生成。

由微調過的 Transformer 模型評分,不是用字詞模式檢查器。

檢查項目

讀取寫作本身,無需浮水印金鑰

這是一項會讀取寫作本身的文字檢查,因此缺少或被移除的浮水印不會影響結果:在 RAID 上以 5% 的誤報率偵測出 99.5% 的 AI 文字,包含對抗性攻擊在內。

在 Claude 影像上讀取 C2PA Content Credential,當 Slop or Not 辨識出一個來源時回報

當沒有可讀取的來源證明或浮水印可解析檔案時,進行像素層級的視覺偵測。

良好用途

  • 檢查可能用 Claude 撰寫的論文或作業
  • 檢查 Claude 圖片是否仍帶有 C2PA Content Credentials
  • 當沒有可讀取的出處資訊能判斷檔案時,以像素檢查 Claude 圖片。

需要知道的限制

  • Slop or Not 不會讀取 Claude 的 SynthID-Text 浮水印,因此其文字判定結果是分類器機率,而非浮水印讀取結果。
  • 文字偵測僅支援英文,而簡短、事實性、程式碼密集、經校對或改寫的段落會留下較少的分類器證據
  • C2PA 憑證可以被移除。Slop or Not 會讀取並回報其辨識出的來源;讀者必須判斷那段歷史是否指向 Claude。即便如此,它支持參與;它並不能證明作者歸屬、所有權、內容真實性、每個像素的 AI 來源,或是歷史未經變更。

常見問題

Claude AI 檢測器 問題

Claude 目前是否會為所有文字加上浮水印?

不一定。Anthropic 表示未來的 Claude 模型會產生帶有浮水印的文字,舊版模型也會在未來幾個月內更新。它尚未公布各模型的推出時程表,因此單靠回覆日期並不能證明標記存在。

Slop or Not 是否能讀取 Claude 的文字浮水印?

不會,而且也不需要。Anthropic 表示 Claude 的標記是 SynthID-Text 的一種版本:一種透過一般 token 選擇所建立的秘密統計模式,只有 Anthropic 自家的偵測器才能讀取。浮水印讀取也會在標記不存在、被移除或被改寫而消失時立即失效。相反地,「文字」分頁會讀取寫作本身,這正是它在 RAID 上以 5% 的誤報率、在測試集包含 11 種對抗性攻擊的情況下,偵測出 99.5% 的 AI 文字的原因。判定結果是機率,而非證據。

為何簡短、事實性或程式碼密集的答案較難加上標記?

當 Claude 合理的用詞選擇很少時,標記能運作的空間就較小。Anthropic 表示簡短範例、事實性段落、程式碼與輕微校對可能帶有太少訊號,難以做出有把握的判讀。同樣的注意事項也適用於簡短或大幅編輯段落的分類器結果。

文字浮水印是否能識別誰使用了 Claude?

Anthropic 表示文字浮水印不含任何識別資訊,無法追溯到個人、組織或對話。它測試的是可能與 Claude 有關,而非誰使用了 Claude。

Slop or Not 如何檢查 Claude 圖片?

Claude 在支援的圖片檔案使用 C2PA Content Credentials,而不是影像 SynthID。憑證是附加在檔案的已簽署來源證明中繼資料,不是嵌入像素的浮水印。Slop or Not 會讀取憑證、回報它辨識出的來源,並在檔案沒有可讀取的來源證明時檢查像素。讀者自行判斷這份紀錄是否指向 Claude;缺少憑證證明不了什麼。

Claude 偵測器的結果能證明什麼?

當記錄的歷史指向 Claude 時,憑證可以支持 Claude 的參與。Slop or Not 會讀取憑證並回報其辨識出的來源;讀者需自行解讀,而專用的 C2PA 檢視器可以顯示完整的簽署鏈。C2PA 不能證明檔案由誰建立或擁有、內容是否真實、每個像素是否由 AI 生成,或歷史是否未經變更。文字分類器的結果是機率。缺少浮水印或憑證不能證明任何事情。

Claude 浮水印清除工具是否有效?

對任何目前回報 Claude 浮水印已清除的工具抱持懷疑。WatermarkDetector.com 會掃描隱藏的 Unicode 與空格,但 Claude 的文字標記不含隱藏字元。watermarks-remover 會執行真正的 Unicode 與中繼資料清理,也能改寫文字,但在沒有 Anthropic 即將推出的偵測器的情況下,無法證明 token 選擇模式已消失。從圖片移除 C2PA 也會讓像素仍可供分析。

在 iPhone 或 Mac 上執行下一次檢查

Slop or Not 應用程式會在裝置上檢查圖片和文字,因此你檢查的任何內容都不會離開你的裝置。