跳至內容

Claude 文字及圖片檢查

Claude 文字及圖片 AI 偵測器

「文字」分頁會閱讀文字本身,所以無論有冇浮水印,佢都可以處理英文 Claude 文章:喺 RAID 上,以 5% 誤報率捕捉到 99.5% 嘅 AI 文字,RAID 係一個我哋冇執行嘅公開基準,測試集包含 11 種對抗性攻擊。Slop or Not 唔會讀取 Claude 嘅 SynthID-Text 浮水印,因為 Anthropic 尚未發布對應嘅偵測器。「相片」分頁會讀取 C2PA Content Credentials、報告佢辨識到嘅來源,並喺冇可讀取嘅來源證明可以確定檔案時為像素評分。網上檢查會喺 Numen 嘅私人 Mac 伺服器上執行,遠離外部 AI 公司,並喺處理後刪除;iPhone 同 Mac app 嘅檢查會喺裝置上執行。

Claude 浮水印:運作方式及其無法證明之處

以 5% 誤判率偵測到 99.5% 嘅 AI 文字,評分來自 RAID 公開基準,唔係我哋。

貼上一段文字或者成篇論文。iPhone 同 Mac 版 app 冇字數上限,亦冇每月字數預算。

  • 貼上英文文字學校作文、產品評論、caption、文章和社交帖文,最多 20,000 個字元。
  • 結果機率判斷、AI 分數和可讀性分析。
  • 私隱檢查一完成即刪除。我們絕不保留你的文字。
只支援英文文字。處理後會刪除。0/20000

試用例子

AI 偵測係機率性嘅。結果會因應新嘅 AI 模型同規避方法而有所唔同。聽起上嚟正式嘅人類寫作有可能會被標記為 AI。

由微調 Transformer 模型評分,不是字詞模式檢查器。

檢查內容

直接閱讀行文本身,唔需要浮水印密鑰

文字檢查直接閱讀行文本身,所以缺少或者被移除嘅浮水印都唔會影響結果:喺 RAID 上以 5% 誤判率捕捉到 99.5% 嘅 AI 文字,包括對抗性攻擊在內

讀取 Claude 圖片上的 C2PA Content Credential,並在 Slop or Not 辨識到來源時回報該來源。

當沒有可讀的出處資訊或浮水印可解析檔案時,進行像素級別視覺偵測。

適合用途

  • 檢查可能由 Claude 撰寫的文章或功課
  • 檢查 Claude 圖片是否仍載有 C2PA Content Credentials
  • 當冇可讀取嘅來源可以解析檔案時,透過像素檢查 Claude 圖像

要知道的限制

  • Slop or Not 唔會讀取 Claude 嘅 SynthID-Text 浮水印,所以佢嘅文字判斷係分類器機率,而唔係浮水印讀數
  • 文字偵測僅限英文,而簡短、事實性、程式碼密集、經校對或改寫的段落,會留下較少分類器證據。
  • C2PA 憑證可以被移除。Slop or Not 會讀取憑證並回報它辨識到的來源;讀者必須判斷該歷史是否指向 Claude。即使如此,它只能支持 Claude 有參與,並不能證明作者身份、擁有權、內容真確性、每個像素均由 AI 產生,或歷史未經更改。

常見問題

Claude AI 偵測器 問題

Claude 目前是否會為所有文字加入浮水印?

未必。Anthropic 表示未來的 Claude 型號會生成帶有浮水印的文字,而舊款型號會在未來數月更新。該公司未有公佈按型號劃分的推出時間表,所以單憑回覆日期不能證明標記存在。

Slop or Not 能否讀取 Claude 的文字浮水印?

唔會,而且亦都冇需要。Anthropic 表示 Claude 嘅標記係 SynthID-Text 嘅一個版本:一種透過一般 token 選擇所創造嘅秘密統計模式,只可以用 Anthropic 自家嘅偵測器讀取。浮水印讀數亦會喺標記唔存在、被移除或者被改寫之後失效。相反,「文字」分頁直接閱讀行文本身,所以佢喺 RAID 上以 5% 誤判率捕捉到 99.5% 嘅 AI 文字,測試集入面包含 11 種對抗性攻擊。判斷係機率,而唔係證據。

為何簡短、事實性或程式碼密集的答案較難加入標記?

當 Claude 合理的詞語選擇有限時,標記可發揮的空間就會較少。Anthropic 表示簡短樣本、事實性段落、程式碼及輕微校對,都可能帶有太少訊號,難以可靠地讀取。同樣的注意事項亦適用於簡短或經大幅編輯段落的分類器結果。

文字浮水印能否識別誰使用過 Claude?

Anthropic 表示文字浮水印不帶任何識別資訊,無法追溯至任何個人、組織或對話。它測試的是可能涉及 Claude,而非誰使用過 Claude。

Slop or Not 如何檢查 Claude 圖片?

Claude 在支援的圖片檔案使用 C2PA Content Credentials,而非 image SynthID。憑證是附加於檔案的已簽署出處中繼資料,不是嵌入像素的浮水印。Slop or Not 會讀取憑證、報告其辨識到的來源,並在檔案沒有可讀出處資訊時檢查像素。由讀者判斷該記錄是否指向 Claude;缺少憑證並不能證明什麼。

Claude 偵測器結果可以證明什麼?

當憑證記錄的歷史指向 Claude 時,它便可支持 Claude 有參與。Slop or Not 會讀取憑證並回報它辨識到的來源;讀者自行解讀,而專用的 C2PA 檢視器可以顯示完整的已簽署鏈。C2PA 不能證明檔案的作者或擁有者是誰、內容是否真確、每個像素是否由 AI 產生,或歷史是否未經更改。文字分類器的結果只是一個機率。缺少浮水印或憑證不能證明任何事。

Claude 浮水印清除工具是否有效?

對任何今日回報 Claude 浮水印結果為乾淨的工具,請保持懷疑。WatermarkDetector.com 會掃描隱藏 Unicode 和間距,但 Claude 的文字標記不含隱藏字元。watermarks-remover 會執行真正的 Unicode 和中繼資料清理,並可重寫文字,但在未有 Anthropic 即將推出的偵測器之前,無法證明 token 選擇模式已經消失。從圖片移除 C2PA 亦會令其像素可供分析。

在 iPhone 或 Mac 上執行下一次檢查

Slop or Not 應用程式會在裝置上檢查影像和文字,因此你檢查的任何內容都不會離開你的裝置。