Saltar al contenido

Comprobaciones de texto e imágenes de Claude

Detector de IA de Claude para texto e imágenes

La pestaña Texto lee la propia escritura, así que funciona con prosa en inglés de Claude con o sin marca de agua: 99.5% de texto AI detectado con una tasa de falsos positivos del 5% en RAID, un benchmark público que no ejecutamos, con 11 ataques adversariales en el conjunto de prueba. Slop or Not no lee la marca de agua SynthID-Text de Claude, porque Anthropic no ha publicado su detector. La pestaña Foto lee C2PA Content Credentials, informa de la fuente que reconoce y puntúa los píxeles cuando ninguna procedencia legible resuelve el archivo. Las comprobaciones online se ejecutan en el servidor Mac privado de Numen, lejos de empresas externas de AI, y se eliminan después del procesamiento; las comprobaciones de la app para iPhone y Mac se ejecutan en el dispositivo.

Marca de agua de Claude: cómo funciona y qué no demuestra

Detecta el 99,5 % del texto generado por IA con una tasa de falsos positivos del 5 %, evaluado por RAID, el benchmark público, no por nosotros.

Pega un párrafo o una tesis entera. Las apps para iPhone y Mac no tienen límite de palabras ni presupuesto mensual de palabras.

  • Pega texto en inglésRedacciones escolares, reseñas de productos, pies de foto, artículos y publicaciones sociales de hasta 20,000 caracteres.
  • ResultadoUn veredicto de probabilidad, puntuación de IA y análisis de legibilidad.
  • PrivacidadSe elimina en cuanto termina la comprobación. Nunca guardamos tu texto.
Solo texto en inglés. Se elimina después del procesamiento.0/20000

Probar un ejemplo

La detección de IA es probabilística. Los resultados pueden variar con nuevos modelos de IA y métodos de evasión. Un texto humano que suena formal puede marcarse como IA.

Puntuado por un modelo transformer ajustado, no por un comprobador de patrones de palabras.

Qué comprueba

Lee la escritura en sí, sin clave de marca de agua

Una comprobación de texto que lee la escritura en sí, así que una marca de agua ausente o eliminada no cambia nada: 99,5% del texto de IA detectado con una tasa de falsos positivos del 5% en RAID, ataques adversarios incluidos

Lectura de C2PA Content Credentials en imágenes de Claude, con informe de la fuente cuando Slop or Not reconoce una

Detección visual a nivel de píxel cuando no hay procedencia legible ni marca de agua que resuelva el archivo

Buenos usos

  • Comprobar un ensayo o una tarea que puede haberse escrito con Claude
  • Comprobar si una imagen de Claude aún conserva C2PA Content Credentials
  • Comprobación de una imagen de Claude por sus píxeles cuando no hay una procedencia legible que resuelva el archivo

Límites que conviene conocer

  • Slop or Not no lee la marca de agua SynthID-Text de Claude, así que su veredicto de texto es una probabilidad de clasificador en lugar de una lectura de marca de agua
  • La detección de texto solo funciona en inglés, y los pasajes cortos, factuales, con mucho código, corregidos o reescritos dejan menos evidencia para el clasificador
  • Las credenciales C2PA pueden eliminarse. Slop or Not las lee e informa de la fuente que reconoce; el lector debe decidir si ese historial apunta a Claude. Incluso entonces, respalda la intervención; no prueba autoría, propiedad, veracidad del contenido, origen de IA en cada píxel ni que el historial no haya cambiado

FAQ

Preguntas sobre Detector de IA de Claude

¿Claude marca actualmente todo el texto con marca de agua?

No necesariamente. Anthropic dice que los futuros modelos Claude generarán texto con marca de agua y que los modelos anteriores se actualizarán en los próximos meses. No ha publicado una tabla de despliegue modelo por modelo, así que la fecha de una respuesta por sí sola no demuestra que la marca esté presente.

¿Slop or Not puede leer la marca de agua de texto de Claude?

No, y no le hace falta. Anthropic dice que la marca de Claude es una versión de SynthID-Text: un patrón estadístico secreto creado mediante elecciones normales de tokens, legible solo con el propio detector de Anthropic. Una lectura de marca de agua también deja de funcionar en cuanto la marca no está, se elimina o desaparece al parafrasear. La pestaña Texto lee la escritura en sí, por eso detectó el 99,5% del texto de IA con una tasa de falsos positivos del 5% en RAID con 11 ataques adversarios en el conjunto de prueba. El veredicto es una probabilidad, no una prueba.

¿Por qué las respuestas cortas, factuales o con mucho código son más difíciles de marcar?

La marca tiene menos margen para actuar cuando Claude tiene pocas opciones de palabras razonables. Anthropic dice que las muestras cortas, los pasajes factuales, el código y las correcciones ligeras pueden contener muy poca señal para una lectura fiable. La misma cautela se aplica a los resultados del clasificador en pasajes cortos o muy editados.

¿La marca de agua de texto puede identificar quién usó Claude?

Anthropic dice que la marca de agua de texto no contiene información identificativa y no se puede rastrear hasta una persona, organización o chat. Comprueba la probable intervención de Claude, no quién usó Claude.

¿Cómo comprueba Slop or Not las imágenes de Claude?

Claude usa Content Credentials de C2PA para los archivos de imagen compatibles, no SynthID de imagen. Una credencial es metadata de procedencia firmada adjunta al archivo, no una marca de agua incrustada en los píxeles. Slop or Not lee la credencial, informa de la fuente que reconoce y analiza los píxeles cuando el archivo no contiene procedencia legible. El lector decide si ese historial apunta a Claude; que falte una credencial no prueba nada.

¿Qué demuestra un resultado de un detector de Claude?

Una credencial puede respaldar la intervención de Claude cuando el historial que registra apunta a Claude. Slop or Not lee la credencial e informa de la fuente que reconoce; el lector la interpreta, y un visor de C2PA específico puede mostrar toda la cadena firmada. C2PA no prueba quién creó o posee el archivo, si su contenido es verdadero, si cada píxel fue generado por IA ni que el historial no haya cambiado. El resultado de un clasificador de texto es una probabilidad. Que falte una marca de agua o una credencial no prueba nada.

¿Funcionan los limpiadores de marcas de agua de Claude?

Conviene desconfiar de cualquier herramienta que hoy informe de un resultado limpio para una marca de agua de Claude. WatermarkDetector.com analiza Unicode oculto y espaciado, pero la marca de texto de Claude no contiene caracteres ocultos. watermarks-remover realiza limpieza real de Unicode y metadatos, y puede reescribir texto, pero sin el próximo detector de Anthropic no puede demostrar que el patrón de elección de tokens haya desaparecido. Quitar C2PA de una imagen también deja sus píxeles disponibles para análisis.

Haz la próxima comprobación en tu iPhone o Mac

La app Slop or Not comprueba imágenes y texto en el dispositivo, así que nada de lo que revises sale nunca de tu dispositivo.