Marca de Agua Invisible · Anthropic · C2PA · 2026

Claude va a poner marca de agua invisible a TODO… y Anthropic sabe que se borra

Anthropic anunció que Claude va a marcar todo lo que genera. No me quedé con el comunicado: abrí la terminal y puse a prueba esa marca con una de las operaciones más comunes del mundo. No hackeé nada — y aun así desapareció.

El veredicto

Procedencia verificable no es lo mismo que procedencia permanente.

Esta semana Anthropic anunció que Claude va a marcar todo lo que genera, para que puedas saber si algo salió de una IA — parte de su respuesta al artículo 50 de la Ley de IA europea. La firma que usan es criptográfica y sólida. Pero viaja embebida dentro del archivo, y eso significa que se puede perder cuando el archivo se transforma. No lo digo yo: lo dice la propia Anthropic en su documentación.

Qué anunció Anthropic, y por qué justo ahora

No es un capricho de producto. Desde el 2 de agosto de 2026, el artículo 50 de la Ley de IA europea exige a los proveedores incluir mecanismos legibles por máquina que permitan detectar contenido generado o manipulado por IA.

AI Act, artículo 50  →  obligación desde el 2-ago-2026
Anthropic             →  anuncia C2PA (imágenes) + marca estadística (texto)
Alcance               →  Claude, Claude API, Claude Code, Claude Cowork, Claude Tag
                         y modelos servidos vía AWS, Google Cloud y Microsoft Foundry

Las 3 capas de marcado

Bajo el mismo nombre de "marca de agua invisible" hay tecnologías distintas, con garantías distintas.

C2PA — la firma en el archivo

Anthropic la anunció esta semana

Un manifiesto criptográfico embebido en la imagen: quién la creó, con qué herramienta, qué se le hizo después. La firma en sí es a prueba de manipulación — no puedes editar el manifiesto sin que la validación lo note.

SynthID — la marca en los píxeles

OpenAI la combina con C2PA desde mayo

Una señal invisible tejida en la propia imagen, diseñada para sobrevivir un resize, una recompresión o hasta una captura de pantalla. No vive en los metadatos: vive en el contenido.

La marca en el texto

La otra mitad del anuncio de Anthropic

Cada vez que Claude te escribe algo, un sesgo estadístico en las palabras que elige queda marcado. Invisible para ti, medible solo con la clave correcta — y se rompe si parafraseas, traduces o reescribes el texto.

La demo: genero, audito, transformo

Nada de teoría. Generé imágenes en Claude y en ChatGPT, y las auditoré con las mismas herramientas que puedes usar tú.

Paso 1 · Auditar

c2patool sobre el archivo original

La imagen de ChatGPT trae un manifiesto C2PA válido: quién la creó, con qué herramienta, firma criptográfica. La de Claude (con los 3 modelos disponibles) no trae manifiesto — consistente con que Anthropic recién empieza a incorporarlo a modelos posteriores al 2 de agosto.

Paso 2 · Transformar

Un simple cambio de tamaño

Con ImageMagick, la operación más común del mundo: cambiar el tamaño de la imagen de ChatGPT. Sin romper ninguna criptografía, sin hackear nada — solo redimensionando.

Paso 3 · Verificar de nuevo

c2patool sobre el archivo redimensionado responde: "No claim found". El manifiesto desapareció. La firma en sí sigue siendo perfecta — no la ataqué, no la rompí. Simplemente ya no hay firma que revisar, porque el manifiesto vive embebido en el archivo y es lo primero que se cae cuando ese archivo pasa por el mundo real: una conversión de formato, una captura de pantalla, o volver a guardarlo. Y no lo digo yo: la propia Anthropic avisa, en letra chica, que estas operaciones pueden eliminar los metadatos.

La segunda capa que Claude todavía no tiene

Alguien ya se hizo esta pregunta antes. Desde mayo de 2026, OpenAI combina C2PA con SynthID — la marca de agua propia de Google DeepMind.

Misma imagen, después del mismo resize:

C2PA (metadatos embebidos)     →  "No claim found"  ❌
SynthID (señal en los píxeles) →  detectado en OpenAI Verify  ✅

Verifiqué la imagen redimensionada en OpenAI Verify: el C2PA murió, pero la herramienta igual confirmó "generado con herramientas de OpenAI" — la señal de SynthID seguía ahí. Ni OpenAI ni Google dicen que sea indestructible; dicen que aguanta mucho mejor. Esa es la diferencia entre tener una capa y tener dos — y es exactamente la segunda capa que, según la documentación de Anthropic hoy, Claude todavía no tiene.

Cómo auditar cualquier archivo tú mismo

La próxima vez que alguien te pregunte "¿esto lo hizo una IA?", no le creas — abre la terminal y verifica.

c2patool

Lee el manifiesto C2PA de un archivo y te dice si hay procedencia firmada. Open source, de la Content Authenticity Initiative.

exiftool

Mira los metadatos del archivo: quién lo hizo, con qué software, cuándo.

OpenAI Verify

El verificador que detecta SynthID en la capa de píxeles, incluso cuando el C2PA ya se cayó.

Content Credentials

El verificador C2PA de la Content Authenticity Initiative, para auditar cualquier archivo.

La lección de ingeniería

Cuando Claude termine de prender su marca de archivos, va a funcionar: vas a poder demostrar que algo lo generó Claude. Hasta que ese archivo pase por un resize, una captura, o un cambio de formato.

La tesis

C2PA no es malo. Es muy bueno para lo que sirve.

Una cadena verificable mientras el archivo se mantiene intacto — eso lo hace muy bien. La lección incómoda es otra: procedencia verificable no es lo mismo que procedencia permanente. Y una ley que te obliga a marcar el contenido no sirve de mucho si esa marca se cae con la operación más común del mundo. La pregunta correcta no es "¿se puede borrar?" — es cómo demuestras que algo lo hizo una IA cuando los archivos cambian miles de veces al día.

Fuentes

Las fuentes oficiales citadas en el video.

Anthropic · 2026

Cómo Claude marca el contenido generado por IA

El artículo oficial de soporte: qué mecanismos usa Claude para imágenes (C2PA) y para texto, y sus limitaciones declaradas.

OpenAI · 2026

Advancing content provenance

Cómo OpenAI combina C2PA con SynthID para que la procedencia sobreviva incluso cuando el manifiesto se cae.

Google DeepMind · 2026

SynthID

La marca de agua propia de Google: invisible en píxeles y texto, diseñada para resistir transformaciones comunes.

Content Authenticity Initiative · 2026

c2patool — repositorio oficial

La herramienta open source para leer y auditar manifiestos C2PA desde la terminal.

Videos relacionados

Contexto sobre los modelos y la disciplina detrás de este análisis.

Claude Fable 5

Los mismos 3 modelos probados en este video (Fable 5, Sonnet 5, Opus 5) — todos anteriores al 2 de agosto, la fecha desde la que Anthropic empieza a marcar.

Harness Engineering

La disciplina de construir el entorno y los controles alrededor del modelo — la procedencia y el marcado son, en el fondo, parte de ese mismo harness.

Preguntas frecuentes

Lo esencial sobre la marca de agua invisible de Claude.

¿Qué es C2PA?

+

Es un estándar abierto de procedencia de contenido: cuando una herramienta crea o edita un archivo, le mete un pequeño manifiesto firmado criptográficamente que cuenta su historia — quién lo creó, con qué programa, y qué se le fue haciendo después. Lo usan las cámaras, Adobe, OpenAI, y ahora se suma Anthropic. La firma en sí es sólida: no puedes modificar el manifiesto sin que la validación lo detecte.

¿Por qué la marca de agua invisible de Claude en imágenes se puede borrar?

+

Porque la implementación actual mete el manifiesto C2PA embebido dentro del propio archivo, y ese manifiesto viaja pegado a los bytes exactos del archivo. Operaciones normales del mundo real — un simple cambio de tamaño, volver a guardar el archivo, o una captura de pantalla — reescriben esos bytes y el manifiesto se cae. No es un hackeo ni una falla de seguridad: la propia Anthropic lo reconoce en su documentación como una limitación conocida del estándar.

¿Claude ya pone marca de agua invisible en sus imágenes hoy?

+

En los flujos de imagen probados en este video — Claude.ai, con los tres modelos Claude 5 disponibles (Fable 5, Sonnet 5 y Opus 5) — no se detectó ningún manifiesto C2PA. Pero eso no prueba que la marca "falle": los tres modelos salieron antes del 2 de agosto de 2026, la fecha desde la que Anthropic empieza a incorporar C2PA a sus modelos. Es más probable que el marcado todavía no esté implementado en esa superficie que una falla real.

¿Qué es SynthID y en qué se diferencia de C2PA?

+

SynthID es la marca de agua propia de Google DeepMind: una señal invisible tejida en los propios píxeles de la imagen (o en el texto), no en los metadatos del archivo. A diferencia de C2PA, está diseñada para sobrevivir transformaciones comunes como un resize, una recompresión o una captura de pantalla. OpenAI combina las dos capas desde mayo de 2026 — si el C2PA se cae, SynthID sigue siendo detectable.

¿Cómo puedo verificar si una imagen fue generada por IA?

+

Con tres herramientas gratuitas: c2patool para leer el manifiesto C2PA desde la terminal, exiftool para revisar los metadatos generales del archivo, y el verificador de OpenAI (openai.com/verify) para detectar SynthID en la capa de píxeles, incluso cuando el resto de las señales ya se cayeron.

¿Qué exige el artículo 50 de la Ley de IA europea (AI Act)?

+

Desde el 2 de agosto de 2026, obliga a los proveedores de sistemas de IA a incluir mecanismos legibles por máquina que permitan detectar contenido generado o manipulado por IA. Es la razón detrás del anuncio de Anthropic — y por eso Claude va a marcar tanto imágenes (C2PA) como texto (una marca estadística en las palabras elegidas).

¿Se puede verificar hoy la marca de agua invisible en el texto de Claude?

+

No fácilmente. La marca en texto no es un carácter escondido que puedas buscar: es un sesgo estadístico en las palabras que el modelo elige, medible solo con la clave correcta. Existe una implementación abierta de este tipo de marcado, pero no es de un clic — el detector público de Google no acepta pegar texto directamente, y el de Anthropic todavía no salió. Además, parafrasear, traducir o reescribir el texto rompe la marca.

Comunidad

Seguimos auditando de verdad en Agentic Engineers

Si quieres seguir aprendiendo a construir, entender y auditar sistemas con IA — no solo a comentarlos. Acceso gratis a la comunidad; los cursos completos van en el tier Premium.

Únete a Agentic Engineers →

Canal YouTube

@NicolasNeiraGarcia

ADK · A2A · Claude Code · Automatización · Infraestructura

Suscribirse ›