Marca de Agua Invisible · Anthropic · C2PA · 2026
Anthropic anunció que Claude va a marcar todo lo que genera. No me quedé con el comunicado: abrí la terminal y puse a prueba esa marca con una de las operaciones más comunes del mundo. No hackeé nada — y aun así desapareció.
El veredicto
Esta semana Anthropic anunció que Claude va a marcar todo lo que genera, para que puedas saber si algo salió de una IA — parte de su respuesta al artículo 50 de la Ley de IA europea. La firma que usan es criptográfica y sólida. Pero viaja embebida dentro del archivo, y eso significa que se puede perder cuando el archivo se transforma. No lo digo yo: lo dice la propia Anthropic en su documentación.
No es un capricho de producto. Desde el 2 de agosto de 2026, el artículo 50 de la Ley de IA europea exige a los proveedores incluir mecanismos legibles por máquina que permitan detectar contenido generado o manipulado por IA.
AI Act, artículo 50 → obligación desde el 2-ago-2026
Anthropic → anuncia C2PA (imágenes) + marca estadística (texto)
Alcance → Claude, Claude API, Claude Code, Claude Cowork, Claude Tag
y modelos servidos vía AWS, Google Cloud y Microsoft Foundry Bajo el mismo nombre de "marca de agua invisible" hay tecnologías distintas, con garantías distintas.
Un manifiesto criptográfico embebido en la imagen: quién la creó, con qué herramienta, qué se le hizo después. La firma en sí es a prueba de manipulación — no puedes editar el manifiesto sin que la validación lo note.
Una señal invisible tejida en la propia imagen, diseñada para sobrevivir un resize, una recompresión o hasta una captura de pantalla. No vive en los metadatos: vive en el contenido.
Cada vez que Claude te escribe algo, un sesgo estadístico en las palabras que elige queda marcado. Invisible para ti, medible solo con la clave correcta — y se rompe si parafraseas, traduces o reescribes el texto.
Nada de teoría. Generé imágenes en Claude y en ChatGPT, y las auditoré con las mismas herramientas que puedes usar tú.
Paso 1 · Auditar
La imagen de ChatGPT trae un manifiesto C2PA válido: quién la creó, con qué herramienta, firma criptográfica. La de Claude (con los 3 modelos disponibles) no trae manifiesto — consistente con que Anthropic recién empieza a incorporarlo a modelos posteriores al 2 de agosto.
Paso 2 · Transformar
Con ImageMagick, la operación más común del mundo: cambiar el tamaño de la imagen de ChatGPT. Sin romper ninguna criptografía, sin hackear nada — solo redimensionando.
Paso 3 · Verificar de nuevo
c2patool sobre el archivo redimensionado responde: "No claim found". El manifiesto desapareció. La firma en sí sigue siendo perfecta — no la ataqué, no la rompí. Simplemente ya no hay firma que revisar, porque el manifiesto vive embebido en el archivo y es lo primero que se cae cuando ese archivo pasa por el mundo real: una conversión de formato, una captura de pantalla, o volver a guardarlo. Y no lo digo yo: la propia Anthropic avisa, en letra chica, que estas operaciones pueden eliminar los metadatos.
Alguien ya se hizo esta pregunta antes. Desde mayo de 2026, OpenAI combina C2PA con SynthID — la marca de agua propia de Google DeepMind.
Misma imagen, después del mismo resize:
C2PA (metadatos embebidos) → "No claim found" ❌
SynthID (señal en los píxeles) → detectado en OpenAI Verify ✅ Verifiqué la imagen redimensionada en OpenAI Verify: el C2PA murió, pero la herramienta igual confirmó "generado con herramientas de OpenAI" — la señal de SynthID seguía ahí. Ni OpenAI ni Google dicen que sea indestructible; dicen que aguanta mucho mejor. Esa es la diferencia entre tener una capa y tener dos — y es exactamente la segunda capa que, según la documentación de Anthropic hoy, Claude todavía no tiene.
La próxima vez que alguien te pregunte "¿esto lo hizo una IA?", no le creas — abre la terminal y verifica.
Lee el manifiesto C2PA de un archivo y te dice si hay procedencia firmada. Open source, de la Content Authenticity Initiative.
Mira los metadatos del archivo: quién lo hizo, con qué software, cuándo.
El verificador que detecta SynthID en la capa de píxeles, incluso cuando el C2PA ya se cayó.
El verificador C2PA de la Content Authenticity Initiative, para auditar cualquier archivo.
Cuando Claude termine de prender su marca de archivos, va a funcionar: vas a poder demostrar que algo lo generó Claude. Hasta que ese archivo pase por un resize, una captura, o un cambio de formato.
La tesis
Una cadena verificable mientras el archivo se mantiene intacto — eso lo hace muy bien. La lección incómoda es otra: procedencia verificable no es lo mismo que procedencia permanente. Y una ley que te obliga a marcar el contenido no sirve de mucho si esa marca se cae con la operación más común del mundo. La pregunta correcta no es "¿se puede borrar?" — es cómo demuestras que algo lo hizo una IA cuando los archivos cambian miles de veces al día.
Las fuentes oficiales citadas en el video.
Anthropic · 2026
El artículo oficial de soporte: qué mecanismos usa Claude para imágenes (C2PA) y para texto, y sus limitaciones declaradas.
OpenAI · 2026
Cómo OpenAI combina C2PA con SynthID para que la procedencia sobreviva incluso cuando el manifiesto se cae.
Google DeepMind · 2026
La marca de agua propia de Google: invisible en píxeles y texto, diseñada para resistir transformaciones comunes.
Content Authenticity Initiative · 2026
La herramienta open source para leer y auditar manifiestos C2PA desde la terminal.
Contexto sobre los modelos y la disciplina detrás de este análisis.
Los mismos 3 modelos probados en este video (Fable 5, Sonnet 5, Opus 5) — todos anteriores al 2 de agosto, la fecha desde la que Anthropic empieza a marcar.
La disciplina de construir el entorno y los controles alrededor del modelo — la procedencia y el marcado son, en el fondo, parte de ese mismo harness.
Lo esencial sobre la marca de agua invisible de Claude.
Es un estándar abierto de procedencia de contenido: cuando una herramienta crea o edita un archivo, le mete un pequeño manifiesto firmado criptográficamente que cuenta su historia — quién lo creó, con qué programa, y qué se le fue haciendo después. Lo usan las cámaras, Adobe, OpenAI, y ahora se suma Anthropic. La firma en sí es sólida: no puedes modificar el manifiesto sin que la validación lo detecte.
Porque la implementación actual mete el manifiesto C2PA embebido dentro del propio archivo, y ese manifiesto viaja pegado a los bytes exactos del archivo. Operaciones normales del mundo real — un simple cambio de tamaño, volver a guardar el archivo, o una captura de pantalla — reescriben esos bytes y el manifiesto se cae. No es un hackeo ni una falla de seguridad: la propia Anthropic lo reconoce en su documentación como una limitación conocida del estándar.
En los flujos de imagen probados en este video — Claude.ai, con los tres modelos Claude 5 disponibles (Fable 5, Sonnet 5 y Opus 5) — no se detectó ningún manifiesto C2PA. Pero eso no prueba que la marca "falle": los tres modelos salieron antes del 2 de agosto de 2026, la fecha desde la que Anthropic empieza a incorporar C2PA a sus modelos. Es más probable que el marcado todavía no esté implementado en esa superficie que una falla real.
SynthID es la marca de agua propia de Google DeepMind: una señal invisible tejida en los propios píxeles de la imagen (o en el texto), no en los metadatos del archivo. A diferencia de C2PA, está diseñada para sobrevivir transformaciones comunes como un resize, una recompresión o una captura de pantalla. OpenAI combina las dos capas desde mayo de 2026 — si el C2PA se cae, SynthID sigue siendo detectable.
Con tres herramientas gratuitas: c2patool para leer el manifiesto C2PA desde la terminal, exiftool para revisar los metadatos generales del archivo, y el verificador de OpenAI (openai.com/verify) para detectar SynthID en la capa de píxeles, incluso cuando el resto de las señales ya se cayeron.
Desde el 2 de agosto de 2026, obliga a los proveedores de sistemas de IA a incluir mecanismos legibles por máquina que permitan detectar contenido generado o manipulado por IA. Es la razón detrás del anuncio de Anthropic — y por eso Claude va a marcar tanto imágenes (C2PA) como texto (una marca estadística en las palabras elegidas).
No fácilmente. La marca en texto no es un carácter escondido que puedas buscar: es un sesgo estadístico en las palabras que el modelo elige, medible solo con la clave correcta. Existe una implementación abierta de este tipo de marcado, pero no es de un clic — el detector público de Google no acepta pegar texto directamente, y el de Anthropic todavía no salió. Además, parafrasear, traducir o reescribir el texto rompe la marca.
Comunidad
Si quieres seguir aprendiendo a construir, entender y auditar sistemas con IA — no solo a comentarlos. Acceso gratis a la comunidad; los cursos completos van en el tier Premium.
Únete a Agentic Engineers →Canal YouTube
@NicolasNeiraGarcia
ADK · A2A · Claude Code · Automatización · Infraestructura