Claude añade marcas invisibles al texto

El nuevo mecanismo de Claude convierte una vieja pregunta en un problema de producto: ¿puede el texto generado por IA identificarse de forma legible por máquinas?

QbitAI informó el 11 de agosto que Anthropic está añadiendo marcas invisibles al contenido generado por Claude. Según la página de ayuda de Anthropic, los modelos Claude lanzados en la Unión Europea a partir del 2 de agosto admiten marcado legible por máquinas desde el primer día.

La frase oficial es breve:

Generated text will carry embedded watermarks
En términos de usuario, significa que un texto de Claude puede llevar una señal invisible que sobreviva a copiar, pegar y editar ligeramente.

La señal entra en la capa del modelo

El alcance es amplio: Claude, Claude Platform API, Claude Code, Claude Cowork y Claude Tag, además de accesos mediante AWS, Google Cloud y Microsoft Foundry. La marca se aplica allí donde Claude ofrece servicio.

El movimiento de cumplimiento de Claude va más allá de un aviso visual. Un aviso informa a personas. Una señal en la salida del modelo crea una entrada para detección automática. Para grandes plataformas eso facilita la moderación; para creadores también eleva el coste de los falsos positivos.

La ley europea marcó el plazo

El contexto es el Artículo 50 del EU AI Act. Cloud Security Alliance divide sus obligaciones de transparencia en cuatro grupos: los sistemas interactivos deben informar de que el usuario interactúa con IA; los sistemas que generan audio, imagen, video o texto deben marcar la salida de forma legible por máquinas.

Las obligaciones de transparencia del Artículo 50 empezaron a aplicarse el 2 de agosto. Para sistemas ya comercializados existe una transición en la obligación de marca de agua; CSA y The Verge mencionan una ventana hasta el 2 de diciembre para productos antiguos.

Detectar no prueba autoría

Detectar una marca de Claude solo indica que el contenido pudo haber pasado por Claude; no prueba por sí solo que Claude sea el autor original. Un texto escrito por una persona y luego corregido, traducido, resumido o formateado con Claude también puede dejar señal. A la inversa, no detectar una marca tampoco prueba que no haya IA.

Cuanto más oficial sea la marca, más claros deben ser sus límites. Reduce el coste de adivinar, pero crea zonas grises. Anthropic aún no ha publicado el algoritmo de marca textual ni documentación técnica de detección. Las empresas deberían tratar el resultado como señal de riesgo, no como veredicto.

Fuentes: QbitAI, Anthropic Claude Help Center, The Verge, Cloud Security Alliance, CocoLoop, iThome; se verificaron alcance de modelos, puntos de producto, nube, tipos de archivo C2PA, obligaciones del Artículo 50, transición para modelos antiguos, límites de detección y ausencia de documentación técnica pública.