En resumen
Anthropic explicó que Claude utilizará una marca de agua textual invisible, basada en elecciones probabilísticas de palabras e inspirada en SynthID-Text, de Google DeepMind. La medida busca cumplir las obligaciones del AI Act de la Unión Europea, pero la propia empresa admite que las reescrituras completas pueden eliminar la señal.
Anthropic explicó cómo pretende marcar los textos generados por Claude con una señal invisible para el lector, pero detectable por quienes tengan una clave específica. La tecnología se utilizará en el contexto de las obligaciones de transparencia previstas para los sistemas de inteligencia artificial en la Unión Europea. La empresa describe el mecanismo como una versión del enfoque SynthID-Text, desarrollado por Google DeepMind y presentado como una tecnología de código abierto.
El anuncio detallado se produjo el 14 de agosto de 2026, según los materiales de TechCrunch, después de que Anthropic revelara la iniciativa a comienzos de esa semana. El reportaje de The Verge, publicado el 17 de agosto, sitúa el cambio como parte de la preparación de la empresa para cumplir las normas europeas aplicables a los contenidos sintéticos. El expediente proporcionado no informa la fecha exacta de activación para todos los usuarios ni si la implementación ya está disponible a escala global.
La lógica del sistema depende de elecciones que, por lo general, no cambian el significado esencial de una frase. Ante una construcción como “Hoy el tiempo estaba frío y…”, el modelo podría elegir palabras semánticamente cercanas, como “nublado” o “gris”, en lugar de una opción improbable. En situaciones de este tipo, un proceso aleatorio puede orientar la elección y, al repetirse a gran escala, formar un patrón estadístico identificable.
Qué cambia en la generación de texto
La marca de agua no aparece como un símbolo, una etiqueta o una alteración visual en el texto. Queda incorporada a las probabilidades que utiliza el modelo para seleccionar palabras. Para el lector, una respuesta marcada y una no marcada deberían parecer iguales, según la descripción de Anthropic reproducida por TechCrunch. La detección, por otro lado, dependería de una clave capaz de reconocer el patrón creado por el sistema.
Este método es diferente de los detectores que buscan características estilísticas asociadas con textos de IA. Anthropic distingue entre la identificación de patrones de redacción, como construcciones recurrentes, y la verificación de una marca de agua. El primer enfoque intenta inferir el origen a partir de señales presentes en el texto; el segundo busca un patrón específico insertado durante la generación. Esta diferencia puede ser relevante para reducir las confusiones entre una sospecha estadística y una comprobación técnica.
La compañía también afirmó que el marcado no aumentará el costo para los usuarios ni tendrá un impacto práctico en la calidad o el contenido de las respuestas. Esta es una declaración de la empresa, no un resultado independiente presentado en el expediente. Las fuentes proporcionadas no detallan métricas de calidad, tasas de detección, falsos positivos ni el comportamiento del sistema en distintos idiomas, extensiones de texto y tipos de tarea.
La relación con el AI Act europeo
La iniciativa se presenta como una respuesta a las exigencias de transparencia del AI Act de la Unión Europea. Según el material proporcionado, la regulación establece que los contenidos sintéticos de audio, imagen, video y texto deben incluir marcas legibles por máquinas capaces de indicar una generación o manipulación artificial. Para Anthropic, el mecanismo textual forma parte de este esfuerzo de cumplimiento.
La empresa también planea ofrecer compatibilidad con C2PA para las imágenes procesadas por Claude. C2PA es un estándar orientado a la procedencia de los contenidos, mientras que la marca de agua descrita para los textos funciona mediante patrones probabilísticos. El expediente no aclara cómo se integrarán ambas soluciones en los productos, qué metadatos se conservarán después de la descarga ni cómo podrán verificar las señales terceros.
En la práctica, la medida puede facilitar auditorías y procesos que dependan de identificar el origen probable de un texto. Instituciones educativas, empresas y plataformas podrían utilizar un detector asociado con la clave de Anthropic para verificar materiales producidos por Claude. Sin embargo, esto no significa que todo texto de origen humano quede automáticamente fuera de sospecha ni que un resultado positivo demuestre por sí solo quién escribió el contenido.
Límites, edición y próximos pasos
La principal limitación reconocida por Anthropic es la resistencia de la señal a la edición. La empresa afirma que las modificaciones leves probablemente no la eliminarán por completo. En cambio, una reescritura total, que sustituya todas las palabras, debería eliminar la marca. La propia compañía señala que, en ese escenario, resulta discutible llamar al resultado un texto generado por IA, porque el material ha pasado por una transformación integral.
Este punto delimita el alcance de la tecnología. La marca de agua puede ayudar a identificar respuestas conservadas o modificadas ligeramente, pero no ofrece una garantía de rastreo después de una reformulación completa. Tampoco está confirmado, según las fuentes proporcionadas, cómo gestionará el detector las traducciones, las revisiones humanas extensas, las conversiones de formato o los textos combinados con fragmentos producidos por otras herramientas.
Anthropic pretende lanzar una API de detección. Este será un paso importante para evaluar la utilidad práctica de la propuesta, ya que permitirá observar quién tendrá acceso al detector, cuáles serán los requisitos de uso y cómo comunicará la empresa los resultados. El expediente no presenta un cronograma, documentación técnica de la API ni criterios públicos para interpretar una detección positiva.
- La marca de agua será invisible durante la lectura común y se basará en patrones de selección de palabras.
- El enfoque se describe como una versión de SynthID-Text, de Google DeepMind.
- Anthropic afirma que las ediciones leves probablemente conservarán parte de la señal, mientras que las reescrituras completas deberían eliminarla.
- La empresa planea ofrecer una API de detección, pero no se informó el cronograma.
- Todavía faltan datos independientes sobre precisión, falsos positivos y rendimiento en distintos usos.
La reacción de los usuarios demuestra que la medida también tiene una dimensión de gobernanza. TechCrunch informó sobre debates en foros y afirmaciones de cancelaciones de suscripciones, aunque el expediente no ofrece una verificación independiente de esas afirmaciones. El conflicto central es conocido: la misma marca que puede aumentar la transparencia para terceros también puede ser percibida por los usuarios como una forma de rastrear o clasificar sus textos.
Lo que debe seguirse ahora es la implementación concreta: cuándo se activará la función, qué productos abarcará, cómo funcionará la API y qué pruebas presentará Anthropic sobre calidad y confiabilidad. Hasta que aparezcan esos datos, es más preciso considerar la tecnología como una estrategia anunciada de cumplimiento e identificación, no como una solución demostrablemente inviolable para atribuir la autoría.
Nuestro prisma
La propuesta de Anthropic desplaza la detección de textos de IA desde los indicios estilísticos hacia un mecanismo insertado en el momento de la generación. Esto puede mejorar la transparencia sin alterar la experiencia de lectura, pero su eficacia dependerá del acceso al detector, de la calidad de la clave y de la resistencia a las transformaciones del texto. El reconocimiento de que una reescritura completa elimina la señal demuestra que la marca de agua no equivale a una prueba permanente de autoría. El punto decisivo será la publicación de datos técnicos independientes sobre precisión, falsos positivos y rendimiento fuera del inglés.
Fuentes: The Verge (IA) · TechCrunch (IA)
Preguntas frecuentes
¿Cómo funcionará la marca de agua de Claude?
El sistema insertará patrones estadísticos en la selección de palabras durante la generación del texto, sin alterar visualmente la respuesta para el lector.
¿La marca de agua se eliminará con la edición?
Según Anthropic, las ediciones leves probablemente no eliminarán por completo la señal, pero una reescritura integral, con la sustitución de todas las palabras, debería eliminarla.
¿La tecnología afectará la calidad de las respuestas?
Anthropic afirma que no habrá un impacto práctico en la calidad ni en el contenido de las respuestas, pero los materiales proporcionados no incluyen pruebas independientes que confirmen esta declaración.
Recibe Radar de IA todos los días
Las noticias de inteligencia artificial que importan — con nuestro prisma y siempre con las fuentes. Gratis.






