Anthropic, Inteligencia Artificial

Anthropic incorpora una marca de agua al texto generado por Claude


Anthropic confirmó que los nuevos modelos de Claude incorporarán una marca de agua en los textos que generan, como parte de las exigencias de transparencia del EU AI Act. La compañía aclara que el sistema es invisible para los lectores y no modifica de forma apreciable la calidad, el contenido ni el precio de las respuestas.

El sistema funciona aprovechando las decisiones que el modelo toma al elegir entre palabras igualmente válidas. Esas elecciones dejan un patrón estadístico detectable mediante una clave, que permite estimar si Claude participó en la creación de un texto. No agrega caracteres, tokens ni información sobre el usuario.

La tecnología tiene algunas limitaciones:

  • No identifica a la persona que utilizó Claude ni su organización.
  • No permite determinar si el texto fue escrito completamente por IA o simplemente editado por Claude.
  • Los textos muy cortos pueden ser difíciles de detectar.
  • Una reescritura completa puede eliminar la marca.

Anthropic también confirmó que próximamente ofrecerá una API para detectar estas marcas. En imágenes y otros archivos compatibles utilizará C2PA, un estándar abierto que incorpora información sobre el origen del contenido en los metadatos.

La compañía implementará el sistema globalmente porque el EU AI Act exige marcar el contenido generado por IA desde el 2 de agosto. Anthropic señala que otros grandes desarrolladores de modelos también adoptarán mecanismos similares.

Compartir

Más historias

¡La forma más inteligente de empezar tu semana!

Más de 500 lectores ya reciben el resumen semanal de QUVO en su bandeja.