
AI Safety2026-09-10
IEEE Spectrum AI
Modelos de IA ahora marcarán su texto con agua invisible
En un esfuerzo coordinado para frenar la propagación de desinformación, Anthropic ha confirmado que todas las versiones futuras de sus modelos Claude incorporarán una marca de agua invisible en el texto que generen. Esta decisión alinea a la compañía con Google y OpenAI, que ya han implementado técnicas similares en sus sistemas de IA, especialmente en el caso de Gemini de Google.
La tecnología de marcado, en la que se basa el enfoque de Anthropic, funciona introduciendo cambios sutiles y estadísticamente detectables en la selección de palabras y la estructura de las frases que producen los modelos. Estos patrones son imperceptibles para las personas, pero pueden ser identificados de manera fiable mediante software especializado. La meta es ofrecer un método consistente para diferenciar el contenido generado por IA del escrito por humanos, respondiendo a las crecientes preocupaciones sobre la autenticidad de la información en línea.
Este avance llega en un momento en que las herramientas de escritura con IA se vuelven cada vez más capaces, dificultando la detección de artículos, reseñas o publicaciones en redes sociales creados automáticamente. El potencial de uso indebido es amplio, desde propaganda automatizada hasta fraude académico. Al incrustar una huella digital en sus resultados, las empresas esperan ofrecer una red de seguridad para plataformas y reguladores que necesiten verificar el origen de un texto. Si bien la tecnología no es infalible y podría ser sorteada por usuarios sofisticados, representa un avance significativo hacia la rendición de cuentas. La adopción de esta práctica a nivel industrial refleja un reconocimiento colectivo: a medida que crecen las capacidades creativas de la IA, también deben hacerlo los mecanismos para garantizar la transparencia y la confianza en el ecosistema digital.