Anthropic comparte detalles sobre cómo funcionarán las nuevas marcas de agua en Claude
Anthropic publicó un artículo explicando cómo el chatbot Claude utilizará marcas de agua en textos para cumplir con la Ley de IA de la Unión Europea.
Anthropic publicó un artículo el viernes buscando responder algunas preguntas básicas sobre cómo aplicará marcas de agua al texto generado por su chatbot Claude. Por ejemplo, ¿cómo funcionará exactamente la marcación? ¿Se puede ocultar con la edición? ¿Y cómo afecta esto al código?
Los usuarios de Claude han estado debatiendo el movimiento desde que la empresa reveló hace unos días que lo haría para cumplir con el Código de Transparencia de la Ley de IA de la Unión Europea, que requiere que las empresas de IA utilicen sistemas que hagan posible identificar contenido generado por IA.
Reacciones en redes sociales
En Reddit, por ejemplo, un publicador caracterizó esto como una conspiración contra usuarios inocentes de Claude, mientras que otro afirmó: La única razón por la que no querría esto es para mentir a las personas. Business Insider informa que docenas de usuarios en X han afirmado cancelar sus suscripciones a Claude como resultado.
Cómo funcionan las marcas de agua
El nuevo artículo de Anthropic comienza con una descripción general del concepto de marcación de agua, explicando que al tomar decisiones de bajo riesgo, como elegir entre las palabras sobrecaste y gris para describir el clima, Claude puede crear un patrón en sus respuestas que sea indetectable para el lector, pero que sea detectable para cualquiera que tenga una clave que lo codifique.
La marcación de agua no afecta la calidad de la salida de Claude, dijo la empresa. Para un lector, una respuesta marcada es indistinguible de una no marcada.
Enfoque de Google DeepMind
Más específicamente, Anthropic dijo que utilizará el enfoque SynthID-Text que el equipo de Google DeepMind esbozó en 2024, y que planea lanzar una API de detección de marcas de agua. También señaló que la marcación es distinta de los enfoques de detección de IA ofrecidos por empresas como Pangram que buscan identificadores en la escritura para revelar uso de IA.
¿Podría alguien simplemente reescribir el texto para ocultar la marca de agua? Anthropic dijo que es posible, pero la edición ligera probablemente no eliminará completamente la marca. Sin embargo, una reescritura completa donde se reemplaza cada palabra lo hará. En este último caso, por supuesto, es cuestionable si el texto aún puede describirse como generado por IA, señaló la empresa.
Fuente: TechCrunch
