¿Es legal entrenar modelos de IA con libros protegidos por derechos de autor? Es complicado
Los modelos de IA que potencian ChatGPT, Gemini y Claude fueron entrenados con obras de autores sin su consentimiento. Un reciente fallo de un juez sugiere que esto podría ser legal, aunque con complicaciones.
Probablemente ya sabes que los modelos de IA que potencian ChatGPT, Gemini, Claude y otros chatbots fueron entrenados en aparentemente infinitas bases de datos de obras publicadas, que contienen cientos de millones de libros, artículos en línea, artículos académicos y prácticamente cualquier cosa que puedas encontrar en internet. La mayoría de los autores publicados han, sin su conocimiento o consentimiento, contribuido al desarrollo de las mismas herramientas de IA que amenazan con socavar sus medios de vida. Eso parece ilegal, ¿verdad?
La realidad no es tan simple.
La complejidad legal
"Creo que uno de los problemas con esta área completa de la ley y esta área completa de la tecnología es que hay mucho sucediendo", le dijo a TechCrunch Cathy Gellis, una abogada con experiencia en propiedad intelectual, derechos de autor y tecnología. "Es muy complejo y hay muchos sentimientos fuertes sobre lo que está sucediendo, tanto a favor como en contra".
El año pasado, en uno de los primeros fallos de su tipo, el Juez William Alsup ordenó a Anthropic pagar un acuerdo de derechos de autor de 1.500 millones de dólares a un grupo de escritores cuyos trabajos fueron utilizados para entrenar los modelos de IA de la empresa. A primera vista, esto pareció una victoria moral a favor de los autores, pero el Juez Alsup en realidad falló que el entrenamiento de IA de Anthropic era legal. Lo que Alsup penalizó a Anthropic fue por piratear estos libros de bibliotecas en línea ilegales.
Interpretación judicial sobre entrenamiento de IA
"Como cualquier lector que aspire a ser escritor, los LLM de Anthropic fueron entrenados en obras no para adelantarse y replicarlas o desplazarlas, sino para girar una esquina cerrada y crear algo diferente", escribió el juez, comparando la forma en que un LLM ingiere billones de palabras con el estudio de literatura de un escritor.
Gellis cree que el fallo es más ventajoso para las empresas de IA. ¿Cuál es una multa de 1.500 millones de dólares para una empresa que proyecta aproximadamente 200.000 millones de dólares en ingresos anuales para 2028?
Implicaciones para la industria de IA
"Creo que en general es una buena noticia para el entrenamiento de IA que observara qué estaba sucediendo y realmente pensara que era análogo a leer una obra protegida por derechos de autor en lugar de copiar una obra protegida por derechos de autor", dijo Gellis. "La ley de derechos de autor depende de la copia, pero no depende de usar la obra o experimentar la obra".
El debate sobre la legalidad del entrenamiento de IA en obras protegidas continúa evolucionando en los tribunales y en la esfera pública, con implicaciones significativas para tanto autores como desarrolladores de IA.
Fuente: TechCrunch
