← Volver a notas
ia,copyright,ley,entrenar,modelos

¿Es legal entrenar modelos de IA con libros protegidos por copyright? Es complicado

La legalidad de entrenar modelos de IA en obras literarias protegidas por copyright es compleja, con casos recientes mostrando que aunque el entrenamiento puede ser legal, el origen de los datos importa significativamente.

RRedacción Sandia Tech·24 de agosto de 2026·2 min

Probablemente ya sabes que los modelos de IA que impulsan ChatGPT, Gemini, Claude y otros chatbots se entrenan en bases de datos aparentemente infinitas de obras publicadas, conteniendo cientos de millones de libros, artículos en línea, trabajos académicos y básicamente cualquier cosa que puedas encontrar en internet. La mayoría de los autores publicados han, sin su conocimiento o consentimiento, contribuido al desarrollo de las mismas herramientas de IA que amenaza con socavar sus medios de vida. Eso parece ilegal, ¿verdad?

La realidad no es tan simple.

Complejidad legal

"Creo que uno de los problemas con esta área completa de la ley y esta área completa de la tecnología es que hay mucho sucediendo", Cathy Gellis, una abogada con experiencia en propiedad intelectual, copyright y tecnología, le dijo a TechCrunch. "Es muy complejo y hay muchas emociones crudas sobre lo que está sucediendo, tanto a favor como en contra".

El caso Anthropic y la decisión del Juez Alsup

El año pasado, en uno de los primeros fallos de su tipo, el Juez William Alsup ordenó a Anthropic pagar un acuerdo por derechos de autor de 1.500 millones de dólares a un grupo de escritores cuyos trabajos fueron utilizados para entrenar los modelos de IA de la empresa. A primera vista, esto parecía una victoria moral a favor de los autores, pero el Juez Alsup en realidad falló que el entrenamiento de IA de Anthropic era legal. Lo que Alsup penalizó a Anthropic fue por piratear estos libros de bibliotecas en línea ilegales en la sombra.

"Como cualquier lector que aspira a ser escritor, los LLM de Anthropic se entrenaron en obras no para correr adelante y replicar o suplantarlas, sino para girar una esquina difícil y crear algo diferente", escribió el juez, comparando la manera en que un LLM ingiere billones de palabras con el estudio de un escritor de literatura.

Interpretación favorable a la IA

Gellis cree que el fallo es más ventajoso para las empresas de IA. ¿Qué significa una multa de 1.500 millones de dólares para una empresa que proyecta aproximadamente 200 mil millones de dólares en ingresos anuales para 2028?

"Creo que es generalmente buenas noticias para el entrenamiento de IA que él mirara lo que estaba sucediendo y realmente lo pensara análogo a leer una obra protegida por copyright en lugar de copiar una obra protegida por copyright", dijo Gellis. "La ley de derechos de autor se centra en copiar, pero no se centra en usar la obra o experimentar...[truncado]".

Los debates sobre la legalidad del entrenamiento de IA en obras protegidas continuarán moldeando el futuro de la industria, con implicaciones significativas tanto para creadores como para desarrolladores de tecnología.

Fuente: TechCrunch

Ver más notas →