Un ejecutivo de Microsoft calificó el scraping de IA como 'el mayor robo de mano de obra de la historia humana', según documentos judiciales
Documentos recién desclasificados en la demanda de The New York Times contra OpenAI y Microsoft revelan que un alto ejecutivo de Microsoft describió en privado las prácticas de entrenamiento de IA como 'robo'.
Nueva información sin redactar en la demanda por derechos de autor que The New York Times presentó contra OpenAI y Microsoft hace tres años revela una admisión de que el scraping de IA equivalía a un robo, y que los productos de IA representan una gran amenaza para las publicaciones.
Según la demanda, un alto ejecutivo de Microsoft describió en privado las prácticas de entrenamiento de IA de las empresas como "robo", y el propio liderazgo de OpenAI dijo que sus modelos de IA representaban una "amenaza existencial" para los editores y periodistas cuyo trabajo los entrenó.
El material desclasificado también detalla cómo las empresas supuestamente obtuvieron y usaron ese contenido sorteando muros de pago sin ser detectadas, construyendo conjuntos de datos de entrenamiento mediante scraping masivo y eliminando deliberadamente los avisos de derechos de autor de los datos de entrenamiento.
Contexto del caso
Vale la pena señalar que gran parte de la nueva información proviene del propio escrito de The Times, no de las pruebas subyacentes, que permanecen selladas. Las citas a continuación se presentan sin su contexto original.
La presentación sin redactar es la última escalada en la demanda de tres años, en la que The New York Times alegó inicialmente que las empresas violaron la ley de derechos de autor al entrenar modelos de IA generativa con su contenido.
La cuestión de si las empresas de IA pueden usar legalmente material protegido por derechos de autor para entrenar IA no tiene una respuesta clara, pero los jueces han sido en gran medida favorables a los argumentos de las empresas de IA de que el entrenamiento constituye "uso justo". Esta regla legal permite usar obras protegidas sin permiso en ciertos casos, como la parodia, el reportaje periodístico o la crítica. A principios de este mes, la administración Trump presentó un escrito en defensa del uso sin licencia de material protegido por parte de OpenAI para entrenar sus LLM.
Sin embargo, varias de las nuevas admisiones contradicen la defensa de uso justo de OpenAI, particularmente el requisito de la regla de que el uso no sustituya ni perjudique el mercado de la obra original.
Por ejemplo, los propios datos de Microsoft muestran que su "motor de respuestas" Copilot provocó que las tasas de clics hacia el dominio de The New York Times cayeran hasta un 93% en comparación con la búsqueda tradicional de Bing.
Fuente: TechCrunch
