
Documentos judiciales recientemente desclasificados en el caso The New York Times contra OpenAI y Microsoft, según el resumen de The Verge, contienen advertencias internas sobre la formación de un «círculo vicioso» que podría dañar la web. En los documentos, la recopilación de datos para entrenar modelos también se describía de forma extremadamente crítica: como una apropiación masiva de trabajo y como una burla al concepto de uso justo.
Muchas de las declaraciones más notables, según The Verge, pertenecen a Brent Hecht, director de investigación aplicada de Microsoft. Sin embargo, Microsoft intentó distanciarse de sus afirmaciones.
La historia es importante porque aborda la disputa sobre los límites del uso de materiales de la web para entrenar IA y las consecuencias de ese enfoque para los creadores de contenido. Pero el paquete presentado no contiene el texto completo de los documentos ni confirmación independiente de las formulaciones.
comentario editorial
Por qué importa
La consecuencia probable es un fortalecimiento de la disputa sobre reglas legales y económicas para la recopilación de datos en la web para entrenar IA. El siguiente signo observable serán los textos completos de los documentos, comentarios oficiales de las partes o nuevos materiales judiciales. Una gran incertidumbre está vinculada a que actualmente solo hay un resumen de The Verge, sin el texto original y sin confirmación adicional.