Ejecutivo de Microsoft critica entrenamiento de IA como 'el mayor robo de trabajo en la historia de la humanidad'

  • Las declaraciones salieron a la luz a través de documentos legales presentados en demanda de derechos de autor del NYT

  • Microsoft asegura que se trata de opiniones personales y no representan la posición oficial de la empresa

Microsoft (MS) [Foto=Reuters·Yonhapnews]
Microsoft (MS) [Foto=Reuters·Yonhapnews]

En medio de la polémica sobre derechos de autor en torno al entrenamiento de inteligencia artificial (IA), ha salido a la luz que dentro de Microsoft (MS) también hubo fuertes cuestionamientos internos sobre la forma en que se utilizan los contenidos de medios de comunicación.


El Washington Post reportó el 17 de septiembre (hora local) que un ejecutivo de Microsoft caracterizó el entrenamiento de modelos de IA como "el mayor robo de trabajo en la historia de la humanidad", según consta en documentos judiciales.


La declaración surgió en documentos legales presentados durante el juicio de derechos de autor que el New York Times (NYT) y otros medios de comunicación mantienen contra Microsoft y OpenAI. Los documentos fueron hechos públicos ese mismo día.


El autor de las declaraciones es Brent Hecht, director de Ciencias Aplicadas de Microsoft. Según los documentos presentados por el NYT, Hecht describió el entrenamiento de modelos de IA como "el mayor robo de trabajo en la historia de la humanidad" y en otra ocasión lo llamó "un robo extraordinario de una escala sin precedentes".


Los demandantes, encabezados por el NYT, utilizan estas declaraciones internas como prueba de que Microsoft y OpenAI sabían que estaban utilizando contenido de medios a gran escala para entrenar sistemas de IA sin proporcionar compensación adecuada.


Microsoft trazó una línea clara al afirmar que las declaraciones de Hecht no representan la posición oficial de la empresa. Un portavoz de Microsoft señaló que "reflejan la perspectiva de un empleado individual, no constituyen un análisis legal y no representan la posición de la empresa".


Microsoft y OpenAI han mantenido públicamente que el uso de material disponible al público en el entrenamiento de modelos de IA se ajusta al concepto legal de "uso justo" según la ley de derechos de autor. Sin embargo, los documentos ahora publicados revelan que dentro de ambas empresas también hubo preocupaciones sobre la utilización de contenido periodístico en el entrenamiento de IA.


Greg Brockman, cofundador y presidente de OpenAI, mencionó en un mensaje interno de 2020 que la IA parece ser "particularmente buena en predecir frases de artículos de noticias". Brockman señaló que "si le pides que continúe escribiendo a mitad de una oración del NYT, completa la frase con casi total precisión" y que el modelo de IA es "extremadamente competente en prácticamente cualquier tarea relacionada con noticias".


Satya Nadella, director ejecutivo de Microsoft, declaró en su testimonio relacionado con el juicio que el chatbot podría proporcionar información directamente a los usuarios a través de la plataforma de IA sin necesidad de que acudan a la fuente original. Microsoft respondió afirmando que el testimonio de Nadella es consistente con la posición legal de la empresa, y que se trató de una explicación general sobre los cambios en la forma en que las personas buscan y consumen información.


El NYT actualmente solicita a la corte federal que dicte un fallo sumario que declare que Microsoft y OpenAI son responsables de la reproducción no autorizada de obras protegidas en el desarrollo de modelos de IA.


Steven Lieberman, abogado que representa a los demandantes, argumentó que "esta evidencia recién divulgada demuestra que OpenAI y Microsoft sabían que lo que estaban haciendo estaba mal".


El NYT presentó la demanda por derechos de autor contra Microsoft y OpenAI en 2023. Posteriormente, otros medios de comunicación se sumaron al litigio, incluyendo el New York Daily News, The Intercept y el Center for Investigative Reporting (CIR), una organización sin fines de lucro especializada en reportajes de investigación.


Las empresas de IA argumentan que el uso de contenido publicado en el entrenamiento de IA es similar a como una persona aprende leyendo libros y adquiriendo conocimientos. Por su parte, los medios de comunicación, autores, músicos y otros creadores se oponen, argumentando que las empresas de IA están utilizando obras protegidas sin permiso para crear servicios que podrían reemplazar a los creadores originales.





* Este artículo ha sido traducido por IA.