Documentos internos de Microsoft y OpenAI revelados en la demanda del NYT sobre scraping de datos
Memorandos sin censura presentados por el New York Times muestran a ejecutivos describir la recolección masiva de contenido como un robo sin precedentes y advierten sobre un bucle económico destructivo.

En la demanda de derechos de autor presentada por The New York Times y otras editoriales contra Microsoft y OpenAI, los demandantes han incorporado al expediente judicial una serie de documentos internos sin censura que revelan la percepción que ambos gigantes tecnológicos tienen sobre la recolección masiva de contenido protegido para entrenar modelos generativos de inteligencia artificial.
Los documentos incluyen correos electrónicos, informes y notas internas que, según informaron Ars Technica el 17 de septiembre de 2026 y Golem.de el 18 de septiembre de 2026, fueron presentados tal cual, sin haber sido editados o filtrados antes de su admisión en el proceso judicial.
El lenguaje ejecutivo califica la práctica como un robo sin precedentes
Un memorando interno citó a Brent Hecht, director de ciencias aplicadas de Microsoft, describiendo la enorme recolección de contenido como "el mayor robo de trabajo en la historia de la humanidad" y señalando que la defensa basada en el uso razonable era objeto de debate dentro de la compañía.
Microsoft subrayó posteriormente que el comentario de Hecht no constituía un análisis jurídico, sino una opinión personal, matiz que la empresa reiteró en su respuesta pública para distanciarse de cualquier posición oficial sobre la legalidad del scraping.
Posible bucle económico destructivo
Otro informe interno de Microsoft alertó sobre un "bucle destructivo": los productos de IA que se alimentan de contenido protegido podrían reducir los ingresos de los productores originales, lo que a su vez disminuiría la disponibilidad de material para entrenar futuros modelos, creando un círculo vicioso de menor remuneración y menor acceso a datos.
Evidencia de caída de tráfico y comportamiento de usuarios
Los demandantes presentaron datos que indican caídas en la tasa de clics de entre el 83 % y el 93 % para ciertos titulares y entre el 51 % y el 94 % para otros, después de que se mostraran respuestas generadas por IA en lugar de los artículos originales; esas cifras se ofrecen como evidencia, no como un hecho dictado por el tribunal.
Mensajes internos de OpenAI revelan que varios empleados anticipaban que los usuarios serían menos propensos a hacer clic en un enlace cuando la respuesta ya estaba incluida en la salida de la IA, reforzando la afirmación de los editores sobre la pérdida de tráfico.
- Brent Hecht calificó el scraping como "el mayor robo de trabajo en la historia de la humanidad"
- Microsoft advirtió de un bucle de ingresos destructivo para los creadores de contenido
- Satya Nadella declaró bajo juramento que los asistentes de IA pueden sustituir una visita al sitio original
- El personal de OpenAI anticipó menores tasas de clics cuando las respuestas se generan previamente
Satya Nadella, director ejecutivo de Microsoft, testificó bajo juramento que los asistentes de IA podrían reemplazar efectivamente la visita del usuario a la fuente original al proporcionar la información solicitada directamente, una declaración que coincide con las preocupaciones internas sobre la pérdida de tráfico.
Los demandantes también alegan que se descubrió una técnica de elusión de paywall que permitió a un proveedor externo suministrar aproximadamente 1,8 millones de artículos del New York Times bajo restricciones de uso comercial, los cuales fueron posteriormente empleados para entrenar modelos de IA.
Microsoft ha respondido que las declaraciones citadas reflejan la perspectiva de un empleado individual y no constituyen la posición legal oficial de la compañía, insistiendo en que su uso de material protegido se enmarca dentro de los límites del uso razonable.
OpenAI, por su parte, mantiene que su proceso de recopilación sigue los lineamientos de la doctrina del fair use y que cualquier contenido obtenido sin autorización se utiliza de forma transformadora, una postura que aún no ha sido evaluada por un tribunal.
Los abogados de los editores señalan que, además de la cuestión del uso razonable, el caso plantea interrogantes sobre la responsabilidad de los proveedores de datos externos que facilitan el acceso masivo a contenido protegido mediante vulnerabilidades técnicas.
En el contexto de la legislación europea, la reciente directiva sobre derechos de autor en el mercado único digital podría reforzar la necesidad de obtener licencias explícitas para el entrenamiento de IA, lo que complicaría aún más los modelos de negocio de empresas como Microsoft y OpenAI.
Para organizaciones de habla hispana, la aparición de estos documentos internos indica un aumento del riesgo para las empresas que dependen de contenido generado por IA; las dudas internas sobre el uso razonable y las pérdidas de tráfico cuantificadas sugieren que futuras litigaciones podrían imponer requisitos de licencia más estrictos, exigir una mayor transparencia en la obtención de datos y elevar los costos de desplegar modelos de lenguaje a gran escala que utilicen textos protegidos.
En Madrid, la asociación de editores digitales ha convocado una reunión para analizar el impacto potencial de la sentencia y explorar estrategias de defensa colectiva, subrayando que la claridad jurídica es esencial para proteger la sostenibilidad del ecosistema informativo en la era de la inteligencia artificial.
Fuentes
- Microsoft exec called AI scraping the largest theft of labor in human historyArs Technica · 17 de septiembre de 2026
- Ungeschwärzte Dokumente belasten Microsoft und OpenAIGolem.de · 18 de septiembre de 2026



