Ilustración en tonos papiro y grafito, de estética poligonal. Dos hojas de piedra salen de un mismo sobre entreabierto: la de la izquierda, áspera y con líneas irregulares; la de la derecha, lisa, con un sello redondo y líneas regulares.

Cuaderno público

Escrito en 2023

El 17 de septiembre de 2026 se hizo pública sin las principales tachaduras una moción conjunta de los medios que demandan a OpenAI y Microsoft. El escrito pide al juez que resuelva determinadas cuestiones sin juicio y cita comunicaciones, presentaciones y testimonios obtenidos durante el proceso. No son conclusiones del tribunal: son materiales seleccionados y ordenados por una de las partes para sostener su posición.

El comienzo del escrito reúne dos formulaciones atribuidas a Brent Hecht, director de Ciencia Aplicada de Microsoft, procedentes de documentos internos distintos. En uno escribió que millones de personas considerarían que los grandes modelos absorbieran su trabajo como «un robo asombroso de proporciones sin precedentes». En otro describió esa práctica como, posiblemente, «el mayor robo de trabajo de la historia humana».

El mismo escrito cita una presentación posterior, de enero de 2024, en la que Hecht analizó lo que llamó un «bucle de la muerte». Si las respuestas de Copilot reducen el tráfico que llega a los medios, estos pierden recursos para publicar y los modelos futuros encuentran menos contenido del que aprender. Según los datos de Microsoft reproducidos por los demandantes, frente a la búsqueda convencional de Bing los clics hacia las webs de The New York Times descendían entre un 87 y un 93 %; hacia las de Daily News, entre un 83 y un 91 %; y hacia las de Ziff Davis, entre un 51 y un 94 %. El 94 % no corresponde al Times.

El documento no es una sentencia ni una recopilación neutral. Es un escrito de los demandantes, preparado con un propósito procesal. Las citas aparecen dentro de su argumentación y parte de los documentos subyacentes continúa sin ofrecerse públicamente en su contexto íntegro. Eso no vuelve falsas las frases pero limita lo que puede deducirse de ellas.

Microsoft respondió que las palabras de Hecht reflejan la perspectiva individual de un empleado, no constituyen un análisis jurídico y no representan la posición de la empresa. La defensa pública de Microsoft y OpenAI sostiene que el entrenamiento tiene carácter transformador y puede quedar amparado por el fair use. La discrepancia entre esa defensa y los documentos citados forma parte precisamente de lo que los demandantes quieren que el tribunal valore.

Tampoco estamos ante una confesión corporativa de responsabilidad. Hecht ocupaba un puesto técnico relevante, pero sus palabras no equivalen a una decisión del consejo, una posición jurídica de Microsoft ni una admisión judicial. A 4 de octubre de 2026, el litigio continúa abierto y no consta una resolución sobre el fondo que adopte la lectura que dan los demandantes.

Un documento interno y una defensa judicial pertenecen a situaciones distintas. En el primero, alguien puede describir un riesgo técnico, social o económico sin fijar la posición legal de la empresa. En la segunda, los abogados formulan la tesis que la compañía puede sostener ante un tribunal. Que ambos textos difieran no prueba por sí solo engaño ni responsabilidad.

Las dos formulaciones más contundentes atribuidas a Hecht proceden de materiales de 2023, cuando la expansión pública de los modelos de lenguaje apenas empezaba. Antes de que este litigio obligara a las empresas a defender jurídicamente sus sistemas, dentro de Microsoft ya se había formulado el problema en términos de apropiación del trabajo ajeno y falta de compensación.

La presentación de enero de 2024 añade otra dimensión. No se limita al origen de los datos: describe un producto que puede reducir el tráfico y debilitar a quienes producen la información de la que depende. Los porcentajes citados en el escrito no demuestran por sí solos el daño económico total ni su causa exclusiva, pero documentan la diferencia que Microsoft observó entre las respuestas de Copilot y la búsqueda convencional en los dominios analizados.

Para quien crea, escribe o publica, el interés no está en convertir la palabra «robo» en una conclusión jurídica, sino en poder comparar dos registros: lo que una persona con autoridad técnica escribió internamente sobre el origen y los efectos del sistema, y lo que las empresas sostienen ante el tribunal sobre la licitud de ese uso.

Falta conocer los documentos completos en su contexto y saber qué hechos considera probados el juez. Hasta entonces, las frases son relevantes, pero no sustituyen la resolución que todavía no existe.

Sobre la conversación abierta

Este texto continúa la línea del Cuaderno sobre autoría, datos de entrenamiento e infraestructuras. Parte de una lectura del escrito desprecintado de los demandantes y distingue sus alegaciones de las afirmaciones que todavía debe resolver el tribunal. Algunos documentos internos citados no están disponibles públicamente con todo su contexto. Si trabajas en derecho de autor, periodismo o desarrollo de estos sistemas y puedes aportar documentación primaria adicional, escríbeme.

Fuentes

In re OpenAI, Inc. Copyright Infringement Litigation, escrito conjunto de los demandantes en apoyo de su solicitud de sentencia sumaria, documento 1977-1, versión desprecintada en septiembre de 2026.

CourtListener, expediente de The New York Times Company v. Microsoft Corporation, 1:23-cv-11195.

CourtListener, expediente multidistrito In re OpenAI, Inc. Copyright Infringement Litigation, 1:25-md-03143.

Nieman Journalism Lab, «An astonishing theft of unprecedented proportions», 18 de septiembre de 2026.

The Next Web, «A Microsoft scientist called AI training the largest theft of labor», 21 de septiembre de 2026.


Descubre más desde Juan A. Esteban

Suscríbete y recibe las últimas entradas en tu correo electrónico.

Español English (UK)