The New York Times y el Daily News presentaron una moción de sanciones contra OpenAI, en la que acusan a la empresa de haber ocultado durante el litigio su propia capacidad para rastrear obras con derechos de autor dentro de sus datos de entrenamiento y de los registros de conversaciones de ChatGPT. La moción, del 9 de julio, escala una demanda por infracción de derechos de autor que ambos medios sostienen desde hace dos años, según TechCrunch.
OpenAI había argumentado ante el tribunal que ese tipo de búsquedas eran técnicamente imposibles y que, además, plantearían problemas de privacidad para sus usuarios. Los demandantes sostienen ahora que esa defensa era falsa.
Lo que reveló la declaración bajo juramento
La base de esa acusación es una declaración bajo juramento de abril del ingeniero de privacidad de datos de OpenAI, Vinnie Monaco. Según TechCrunch, Monaco reveló que la empresa ya había realizado búsquedas internas en su corpus de entrenamiento para identificar obras periodísticas protegidas, y que contaba con una base de aproximadamente 78 millones de conversaciones de ChatGPT desidentificadas, que usaba puertas adentro para evaluar cuánto estaba infringiendo material ajeno.
Poco después de que arrancara la demanda, OpenAI implementó un filtro bautizado "Bloom", parte de un conjunto de herramientas internas llamado "Project Giraffe", diseñado para detectar y registrar cuándo el modelo reproducía contenido ajeno en sus respuestas.
Evidencia borrada y una muestra "inutilizable"
Los demandantes afirman que OpenAI borró miles de millones de respuestas de ChatGPT después de iniciado el juicio, en violación directa de la orden judicial que exigía preservar esa evidencia. Cuando la empresa finalmente entregó una muestra de 20 millones de registros de chat en diciembre, llegó con redacciones tan extensas que la corte las calificó de inutilizables.
Con esa base, la moción pide a la corte:
- que impida a OpenAI usar la muestra de 20 millones de registros como evidencia;
- que dé por probado que esos registros habrían mostrado reproducción sustancial del material de los demandantes;
- que impida a OpenAI argumentar lo contrario;
- que la empresa pague los honorarios legales del litigio.
OpenAI niega las acusaciones. Su vocero, Drew Pusateri, respondió:
"A medida que el caso del Times se debilita y se vieron obligados a retirar reclamos contra nosotros, insisten en sus esfuerzos por invadir la privacidad de personas que no tienen nada que ver con este caso."
La corte todavía no resolvió la moción. El litigio original discutía si OpenAI entrenó con artículos protegidos; esta moción suma una segunda pregunta, si la empresa faltó a la verdad ante el tribunal sobre su propia capacidad de averiguarlo.
