The Daily Commit · Edición de sección Portada PHP AI Dev EN DE FR ES

TheModelDesk

9 de julio de 2026
modelos, agentes e inferencia local

Noticias

The New York Times acusa a OpenAI de ocultar pruebas en el juicio por derechos de autor

The New York Times y The Daily News han solicitado sanciones contra OpenAI. Alegan que la firma de IA ocultó herramientas internas, conjuntos de datos y un registro de 78 millones de conversaciones utilizado para rastrear infracciones de derechos de autor, contradiciendo sus afirmaciones previas sobre la inviabilidad técnica.

En julio de 2026, The New York Times y The Daily News escalaron su demanda por violación de derechos de autor contra OpenAI mediante una solicitud de sanciones. Los editores acusan a la empresa de ocultar evidencia que contradice las afirmaciones anteriores de OpenAI sobre limitaciones técnicas en la búsqueda de sus propios datos.

Según la declaración de abril del ingeniero de privacidad de datos de OpenAI, Vinnie Monaco, la empresa ya había realizado búsquedas internas en su corpus de entrenamiento para identificar contenido periodístico protegido por derechos de autor. Más significativamente, OpenAI mantenía una base de datos de aproximadamente 78 millones de conversaciones de ChatGPT desidentificadas que utilizaba internamente para evaluar el alcance de las violaciones de derechos de autor. Además, la empresa había implementado un filtro "Bloom" como parte de un conjunto de herramientas llamado "Project Giraffe", diseñado para detectar y registrar instancias donde ChatGPT reproducía contenido existente, desplegado poco después de presentada la demanda.

A lo largo del litigio de dos años, OpenAI había insistido en que carecía de la capacidad técnica para buscar en sus datos de entrenamiento y argumentó que recuperar, procesar y desidentificar sus enormes registros de conversaciones sería operacionalmente gravoso y plantearía preocupaciones de privacidad. Los editores buscaban acceso a estos datos para verificar si su periodismo protegido aparecía en el corpus de entrenamiento de OpenAI y determinar con qué frecuencia ChatGPT generaba respuestas que contenían o reproducían su contenido.

El descubrimiento de estas herramientas y bases de datos representa una contradicción significativa de los argumentos legales anteriores de OpenAI. Cuando los editores solicitaron originalmente 120 millones de registros de chat, OpenAI negoció su reducción a 20 millones. La empresa finalmente presentó esta muestra reducida al tribunal en diciembre de 2025, pero contenía redacciones tan extensas que la hacía prácticamente inutilizable según la evaluación del tribunal.

Leer la fuente original (en inglés) ↗

Valora este artículo: 0

Tribuna de lectores

Aún no hay aportaciones — abre el debate.

← The Model Desk — Page C1

Models, agents & local inference · The Daily Commit · Edición de pantalla · Información legal · Política de privacidad