OpenAI ha solicitado a un juez limitar drásticamente el acceso del periódico The New York Times (NYT) a los registros de ChatGPT en el marco de una disputa legal que podría sentar precedentes importantes en el ámbito de la privacidad y el uso de inteligencia artificial. En el centro de este caso se encuentra la acusación de que ChatGPT, el popular chatbot desarrollado por OpenAI, podría estar generando contenido que infringe derechos de autor, una cuestión que ha llevado a NYT a solicitar el acceso a un volumen masivo de registros de conversaciones.
Ambas partes han acordado realizar una conferencia de conciliación confidencial para discutir uno de los aspectos más controvertidos del litigio: la búsqueda por parte de NYT a través de millones de registros de ChatGPT. Sin embargo, esta reunión no se llevará a cabo para resolver todo el caso, sino para abordar el acceso específico a estos registros.
OpenAI, que previamente ha intentado evitar lo que califica como “vigilancia masiva” de los usuarios de ChatGPT, se vio obligado a aceptar que los demandantes de medios de comunicación puedan investigar en los registros de chat, lo que ha generado preocupación entre los usuarios por la posible exposición de contenidos sensibles. Ante esta situación, OpenAI ha propuesto una solución intermedia: permitir el acceso a una muestra de 20 millones de registros, en lugar de los 120 millones que reclama NYT. Según el único experto que ha evaluado el caso, una muestra de 20 millones de registros sería suficiente para determinar la frecuencia con la que ChatGPT podría estar reproduciendo artículos y eludiendo los muros de pago de los sitios de noticias.
El NYT, sin embargo, ha rechazado esta propuesta, insistiendo en la necesidad de examinar un número mucho mayor de registros para poder detectar patrones de infracción a lo largo del tiempo. Esta solicitud ha sido calificada por OpenAI como extraordinaria y desproporcionada, ya que cumplirla implicaría un proceso complejo y costoso, afectando la privacidad de los usuarios al prolongar el tiempo que sus conversaciones se almacenan y aumentando el riesgo de violaciones de seguridad.
En la carta presentada por OpenAI, se argumenta que la búsqueda a través de 120 millones de registros no solo es técnicamente desafiante, sino que también implica un costo significativo en términos de almacenamiento y procesamiento de datos, dado que estos registros son archivos de datos grandes y no estructurados que requieren ser descomprimidos y anonimizados antes de ser examinados.
Además, OpenAI ha señalado que el proceso de hacer que estos registros eliminados sean accesibles es extremadamente complicado, requiriendo tiempo, recursos computacionales y personal técnico especializado. La compañía estima que el análisis de 20 millones de registros podría llevar aproximadamente 12 semanas, mientras que examinar 120 millones podría extenderse a 36 semanas.
Por otro lado, el NYT podría estar motivado a llegar a un acuerdo en la conferencia de esta semana debido a su propia disputa con Microsoft, co-demandado de OpenAI, sobre el acceso a registros de su herramienta interna de inteligencia artificial, ChatExplorer. En este caso, el NYT ha argumentado que la solicitud de Microsoft es excesiva, demandando más de 80,000 registros que incluyen datos de periodistas y abogados del NYT.
La resolución de estas disputas legales podría tener implicaciones significativas para la forma en que se manejan las cuestiones de privacidad y derechos de autor en la era de la inteligencia artificial. Mientras tanto, OpenAI continúa defendiendo el derecho a la privacidad de sus usuarios, argumentando que cualquier forma de acceso masivo a los datos debe ser cuidadosamente gestionada para evitar potenciales daños a la confianza del público en las tecnologías de inteligencia artificial.