Tres autores demandan a Nvidia por entrenar NeMo con sus libros

Los escritores Brian Keene, Abdi Nazemian y Stewart O’Nan demandaron a Nvidia ante un tribunal federal de San Francisco. Los tres sostienen que la compañía usó sus libros, sin permiso, para entrenar NeMo, su plataforma de modelos de lenguaje, y piden que el caso se reconozca como acción colectiva abierta a cualquier autor estadounidense en la misma situación.

Books3, el conjunto de datos en el centro del caso

Según la demanda, Nvidia habría entrenado NeMo con «Books3», un conjunto de datos de más de 195.000 libros que circuló durante años por la comunidad de investigación en IA antes de retirarse en octubre tras varias alegaciones de infracción de derechos de autor. Entre las obras citadas explícitamente en la demanda están «Ghost Walk» (2008), de Keene; «Like a Love Story» (2019), de Nazemian; y «Last Night at the Lobster» (2007), de O’Nan.

Los demandantes argumentan que la propia retirada de Books3 por parte de Nvidia se puede leer como un reconocimiento tácito de que el conjunto de datos contenía material protegido usado sin licencia. La demanda reclama compensación para todos los autores estadounidenses cuyas obras se hayan usado para entrenar los modelos de NeMo en los últimos tres años.

Nvidia, en el mismo frente legal que OpenAI y Meta

El caso suma a Nvidia a una lista de compañía de IA que ya enfrentaban demandas similares por parte de escritores y medios, con el New York Times como el ejemplo más conocido contra OpenAI. No es la única vez que el nombre de Nvidia aparece ligado a fuentes de datos de origen dudoso: meses después trascendió también su relación con Anna’s Archive, una biblioteca digital de libros pirateados usada como fuente para entrenar modelos.

La tensión entre editores y compañías de IA no ha hecho más que crecer desde entonces. Casi 400 medios locales y regionales de Estados Unidos demandaron después a OpenAI y Microsoft por el mismo motivo: entrenar modelos con contenido protegido sin pagar licencia ni pedir permiso.

Lo que está en juego no es solo la indemnización a tres autores concretos. Si un tribunal reconoce la acción colectiva, cualquier sentencia sentará precedente sobre qué conjuntos de datos son legítimos para entrenar modelos comerciales de IA en Estados Unidos, y eso afecta directamente al modelo de negocio de fabricantes de GPU e infraestructura como Nvidia, no solo a las empresas que construyen los chatbots finales.

Preguntas frecuentes

¿Quiénes demandan a Nvidia?

Los escritores Brian Keene, Abdi Nazemian y Stewart O’Nan, en un tribunal federal de San Francisco, buscando el estatus de acción colectiva.

¿Qué es Books3?

Un conjunto de datos con más de 195.000 libros que circuló en la comunidad de IA hasta su retirada en octubre tras alegaciones de infracción de derechos de autor.

¿Qué es NeMo?

La plataforma de modelos de lenguaje de Nvidia, que según la demanda se entrenó con las obras de los demandantes sin autorización.

¿Qué precedente podría sentar este caso?

Determinaría qué conjuntos de datos se consideran legítimos para entrenar modelos comerciales de IA en Estados Unidos, con efecto directo sobre fabricantes de infraestructura, no solo sobre quienes desarrollan los chatbots.

Vía: Reuters

Scroll al inicio