"Proyecto Panamá", para alimentar a la IA
"Proyecto Panamá", para alimentar a la IA Credit: Nothing Ahead

LONDRES, Reino Unido.— Este domingo, la Corporación Británica de Radiodifusión, conocida por sus siglas en inglés como BBC (British Broadcasting Corporation) publicó un artículo sobre el “Proyecto Panamá” y cómo se reveló la destrucción de miles de libros antiguos para entrenar a la inteligencia artificial (IA).

¿Qué es el Proyecto Panamá?

Según un artículo de Craig Saueurs para Euronews, documentos judiciales recién desclasificados revelaron que la empresa estadounidense Anthropic, de investigación y seguridad en inteligencia artificial fundada en 2021 por exinvestigadores de OpenAI, compró, destruyó y escaneó en secreto para entrenar su chatbot de IA, Claude.

La publicación agrega que, al parecer, los libros fueron cortados por los lomos y escaneados, para procesar su contenido en masa.

Esta información se utilizó para entrenar modelos de IA capaces de imitar la voz y la estructura del las lenguas.

Proyecto Panamá era el plan secreto de Anthropic “para escanear de forma destructiva todos los libros del mundo”, reveló un documento interno de planificación que salió a la luz en unos escritos judiciales a finales del mes de julio.

La información fue publicada por el periódico estadounidense The Washington Post y arroja otra sombra sobre la carrera por dominar la IA.

El Proyecto Panamá fue una iniciativa secreta de la empresa de inteligencia artificial Anthropic que consistió en la compra masiva, el escaneo mediante corte de lomos y la posterior destrucción de millones de libros físicos para entrenar sus modelos de lenguaje, como el asistente Claude.

El Proyecto Panamá comenzó a principios de 2024, cuando los directivos de Anthropic buscaban libros anteriores a los disponibles en línea que pudieran enseñar a su chatbot de IA Claude “a escribir bien” en lugar de imitar “la jerga de internet de baja calidad”, según los documentos publicados.

En su artículo, Saueurs dice que la empresa compró miles de libros a varios proveedores, después contrató a una empresa externa para cortar y escanear una a una las páginas de modo que pudieran copiarse y cargarse mediante equipos de imagen industriales.

Un proveedor que trabajó para Anthropic la compañía buscaba “un proveedor de servicios de digitalización de documentos con experiencia, capaz de convertir de 500,000 a dos millones de libros en un periodo de seis meses”.

Por qué libros y no internet

Al parecer, los directivos de Anthropic creían que la iniciativa mejoraría la calidad de la comunicación y ayudaría a abordar el colapso de los modelos de IA, un tipo de degradación que se produce cuando la IA se entrena con textos contaminados por su propia producción.

Por otra parte, los libros ofrecen grandes cantidades de literatura escrita por personas y editada de forma profesional que aún no ha sido estropeada por contenidos generados por IA.

De acuerdo con los documentos judiciales, el cofundador de Anthropic Ben Mann obtuvo una colección de contenidos protegidos por derechos de autor de una “biblioteca en la sombra” llamada LibGen en junio de 2021. El documento incluso incluía una captura de pantalla del navegador de Mann mientras descargaba libros pirateados.

Mann también compartió con otros empleados de Anthropic un enlace a Pirate Library Mirror, un catálogo completo de libros obtenidos de forma ilegal.

Ajuste de cuentas en los tribunales

El Proyecto Panamá salió a la luz debido a la desclasificación de documentos judiciales, referentes a una demanda por derechos de autor, presentada por un grupo de autores, que acusaban a Anthropic de utilizar en forma ilegal sus obras para entrenar a Claude.

La publicación de euronews agrega que, en 2024, un grupo de autores, entre ellos Andrea Bartz, Charles Graeber y Kirk Wallace Johnson, presentó una demanda colectiva contra Anthropic, señalando que la empresa vulneró las leyes de derechos de autor y utilizó libros pirateados para entrenar su modelo de IA.

En septiembre de 2025, Anthropic aceptó pagar 1,500 millones de dólares para resolver el caso.

Cuatro meses después, el diario Washington Post publicó en exclusiva un documento que fue parte del proceso judicial, en el que se mencionaba la existencia de un plan para digitalizar todas las obras escritas por la humanidad.

La compra de libros antiguos

El artículo de Matías Zibell, publicado este domingo por la BBC Mundo, explica que, el 30 de abril pasado Marçal Font, un librero de viejo de Badalona, recibió un pedido que llamó su atención en la Librería Fénix, referente para el comercio de libros antiguos.

Marçal Font, también profesor de Literatura Comparada de la Universidad de Barcelona, explicó a la BBC Mundo que el pedido provenía de una empresa ubicada en Canadá, con sus 20 años de experiencia en venta de libros antiguos “el patrón (de compra) era extraño”, por lo que Font decidió investigar por temor a que se tratara de un fraude.

Consultó con su amigo Xavier Vinaixa, a quien lo unía la pasión por la inteligencia artificial.

El artículo de Matías Zibell agrega que, en su investigación, Vinaixa encontró otros casos como el de Marçal Font en Alemania, en Nueva Zelanda, y todo quedó claro sobre el asunto.

La publicación de la BBC Mundo señala que, en un artículo del periódico británico The Telegraph titulado “Barbarie cultural: cómo las empresas de IA están destruyendo los libros del mundo”, un librero de Haarlem, Países Bajos, cuenta lo que sintió al recibir un pedido masivo de libros:
“En el comercio de libros antiguos es muy poco frecuente que la gente quiera comprar más de un libro. Así que, si alguien viene y dice ‘quiero un par de cientos de sus libros’ resulta muy extraño”, contó el anticuario Pieter de Vries.

También el diario The Guardian, citó una librera de la ciudad de Victoria, Australia, que recibió un pedido de la misma compañía que le compró a Marçal Font: “Hicieron el pedido, pagaron por adelantado y no pusieron reparos a los gastos de envío”, explicó Delfina Manor.

Maximiliano Firtman, profesor argentino y autor de libros sobre programación e inteligencia artificial, fue uno de los autores que demandó a Anthropic en la demanda colectiva.

Según le cuentó a la BBC Mundo, el juez dictaminó que si la empresa compraba el ejemplar del libro, podía usarlo para entrenar a la IA.

“Y ahí empezaron a surgir los testimonios de libreros alrededor del mundo que reciben órdenes de libros que nadie tocaba, y de algunas empresas que se dedican a escanear estos libros y darles el texto ya escaneado a las empresas de inteligencia artificial. Así aparece el tema de la destrucción de los libros”.

¿Están destruyendo libros para alimentar la IA?

Youtube video

Una publicación de Deutsche Welle, el servicio de radiodifusión internacional financiada por el presupuesto fiscal federal alemán, cuestiona ¿Están destruyendo libros para alimentar la IA? y agrega, “La respuesta es sí… pero probablemente no los que tú crees. Buscan libros descatalogados y de baja demanda. ¿Pero por qué?”.

El vídeo comienza con una pregunta aún más compleja: “¿Están destruyendo joyas literarias para alimentar a la IA?” y asegura que esa es la afirmación que circula por todas las redes sociales, sin embargo, al parecer, “la realidad es otra”.

En el vídeo, se confirma que Anthropic está comprando miles de libros físicos en todo el mundo, debido a que necesitan más y más datos para entrenar sus modelos de IA.

Las empresas de IA han extraído ya casi todo lo que hay en internet, y es cada vez más difícil encontrar contenido nuevo, de calidad y escrito por humanos. También porque gran parte de lo que se publica hoy ya es generado por IA, y eso no sirve para entrenar modelos más complejos.

Por eso buscan libros que no hayan sido digitalizados y que hayan sido escritos antes de la era de la IA, principalmente los que despiertan poco interés, como antiguas guías de viaje o libros muy especializados, pero para la IA son clave, son textos profesionales, revisados y bien estructurados.

Pero, es poco probable que sean tesoros culturales, en la mayoría de los casos son libros con muchas copias y como todo es legal, pues si hay que destruir millones de libros, lo harán, todo por la IA.

Lo complicado es que mientras Silicon Valley quema millones de dólares comprando y destruyendo libros solo para escanearlos, en América Latina muchas bibliotecas públicas y archivos históricos se están perdiendo por falta de presupuesto para conservarlos o digitalizarlos, y la lecto-escritura es una competencia clave en cualquier país, eso no lo puede remplazar una IA.

Deja un comentario