Tiempo de lectura: 3 minutos

Desde que existe el escáner, digitalizar libros siempre significó conservarlos. Escanear una obra era una forma de protegerla, facilitar su consulta y divulgación o evitar que se quedara olvidada en una estantería ¿Que ha cambiado? Esta década está marcada por una carrera frenética para entrenar modelos de inteligencia artificial cada vez más eficientes a cualquier coste, la cual ha desvariado dicha función y está provocando todo un genocidio literario.

¿Que ha está provocando esto? hoy algunos libros ya no se escanean para ser leídos por personas, sino para convertirse en datos, algoritmos. Y en este caso, el proceso termina con cientos de miles de ejemplares físicos destruidos.

Este caso en particular tiene nombre y apellidos: Project Panama.

El caso Project Panama

Project Panama (nombre en clave) es una iniciativa de Anthropic, la compañía detrás de Claude, que salió a la luz a través de documentos judiciales en una demanda por derechos de autor, según la información publicada por medios como The Washington Post, el proyecto busca comprar libros físicos, retirarles la encuadernación, cortar sus páginas, escanearlas y después desechar el ejemplar original.

Pero, ¿Porque hacer esto? Los modelos de IA actuales necesitan enormes cantidades de texto y contexto original para aprender, además de necesitar «feedback» de autores humanos con buena narrativa y claridad redactora, para poder imitar a la perfección su contenido. Y los libros son una fuente muy valiosa porque suelen estar editados, corregidos, estructurados y escritos con más cuidado que buena parte del contenido disponible en Internet (foros, rrss…), esto es oro para una empresa de IA, ya que un libro puede convertirse en el mejor alimento para su entrenamiento.

Del estante al dataset

El problema no es escanear libros, ya que digitalizar puede servir para conservar, consultar y abrir el acceso a obras que de otra forma quedarían olvidadas.

Lo preocupante empieza cuando el libro se compra solo para acabar siendo destruido. En Project Panama, el proceso descrito en documentos judiciales era muy claro: Las alarmas saltaron cuando a mediados de mayo y junio de 2026, libreros independientes de países como Alemania, Nueva Zelanda, Canadá y España detectaron compras masivas de obras descatalogadas, algunas sin código ISBN, académicas y de ficción, sin reemplazo ni reedición posible, por lo que su destrucción las pone en riesgo de perderse para siempre. Dichas obras fueron automatizadas por Anthropic que vaciaban sus inventarios de libros usados, posteriormente en instalaciones y almacenes operados por subcontratistas y proveedores logísticos especializados sobre digitalización documental quitado la encuadernación, cortado las páginas, pasándolas por el escáner y triturando lo que quedaba. No se conoce la cifra final, porque aparece tachada en los documentos, pero estimaciones de proveedores hablan de alrededor de 500.000 y 2 millones de libros digitalizados.

Ahí el libro deja de ser una obra y pasa a ser materia prima. Ya no importa como ejemplar, sino como texto extraíble para entrenar un modelo.

El riesgo de la acaparación de conocimiento

Project Panama también abre otra pregunta: ¿quién controla esos libros una vez convertidos en dataset?

Antes un libro podía estar en una biblioteca, una librería de segunda mano, una colección particular o un archivo. Después del escaneo destructivo, el ejemplar desaparece y su contenido queda dentro de una infraestructura privada, cerrada y orientada a entrenar modelos comerciales.

La cuestión legal es compleja. No es la primera vez que Anthropic recurre a tácticas de contenido masivo para alimentar sus modelos, En agosto de 2024, autores demandaron a anthropic por presuntamente utilizar libros con derechos de autor para entrenar sus modelos de ia, en julio de 2025 un tribunal dictó que en 2021 Anthropic descargó 196.640 copias no autorizadas desde controvertidas plataformas de libros piratas como Books3, después unos cinco millones desde LibGen y en 2022 al menos dos millones desde PiLiMi, el tribunal diferenció entre transformar libros comprados en copias digitales internas y usar obras obtenidas de fuentes no autorizadas. De hecho, el caso Anthropic acabó muy marcado por el debate sobre libros pirateados y derechos de autor, además del propio escaneo destructivo.

El caso terminó fallando a favor de los autores, Anthropic aceptó pagar 1.500 millones de dólares a los autores, el mayor acuerdo conocido en un caso de copyright en Estados Unidos. El acuerdo cubrió cientos de miles de libros y supuso alrededor de 3.000 dólares por obra de indemnización para el autor de cada obra.

Pero incluso si una parte puede defenderse jurídicamente, queda la pregunta cultural: ¿queremos que el acceso al conocimiento pase cada vez más por empresas capaces de comprarlo, procesarlo y cerrarlo vorazmente dentro de sus modelos?

La pregunta incómoda

La cuestión no es estar contra la inteligencia artificial ni contra la digitalización. Ya que ambas pueden tener usos muy valiosos.

El problema radica donde el conocimiento empieza a tratarse como una cantera: se compra, se corta, se escanea, se procesa y se «descarta» el soporte original. Project Panama deja una caso que da a pensar: libros entrando en cajas y saliendo destruidos, convertidos en datos.

La historia de la computación siempre ha estado ligada a la información. Pero esta vez no hablamos solo de datos. Hablamos de memoria cultural, de concentración de poder y de ejemplares físicos que, una vez destruidos, no volverán nunca.