Un informe de 404 Media ha revelado que las principales empresas de inteligencia artificial están utilizando servicios de intermediación para comprar y destruir millones de libros físicos, con el objetivo de obtener datos de entrenamiento de alta calidad sin generar titulares negativos.
La práctica, que ya había sido documentada en el caso de Anthropic durante un juicio por derechos de autor en 2025, se ha intensificado en los últimos meses. Según la investigación, las empresas contratan a compañías especializadas para adquirir grandes cantidades de libros, que luego son escaneados y desechados, en un proceso que ha generado un aumento sin precedentes en la demanda de ejemplares raros y descatalogados.
El valor de los libros como fuente de datos “puros”
En un ecosistema digital cada vez más saturado de contenido generado por inteligencia artificial, los libros físicos se han convertido en una fuente de datos de gran valor para las empresas tecnológicas. Los textos que no han sido contaminados por el lenguaje artificial ofrecen un material de entrenamiento único que permite a los modelos de lenguaje aprender de ejemplos auténticamente humanos. Un libro solo es útil para una empresa de inteligencia artificial hasta que todas sus páginas han sido escaneadas. Una vez completado el proceso, los libros son destruidos.
El informe de 404 Media revela que las empresas de inteligencia artificial están recurriendo a intermediarios para realizar estas compras de forma anónima. ISBNdb, una base de datos de libros, ofrecía hasta hace poco un servicio de adquisición de libros “adaptado a las necesidades de entrenamiento de modelos de lenguaje, entregado a la escala que la inteligencia artificial exige”. La empresa prometía un “estricto acuerdo de confidencialidad en cada compromiso” para garantizar que “su identidad, estrategia y objetivos de adquisición nunca sean revelados”.
El impacto en el mercado de libros y el precedente legal

Los libreros especializados en libros raros y de baja circulación han confirmado un aumento sin precedentes en las ventas. Un librero citado por 404 Media declaró que está cumpliendo pedidos de cientos de libros a la semana, cuando anteriormente esperaba vender unos 20. Los libros que se compran al por mayor no tienen un tema común, excepto que todos tienen un ISBN, lo que sugiere que se identifican a través de bases de datos.
El proceso de destrucción de libros para el entrenamiento de inteligencia artificial tiene un precedente legal. En 2025, un tribunal dictaminó que Anthropic había violado los derechos de autor al escanear millones de libros, pero el juez también determinó que la transformación de los libros en datos de entrenamiento constituía “uso legítimo” según la ley de derechos de autor. La empresa pagó una indemnización de 1.500 millones de dólares y acordó dejar de escanear libros en el futuro. Sin embargo, la investigación de 404 Media sugiere que otras empresas están utilizando intermediarios para continuar con esta práctica de forma anónima.
Los libreros que participan en estas ventas tienen sentimientos encontrados sobre su papel en el proceso. Por un lado, la demanda les permite liquidar inventarios que de otro modo no se venderían. Por otro, muchos expresan su desaprobación por el destino final de los libros. “No me gusta el uso final, y no me gusta que libros poco comunes sean destruidos”, declaró uno de los libreros citados. El informe de 404 Media pone de manifiesto la creciente tensión entre la necesidad de datos de las empresas de inteligencia artificial y la preservación del patrimonio cultural impreso.
Fuente: PC Gamer / 404 Media, 31 de julio de 2026
