← Inicio

Amazon destruye libros raros para entrenar IAs — y el mercado librero está en shock

Qué pasó

Una investigación de 404 Media, publicada el 17 de agosto de 2026, reveló que Amazon compra grandes cantidades de libros —muchos de ellos raros y sin valor comercial— y los destruye en el proceso: los lomos son cortados, las páginas son escaneadas en masa y el volumen es triturado. El rastreo de un AirTag escondido en una copia rara permitió al equipo periodístico seguir el envío hasta un galpón en Las Vegas, Nevada, donde un equipo designado como "VGT3" realiza este trabajo diariamente. El logotipo en la puerta del equipo muestra un tiranosaurio devorando un libro.

La empresa no ha mencionado inteligencia artificial en sus comunicaciones. Para 404 Media y Ars Technica, Amazon afirmó solo que "compra libros por canales comerciales para ayudar a desarrollar y mejorar los productos y servicios que nuestros clientes usan". La declaración neither confirma ni niega el uso de libros para el entrenamiento de modelos de lenguaje.

El método: por ISBN, no por título

Un detalle crucial de la operación se refiere a la estrategia de adquisición. Los libreros sospechan desde hace más de un año que las empresas de IA estarían comprando stocks enteros no por título, sino por ISBN —el código universal que identifica cada edición impresa. La lógica es simple: recoger el mayor número posible de ISBNs distintos garantiza la digitalización prácticamente de todos los libros publicados. Esto explica patrones de compra que parecían sin sentido para el comercio tradicional: ediciones celebradas siendo ignoradas, mientras obras antiguas, sin traducción, con tirajes mínimos y poco movimiento en estanterías, están siendo compradas en gran volumen.

En el galpón de Las Vegas, empleados reportaron al 404 Media que escanean el código de barras o ISBN antes de escanear el libro. El personal también mencionó que, a principios de año, Amazon casi se quedó sin libros para escanear —tanto que algunos se preocuparon por el cierre del galpón. La operación está activa y suministrando datos.

Por qué los libros antiguos son tan valiosos para las IAs

La prioridad por obras publicadas antes de 2022 tiene una causa técnica directa: lo publicado desde puede contener texto escrito por máquina, y los modelos entrenados con salida de modelo degradan mediante un proceso recursivo conocido como "colapso del modelo". Hasta aproximadamente 2022, prácticamente todos los libros impresos fueron escritos por humanos. Entrenar un modelo en texto generado por otros modelos causa que la calidad de las salidas degrade progresivamente. La escritura humana pre-internet y pre-chatbot es, por tanto, una fuente finita y cada vez más escasa de datos de entrenamiento de alta calidad.

Documentos judiciales desclasados revelaron que Anthropic bautizó su proyecto de escaneo destructivo como "Project Panama", con el objetivo declarado de escanear todos los libros del mundo. Uno de los co-fundadores de la empresa teorizó que entrenar IAs con libros podría enseñarles "a escribir bien" en lugar de imitar el "habla de baja calidad de internet". Anthropic también pagó $1.5 mil millones para resolver una acción judicial sobre copias piratas, pero públicamente afirma que no compra ni destruye libros raros o antiquarios.

Amazon, en cambio, no ha trazado esa línea públicamente. Y entrena sus modelos en materiales aún más cercanos a su propio ecosistema: 404 Media reportó la semana anterior que Twitch entrenará la IA de Amazon en los streams de los usuarios, a menos que los usuarios encuentren la configuración.

La reacción del gremio librero

El mercado de libros usados y raros está dividido. Stuart Manley, de Barter Books, en el norte de Inglaterra, dijo a la BBC que nunca había visto nada parecido en 30 años de profesión —un pedido reciente en volumen equivalió a una semana entera de ventas normales. No lamenta mucho: "El mundo ya no necesita cinco millones de copias del Código Da Vinci". Hay libros que no se movieron online por 20 años y que ahora fueron vendidos.

Derek Walker, de McNaughtan's, en Edimburgo, traza una línea clara: un texto académico impreso en 100 ejemplares con 75 ya en bibliotecas no es gran pérdida. Pero "sería un problema mucho más significativo si un ejemplar del siglo XVIII, sobreviviendo hasta hoy, fuera comprado para destrucción".

David Tobin, de Walden Books, en el norte de Londres, resumó la inquietud de la clase: es agradable vender títulos que no se mueven há años, y sería triste verlos destruidos. Vender inventario estancado de décadas para entrenamiento de IA plantea cuestiones que van mucho más allá del confort comercial.

Qué está en juego

El escaneo destructivo es posible porque un juez federal, William Alsup, decidió en 2025 que el uso de libros comprados por Anthropic era "extremadamente transformador" y, por tanto, se encuadra en el fair use. Comprar un libro y escanearlo es legal. Destruirlo después es lo que mantiene solo una copia en existencia —el punto crucial de la decisión. Sin embargo, en Gran Bretaña, la situación jurídica es diferente: el punto de partida es que tanto la creación de la biblioteca de entrenamiento como el entrenamiento en sí requieren permiso del titular de los derechos de autor.

Tres preguntas permanecen sin respuesta. ¿Amazon declarará explícitamente para qué usa sus libros escaneados? ¿Adoptará una excepción para obras raras y antiquarias, como sus competidores afirman hacer? ¿Y alguien mantiene registro de lo que pasó por el escáner VGT3 —porque un archivo digital en un conjunto de entrenamiento privado no es lo mismo que un libro que aún existe en un estante de biblioteca?

Fuentes: 404 Media, TechCrunch, TNW

✓ Fuentes independientes cruzadas y verificadas antes de la publicación