technology 6 min de lectura

Las librerías de Japón se vacían para alimentar la IA estadounidense, 50 toneladas a la vez

Un mayorista editorial japonés envió más de 50 toneladas de libros en japonés a Estados Unidos el año pasado. Los documentos judiciales y los datos de exportación apuntan al entrenamiento de IA: la huella física de la economía de los datos, medida en papel destruido.

  • datos de entrenamiento de IA
  • datos de entrenamiento de IA
  • Anthropic
  • mayorista editorial
  • derechos de autor

El almacén estaba lleno de libros. Luego, desaparecieron.

En algún lugar de Estados Unidos, un almacén se está llenando lentamente de papel japonés. No se trata de novelas bestsellers ni de guías turísticas, sino de títulos de hace décadas, volúmenes académicos, archivos de manga, todo lo que tenía en stock un gran distribuidor mayorista japonés de publicaciones. Los libros llegaron en contenedores. Solo el año pasado, los registros de exportación muestran que más de 50 toneladas salieron de Japón con la etiqueta “LIBROS JAPONESES”.

Si cada uno de esos volúmenes eran libros pesados de tapa dura a 500 gramos, el envío equivale a aproximadamente 100.000 ejemplares. Eso no es una adquisición bibliotecaria. Es un flujo de datos.

El rastro del papel conduce a documentos judiciales

El vínculo entre los libros físicos y el entrenamiento de inteligencia artificial aún no está demostrado en Japón, pero las pruebas circunstanciales convergen desde múltiples direcciones. Una investigación de noticias de Red de Información de Japón utilizando la plataforma de análisis comercial Sayari identificó los registros de envío. Documentos judiciales en Estados Unidos nombraron al mismo grupo corporativo del distribuidor mayorista en conexión con Anthropic, la empresa de IA que ha discutido públicamente planes para escanear destructivamente cada libro del mundo.

El enfoque de Anthropic es brutal por diseño. La empresa no licencia textos uno por uno: compra o recolecta libros físicos, los desarma con equipos industriales de encuadernación, fotografía cada página a alta velocidad y digitaliza el resultado antes de descartar los restos. El proceso convierte obras publicadas en datos legibles por máquinas y luego destruye el artefacto original. Según documentos judiciales de EE. UU. citados por 404 Media, las publicaciones japonesas estuvieron entre los objetivos, y el nombre de un importante distribuidor mayorista japonés —el que se sitúa en el centro de la cadena de suministro editorial de Japón— apareció en los expedientes.

Amazon ha estado realizando una operación similar. La prensa estadounidense reportó que la empresa reúne libros físicos en almacenes, los une en rollos masivos, los hace pasar por escáneres y luego tira los restos. Los títulos japoneses también estuvieron incluidos en esos envíos.

El distribuidor en sí no confirmó el uso final. Le dijo al medio investigador que no tiene conocimiento de haber vendido libros de su grupo a empresas de IA con fines de aprendizaje. Pero el registro de exportación no miente: 50 toneladas de “LIBROS JAPONESES” cruzaron el Pacífico en un solo año, y la identidad del comprador no se reveló en los datos aduaneros.

Lo que realmente significa 50 toneladas

Para entender la escala, consideremos el ecosistema editorial japonés. El país produce aproximadamente entre 300.000 y 400.000 títulos nuevos anualmente. Un envío de 100.000 volúmenes representa una porción significativa del inventario de títulos retro, libros que de otro modo permanecerían en almacenes o serían convertidos en pulpa. Estos no son archivos digitales efímeros. Son textos con derechos de autor, con autores, ilustradores, editores y editoriales cuyos nombres aparecen en cada página.

La dimensión del manga es especialmente significativa. La industria del cómic en Japón genera decenas de miles de millones de dólares y depende de un modelo de distribución estrictamente controlado. Si las empresas de IA están ingeriendo sistemáticamente archivos de manga japonés, no solo están copiando imágenes: están absorbiendo un lenguaje visual que tomó décadas desarrollarse, incluyendo composición de viñetas, técnicas de tinta y convenciones de ritmo narrativo que son difíciles de replicar sin el material original.

La ley de derechos de autor de Japón actualmente trata el aprendizaje de la IA como un área gris legal. El profesor Tatsuhiro Ueno, de la facultad de derecho de la Universidad de Waseda, afirmó que el marco existente probablemente permite el aprendizaje de la IA como una forma de análisis de información, pero de inmediato matizó esa posición con una excepción importante: si el uso causa un daño injusto a los intereses de los titulares de derechos de autor, la exención podría no aplicar.

Ese matiz es donde reside la disputa real. También es donde se acumulan decenas de demandas en todo el mundo.

Los editores japoneses han estado luchando esta batalla durante años. La Japan Magazine Publishers Association emitió una declaración conjunta en 2023 advirtiendo que la generación masiva de contenido mediante aprendizaje de IA no autorizado destruiría las oportunidades creativas y haría inviable económicamente la publicación comercial. En 2025, editores y la Japan Cartoonists Association sumaron sus firmas a una declaración que exigía que las empresas obtuvieran licencias adecuadas antes de usar obras con derechos de autor para el entrenamiento de IA.

Su argumento es sencillo: si una empresa de IA necesita millones de textos con derechos de autor para construir un producto, y ese producto compite con los mismos creadores cuya obra consumió, la lógica económica se desploma. A los autores no se les paga. A los ilustradores no se les paga. A los editores no se les paga. Los propios libros se destruyen en el proceso.

Quiénes ganan, quiénes pierden

Los ganadores son claros. Las empresas de IA que garantizan corpora masivos de entrenamiento sin negociar licencias individuales reducen sus costos de adquisición de datos de potenciales cientos de millones al precio de libros usados y envío. El costo marginal de datos de entrenamiento adicionales se acerca a cero una vez que la infraestructura está instalada. Sus modelos mejoran. Sus valoraciones aumentan.

Los perdedores son todos los que crearon el material dentro de esos libros, y no se trata de una preocupación hipotética. Autores e ilustradores japoneses ya han visto su trabajo aparecer en conjuntos de datos de entrenamiento de IA sin consentimiento ni compensación. El daño económico se acumula lentamente. Los lectores comienzan a encontrar contenido generado por IA indistinguible del trabajo humano. Los editores no pueden recuperar inversiones si el panorama competitivo se inunda con modelos derivados entrenados sobre sus catálogos. Toda la estructura de incentivos para la creación profesional se erosiona.

Qué sigue

La situación legal es inestable por diseño. El marco actual de derechos de autor de Japón fue escrito antes de que existiera la IA comercial a gran escala. La excepción de “análisis de información” está siendo probada en tribunales de todo el mundo, y ninguna jurisdicción ha producido un estándar consolidado aún. Japón probablemente seguirá la misma trayectoria: fallos incrementales, interpretaciones cambiantes y un cuerpo creciente de jurisprudencia que ni los creadores ni las empresas de IA consideran satisfactorio.

La presión más práctica podría provenir de las fuerzas del mercado. Si las empresas de IA continúan operando con datos robados, la alternativa es un mundo donde los creadores profesionales opten por salirse por completo: publicando exclusivamente en plataformas que verifiquen la autoría humana, negándose a licenciar obra para cualquier conjunto de datos, o desarrollando medidas técnicas que impidan el escaneo. Parte de esto ya está sucediendo. Si será suficiente para cambiar el comportamiento corporativo permanece como una pregunta abierta.

El envío de 50 toneladas cuenta una historia más amplia que la de un solo distribuidor moviendo inventario. Documenta el momento en que el hambre de datos de las empresas estadounidenses de IA cruzó el Pacífico y convirtió bibliotecas, almacenes y librerías japonesas en materia prima. Los libros eran reales. Los autores eran reales. La destrucción era real. La pregunta ahora es si la ley japonesa, y eventualmente el marco legal global, tratarán esto como un modelo de negocio o como algo completamente diferente.