La desposesión digital del conocimiento: el Proyecto Panamá de Anthropic

0

Isidro Páez

En 2024, Anthropic, empresa creadora del asistente Claude, puso en marcha en 2024 el llamado Proyecto Panamá. Según documentación interna desclasificada en el litigio sobre derechos de autor en EEUU, Wired informó que la compañía gastó decenas de millones de dólares en adquirir grandes cantidades de libros impresos. La documentación describía el proyecto como un intento de digitalizar de manera destructiva todos los libros posibles, una operación de escala industrial diseñada para devorar el soporte físico del pensamiento.

Una iniciativa que Anthropic intentó mantener bajo un estricto velo de misterio corporativo, pero documentos judiciales revelaron cómo empresas de IA se apresuraron a obtener más libros para alimentar sus chatbots, incluso mediante la compra, el escaneo y la eliminación de millones de títulos. En enero de 2024, el Washington Post informaba que ejecutivos de la startup de inteligencia artificial Anthropic impulsaron un ambicioso proyecto. “Es nuestro esfuerzo por escanear de forma destructiva todos los libros del mundo”, decía un documento de planificación interna revelado en documentos legales. El mismo documento añade según el Boston Globe «No queremos que se sepa que estamos trabajando en esto». Aunque no se ha revelado la cantidad de libros comprados ni cuánto gastó Anthropic en ellos, la empresa estima que existen 130 millones de libros únicos en el mundo, de los cuales 40 millones están a la venta.

El Proyecto Panamá se encuentra dentro de la infraestructura privada de Anthropic. Ningún lector accede a él. Ninguna biblioteca lo manipula. Un libro impreso bien conservado puede sobrevivir siglos. Los modelos de IA se vuelven obsoletos en ciclos de producto que se miden en años. Anthropic no quería que supiéramos que estaban destruyendo millones de libros para alimentar su software.

El Proyecto Panamá se basaba en la premisa de alimentar a los robots con toneladas de libros, físicos, hechos de papel y tinta, para enseñarles «a escribir bien» en lugar de imitar el AI slop, lenguaje de baja calidad de internet, un término despectivo referido específicamente a textos, imágenes, videos y códigos de baja calidad generados de forma automática por IA con el único fin de rellenar feeds, atraer clics sin esfuerzo y monetizar plataformas.

El Washington Post estima una cifra de entre quinientos mil y dos millones de volúmenes, comprados a lo largo de unos seis meses a un coste de decenas de millones de dólares. El proceso operativo operaba con la frialdad de un matadero intelectual, cada uno de los libros se escaneaba página por página y se introducía en el gran modelo de lenguaje (LLM) de Anthropic para perfeccionar sus habilidades de escritura. Concretamente, el proceso utilizaba una «máquina de corte hidráulica» para «desmembrar con precisión» las encuadernaciones de los millones de libros que recibía de los vendedores de libros usados, y luego escaneaba cada página «con escáneres de alta velocidad y calidad profesional«. Después, se contrataba a una empresa de reciclaje para hacer pasta de papel de los originales en papel, porque «no había que desperdiciar nada» indica Wired. Se destruía la base material —el libro como tecnología de preservación— para extraer su valor de cambio digital.

Implicaciones del “uso legítimo” (Fair Use) en el entrenamiento de IA y el vacío legal del escaneo.

La rápida evolución de la IA generativa ha provocado una creciente tensión con el marco jurídico de los derechos de autor, una legislación diseñada mucho antes de la existencia de modelos de lenguaje a gran escala (LLM). Dos sentencias fundamentales y recientes de diferentes jueces del Tribunal de Distrito de EEUU para el Distrito Norte de California

Iniciativas como el Proyecto Panamá o el propio Google Books se apoyaron conceptualmente en este principio del “fair use” para la fase inicial: comprar legalmente millones de libros físicos en el mercado de segunda mano. Sin embargo, la doctrina de la primera venta te permite revender o destruir el papel, pero no te da derecho a hacer copias digitales masivas (reproducción) ni a explotar comercialmente el texto para entrenar un software. Por esta razón, dichas empresas terminaron enfrentados a demandas por infracción de derechos de autor (copyright), ya que el escaneo viola el derecho exclusivo de reproducción del autor.

¿Por qué Google Books ganó y el Proyecto Panamá tuvo que indemnizar?

Aunque ambos compraron libros bajo la «doctrina de la primera venta» (que permite comprar y revender el papel, pero no reproducir digitalmente el contenido de forma masiva), sus destinos jurídicos divergieron por criterios de «uso legítimo».

El caso Authors Guild v. Google, Inc. en EEUU se resolvió de forma definitiva a favor de Google. Tras una batalla legal de 11 años (2005-2016), la justicia de EEUU determinó que la digitalización masiva de libros sin autorización de los autores constituye un «uso legítimo» (fair use) bajo la ley de propiedad intelectual.

Aunque ambos proyectos involucran el escaneo masivo de obras escritas, existen diferencias jurídicas críticas: Mientras que en Google Books el destino final del texto se indexa para que el usuario localice dónde está la información física (libro) en Anthropic se procesa para «entrenar» un software predictivo que genera nuevos textos.

Respecto a la Sustitución del mercado, Google Books no sustituye al libro original. Si quieres leerlo completo, debes comprarlo, solo te ofrece fragmentos del original, por contra Anthropic sí puede sustituir a los autores al producir obras competitivas directamente de su aprendizaje.

Respecto al Acceso público, Google Books es una herramienta abierta y gratuita de consulta pública, en el caso de Anthropic es una base de datos privada cuyo contenido es restringido y protegido para el beneficio comercial de la empresa

El uso legítimo (fair use) son los criterios legales que establece la ley de propiedad intelectual de EEUU (sección 107 de la Copyright Act) para determinar si el uso de una obra protegida sin permiso del autor es legal o constituye una infracción.

No debe causar un perjuicio injustificado a los intereses legítimos del titular de los derechos en el mercado potencial, evalúa si el nuevo producto daña económicamente al autor original al restarle ventas actuales o futuras. Si la sustitución es directa en el mercado (provocando que la gente deje de comprar la obra original), el tribunal raramente concederá el fair use.

 En el caso de Google Books copió millones de libros enteros, sin embargo, la justicia determinó que era transformador, el libro original sigue existiendo para ser leído, mientras que Google Books los usa para construir una herramienta de búsqueda informática que te dice en qué página se encuentra una palabra.

El choque legal entre Anthropic (creadores de Claude) y la Copyright Act se centró en la demanda colectiva Bartz v. Anthropic PBC. Las acusaciones apuntaron a que la empresa vulneró la ley al descargar, escanear y almacenar millones de libros protegidos de forma no autorizada.

La conducta de Anthropic, según se describe en la sentencia del Juez Alsup, consistió en una estrategia multifacética para construir un corpus masivo de datos para el entrenamiento de sus modelos:

-Adquisición de obras: La empresa utilizó dos métodos principales. Primero, descargó millones de libros de sitios de internet conocidos por distribuir contenido pirateado, como Books3, Library Genesis (LibGen) y Pirate Library Mirror (PiLiMi). Esta vía fue una elección deliberada; según el director ejecutivo de Anthropic, se prefirió descargar los libros para evitar el “engorro legal/práctico/comercial” (legal/practice/business slog) de una compra común.

Segundo: la creación de la biblioteca central: El objetivo de estas adquisiciones era amasar una “biblioteca de investigación” o “área de datos generalizada” con la intención de “almacenar todo para siempre” (store everything forever). Esta biblioteca fue concebida como un recurso permanente y de propósito general. A partir de ella los ingenieros de Anthropic seleccionaron y copiaron subconjuntos de obras para crear las “mezclas de datos” (data mixes). Estas mezclas fueron utilizadas para entrenar las sucesivas versiones de los LLM que potencian el servicio de Claude.

Con las copias piratas de la biblioteca (Pirated Library Copies), de manera crucial, el juez determinó que este uso no constituía un fair use. Sostuvo que el acto de descargar masivamente libros pirateados para construir una biblioteca de investigación de propósito general no es transformador en sí mismo. Este acto daña directamente el mercado primario de las obras, ya que sustituye su compra legítima. 

El 26 de julio de 2026 Reuters informó que un juez federal en San Francisco aprobó el histórico acuerdo extrajudicial del pago de 1.500 millones de dólares por parte de Anthropic para resolver una demanda colectiva presentada por un grupo de autores que la acusaron de usar indebidamente los derechos de autor para entrenar a su chatbot de IA, Claude, el mayor pago conocido en un caso de derechos de autor en EEUU

Análisis marxista del Proyecto Panamá

Se aborda este fenómeno no como un simple avance tecnológico, sino como un proceso profundo de acumulación de capital, desposesión y mercantilización del conocimiento humano.

1. Acumulación por Desposesión y Apropiación Digital

Desde la perspectiva de David Harvey este proceso es una forma moderna de acumulación por desposesión.

-Privatización de lo común: El conocimiento acumulado por la humanidad durante siglos en formato de libros (muchos en bibliotecas públicas o mercados de segunda mano) se extrae del dominio público.

-Nuevas apropiaciones: Al igual que el cercamiento de tierras comunales en la Inglaterra del siglo XVIII, la IA «cerca» el saber humano tradicional para encerrarlo en los servidores privados de una corporación privada.

2. Destrucción Creativa y el Valor de Cambio

La destrucción física de los libros ejemplifica la contradicción entre el valor de uso social y el valor de cambio.

-Aniquilación del objeto: Para el capital, el libro físico (su valor de uso como objeto de lectura) ya no tiene valor por sí mismo. Su único valor radica en los datos que contiene (su valor de cambio potencial).

-Destrucción de fuerzas productivas: El capital destruye la base material antigua (el papel y la imprenta) para crear una fuerza productiva infinitamente más rentable y explotable: el modelo de lenguaje algorítmico.

3. Alienación y Proletarización del Trabajo Intelectual

El entrenamiento de modelos de IA representa la fase superior de la enajenación del trabajo.

-Apropiación del trabajo muerto: Marx llama «trabajo muerto» al capital constante (máquinas, herramientas). En este caso, los libros son el «trabajo muerto» de millones de escritores, pensadores y editores fallecidos y vivos.

-Subsunción real: La IA absorbe ese trabajo humano acumulado para cristalizarlo en un software que ahora compite directamente contra los propios trabajadores intelectuales contemporáneos (redactores, traductores, programadores), devaluando su fuerza de trabajo.

4. Concentración del Capital e Imperialismo Tecnológico

El hecho de que solo un puñado de corporaciones multimillonarias puedan financiar operaciones de esta escala confirma las leyes de concentración de Marx.

-Monopolio del saber: El conocimiento ya no pertenece a la sociedad ni a sus creadores, sino a las pocas empresas que poseen el capital constante (supercomputadoras) necesario para procesarlo.

-Asimetría global: Una empresa del Norte Global centraliza la producción cultural global, transformando la herencia intelectual de la humanidad en una mercancía de su propiedad exclusiva.

El capital ya no solo se apropia de la tierra y del sudor de la clase trabajadora; ahora guillotina los libros para privatizar el pensamiento humano acumulado. El Proyecto Panamá demuestra que, en el siglo XXI, la barbarie capitalista no se manifiesta quemando bibliotecas, sino digitalizándolas de forma destructiva para encerrarlas en servidores privados. para alimentar esa obsolescencia acelerada, la industria tecnológica ha recurrido a una táctica visceral: la destrucción física de lo permanente: el libro

Desde la perspectiva marxista, la respuesta a la privatización del conocimiento no es volver al pasado ni destruir las máquinas (lo que Marx llamaba ludismo). La solución radica en cambiar radicalmente quién posee y para qué se usa esa tecnología. Si los modelos de lenguaje existen gracias a que han absorbido el trabajo intelectual colectivo de la humanidad (el «trabajo muerto» de los autores), esos modelos y la infraestructura que los sostiene deben ser considerados bienes públicos, los beneficios de esa automatización deben retornar íntegramente a la sociedad.

Frente al monopolio de corporaciones como Anthropic u OpenAI, la alternativa es la expropiación y socialización de la infraestructura tecnológica mediante:

-Sustituir la parcelación digital por un ecosistema de comunes digitales (digital commons).

-Con servidores e infraestructura pública: Las supercomputadoras y los centros de datos deben dejar de ser propiedad privada y gestionarse como bienes públicos comunes, financiados por el Estado

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.