¿Qué es el “Proyecto Panamá” y por qué la inteligencia artificial está en el centro?

El denominado “Proyecto Panamá”, relacionado con la empresa de inteligencia artificial Anthropic, ha vuelto a generar debate sobre la manera en que las compañías tecnológicas obtienen y utilizan libros para entrenar sus modelos de IA.

El caso salió a la luz a partir de documentos judiciales relacionados con el proceso Bartz et al. v. Anthropic, en Estados Unidos. Según esos documentos, Anthropic adquirió grandes cantidades de libros físicos, retiró sus encuadernaciones, escaneó sus páginas para convertirlas en archivos digitales y posteriormente se deshizo de los ejemplares físicos. El objetivo era construir una biblioteca digital que pudiera servir para el desarrollo y entrenamiento de sus modelos de inteligencia artificial.

El procedimiento partía de la adquisición de libros, muchos de ellos provenientes del mercado de segunda mano. Los ejemplares eran preparados para un proceso de digitalización masiva: se retiraban las cubiertas y los lomos, las páginas eran escaneadas y su contenido convertido en información digital que podía ser procesada por sistemas informáticos.

La importancia de este proceso radica en que los modelos de lenguaje necesitan grandes cantidades de información para aprender patrones de escritura, vocabulario, estructuras lingüísticas y diferentes formas de expresión. En este caso, los libros proporcionaban material escrito de mayor calidad y variedad para el entrenamiento de los sistemas de IA.

Le recomendamos leer

El nombre Proyecto Panamá se ha utilizado para identificar esta operación que, de acuerdo con los documentos judiciales difundidos, se desarrolló de manera reservada. La revelación generó especial interés porque muestra una dimensión poco visible del desarrollo de la inteligencia artificial.

¿Por qué la inteligencia artificial está en el centro del caso?

La IA necesita enormes volúmenes de datos para entrenar modelos capaces de comprender y producir lenguaje humano. Los libros representan una fuente especialmente valiosa porque contienen textos extensos, estructurados y editados, que permiten a los modelos aprender diferentes estilos, conceptos y formas de construcción lingüística.

Sin embargo, el uso de obras protegidas por derechos de autor ha generado uno de los principales debates legales de la industria tecnológica: ¿hasta dónde pueden llegar las empresas de inteligencia artificial para obtener los datos que necesitan para desarrollar sus sistemas?

El caso Anthropic es especialmente relevante porque un tribunal estadounidense determinó en 2025 que la digitalización de libros obtenidos legalmente y su utilización para entrenar modelos podía estar protegida por la doctrina de “fair use” o uso legítimo. Sin embargo, el mismo tribunal concluyó que la adquisición de millones de copias mediante fuentes piratas no quedaba protegida por esa doctrina.

Posted in InternacionalesEtiquetas

Más de panorama

Más leídas de panorama

Las Más leídas