Digitalización a gran escala en la era de la inteligencia artificial: cuestiones y modelos de acuerdo para bibliotecas y sus socios

Center for Research Libraries (CRL). (2026). Large Scale Digitization in the AI Era: Issues and Model Terms for Libraries and Their Partners. Center for Research Libraries, 14 pp. Publicado el 14 de septiembre de 2026.

Texto completo

El documento del Center for Research Libraries (CRL) aborda el creciente número de propuestas para digitalizar colecciones bibliotecarias a gran escala y utilizar posteriormente esos contenidos y sus metadatos en sistemas comerciales de inteligencia artificial. Estas colaboraciones pueden facilitar la preservación, ampliar el acceso a las colecciones y reducir los costes de digitalización, pero plantean cuestiones fundamentales sobre propiedad, usos autorizados, acceso público, control institucional, compensación, atribución, privacidad y custodia a largo plazo.

El informe propone que las bibliotecas establezcan condiciones claras antes de poner sus colecciones a disposición de empresas tecnológicas y sistemas de IA. El CRL considera especialmente importante que las instituciones comprendan qué valor generan sus colecciones digitales y qué usos podrán realizar terceros con ellas. El documento pretende servir como punto de partida para desarrollar términos contractuales comunes y orientar futuras negociaciones entre bibliotecas y empresas, incluyendo posibles acuerdos colectivos, solicitudes conjuntas de propuestas y la creación de corpus digitales compartidos.

En definitiva, el informe plantea que la digitalización ya no debe contemplarse únicamente como una estrategia de preservación y acceso, sino también como una cuestión de gobernanza de datos culturales y científicos en la era de la IA. Las decisiones que adopten ahora las bibliotecas pueden contribuir a establecer nuevas normas sobre cómo se utilizan comercialmente colecciones que han sido conservadas y gestionadas como bienes de interés académico y cultural. El CRL señala que cualquier modelo definitivo deberá someterse a nuevas discusiones entre las bibliotecas y a revisión jurídica.

Finalmente, el documento presenta una plantilla marco de términos modelo (Model Digitization Terms) que sirve como guía de negociación para los contratos:

  • Propósito, alcance y derechos de la biblioteca: La biblioteca debe mantener autoridad final sobre qué se digitaliza y conservar derechos para preservar, analizar, albergar y prestar los archivos.
  • Usos del socio e IA: Se exige que cualquier entrenamiento de modelos, evaluación o comercialización mediante IA requiera una autorización explícita y específica, de modo que el silencio contractual nunca sea interpretado como permiso.
  • Metadatos y estándares técnicos: Se debe limitar la cesión inicial de metadatos al mínimo necesario y exigir que el socio devuelva OCR enriquecido, transcripciones e identificadores en formatos interoperables y de calidad de conservación.
  • Estructura económica e indemnizaciones: El socio comercial debe asumir los costos directos e incrementales del proyecto. Legalmente, se debe eximir a la biblioteca de garantizar autorizaciones masivas de derechos de autor, trasladando la responsabilidad e indemnización de los usos derivados al desarrollador.
  • No exclusividad y gobernanza: Salvo excepciones temporales y justificadas, las licencias deben ser no exclusivas, sin cláusulas de confidencialidad que impidan transparentar los términos ante la comunidad académica.

Tendencias del entorno informativo en 2026: resultados de la encuesta internacional a expertos

Altay, Sacha, Sebastián Valenzuela y Philip N. Howard, eds. “Trends in the Information Environment: 2026 Expert Survey Results.” Zurich: International Panel on the Information Environment (IPIE), 2026. Synthesis Report, SR2026.3. DOI: 10.61452/MEMA1194.

PDF

El informe IPIE 2026 muestra un creciente deterioro del entorno informativo, marcado por la desinformación, la falta de responsabilidad de las plataformas y la polarización. La IA generativa puede facilitar el acceso a la información, pero también reducir la diversidad de fuentes, las visitas a contenidos originales y la confianza en los medios.

El informe del International Panel on the Information Environment (IPIE) analiza cómo está evolucionando el entorno informativo mundial a partir de la cuarta encuesta anual realizada a investigadores especializados en información, medios, plataformas digitales, desinformación, algoritmos y alfabetización mediática. La encuesta se realizó entre mayo y junio de 2026 y reunió las respuestas completas de 470 expertos con conocimiento sobre 71 países, casi la mitad de ellos centrados en economías en desarrollo. El estudio parte de una transformación fundamental: las personas ya no se limitan a buscar información, sino que cada vez reciben contenidos previamente seleccionados, ordenados y resumidos por algoritmos, redes sociales y, cada vez más, sistemas de inteligencia artificial generativa. Esta transición modifica no solo la manera de acceder a las noticias y al conocimiento, sino también quién controla los mecanismos que determinan qué información aparece, en qué orden y con qué contexto.

Uno de los resultados más consistentes de la investigación es que los expertos mantienen, por cuarto año consecutivo, una concepción bastante estable de lo que constituye un entorno informativo saludable. La disponibilidad de información precisa continúa siendo considerada el elemento fundamental: el 64 % la considera absolutamente esencial y el 90 % la sitúa entre los niveles más altos de importancia. En segundo lugar aparece la diversidad de voces, considerada absolutamente esencial por el 47 % de los especialistas, seguida de la diversidad en la propiedad de los medios, con el 41 %. Sin embargo, el problema no parece ser únicamente la posibilidad de acceder a diferentes puntos de vista: el 76 % de los expertos considera que las personas pueden encontrar perspectivas diversas en Internet, mientras que solamente el 28 % cree que más de la mitad de la población confía en los principales medios de comunicación para informar con precisión sobre política. Además, solo el 37 % considera que la información disponible proporciona a las personas el conocimiento necesario para participar adecuadamente en la vida cívica.

En relación con las principales amenazas, la falta de responsabilidad y rendición de cuentas de las plataformas digitales aparece como la preocupación más extendida. El 78 % de los expertos la considera una amenaza grande o extrema, seguida de la desinformación, con un 73 %, y la polarización, con un 69 %. También reciben una valoración elevada la concentración del poder en unas pocas plataformas sociales, señalada por el 64 %, y las burbujas de filtros o cámaras de eco, con el 53 %. El informe resulta interesante porque sitúa la inteligencia artificial generativa dentro de un panorama de amenazas más amplio: aunque los expertos manifiestan una preocupación creciente por sus efectos, actualmente consideran más urgentes problemas como la falta de responsabilidad de las plataformas y la desinformación.

La inteligencia artificial generativa constituye, no obstante, uno de los grandes elementos de transformación identificados por el estudio. Por tercer año consecutivo, los expertos esperan que la IA generativa contribuya a empeorar el entorno informativo durante los próximos cinco años. Dentro de sus diferentes aplicaciones, los contenidos audiovisuales generados mediante IA constituyen la mayor preocupación, mientras que los textos generados por IA son considerados relativamente menos problemáticos. El informe subraya que la IA tiene una naturaleza ambivalente: puede reducir los costes de producción de contenidos, ayudar al periodismo y ampliar el acceso a la información, pero también puede producir grandes cantidades de información falsa o engañosa y modificar los mecanismos tradicionales mediante los cuales las personas llegan a las fuentes originales.

Especialmente significativa es la valoración de los resúmenes generados por IA que aparecen en los buscadores. El 79 % de los expertos considera que estos sistemas permitirán encontrar respuestas con mayor rapidez. Sin embargo, esta ganancia de velocidad podría tener consecuencias importantes para el ecosistema informativo: el 64 % espera que disminuyan las visitas a los sitios web de noticias y el 58 % considera probable que se reduzca la diversidad de puntos de vista que encuentran los usuarios. El informe plantea así una cuestión central para bibliotecas, medios y sistemas de información: cuando el buscador proporciona directamente una respuesta sintetizada, el usuario puede obtener información de manera más rápida, pero puede dejar de visitar las fuentes originales. Esto puede afectar al tráfico hacia los medios, a la visibilidad de los productores de información y, potencialmente, a la sostenibilidad económica del periodismo y de otros sistemas de producción de conocimiento.

El informe llega a cuatro conclusiones principales:

  • Los resúmenes generados por IA ofrecen rapidez a costa de las visitas a sitios web de noticias y de la diversidad de puntos de vista.
  • Las condiciones para investigar el entorno informativo han empeorado según todos los indicadores, especialmente en Estados Unidos.
  • La mayor preocupación de los expertos es el poder incontrolado de las plataformas, seguido de la desinformación y la polarización.
  • El pesimismo alcanza niveles récord, siendo más acusado allí donde las condiciones de investigación se valoran mejor.


Alfabetización en IA: competencias, marcos de referencia y el papel de las bibliotecas

II Encuentro sobre Servicios de Referencia y Acceso a la información
Buenos Aires 15 y 16 de septiembre de 2026. Biblioteca Nacional de Argentina «Mariano Moreno»

Ver Video Youtube

La llegada de la inteligencia artificial (IA), y en particular de la IA generativa, está provocando un impacto notable en todos los ámbitos de la vida —la educación, las empresas, la salud y la convivencia social— lo que convierte a la alfabetización en IA en una competencia esencial del siglo XXI. El artículo que se presenta realiza una revisión sistemática que abarca desde el estado del concepto hasta los marcos de referencia desarrollados a nivel global y el papel que desempeñan las bibliotecas como actores clave en la formación de ciudadanos críticos y responsables frente a esta tecnología. Los hallazgos muestran que la alfabetización en Inteligencia Artificial es un fenómeno multidimensional, que incluye aspectos técnicos, críticos, éticos y comunicativos; que trasciende el simple manejo de herramientas; que está generando una nueva brecha en un entorno donde surgen distanciamientos y riesgos asociados a esta tecnología; y que, en este contexto, las bibliotecas se sitúan en una posición estratégica para ir más allá de la alfabetización informacional tradicional ante las exigencias del entorno algorítmico. Finalmente, se identifican las distintas estrategias presentes en los marcos existentes y se proponen líneas de actuación futuras.

Mejores prácticas de datos abiertos en Europa: resumen de estrategias clave para avanzar en la madurez de los datos abiertos

Publications Office of the European Union, Capgemini Invent, Page, M., Behrooz, A. and Moro, M., 2025 Open data best practices in Europe – A summary of key strategies for advancing open data maturity, Publications Office of the European Union, 2026, https://data.europa.eu/doi/10.2830/2338780

Los ecosistemas de datos abiertos con mayor madurez comparten varios elementos: orientación hacia los usuarios, gobernanza estructurada, calidad e interoperabilidad de los metadatos, apoyo y capacitación de los proveedores y evaluación permanente del impacto. Las políticas solo producen resultados cuando se traducen en procedimientos, herramientas, formación y mecanismos de coordinación concretos. Del mismo modo, un portal no alcanza su máximo valor por el número de conjuntos de datos que contiene, sino por su capacidad para hacerlos descubribles, comprensibles, accesibles, actualizados y reutilizables.

La primera dimensión destaca que disponer de una legislación o una estrategia nacional de datos abiertos no es suficiente: es necesario contar con estructuras de gobernanza, responsabilidades claramente definidas, procedimientos operativos, mecanismos de seguimiento y recursos que permitan llevar las políticas a la práctica. Entre las principales recomendaciones aparece la creación de foros permanentes y multiactor, en los que participen administraciones públicas, autoridades regionales y locales, universidades, empresas y sociedad civil. Estos espacios favorecen el intercambio de experiencias, permiten resolver problemas de implementación y facilitan una interpretación coherente de las obligaciones relacionadas con los datos abiertos. Austria, Chequia y Lituania ofrecen ejemplos de este tipo de estructuras de coordinación.

El informe concede también importancia a la creación de comunidades digitales de usuarios y proveedores de datos. Plataformas como las desarrolladas en Noruega, Italia o los Países Bajos permiten formular preguntas, compartir conocimientos, presentar proyectos, debatir problemas técnicos y establecer relaciones entre quienes producen los datos y quienes los reutilizan. La idea fundamental es pasar de un modelo puramente administrativo de publicación a un ecosistema colaborativo, en el que las necesidades de los usuarios contribuyan a orientar la producción y mejora de los datos.

Otro aspecto destacado es la necesidad de proporcionar asistencia técnica y financiación, especialmente a las administraciones locales y regionales que cuentan con menos recursos. En este ámbito, España aparece como ejemplo mediante la iniciativa Aporta, que proporciona asesoramiento técnico y metodológico a organismos públicos sobre datos abiertos y reutilización de la información del sector público. Estonia y Francia también han desarrollado programas que combinan orientación especializada, formación, financiación e infraestructura para ayudar a las administraciones territoriales a desarrollar proyectos de datos abiertos sostenibles.

La segunda dimensión se centra en los portales nacionales de datos abiertos, que deben funcionar como auténticas puertas de entrada a la información pública y no simplemente como grandes catálogos de conjuntos de datos. El informe recomienda que los portales sean fáciles de utilizar, permitan búsquedas avanzadas, ofrezcan APIs y SPARQL, posibiliten la previsualización de datos, incorporen mecanismos para solicitar nuevos conjuntos de datos y faciliten la comunicación entre usuarios y administraciones. También considera fundamental analizar el comportamiento de los usuarios para adaptar continuamente las funcionalidades del portal a sus necesidades.

España constituye uno de los ejemplos destacados en esta dimensión. Su portal nacional dispone de un sistema estructurado para solicitar conjuntos de datos que todavía no están disponibles, haciendo visibles las peticiones para que otros ciudadanos puedan sumarse y expresar su demanda. Este mecanismo convierte las necesidades de los usuarios en una fuente de información para orientar la publicación de nuevos datos. El informe considera que este enfoque favorece la participación, la transparencia y la confianza en los servicios públicos de datos.

La experiencia española también sobresale por la integración automatizada de datos procedentes de administraciones locales y regionales. Mediante sistemas de harvesting automático, los conjuntos de datos pueden incorporarse al catálogo nacional sin necesidad de realizar manualmente todo el proceso de actualización. Además, el portal integra conjuntos de datos dinámicos que pueden actualizarse con una frecuencia muy elevada, incluso cada minuto, y señala aquellos disponibles mediante APIs o servicios web. De este modo, se favorece la disponibilidad de información actualizada y reutilizable, especialmente importante en ámbitos donde los datos cambian constantemente.

La tercera dimensión considera que la apertura de los datos carece de gran utilidad si estos no están correctamente descritos, actualizados, estructurados y preparados para su reutilización. Por ello, el informe concede un papel central a la calidad de los metadatos, su integridad, actualización, interoperabilidad y adecuación al estándar europeo DCAT-AP. También se valoran aspectos como la utilización de formatos legibles por máquinas, los principios FAIR, las licencias estructuradas y las conexiones entre diferentes fuentes de información.

Una de las buenas prácticas identificadas consiste en establecer controles de calidad antes de que los conjuntos de datos sean publicados. España aparece nuevamente como ejemplo: los conjuntos que no cumplen los estándares establecidos no pueden publicarse hasta que los problemas de los metadatos hayan sido corregidos. Los sistemas de federación o carga manual generan informes que identifican los errores y permiten a los responsables solucionar las deficiencias antes de incorporar definitivamente el conjunto al catálogo. Este procedimiento pretende garantizar un nivel mínimo de calidad y mejorar la interoperabilidad de los datos.

El informe señala además que los controles automáticos deben complementarse con apoyo personalizado a los proveedores de datos. Italia utiliza registros de errores y comunicación directa con los responsables de los datos; Luxemburgo combina controles automatizados con asistencia individual; y Croacia mantiene reuniones periódicas con los proveedores para explicar los estándares y resolver problemas. La conclusión es que la calidad no se consigue únicamente mediante normas técnicas: requiere también formación, acompañamiento, asesoramiento y comunicación continuada con quienes publican los datos.

La cuarta dimensión introduce una cuestión fundamental: abrir datos no constituye un fin en sí mismo. Es necesario conocer quién utiliza los datos, cómo los utiliza y qué beneficios genera su reutilización. El informe propone medir el impacto en cuatro grandes ámbitos: gubernamental, social, medioambiental y económico. Entre los posibles resultados se incluyen una mayor eficiencia administrativa, transparencia y mejor toma de decisiones; beneficios en educación, salud, inclusión o alfabetización de datos; contribuciones a la sostenibilidad y la lucha contra el cambio climático; y efectos económicos relacionados con innovación, productividad, empleo y creación de empresas.

Los portales nacionales pueden convertirse en una herramienta fundamental para realizar este seguimiento. España, Francia e Irlanda utilizan estadísticas sobre visitas, descargas e interacciones para conocer qué datos despiertan mayor interés. En España, además, se realizan acciones para identificar y difundir casos de reutilización, incluyendo una comunidad de más de 400 pequeñas y medianas empresas que han desarrollado soluciones innovadoras utilizando datos abiertos. El informe destaca la importancia de combinar los indicadores cuantitativos con entrevistas, encuestas y contacto directo con los usuarios para comprender no solo cuánto se utilizan los datos, sino también por qué se utilizan, qué obstáculos existen y qué necesidades todavía no están cubiertas.

Otra estrategia consiste en hacer visible la reutilización mediante hackatones, seminarios, talleres, demostraciones y espacios donde se muestran aplicaciones desarrolladas a partir de datos públicos. Grecia utiliza hackatones para conectar administraciones, empresas y desarrolladores; Polonia dispone de un espacio específico para mostrar aplicaciones; y Lituania utiliza eventos y actividades públicas para presentar casos de éxito. Estas iniciativas ayudan a transformar los datos abiertos en productos, servicios, investigaciones y soluciones concretas y, al mismo tiempo, permiten demostrar a la sociedad el valor de mantener los datos disponibles.

El informe insiste finalmente en que el impacto debe evaluarse de forma periódica y estructurada. Polonia, Italia y Chipre han incorporado diferentes mecanismos de evaluación para conocer los usos de los datos y sus efectos, vinculando los resultados con la planificación y la mejora de las políticas públicas. La evaluación continua permite detectar nuevas necesidades, identificar tendencias y adaptar las estrategias nacionales en función de evidencias reales, en lugar de mantener políticas estáticas.

Políticas de acceso abierto en los Estados miembros de la UE y más allá

European Commission: Directorate-General for Research and Innovation and Spichtinger, D., Open access policies in EU Member States and beyond – Final report, Publications Office of the European Union, 2026, https://data.europa.eu/doi/10.2777/8921907

El objetivo de la publicación es ofrecer una visión actualizada de las políticas de acceso abierto en todos los Estados miembros de la UE y en determinados terceros países (por ejemplo, el Reino Unido, EE. UU., China y Japón). Su valor añadido reside en que esta información actualizada proporcionará a la Comisión y a los lectores externos un conocimiento actual y preciso sobre un componente importante de la ciencia abierta: el acceso abierto a las publicaciones científicas. Además, la información recopilada en el informe sirve de base para los trabajos relacionados con la propuesta de Ley del Espacio Europeo de Investigación. La publicación aborda un aspecto de la investigación en Europa.

Análisis comparativo de las políticas de acceso abierto a las publicaciones científicas y a los datos de investigación en los 27 Estados miembros de la Unión Europea, complementado con un estudio comparativo de ocho países no pertenecientes a la UE. Su objetivo es proporcionar una visión actualizada de los marcos nacionales de acceso abierto y, a partir de ellos, formular recomendaciones para mejorar la coordinación europea. El estudio destaca desde el principio que se han producido avances importantes durante más de una década, pero que estos avances son desiguales y fragmentados: los países difieren en la fuerza jurídica de sus políticas, los ámbitos cubiertos, los períodos de embargo, los derechos de autor, los sistemas de repositorios, los mecanismos de financiación y los procedimientos de seguimiento. Esta diversidad genera una considerable complejidad para investigadores, instituciones y financiadores, especialmente en los proyectos de colaboración internacional.

Uno de los principales hallazgos es que no existe todavía un modelo europeo homogéneo de acceso abierto. Los Estados miembros utilizan fundamentalmente tres tipos de instrumentos: estrategias nacionales, mandatos de los organismos financiadores y legislación. Las estrategias tienen la ventaja de facilitar el consenso y permitir una implantación progresiva, pero pueden quedarse en declaraciones de intenciones cuando no existen mecanismos de aplicación. Los mandatos de los financiadores permiten establecer obligaciones más concretas y adaptarse con mayor rapidez a los cambios del mercado editorial, aunque solamente afectan a la investigación financiada por esos organismos. La legislación proporciona mayor estabilidad jurídica y cobertura sistémica, pero puede resultar difícil de modificar cuando cambian las prácticas de publicación científica. El informe señala que los marcos que combinan varios instrumentos —legislación, financiación, estrategias nacionales e infraestructuras institucionales— ofrecen un entorno más completo, aunque también pueden generar complejidad si sus requisitos no son coherentes entre sí.

El informe concede especial importancia a la obligatoriedad de las políticas. La evidencia comparativa muestra que los planteamientos exclusivamente voluntarios tienden a producir resultados más desiguales, mientras que la combinación de obligaciones con infraestructuras, apoyo institucional y sistemas de seguimiento facilita una adopción más consistente. Sin embargo, el documento advierte de que una obligación legal, por sí sola, tampoco garantiza el cumplimiento: cuando no existen procedimientos de depósito sencillos, apoyo de las bibliotecas, recursos, sistemas de monitorización y mecanismos de cumplimiento, las disposiciones formales pueden tener en la práctica efectos similares a una política voluntaria. Por ello, el problema no es únicamente qué dice la legislación, sino también si las instituciones disponen de los medios necesarios para convertir esas obligaciones en prácticas habituales de los investigadores.

Otro aspecto fundamental es la transición desde los modelos basados en embargos hacia el acceso abierto inmediato. El estudio identifica los períodos de embargo como uno de los puntos de mayor divergencia entre los Estados miembros. Algunas políticas y organismos financiadores ya exigen acceso inmediato, mientras que otros permiten períodos determinados o incluso dejan la duración del embargo condicionada por las políticas de las editoriales. El informe propone avanzar hacia el acceso abierto inmediato y sin embargo para los artículos derivados de investigación financiada públicamente. Cuando esto no sea todavía posible, recomienda establecer como máximo seis meses para las ciencias, tecnologías y matemáticas y doce meses para las ciencias sociales y humanidades, con una progresiva eliminación de estos períodos. El estudio considera especialmente problemáticos los embargos indefinidos o aquellos cuya duración queda esencialmente en manos de las editoriales.

La cuestión de los derechos de autor y la retención de derechos ocupa igualmente una posición central. El informe distingue entre el derecho legal de publicación secundaria, que permite a los investigadores hacer disponible su trabajo independientemente de determinadas condiciones contractuales de las editoriales, y las políticas de rights retention, mediante las cuales los autores conservan los derechos necesarios para depositar sus manuscritos. La recomendación general es proporcionar a los investigadores una base jurídica sólida que permita el autoarchivo, preferentemente con embargo cero, y promover licencias abiertas como CC BY para las publicaciones y CC BY/CC0 para los metadatos, admitiendo excepciones justificadas. El objetivo es reducir la dependencia de las condiciones contractuales de los editores y garantizar que la financiación pública produzca resultados que puedan ser consultados y reutilizados públicamente.

El documento también aborda la transformación del acceso abierto hacia una concepción más amplia de la ciencia abierta. Ya no se trata solamente de que los artículos sean gratuitos para su lectura, sino de integrar publicaciones, datos de investigación, software, protocolos, infraestructuras, recursos educativos, ciencia ciudadana y nuevas formas de evaluación científica. Los datos deben gestionarse conforme a los principios FAIR —Findable, Accessible, Interoperable y Reusable—, aunque el informe recuerda que FAIR no significa necesariamente que todos los datos tengan que ser completamente abiertos: deben aplicarse los principios de «tan abiertos como sea posible y tan cerrados como sea necesario». Los planes de gestión de datos deberían evolucionar desde documentos estáticos hacia herramientas legibles tanto por humanos como por máquinas.

Un elemento especialmente relevante es la infraestructura de repositorios. El informe considera que las políticas de acceso abierto necesitan apoyarse en repositorios institucionales, disciplinares o nacionales que permitan depositar, preservar y difundir las publicaciones y los datos. Se propone establecer requisitos técnicos comunes para los repositorios de confianza, incluyendo identificadores persistentes, metadatos abiertos y normalizados, licencias legibles por máquinas y APIs que permitan la agregación de información y el text and data mining. Además, se recomienda mejorar la conexión entre las infraestructuras nacionales y la European Open Science Cloud (EOSC). De esta manera, los repositorios dejan de ser simples depósitos de documentos para convertirse en elementos esenciales de la infraestructura europea de comunicación científica.

La financiación constituye otro de los grandes problemas identificados. El informe observa un crecimiento significativo de los costes asociados a las tasas de publicación —APC— y advierte de que la expansión de modelos basados exclusivamente en el pago por publicar puede generar nuevas desigualdades. Las instituciones y los investigadores con menor capacidad económica pueden quedar en desventaja frente a aquellos que disponen de mayores recursos. Por ello, se propone considerar los costes de acceso abierto, repositorios, gestión de datos, infraestructuras y formación como parte estructural de la financiación del sistema de investigación. Paralelamente, el estudio recomienda diversificar los modelos de publicación y fortalecer especialmente el Diamond Open Access, en el que ni los lectores ni los autores pagan por acceder o publicar, apoyando revistas y plataformas comunitarias, institucionales y sin ánimo de lucro.

Una cuestión particularmente importante es la relación entre acceso abierto y evaluación de la investigación. El informe considera que mientras los sistemas de evaluación sigan recompensando principalmente el prestigio de las revistas y determinados indicadores bibliométricos, los investigadores pueden tener pocos incentivos para priorizar la apertura. Por ello, recomienda integrar formalmente las prácticas de ciencia abierta en la evaluación de investigadores, proyectos e instituciones, en línea con iniciativas como CoARA y los principios de reforma de la evaluación científica. El acceso abierto debería formar parte de los criterios de reconocimiento junto con otras contribuciones científicas, y deberían evitarse incentivos que premien exclusivamente la publicación en revistas consideradas de máxima categoría.

En el caso de España, el informe describe un marco relativamente desarrollado que combina legislación, estrategia nacional y mandatos de organismos financiadores. La Ley 17/2022 exige el depósito simultáneo de las publicaciones con su fecha de publicación, mientras que la ENCA 2023-2027 amplía la perspectiva hacia la ciencia abierta, incorporando publicaciones, datos, software, protocolos y otros objetos digitales. También participan en este sistema organismos como AEI e ISCIII, junto con infraestructuras como RECOLECTA, que agrega metadatos procedentes de repositorios institucionales españoles y favorece su interoperabilidad con infraestructuras europeas.

España presenta además una característica especialmente significativa: la incorporación del acceso abierto a los sistemas de evaluación científica. La LOSU establece que las agencias de calidad deben incluir la accesibilidad en abierto de los resultados científicos entre sus criterios de evaluación y utilizar los repositorios institucionales para acceder a la documentación correspondiente. Asimismo, desde 2023 ANECA ha incorporado el depósito de los resultados de investigación como criterio en las convocatorias de sexenios, manteniéndose posteriormente este requisito. El informe interpreta esta conexión entre políticas de apertura y evaluación como un mecanismo capaz de modificar el comportamiento de los investigadores, al convertir el depósito y la disponibilidad de los resultados en elementos relevantes para la carrera científica.

La implementación de la IA en la educación superior en América Latina y el Caribe

Valentini, Arianna. (2026). La implementación de la IA en la educación superior en América Latina y el Caribe. Instituto Internacional de la UNESCO para la Educación Superior en América Latina y el Caribe (IESALC), IESALC. Documentos de trabajo, 16. ED/HE/IESALC/WP/2026/103. https://doi.org/10.54674/WP.2026.104

La inteligencia artificial está transformando rápidamente la educación superior en América Latina y el Caribe, generando nuevas posibilidades para la enseñanza, el aprendizaje, la investigación y la gestión universitaria, pero también importantes desafíos relacionados con la ética, la gobernanza, la equidad y la calidad educativa. El estudio de UNESCO-IESALC ofrece una visión regional basada en datos de 200 instituciones de educación superior de 19 países, lo que permite conocer cómo se está produciendo la incorporación de la IA en el sector.

Los resultados muestran una adopción amplia, pero desigual, de estas tecnologías. El 87 % de las instituciones encuestadas afirma utilizar IA en al menos una de sus áreas de actividad, mientras que únicamente el 26 % dispone de una estrategia institucional formal para su implementación. La IA tiene una presencia especialmente significativa en los procesos de enseñanza y aprendizaje y está adquiriendo también una importancia creciente en la investigación. Sin embargo, buena parte de esta incorporación surge de iniciativas de docentes, investigadores y estudiantes, más que de políticas institucionales planificadas.

El informe subraya, por ello, la necesidad de avanzar desde una adopción espontánea de la IA hacia una integración estratégica, responsable y equitativa. Para ello resulta fundamental fortalecer la gobernanza, desarrollar competencias y programas de alfabetización digital y en IA, invertir en capacidades institucionales y establecer mecanismos que permitan afrontar cuestiones relacionadas con la ética, la inclusión y la calidad. UNESCO plantea además que estos desafíos requieren una actuación coordinada entre las universidades, los gobiernos y las organizaciones internacionales.

Tendencias de las bibliotecas públicas en 2026: cinco claves que están transformando su futuro

PressReader. (2026). Public Library Trends 2026: Five Key Trends Shaping the Future of Libraries. PressReader. Artículo original de PressReader

Las nuevas tecnologías están cambiando la forma en que las personas descubren información. Los contenidos generados por inteligencia artificial hacen cada vez más difícil saber en qué información confiar. Los servicios digitales ocupan un lugar cada vez mayor en el uso cotidiano de las bibliotecas. Además, los usuarios recurren a las bibliotecas no solo para acceder a libros e información, sino también para aprender, cuidar su bienestar, relacionarse con otras personas y comprender mejor el mundo que les rodea.

Por ello, las tendencias más importantes de las bibliotecas públicas en 2026 no tienen que ver únicamente con la tecnología. También están relacionadas con la confianza, la relevancia y la transformación del papel que desempeñan las bibliotecas en la vida de las personas.

Estas son cinco tendencias fundamentales que están configurando el futuro de las bibliotecas públicas en 2026.

1. Las bibliotecas públicas están fomentando hábitos de lectura más intencionados

Una de las tendencias de las bibliotecas públicas en 2026 es el cambio hacia experiencias de lectura que resulten útiles, tranquilizadoras y personalmente relevantes.

El informe «2026: The Year of Intentional Media», basado en datos globales de uso de PressReader y en tendencias del sector, muestra un desplazamiento desde unos medios que simplemente reclaman la atención hacia contenidos que las personas eligen porque encajan con sus vidas. El informe define los medios intencionados como aquellos contenidos que favorecen la concentración, la comprensión y las rutinas cotidianas, ayudando a las personas a aprender, relajarse y comprender el mundo sin sentirse abrumadas.

Para las bibliotecas, esto es importante.

Las colecciones de las bibliotecas públicas han apoyado tradicionalmente el aprendizaje permanente y el enriquecimiento personal. Sin embargo, esta demanda se está haciendo cada vez más visible también en los contenidos digitales. Los usuarios no buscan únicamente las últimas noticias. También consultan contenidos sobre alimentación, salud, viajes, aficiones, pasatiempos, cultura, finanzas personales, historias locales y otros temas prácticos que contribuyen a su vida cotidiana.

Esta tendencia también aparece en el informe Weak Signals 2026 de IFLA, que identifica específicamente el «bienestar y la recuperación» y el diseño comunitario como temas emergentes de liderazgo.

Para los responsables de las bibliotecas, la implicación es clara: las colecciones deben reflejar el conjunto de necesidades de los usuarios. El acceso a las noticias sigue siendo importante, pero también lo son los contenidos y formatos que favorecen el bienestar, la curiosidad, la relajación y el aprendizaje permanente.

Algunas bibliotecas ya están poniendo esta idea en práctica. Por ejemplo, la iniciativa Rediscover Reading, del Palm Beach County Library System, presenta la lectura recreativa como una actividad respaldada por evidencias para favorecer el bienestar mental, reducir el estrés, fortalecer la empatía y crear vínculos comunitarios.

2. La IA está transformando los servicios de las bibliotecas públicas, pero la confianza sigue siendo lo más importante

La inteligencia artificial ha sido una de las grandes tendencias tecnológicas que han transformado las bibliotecas públicas durante los últimos años, y esta evolución continúa en 2026.

Las herramientas de búsqueda, los asistentes de investigación, los sistemas de recomendación y las plataformas de contenidos utilizan cada vez más IA para ayudar a las personas a encontrar información con mayor rapidez. En muchos casos, esto puede mejorar el descubrimiento de información y facilitar la navegación por los recursos digitales. Para los usuarios puede significar recomendaciones más personalizadas, respuestas más rápidas y experiencias de búsqueda más intuitivas.

Las bibliotecas ya están reaccionando ante esta transformación. El informe Pulse of the Library, de Clarivate, señala que el 67 % de las bibliotecas de todo el mundo estaba explorando o implementando IA en 2025, frente al 63 % registrado en 2024.

Pero la IA también plantea nuevos desafíos.

A medida que los resúmenes, resultados de búsqueda y recomendaciones generados por IA se vuelven más habituales, los usuarios necesitan ayuda para comprender de dónde procede la información, cómo ha sido creada y hasta qué punto se puede confiar en ella. Un acceso más rápido no significa necesariamente una mejor comprensión.

En este contexto, las bibliotecas están emergiendo como lo que el informe Weak Signals 2026 de IFLA denomina «anclas de confianza»: espacios en los que las personas pueden aprender a distinguir los hechos de las informaciones fabricadas y desarrollar una actitud crítica ante los contenidos producidos por IA.

La biblioteca puede, por tanto, ofrecer un punto de equilibrio: aprovechar las posibilidades de la inteligencia artificial evitando al mismo tiempo sus riesgos.

3. La alfabetización mediática se está convirtiendo en una responsabilidad fundamental de las bibliotecas públicas

Entre las tendencias más importantes de las bibliotecas públicas en 2026, y directamente relacionada con el desarrollo de la IA, destaca la creciente importancia de la alfabetización mediática.

En el pasado, la alfabetización mediática podía abordarse como un tema para talleres, una actividad desarrollada en colaboración con centros educativos o un complemento de las competencias digitales. Actualmente se está convirtiendo en una responsabilidad central de las bibliotecas públicas.

Una investigación realizada por PressReader y la Australian Library and Information Association (ALIA) muestra hasta qué punto esta cuestión resulta importante para las bibliotecas públicas australianas.

El estudio revela que:

  • El 87 % de los profesionales de las bibliotecas considera que los contenidos generados por IA y las redes sociales han incrementado la necesidad de alfabetización mediática.
  • El 99 % de los bibliotecarios públicos australianos considera esencial la alfabetización mediática.

Esta percepción también se refleja entre los profesionales de las bibliotecas de Norteamérica. Otro informe elaborado en colaboración con la Public Library Association señala que las bibliotecas públicas están cada vez más en primera línea de la alfabetización mediática, ayudando a los usuarios a evaluar fuentes, navegar por contenidos digitales y acceder diariamente a información fiable.

Para las bibliotecas públicas, esto representa una oportunidad clara para reforzar su papel como instituciones educativas de proximidad en un entorno mediático cada vez más complejo.

4. Las bibliotecas públicas se están convirtiendo en centros comunitarios de conocimiento más sólidos

Otra tendencia importante es la continua expansión del papel de la biblioteca como infraestructura comunitaria.

Las bibliotecas ya no se definen únicamente por aquello que prestan. Cada vez son más valoradas por aquello que hacen posible: acceso digital, aprendizaje, conexión social, participación ciudadana, apoyo comunitario y orientación fiable.

El Library Insights Report 2025, del Urban Libraries Council, constató que las visitas a las bibliotecas públicas aumentaron un 9,8 % respecto a 2023, mientras que las reservas de salas crecieron un 25 %. También continuó aumentando la demanda de recursos digitales, especialmente de libros electrónicos. El informe describe las bibliotecas públicas como una infraestructura social esencial, que proporciona a las comunidades acceso a herramientas y espacios modernos para la información y la conexión social.

Algunos usuarios acuden a la biblioteca para disponer de un espacio tranquilo de trabajo. Otros buscan actividades, apoyo tecnológico, acontecimientos comunitarios, recursos digitales, información local o ayuda para acceder a servicios esenciales. Muchos combinan los servicios físicos y digitales de la biblioteca dependiendo de sus necesidades.

Esta es una de las razones por las que las bibliotecas públicas siguen siendo tan relevantes en 2026. Son instituciones locales de confianza capaces de atender necesidades muy diversas, independientemente de la edad, procedencia o nivel de competencia digital de las personas.

5. Las bibliotecas públicas facilitan el acceso a un periodismo diverso y de calidad

Una última tendencia que habrá que observar en 2026 es la creciente relación entre alfabetización mediática y acceso a un periodismo de calidad.

Enseñar a las personas a evaluar la información es fundamental. Pero esas competencias adquieren mucho más sentido cuando los usuarios también tienen acceso a noticias fiables, elaboradas profesionalmente, y a una amplia variedad de perspectivas.

La investigación de ALIA mencionada anteriormente señala que el 99 % de los profesionales de las bibliotecas considera que las noticias de calidad y la diversidad de perspectivas son elementos importantes para desarrollar las competencias de alfabetización mediática.

Aunque la investigación se centra en Australia, los problemas que aborda son comunes a las bibliotecas públicas de todo el mundo. Las comunidades necesitan ayuda para enfrentarse a la desinformación, comparar fuentes y comprender diferentes puntos de vista. Las bibliotecas quieren ofrecer ese apoyo, pero muchas tienen que hacerlo con limitaciones de personal, carencias de formación y restricciones presupuestarias.

Aquí es donde el acceso al periodismo de calidad se convierte en una parte importante de la alfabetización mediática.

Cuando las bibliotecas proporcionan acceso a periódicos y revistas fiables procedentes de diferentes regiones, países y perspectivas, los usuarios pueden comparar coberturas, conocer diferentes puntos de vista y desarrollar mejores capacidades de pensamiento crítico. Este tipo de acceso favorece no solo la lectura, sino también la participación democrática y una vida comunitaria informada.

Mirando hacia el futuro: qué significan estas tendencias para las bibliotecas públicas en 2026

Las principales tendencias de las bibliotecas públicas en 2026 apuntan hacia una misma idea: las bibliotecas son cada vez más esenciales a medida que el ecosistema de la información se vuelve más complejo.

Los usuarios necesitan ayuda para encontrar información fiable. Necesitan desarrollar competencias digitales y mediáticas. Necesitan acceder a periodismo de calidad y a perspectivas diversas. Necesitan recursos que apoyen el aprendizaje, el bienestar y la vida cotidiana. Y necesitan espacios comunitarios —físicos y digitales— donde puedan relacionarse, explorar y crecer.

Las bibliotecas públicas ocupan una posición privilegiada para responder a todas estas necesidades. Su valor futuro no dependerá únicamente de su capacidad para ofrecer libros o recursos digitales, sino de su capacidad para actuar como espacios de confianza, aprendizaje, alfabetización mediática, participación comunitaria y orientación en un mundo cada vez más dominado por la información y la inteligencia artificial.

Los detectores de IA se están utilizando para sancionar a los estudiantes: ¿son realmente fiables?

CNET. “AI Detectors Are Being Used to Discipline Students. I Tested Whether They Should Be.” CNET, 2026. Artículo original en CNET

Los detectores de IA pueden proporcionar indicios, pero no deberían considerarse una prueba concluyente de autoría ni constituir, por sí solos, la base para sancionar a un estudiante. La cuestión fundamental no es solamente si podemos detectar IA, sino cómo garantizar procesos de evaluación académica justos y fiables en un contexto en el que humanos e inteligencia artificial colaboran cada vez más en la producción de textos.

Se aborda un problema cada vez más controvertido en el ámbito educativo: el uso de detectores de inteligencia artificial para determinar si un estudiante ha utilizado ChatGPT u otras herramientas generativas en la elaboración de un trabajo. La cuestión adquiere especial importancia porque algunas instituciones educativas están utilizando estas herramientas como elemento de prueba para investigar o incluso sancionar a estudiantes, pese a que la detección de textos generados por IA no ofrece una certeza equivalente a la de una prueba objetiva de autoría.

La experiencia descrita en el artículo pone de manifiesto una de las principales debilidades de estos sistemas: los detectores pueden equivocarse tanto al identificar textos humanos como textos generados por IA. El problema de los falsos positivos resulta especialmente preocupante en contextos académicos, ya que un texto redactado íntegramente por un estudiante puede ser clasificado como producido por inteligencia artificial. Del mismo modo, pequeñas modificaciones o procesos de edición pueden alterar considerablemente el resultado de la detección.

El artículo también cuestiona la idea de que exista una especie de “huella digital” inequívoca de la IA en un texto. Los modelos de detección trabajan mediante estimaciones probabilísticas relacionadas con características lingüísticas y patrones estadísticos, pero no pueden demostrar por sí mismos quién ha escrito un documento. Por ello, un porcentaje elevado de probabilidad de utilización de IA no debería interpretarse como una prueba definitiva de que un estudiante ha cometido una infracción académica.

Una cuestión particularmente relevante es la asimetría entre el poder de estas herramientas y las consecuencias de sus errores. Cuando un detector se emplea simplemente como instrumento orientativo para iniciar una conversación con el estudiante, sus limitaciones pueden resultar manejables. Sin embargo, cuando el resultado se transforma directamente en una acusación o en una sanción académica, un falso positivo puede tener consecuencias importantes para la trayectoria educativa de una persona. El artículo invita, por tanto, a diferenciar claramente entre detectar una anomalía estadística y demostrar una conducta académicamente deshonesta.

El texto resulta especialmente pertinente para el debate sobre integridad académica en la era de la IA generativa. La aparición de ChatGPT y de otras herramientas similares obliga a las universidades a replantearse no solamente cómo detectar posibles usos indebidos de IA, sino también qué significa actualmente escribir, investigar, aprender y demostrar competencias. En lugar de depositar una confianza excesiva en los detectores, parece más razonable combinar diferentes evidencias: proceso de elaboración del trabajo, versiones anteriores, referencias utilizadas, capacidad del estudiante para explicar sus argumentos y diálogo con el docente.

En este sentido, el artículo plantea indirectamente un cambio de enfoque: la respuesta a la IA generativa no debería basarse exclusivamente en una tecnología destinada a “policiar” los textos, sino en estrategias educativas que permitan enseñar un uso responsable, transparente y crítico de estas herramientas. Para las bibliotecas universitarias y los programas de alfabetización informacional, esto supone una oportunidad para incorporar nuevas competencias relacionadas con la IA, la evaluación crítica de sus resultados, la transparencia en su utilización y la comprensión de sus limitaciones.

Programas de alfabetización informacional en las universidades mexicanas: experiencias, evolución y perspectivas de futuro

Cortés Vera, José de Jesús, y Ma. Lourdes Tiscareño Arroyo, coords. Programas de alfabetización informacional desarrollados en universidades mexicanas: Un recuento de experiencias y un vistazo al futuro. Ciudad Juárez: Universidad Autónoma de Ciudad Juárez, 2026. ISBN 978-607-520-566-3. DOI: 10.20983/uacj-2026-6.

La obra analiza el desarrollo de los programas de alfabetización informacional (ALFIN) en las universidades mexicanas, reuniendo experiencias acumuladas durante aproximadamente los últimos veinticinco años.

El libro parte de la importancia de que los estudiantes y demás miembros de la comunidad universitaria desarrollen competencias para buscar, localizar, evaluar, seleccionar, utilizar y comunicar información de manera eficaz, especialmente en un contexto académico caracterizado por la sobreabundancia informativa y la transformación permanente de los entornos digitales.

Uno de los principales valores de la publicación es su carácter experiencial y colectivo. Los coordinadores reúnen contribuciones de numerosos especialistas vinculados con distintas instituciones mexicanas de educación superior, con el propósito de mostrar cómo se han concebido, implantado y desarrollado los programas de ALFIN en contextos universitarios diversos. Por ello, el volumen no presenta una única metodología, sino que ofrece una panorámica plural de estrategias, modelos, experiencias institucionales y reflexiones profesionales sobre la alfabetización informacional.

La publicación resulta especialmente interesante porque permite observar la evolución de la ALFIN durante un periodo de profundas transformaciones tecnológicas. Las bibliotecas universitarias han pasado de centrarse fundamentalmente en enseñar a localizar y utilizar fuentes bibliográficas a asumir funciones más amplias relacionadas con las competencias digitales, la evaluación crítica de la información y el acompañamiento de los procesos de aprendizaje e investigación. En este sentido, los programas de alfabetización informacional aparecen como una pieza estratégica de la universidad para formar usuarios capaces de desenvolverse de manera autónoma y crítica en ecosistemas informativos cada vez más complejos.

Otro aspecto destacable es que los textos no son exclusivamente investigaciones académicas en sentido estricto. Los propios responsables de la obra señalan que buena parte de las aportaciones son informes, relatos de experiencias y ensayos en los que los autores comparten aprendizajes y reflexiones derivados de su práctica profesional. Esto convierte el libro en un recurso particularmente útil para bibliotecarios y responsables universitarios que quieran conocer experiencias concretas y extraer ideas para diseñar o mejorar sus propios programas de ALFIN.

Finalmente, el libro incorpora una mirada prospectiva, intentando identificar los factores que pueden condicionar la evolución de estos programas durante los próximos años. Esta dimensión resulta especialmente relevante en un momento en el que la alfabetización informacional se encuentra estrechamente relacionada con cuestiones como la inteligencia artificial generativa, la desinformación, la evaluación de la calidad de las fuentes, la alfabetización digital y la transformación de las prácticas de aprendizaje e investigación. Así, la obra no se limita a realizar un balance histórico de la ALFIN universitaria mexicana, sino que plantea la necesidad de repensar sus objetivos y estrategias ante los nuevos escenarios informativos y tecnológicos.

En conjunto, se trata de una obra de especial interés para comprender la trayectoria de la alfabetización informacional universitaria en México y, al mismo tiempo, para reflexionar sobre hacia dónde deberían evolucionar las competencias informacionales en las bibliotecas académicas. La diversidad institucional y la combinación de experiencias profesionales, análisis y perspectivas de futuro constituyen uno de sus principales valores.

Destruir libros para construir una mente artificial: Anthropic y el futuro de la lectura

Mancino, Francesca. “Destroying Books to Build a Mind.” The New Yorker, 8 de septiembre de 2026. https://www.newyorker.com/culture/the-lede/destroying-books-to-build-a-mind

Anthropic adquirió y digitalizó masivamente libros, incluso destruyendo físicamente algunos ejemplares, para utilizarlos en el entrenamiento de sus modelos de IA. El caso plantea un debate sobre copyright, preservación, transparencia y el futuro del libro, diferenciando entre conservar información y conservar realmente los libros como objetos culturales.

A principios de 2026, numerosos libreros de segunda mano estadounidenses y canadienses comenzaron a recibir pedidos masivos de libros extraños, especializados y de escasa demanda. Eran títulos sobre arquitectura, derecho, historia, ciencias sociales, literatura o incluso cuestiones muy específicas como el tratamiento de aguas residuales. Los pedidos procedían en ocasiones de sociedades de responsabilidad limitada con nombres poco reconocibles, lo que despertó la curiosidad de los vendedores. Una investigación permitió relacionar parte de estas compras con Anthropic, la empresa responsable de Claude. Los documentos judiciales posteriormente revelados permitieron conocer la existencia de Project Panama, una iniciativa cuyo objetivo era adquirir enormes cantidades de libros impresos para convertirlos en datos digitales destinados al entrenamiento de modelos de IA.

La particularidad del procedimiento es que se trataba de digitalización destructiva. Los libros se compraban físicamente, se les retiraba la encuadernación, las páginas se cortaban para facilitar su procesamiento y posteriormente se escaneaban industrialmente, mientras que el ejemplar físico era descartado. El artículo explica que esta técnica no es completamente nueva: determinadas bibliotecas y departamentos de preservación digital también desmontan libros para conseguir una digitalización más rápida y eficiente. La diferencia fundamental está en la escala y en el propósito. Anthropic pretendía obtener millones de páginas para alimentar sus sistemas de inteligencia artificial. En Princeton, por ejemplo, se ha optado deliberadamente por métodos de digitalización que permiten conservar los ejemplares físicos, aunque sean más costosos.

Uno de los matices importantes del reportaje es que la imagen de Anthropic destruyendo ejemplares únicos y valiosísimos de libros antiguos resulta más espectacular que la realidad documentada. Según la investigación de The New Yorker, los libreros consultados no identificaron una adquisición sistemática de libros verdaderamente antiguos o antiquarios. Muchos de los ejemplares tenían ISBN y eran publicaciones relativamente recientes, aunque con tiradas pequeñas y escasa circulación. Una lista de más de 600 títulos proporcionada por libreros mostró que buena parte correspondía a publicaciones académicas, especialmente de editoriales universitarias, y que abarcaban historia, biografía, ficción, poesía, crítica literaria, derecho y ciencias sociales. Precisamente estos libros especializados y poco populares pueden resultar especialmente valiosos para entrenar modelos de IA porque contienen conocimientos que difícilmente se encuentran en grandes corpus comerciales o en la web generalista.

Aquí aparece una de las cuestiones más interesantes del artículo: la IA puede estar rescatando digitalmente conocimientos que, de otro modo, permanecerían prácticamente invisibles, pero lo hace transformando los libros en materia prima para modelos computacionales. Algunos de los títulos adquiridos probablemente estaban destinados a quedar olvidados en almacenes, librerías de segunda mano o colecciones con muy poca circulación. Desde esta perspectiva, introducirlos en un modelo de IA puede aumentar enormemente su capacidad de supervivencia informativa. El problema es que esa preservación no equivale necesariamente a conservación cultural. El libro deja de existir como objeto accesible y pasa a convertirse en información procesada por una máquina, sin que investigadores, lectores o bibliotecas puedan necesariamente consultar o reconstruir el conjunto documental que alimentó al modelo.

El artículo aborda también la compleja cuestión de los derechos de autor y del uso legítimo (fair use). Anthropic se enfrentó a demandas por utilizar libros para entrenar sus modelos y en 2025 aceptó pagar 1.500 millones de dólares para resolver una demanda colectiva relacionada con infracciones de copyright. El juez William Alsup, sin embargo, distinguió entre determinadas prácticas ilícitas —como la descarga masiva de millones de copias pirateadas— y el uso de libros adquiridos legalmente para entrenar modelos. Según su interpretación, utilizar esas obras para entrenamiento de IA podía considerarse fair use, de manera comparable a cómo una persona lee libros y posteriormente utiliza lo aprendido para producir nuevos textos. También consideró legítimo que Anthropic destruyera ejemplares físicos comprados legalmente cuando los sustituía por copias digitales destinadas exclusivamente a su biblioteca interna.

Pero la legalidad no resuelve el problema cultural y bibliotecario. El artículo plantea una cuestión fundamental: ¿podemos llamar «biblioteca» a una colección creada exclusivamente para alimentar una inteligencia artificial? En una biblioteca tradicional, los libros se conservan para que puedan ser leídos, investigados, comparados y reinterpretados por personas. En el modelo de Anthropic, los libros se convierten esencialmente en datos destinados a ampliar la «memoria» y las capacidades lingüísticas del modelo. El resultado puede contener el conocimiento de millones de libros, pero los seres humanos no tienen necesariamente acceso directo a ese corpus ni pueden saber con precisión qué documentos contiene, cómo fueron procesados o de qué manera intervienen en las respuestas generadas por la IA.

Esta cuestión conduce directamente a la transparencia de los corpus de entrenamiento. Mike Furlough, director ejecutivo de HathiTrust, señala que existe un interés legítimo en conocer cómo se construyen estos conjuntos de datos. En el mundo académico, cuando un investigador desarrolla un modelo, se espera que indique qué fuentes ha utilizado para permitir la reproducibilidad y evaluación de su trabajo. La misma lógica debería plantearse para las herramientas de IA que utilizan millones de personas para investigar, estudiar o tomar decisiones. Si un sistema responde utilizando conocimiento extraído de cientos de miles o millones de libros, resulta relevante saber qué libros fueron utilizados, bajo qué condiciones, con qué criterios y con qué mecanismos de atribución.

El aspecto quizás más profundo del artículo tiene que ver con qué significa leer. La historiadora Leah Price recuerda que el libro ha sobrevivido a numerosas predicciones sobre su desaparición y ha demostrado una extraordinaria capacidad de adaptación tecnológica. Sin embargo, la inteligencia artificial introduce una diferencia importante: no se limita a cambiar el soporte del libro, sino que puede cambiar el propio proceso mediante el cual el conocimiento es leído y utilizado. Cuando una persona lee una novela, debe dedicar tiempo, interpretar, anticipar, relacionar ideas y construir significados. Cuando una IA procesa millones de libros, convierte ese universo textual en datos que posteriormente puede recombinar para generar respuestas. El riesgo, según la reflexión del artículo, es que la lectura humana sea sustituida progresivamente por una lectura maquínica cuyo objetivo no es comprender una obra en su totalidad, sino extraer información útil de ella.

La frase que resume mejor esta tensión es la idea de que «un libro no es simplemente un recipiente de frases». El orden de las frases, la estructura, el contexto, la materialidad, las anotaciones, la procedencia del ejemplar y la experiencia del lector forman parte de su significado. Cuando un libro se desmonta y se convierte en miles de imágenes o fragmentos de texto destinados al entrenamiento de una IA, puede conservarse su contenido lingüístico, pero pueden perderse muchas dimensiones de su existencia como objeto cultural. El artículo plantea así una distinción crucial entre preservar información y preservar libros: digitalizar un texto puede salvar sus palabras, pero no necesariamente conserva toda la experiencia intelectual, material e histórica asociada al ejemplar.

Desde la perspectiva de las bibliotecas y de la gestión del conocimiento, el artículo plantea un debate especialmente relevante. Durante décadas, las bibliotecas han digitalizado colecciones para facilitar su conservación, búsqueda y acceso. Ahora las grandes empresas de IA están realizando una operación parecida, pero con una finalidad diferente: convertir las colecciones documentales en infraestructura para construir modelos de inteligencia artificial. Esto obliga a replantear qué entendemos por preservación, acceso, propiedad, colección y biblioteca. La cuestión ya no es solamente quién posee un libro, sino quién posee los datos derivados de millones de libros y quién controla las infraestructuras capaces de transformar ese conocimiento en respuestas.