Internet archive al borde del colapso: ¿adiós a la memoria web?

El archivo digital que ha rescatado innumerables artículos periodísticos, investigaciones históricas y tesoros olvidados de la web se tambalea. Internet Archive, el repositorio online más grande del mundo, enfrenta una tormenta perfecta de ciberataques, litigios por derechos de autor y, paradójicamente, la hostilidad de los propios medios que más se beneficiaban de su existencia.

La fragilidad de un gigante digital

Con más de un billón de páginas web archivadas a lo largo de tres décadas, Internet Archive, también conocido como la Wayback Machine, se ha convertido en un pilar para periodistas, investigadores y cualquier persona que necesite recuperar información que ha desaparecido de la red. Su capacidad para ofrecer versiones originales de contenido, incluso aquellas que han sido eliminadas o modificadas, es invaluable. Pero esta infraestructura, mantenida por una organización sin ánimo de lucro, está al límite.

El último varapalo llegó en mayo de 2024, cuando la plataforma se vio obligada a caer completamente durante tres días debido a un ataque cibernético. Un problema que se suma a la creciente presión legal por infracción de derechos de autor, que ha obligado a la plataforma a eliminar más de 500.000 libros. Pero la amenaza más insidiosa proviene de un frente inesperado: los medios de comunicación.

Los medios se cierran a su salvador

Los medios se cierran a su salvador

Un estudio de la Fundación Nieman para la Universidad de Harvard revela que al menos 241 portales de noticias de nueve países están bloqueando el acceso de Internet Archive a su contenido. Nombres tan reconocidos como The Guardian, The New York Times y Le Monde, así como grandes grupos como USA Today Co, están endureciendo sus políticas para evitar que sus artículos sean utilizados para entrenar modelos de inteligencia artificial.

La razón es clara: gigantes tecnológicos como OpenAI y Google están rastreando masivamente los archivos de Internet Archive con bots que realizan decenas de miles de solicitudes por segundo. Mark Graham, director de la Wayback Machine, confirma que la plataforma no estaba preparada para esta avalancha de peticiones provenientes de la IA, saturando sus servidores y dificultando el acceso a los usuarios legítimos. La ironía es palpable: los medios que más necesitan el archivo para verificar hechos y reconstruir información histórica están cortando la vía de escape, temerosos de alimentar a sus competidores en la carrera por la inteligencia artificial.

¿Un archivo para la élite de la ia?

¿Un archivo para la élite de la ia?

Internet Archive defiende su papel como una biblioteca digital universal, ofreciendo acceso gratuito al conocimiento para todos. Pero la realidad es que, con los recursos limitados y la creciente presión, la plataforma corre el riesgo de convertirse en una fuente de datos exclusiva para las grandes empresas tecnológicas. La pérdida de Internet Archive significaría la desaparición de una parte crucial de la historia digital, un retroceso para el periodismo, la investigación académica y la preservación de la memoria colectiva.

La cifra habla por sí sola: más de 100 periodistas se han unido para apoyar a Internet Archive, reconociendo su importancia vital para la reconstrucción de investigaciones y la verificación de hechos en un entorno mediático cada vez más volátil. La lucha por la supervivencia de este repositorio digital es, en última instancia, una lucha por el acceso al conocimiento y la preservación de la verdad en la era de la información.