El bloqueo de Internet Archive amenaza la preservación de la historia web.

Qué está pasando con el acceso a Internet Archive
The New York Times ha comenzado a bloquear que Internet Archive rastree su sitio web utilizando medidas técnicas que van más allá de las reglas tradicionales de robots.txt. Otros periódicos, incluido The Guardian, parecen estar siguiendo este enfoque. Este bloqueo arriesga cortar el acceso a registros históricos de la web en los que periodistas, investigadores y tribunales han confiado durante décadas.
Por qué esto importa para la preservación histórica
Internet Archive opera la Wayback Machine, que contiene más de un billón de páginas web archivadas. Durante casi treinta años, ha preservado sitios de noticias tal como aparecieron originalmente en línea. Cuando los artículos se editan, cambian o eliminan, el Archivo a menudo se convierte en la única fuente para ver esas versiones originales. Que las grandes editoriales bloqueen estos rastreadores significa que el registro histórico comienza a desaparecer.
La conexión con la IA y el contexto legal
Las editoriales citan preocupaciones sobre empresas de IA que extraen contenido de noticias como su motivación para bloquear el Archivo. The New York Times y otros están demandando a empresas de IA por si entrenar modelos con material con derechos de autor viola la ley. Sin embargo, Internet Archive no está construyendo sistemas comerciales de IA, está preservando registros históricos. El artículo argumenta que bloquear a archiveros sin fines de lucro es la respuesta incorrecta a las preocupaciones sobre el entrenamiento de IA.
Desde una perspectiva legal, hacer que el material sea buscable es un uso justo establecido. Los tribunales han reconocido que construir índices buscables a menudo requiere hacer copias del material subyacente. Cuando Google copió libros enteros para crear una base de datos buscable, los tribunales reconocieron esto como uso justo porque servía al propósito transformador de permitir el descubrimiento y la investigación. Los mismos principios se aplican al archivo web.
Impacto práctico en la investigación y el periodismo
Solo Wikipedia enlaza a más de 2,6 millones de artículos de noticias preservados en Internet Archive, que abarcan 249 idiomas. Innumerables blogueros, investigadores y periodistas dependen del Archivo como un registro estable y autorizado de lo que se publicó en línea. Si las grandes editoriales continúan bloqueando el acceso, los futuros investigadores pueden encontrar que partes significativas de la historia de la web han desaparecido.
📖 Lea la fuente completa: HN AI Agents
👀 Ver también

OpenClaw organiza su primer AMA: Perspectivas sobre agentes de codificación de IA.
OpenClaw, una figura destacada en agentes de programación de IA, organizó su primera sesión AMA en Reddit. La discusión arrojó luz sobre sus impactos, planes futuros y desafíos.

OpenClaw 4.2 corrige el error de emparejamiento y añade flujos de tareas duraderos.
OpenClaw 4.2 corrige un error de emparejamiento que afectó a usuarios que actualizaron alrededor del 31 de marzo e introduce flujos de tareas duraderos que permiten que las tareas de larga duración sobrevivan a desconexiones de la puerta de enlace.

Claude Code v2.1.133: reversión de worktree.baseRef, rutas de sandbox, corrección de proxy para MCP OAuth
Anthropic lanza la v2.1.133 de Claude Code CLI con una nueva configuración worktree.baseRef que por defecto es fresh (rama desde origin/default), sandbox.bwrapPath y sandbox.socatPath para binarios personalizados de bubblewrap/socat, corrección de proxy/mTLS para el flujo OAuth de MCP, y varias correcciones de errores.

Claude Code Opus Falla con Error de Límite de Tasa a Pesar de la Capacidad Semanal Disponible
Un suscriptor de Claude Max informa que Claude Code Opus devuelve 'Error de API: Límite de tasa alcanzado' aunque su panel de uso muestra que queda un 97% de su capacidad semanal 'Todos los modelos' sin usar. El problema ocurre específicamente en Claude Code mientras Opus funciona normalmente en claude.ai desde la misma cuenta.