Se uma árvore cai em uma floresta, ela faz algum barulho? Talvez. Mas se um site desaparecer da noite para o dia, sua página inicial realmente existirá? Num mundo digital que prioriza o novo, a história é frágil. A maioria das páginas morre antes de poder ser lembrada. É por isso que a Wayback Machine é importante. Não é apenas uma máquina do tempo para a Internet; é uma tentativa desesperada de conter a maré da decadência digital.
A vida útil média de uma página da web é de aproximadamente 100 dias. Mark Graham, diretor da Wayback Machine, destacou essa estatística em um artigo da Entrepreneur de 2016. Cem dias. Depois disso, o conteúdo geralmente desaparece. Por que isso acontece? Os criadores do site seguem em frente. As empresas de hospedagem vão à falência. Ou simplesmente, a página é substituída por dados mais recentes. Sem um arquivo digital, estas atualizações apagariam completamente o passado.
Como a máquina Wayback começou
O projeto foi criado por Brewster Kahle e Bruce Gilliat. Eles também fundaram o Internet Archive, uma biblioteca digital sem fins lucrativos com sede em São Francisco. A Wayback Machine é um projeto desta instituição maior. Ele preserva sites, livros, áudio, vídeo e software. (Eles também criaram o Alexa Internet, que rastreava o tráfego da web antes de a Amazon comprá-lo.)
Eles começaram a arquivar páginas em 1996. Eles lançaram a ferramenta pública em 2001. O nome vem de “The Rocky and Bullwinkle Show”. No desenho animado, a Máquina WABAC transportou o Sr. Peabody e Sherman de volta ao longo da história. A grafia é diferente, mas a intenção é a mesma. Você quer ver o que estava lá antes.
Como você cataloga 1,7 bilhão de sites? Você usa rastreadores. São bots de software automatizados que se movem pela web. Eles tiram fotos de bilhões de sites. Mas a automação não é suficiente. Os bibliotecários do Internet Archive priorizam manualmente os sites que consideram importantes. Eles decidem o que precisa ser guardado para as gerações futuras.
O que o arquivo realmente captura
Os rastreadores não pegam tudo. A frequência varia. Sites altamente significativos podem ser registrados a cada poucas horas. Outros são registrados com semanas de intervalo. A maioria dos sites não está logada. Então aquela fan page embaraçosa que você construiu no ensino médio? Provavelmente desapareceu para sempre. A máquina tem como objetivo capturar conteúdo importante. Principais manchetes da mídia. Últimas notícias.
Também não recria o site exatamente. Você não experimentará isso como um navegador. O arquivo pode capturar apenas algumas imagens de algumas páginas. Muitas vezes não consegue preservar o conteúdo vinculado a domínios externos. Esta é uma limitação conhecida. A Wayback Machine oferece um vislumbre, não uma réplica perfeita.
Usando a máquina Wayback
Você viu o erro 404. “Página não encontrada.” É frustrante. Você quer saber o que estava lá originalmente. O arquivo ajuda nisso.
Vá para https://archive.org/web/. Digite um URL na barra “Histórico de navegação”. Experimente https://www.howstuffworks.com/ como exemplo. Os resultados mostram um gráfico de barras cronológico. Ele exibe quantas vezes o site foi rastreado e salvo a cada ano.
Esses dados visuais revelam a pulsação de um site. Alguns anos mostram picos. Outros mostram silêncio. Ele informa com que frequência a Internet estava pesquisando. Quantas vezes parou para tirar foto.
Mas por que alguns sites desaparecem enquanto outros sobrevivem? É sorte? Ou é valor? O arquivo prioriza com base na importância percebida. Mas quem decide o que é importante? Os bibliotecários. Os rastreadores. Os algoritmos.
Existem lacunas. Enormes. Eras inteiras da web estão faltando. Ou apenas parcialmente preservado. Nem sempre você consegue obter o contexto completo. Os links externos estão quebrados. As folhas de estilo desapareceram. A página parece errada.
Ainda assim, é melhor que nada. É melhor que o silêncio. A árvore cai. O som desaparece. Mas o arquivo tenta manter o eco.
Navegue além do seletor de ano e você chegará a um calendário de doze meses. É uma história visual de sobrevivência. Quadrados azuis significam que um local foi capturado com sucesso. Vermelho significa que falhou. Clique em uma data azul e os instantâneos serão carregados. Clique no instantâneo. Você está de volta no tempo, visualizando uma versão mais antiga do site.
Às vezes você precisa forçar o problema. Os rastreadores automatizados podem perder uma atualização crítica. Você pode salvar uma página manualmente usando a opção “Salvar página agora”. Isso captura um URL específico instantaneamente. Isso não garante rastreamentos futuros. Não arquiva o site inteiro. Ele apenas salva aquela única página.
Os proprietários de conteúdo têm uma saída. Se quiser que seu material seja mantido fora da Wayback Machine, você pode excluí-lo. Envie um e-mail para info@archive.org e eles atenderão ao pedido.
A interface oferece mais do que apenas páginas da web. Os ícones na parte superior da página inicial abrem livros, vídeos, gravações de áudio e software. Você pode baixá-los permanentemente ou pegá-los emprestados por um determinado período. Os recursos de pesquisa avançada ajudam você a se aprofundar na coleção.
O futuro da máquina Wayback
Graham considera um milagre que a Wayback Machine exista. Considere a escala da web pública. Agora considere a equipe pequena e o orçamento apertado para mantê-la funcionando. Os voluntários ajudam a preencher as lacunas.
“Com mais apoio, podemos fazer um trabalho [ainda] melhor de backup de uma parte maior da web pública”, diz Graham. O modelo de financiamento é misto. Archive-It.org fornece receitas provenientes de serviços de arquivamento baseados em assinatura. Os principais doadores e fundações contribuem. Mais de 100 mil doadores individuais contribuem. Eles se recusam a veicular anúncios. Eles preferem doar seus serviços.
Graham está certo de que o serviço crescerá em importância. Os métodos de comunicação estão mudando. O compartilhamento de informações está evoluindo. A equipe deve construir novas tecnologias, processos e parcerias para acompanhar. O objetivo é simples: preservar o máximo possível de informação pública. Apoia a missão de ajudar jornalistas, ativistas, acadêmicos, historiadores, pesquisadores e o público em geral. O objetivo é tornar a web mais útil e confiável.
Uma nota editorial menciona que o parágrafo 13 do artigo original foi atualizado a pedido da equipe da Wayback Machine.
Agora isso é interessante
Os links da Wikipedia apodrecem. Eles morrem. Mark Graham observa que mais de 11 milhões de páginas da Web referenciadas em artigos da Wikipédia estragaram. Eles retornam um erro 404 “Página não encontrada”. Mas como a Wayback Machine já os havia arquivado, os técnicos puderam intervir. Eles editaram as páginas da Wikipedia. Agora essas referências apontam para as versões arquivadas. Os links permanecem vivos.
Perguntas Frequentes
A Wayback Machine é gratuita?
Sim. O uso é gratuito.
Existe uma alternativa para a Wayback Machine?
O Internet Archive Wayback Machine é uma ferramenta de código aberto para acessar sites arquivados. Não existe uma alternativa oficial, mas existe funcionalidade semelhante em ferramentas como Google Cache, WebCite e Archive.is.
Como posso visualizar um site antigo no Wayback?
Vá para https://web.archive.org/. Digite o URL do site na barra de pesquisa. Pressione Enter.
A web é frágil. Nós tratamos isso como se fosse permanente. Não é. Mas o arquivo cresce. Isso espera. Ele observa.
