Jak Wayback Machine chroni efemeryczny Internet

11

Jeśli drzewo upada w lesie, czy wydaje dźwięk? Może. Ale jeśli witryna zniknie z dnia na dzień, czy jej strona główna naprawdę istniała? W cyfrowym świecie, w którym ceni się nowość, historia jest krucha. Większość stron umiera, zanim zostaną zapamiętane. Dlatego właśnie Wayback Machine ma znaczenie. To nie tylko internetowy wehikuł czasu; jest to desperacka próba powstrzymania fali cyfrowego rozkładu.

Średni czas życia strony internetowej wynosi około 100 dni. Mark Graham, dyrektor Wayback Machine, wspomniał o tych statystykach w artykule dla przedsiębiorców z 2016 roku. Sto dni. Następnie treść zwykle znika. Dlaczego tak się dzieje? Twórcy stron internetowych odchodzą od nich. Firmy hostingowe bankrutują. Lub strona jest po prostu zastępowana nowszymi danymi. Bez archiwum cyfrowego te aktualizacje całkowicie wymazają przeszłość.

Jak rozpoczął się projekt Wayback Machine

Projekt stworzyli Brewster Keil i Bruce Gilliat. Założyli także Internet Archive, cyfrową bibliotekę non-profit z siedzibą w San Francisco. Wayback Machine to projekt tej większej instytucji. Zapisuje strony internetowe, książki, pliki audio, wideo i oprogramowanie. (Stworzyli także Alexa Internet, która śledziła ruch w sieci, zanim Amazon ją kupił.)

Archiwizację stron rozpoczęli w 1996 roku. Narzędzie publiczne zostało uruchomione w 2001 roku. Nazwa pochodzi od serialu animowanego Rocky and Bullwinkle. W kreskówce samochód WABAC przeniósł pana Peabody’ego i Shermana w przeszłość. Pisownia inna, ale cel ten sam. Chcesz zobaczyć, co było wcześniej.

Jak skatalogować 1,7 miliarda stron internetowych? Używasz robotów indeksujących. Są to zautomatyzowane boty programowe poruszające się po Internecie. Robią zdjęcia miliardom stron. Ale automatyzacja nie wystarczy. Bibliotekarze Internet Archive ręcznie ustalają priorytety witryn, które uznają za ważne. To oni decydują, co należy zachować dla przyszłych pokoleń.

Co dokładnie przechwytuje archiwum?

Roboty nie łapią wszystkiego. Częstotliwość jest różna. Miejsca o dużym wpływie mogą być rejestrowane co kilka godzin. Inni rejestrują się w odstępach tygodniowych. Większość witryn nie jest w ogóle zarejestrowana. Więc ten niezręczny fanpage, który założyłeś w liceum? Najprawdopodobniej zniknęła na zawsze. Maszyna stara się uchwycić ważne treści. Główne nagłówki mediów. Najświeższe wiadomości.

Nie odtwarza także witryny w dokładnie taki sam sposób. Nie doświadczysz tego tak, jak w przeglądarce. Archiwum może pomieścić tylko kilka obrazów kilku stron. Często nie zapisuje treści powiązanych z domenami zewnętrznymi. Jest to znana wada. Wayback Machine zapewnia podgląd, a nie idealną kopię.

Korzystanie z Wayback Machine

Widziałeś błąd 404. „Nie znaleziono strony.” To denerwujące. Chcesz wiedzieć, co tam było pierwotnie. Archiwum pomaga w tym.

Przejdź do https://archive.org/web/. Wprowadź adres URL w wierszu Historia przeglądania. Wypróbuj https://www.howstuffworks.com/ jako przykład. Wyniki przedstawiają chronologiczny wykres słupkowy. Pokazuje, ile razy witryna była indeksowana i zapisywana w każdym roku.

Te dane wizualne ujawniają puls witryny internetowej. W niektórych latach występują skoki. Inni okazują ciszę. To mówi wiele o tym, jak często Internet to zauważał. Jak często zatrzymywał się, żeby zrobić zdjęcie?

Ale dlaczego niektóre witryny znikają, a inne przetrwają? Czy to szczęście? Lub wartość? Archiwum ustala priorytety na podstawie postrzeganej ważności. Ale kto decyduje o tym, co jest ważne? Bibliotekarze. Roboty pełzające. Algorytmy.

Są luki. Ogromny. Brakuje całych epok Internetu. Lub tylko częściowo uratowany. Nie zawsze możesz uzyskać pełny kontekst. Linki zewnętrzne są uszkodzone. Nie ma arkuszy stylów. Strona nie wygląda prawidłowo.

Mimo to, lepsze to niż nic. To lepsze niż cisza. Drzewo upada. Dźwięk zanika. Ale archiwum stara się zachować echo.

Przewiń poniżej wyboru roku, a zobaczysz kalendarz dwunastomiesięczny. To wizualna opowieść o przetrwaniu. Niebieskie kwadraty oznaczają pomyślne zapisanie witryny, czerwone kwadraty oznaczają porażkę. Kliknij niebieską datę, a zdjęcia zostaną przesłane. Kliknij na zdjęcie. Przeniesiesz się w czasie i zobaczysz wcześniejszą wersję strony.

Czasami trzeba działać zdecydowanie. Zautomatyzowane roboty mogą przegapić ważną aktualizację. Możesz ręcznie zapisać stronę, korzystając z opcji „Zapisz stronę teraz”. To natychmiast przechwytuje określony adres URL. Nie gwarantuje to przyszłego indeksowania przez roboty. Nie powoduje to archiwizacji całej witryny. To oszczędza tylko jedną stronę.

Właściciele treści mogą wykluczyć swoje treści. Jeśli chcesz, aby Twoje treści nie pojawiały się w Wayback Machine, możesz je wykluczyć. Wyślij e-mail na adres [email protected], a oni spełnią Twoją prośbę.

Interfejs oferuje więcej niż tylko strony internetowe. Ikony w górnej części strony głównej zapewniają dostęp do książek, filmów, nagrań audio i oprogramowania. Możesz je pobrać na zawsze lub wypożyczyć na określony czas. Zaawansowane funkcje wyszukiwania pomogą Ci głębiej eksplorować swoją kolekcję.

Przyszłość Wayback Machine

Graham nazywa samo istnienie Wayback Machine cudem. Pomyśl o skali publicznego Internetu. Teraz pomyśl o małym zespole i ograniczonym budżecie, które zapewniają jego funkcjonowanie. Wolontariusze pomagają wypełnić luki.

„Dzięki większemu wsparciu będziemy w stanie [jeszcze] lepiej tworzyć kopie zapasowe dużej części publicznego Internetu” – mówi Graham. Model finansowania jest mieszany. Archive-It.org zapewnia przychody z usług archiwizacji subskrypcji. Wkład w akcję wnoszą główni sponsorzy i fundacje. Projekt wspiera także ponad 100 000 prywatnych darczyńców. Odmawiają wyświetlania reklam. Wolą świadczyć swoje usługi za darmo.

Graham jest przekonany, że znaczenie tej usługi będzie rosło. Metody komunikacji się zmieniają. Wymiana informacji ewoluuje. Aby nadążać za duchem czasu, zespół musi opracowywać nowe technologie, procesy i partnerstwa. Cel jest prosty: zachować jak najwięcej informacji publicznych. Wspiera misję pomocy dziennikarzom, aktywistom, naukowcom, historykom, badaczom i ogółowi społeczeństwa. Celem projektu jest uczynienie Internetu bardziej użytecznym i niezawodnym.

W notatce redakcyjnej wspomniano, że na prośbę personelu Wayback Machine zaktualizowano paragraf 13 pierwotnego artykułu.

To jest interesujące

Linki do Wikipedii są uszkodzone. Wymierają. Mark Graham zauważa, że ​​ponad 11 milionów stron internetowych, do których prowadzą linki do artykułów Wikipedii, stało się niedostępnych. Zwracają błąd 404 „Nie znaleziono strony”. Ponieważ jednak Wayback Machine już je przechowywał, technicy mogli interweniować. Edytowali strony Wikipedii. Linki te prowadzą teraz do wersji archiwalnych. Linki pozostają aktywne.

Często zadawane pytania

Czy Wayback Machine jest darmowy?
Tak. Korzystanie z niego jest bezpłatne.

Czy istnieje alternatywa dla Wayback Machine?
Wayback Machine firmy Internet Archive to narzędzie typu open source umożliwiające dostęp do zarchiwizowanych stron internetowych. Nie ma oficjalnej alternatywy, ale podobna funkcjonalność jest dostępna w narzędziach takich jak Google Cache, WebCite i Archive.is.

Jak wyświetlić starą witrynę w Wayback Machine?
Przejdź do https://web.archive.org/. Wpisz adres URL witryny w pasku wyszukiwania. Naciśnij Enter.

Internet jest kruchy. Traktujemy to jako coś trwałego. Ale to nieprawda. Archiwum jednak się powiększa. On czeka. On patrzy.