Jak korzystać z Wayback Machine, żeby zobaczyć, jak strona wyglądała kiedyś (i czy coś ukryła)

BLOG · WERYFIKACJA I ARCHIWIZACJA
2019 — Z USUNIĘTYM AKAPITEM DZIŚ — AKAPITU JUŻ NIE MA

ok. 13 minut czytania  ·  Kategoria: Blog  ·  Zaktualizowano: wrzesień 2026

Zespół „Jak szukać?” — piszemy o tym, jak sprawdzać źródła, zanim się nimi podzielisz.

W skrócie: Wayback Machine (web.archive.org) to darmowe, publiczne archiwum internetu prowadzone przez organizację Internet Archive od 1996 roku. Pozwala zobaczyć, jak dowolna strona wyglądała w konkretnym dniu w przeszłości — a przez to wykryć usunięte akapity, zmienione obietnice wyborcze, skasowane wpisy czy „wyczyszczone” historie firm. Poniżej 10 konkretnych trików, jak z niego korzystać, z przykładami prawdziwych dziennikarskich śledztw.

Jak działa Wayback Machine

Internet Archive od 1996 roku automatycznie „skanuje” internet i zapisuje kopie stron w swoim archiwum — dziś jest to już ponad kilkaset miliardów zarchiwizowanych adresów URL. Każda zarchiwizowana wersja strony ma swój własny adres w formacie web.archive.org/web/ZNACZNIK_CZASU/ADRES_STRONY, gdzie znacznik czasu to data i godzina w formacie RRRRMMDDgggmmss. Jeśli więc chcesz zobaczyć stronę example.com dokładnie 1 stycznia 2020 roku, wystarczy wpisać web.archive.org/web/20200101000000/example.com — Wayback Machine pokaże najbliższą dostępną kopię z tamtego okresu.

Internet Archive archiwizuje strony internetowe od 1996 roku i przechowuje setki miliardów zarchiwizowanych adresów — za darmo i bez rejestracji.

Zwykłe wejście na stronę

Widzisz wyłącznie aktualną wersję. Jeśli ktoś coś usunął, zmienił albo „wyczyścił” wczoraj, nigdy się o tym nie dowiesz.

Wejście przez Wayback Machine

Wybierasz konkretną datę z kalendarza i widzisz stronę dokładnie taką, jaka była wtedy — łącznie z treściami, które później zniknęły.

10 przykładów i trików, jak korzystać z Wayback Machine

Wpisz adres bezpośrednio z datą w linku

Format web.archive.org/web/20200101000000/adresstrony.pl od razu pokazuje najbliższą kopię z wybranej daty — nie trzeba klikać przez kalendarz. Zamień znacznik czasu na gwiazdkę (web.archive.org/web/*/adresstrony.pl), żeby zobaczyć listę wszystkich dostępnych zrzutów danego adresu.

Czytaj kolorowe kropki w kalendarzu

Po wpisaniu adresu na stronie głównej web.archive.org dostajesz kalendarz z kolorowymi kropkami przy każdej dacie zrzutu: niebieska oznacza udaną kopię (kod 2xx), zielona — przekierowanie, pomarańczowa i czerwona — błędy. Do przeglądania treści wybieraj przede wszystkim niebieskie kropki.

Porównaj dwie wersje strony narzędziem Compare

Na stronie archive.org/web/docucomp.php możesz wskazać dwa zrzuty tego samego adresu z różnych dat, a narzędzie automatycznie podświetli różnice w tekście. To znacznie szybsze niż ręczne porównywanie dwóch otwartych kart.

Zarchiwizuj stronę sam, zanim ktoś ją zmieni

Funkcja „Save Page Now” na archive.org/web pozwala w kilka sekund zapisać aktualną wersję dowolnej strony. Warto z niej skorzystać, gdy widzisz coś, co może zostać usunięte — np. kontrowersyjny wpis czy obietnicę na stronie kampanijnej — zanim zniknie na dobre.

Szukaj usuniętych treści polityków i firm

To jeden z najczęstszych sposobów wykorzystania archiwum w dziennikarstwie. CNN i Politico wielokrotnie wykorzystywały zarchiwizowane wpisy do pokazania, że politycy usunęli wcześniejsze krytyczne komentarze wobec obecnych sojuszników. Podobnie WSJ i Forbes dokumentowały usunięte ze stron firmowych oświadczenia dotyczące pracy przymusowej czy bezpieczeństwa produktów.

Sprawdzaj, czy treść została „złagodzona” albo „wyostrzona”

Serwis Imprint News wykazał, że język dotyczący polityki migracyjnej na oficjalnych stronach był „wyostrzany” tuż przed ogłoszeniem nowych przepisów. The Guardian z kolei ujawnił, że wpis na blogu ostrzegający przed wirusem miał fragmenty dopisane dopiero PO rozpoczęciu pandemii — mimo że sugerował wcześniejszą datę.

Skorzystaj z API (CDX), jeśli potrzebujesz pełnej listy zrzutów

Dla bardziej zaawansowanych: Wayback CDX Server API pozwala pobrać programistycznie pełną listę wszystkich zrzutów danego adresu wraz z datami i kodami odpowiedzi — przydatne, gdy sprawdzasz historię wielu adresów naraz, a nie pojedynczą stronę.

Udowodnij, że coś się NIE zmieniło

Archiwum działa też w drugą stronę — potwierdza brak zmian. AFP Fact Check wykorzystał zarchiwizowane wersje strony partii politycznej, żeby obalić twierdzenie, że jej program został po cichu zmieniony. Daily Beast podobnie użył archiwum, by pokazać, że konto w mediach społecznościowych nigdy nie zostało zawieszone — wbrew twierdzeniom o jego „reaktywacji”.

Pamiętaj o ograniczeniach — nie wszystko jest zarchiwizowane

Strony zablokowane w pliku robots.txt, treści wymagające logowania, elementy generowane dynamicznie przez JavaScript oraz strony, których crawler jeszcze nie odwiedził, mogą być niedostępne albo wyświetlać się z brakującymi obrazkami czy stylami. Między zapisaniem strony a jej pojawieniem się w archiwum mija też zwykle od 3 do 10 godzin.

Sięgnij po archive.today, gdy potrzebujesz natychmiastowego zrzutu

Wayback Machine to systematyczne archiwum budowane od 1996 roku, ale gdy potrzebujesz zrobić błyskawiczny, pojedynczy zrzut strony (np. żeby ominąć paywall albo zamrozić coś, co zaraz zniknie), alternatywą jest archive.today (archive.ph) — działa na żądanie i zwykle szybciej niż Save Page Now, choć nie ma tak długiej, ciągłej historii jak Internet Archive.

„Internet nie zapomina — ale trzeba wiedzieć, gdzie szukać, żeby przypomnieć mu, co ktoś wolałby ukryć.”

Czego Wayback Machine nie pokaże

Wayback Machine to potężne narzędzie, ale nie jest wszechwiedzące. Nie zarchiwizuje strony, której crawler nigdy nie odwiedził — jeśli nikt wcześniej nie poprosił o jej zapisanie, po prostu jej tam nie będzie. Treści zza logowania, płatnych subskrypcji czy generowane dynamicznie przez JavaScript bywają archiwizowane niepełnie albo wcale. Warto też pamiętać, że sami właściciele stron mogą poprosić o wykluczenie swojego adresu z archiwum, co czasem tłumaczy „dziury” w historii akurat tam, gdzie najbardziej chcielibyśmy zajrzeć.

Najczęściej zadawane pytania

Nie. Archiwizowane są strony, które odwiedził automatyczny crawler Internet Archive, albo które ktoś ręcznie zapisał przez funkcję Save Page Now. Strony nigdy wcześniej nieodwiedzone po prostu nie mają zrzutów.

Tak — służy do tego funkcja „Save Page Now” dostępna na archive.org/web. W kilka sekund zapisuje aktualną wersję wskazanej strony.

Bywa akceptowany w niektórych postępowaniach, ale wymaga to zwykle dodatkowego poświadczenia (np. oświadczenia/affidavitu) i zależy od jurysdykcji oraz konkretnej sprawy. To nie jest porada prawna — w razie wątpliwości warto skonsultować się z prawnikiem.

Wayback Machine to systematyczne, ciągłe archiwum internetu prowadzone od 1996 roku przez Internet Archive. Archive.today robi pojedyncze zrzuty na żądanie, zwykle szybciej, ale bez tak długiej, ciągłej historii poszczególnych stron.

Najczęstsze powody to: strona nigdy nie została odwiedzona przez crawler, właściciel poprosił o jej wykluczenie z archiwum, treść jest generowana dynamicznie przez JavaScript, albo dostęp wymaga logowania.

Chcesz sprawniej odróżniać rzetelną naukę od newsa na jeden dzień?

Więcej z naszego bloga

Źródła: Internet Archive Help Center, „Using the Wayback Machine” (help.archive.org); Internet Archive Blog, „Follow the Changes: 9 Ways Web Archives are Used in Digital Investigations” (blog.archive.org); narzędzie Compare (archive.org/web/docucomp.php); Wayback CDX Server API (Internet Archive); archive.today (archive.ph).

Przewijanie do góry
🛒 0