Technologia

Skąd pochodzi liczba 404 w błędzie 404 Not Found?

Liczba 404 w kodzie błędu "404 Not Found", często spotykanym w internecie, nie jest przypadkowo wybraną cyfrą; jest częścią grupy 4xx protokołu HTTP klasyfikującej błędy klienta. Wbrew powszechnej legendzie o pokoju w CERN, kod powstał jako standardowy kod statusu zdefiniowany w standardach HTTP dla odpowiedzi "Not Found".

Elias KorhonenElias Korhonen7 min czytania
Udostępnij
Skąd pochodzi liczba 404 w błędzie 404 Not Found?

Liczba 404 w komunikacie "404 Not Found", z którym często spotykają się użytkownicy próbujący otworzyć nieistniejącą stronę w internecie, nie jest przypadkowo wybraną liczbą. Według źródła kod ten powstał jako część systematycznej struktury kodów statusu protokołu HTTP i z biegiem lat stał się rozpoznawalnym symbolem kultury internetowej.

Użytkownicy napotykają ten kod zazwyczaj, gdy wpiszą błędnie adres, klikną stary link lub gdy żądana treść została usunięta. 404 stało się tak powszechne, że wiele firm zaczęło dodawać do swoich stron błędów specjalne projekty, gry i żarty.

Zrzut ekranu strony błędu 404 Not Found

Co właściwie oznacza 404 Not Found?

Gdy otwierany jest adres internetowy, przeglądarka wysyła do odpowiedniego serwera żądanie poprzez HTTP. Serwer przetwarza to żądanie i zwraca przeglądarce odpowiedź zawierającą trzycyfrowy kod statusu.

Gdy operacja zakończy się pomyślnie, zwykle używany jest kod 200. W przypadku przekierowań lub problemów po stronie serwera można spotkać inne kody.

Kod 404 oznacza sytuację, w której klient może dotrzeć do serwera, ale serwer nie może znaleźć żądanego zasobu. Dlatego widząc 404, nie należy sądzić, że połączenie internetowe zostało całkowicie zerwane; serwer odpowiedział, ale żądana strona nie istnieje pod tym adresem.

Przyczyną może być błędnie wpisany URL. Strona, która istniała wcześniej, mogła zostać usunięta, link zmieniony lub treść przeniesiona pod inny adres.

Co oznacza pierwsza cyfra 4 w liczbie 404?

W kodach statusu HTTP cyfry nie są wybierane przypadkowo; kody są dzielone na określone klasy według pierwszej cyfry. Pierwsza cyfra 4 w 404 wskazuje grupę kodów statusu związanych z błędami klienta.

Obraz przedstawiający klasyfikację kodów statusu HTTP

W tej grupie znajdują się również inne kody, takie jak 400 Bad Request, 401 Unauthorized, 403 Forbidden i 429 Too Many Requests. Różnica między nimi wynika z rodzaju problemu.

W przypadku kodu 403 serwer rozumie żądanie, ale może nie zezwalać na dostęp do zasobu. W 404 żądany zasób nie został znaleziony. Kod 429 jest używany, aby wskazać, że w krótkim czasie wysłano zbyt wiele żądań.

W przypadku problemów po stronie serwera wchodzą w grę kody zaczynające się od 5. Przykładami tej grupy są 500 Internal Server Error i 503 Service Unavailable.

Zatem 404 nie jest tajemniczą liczbą wybraną samodzielnie, lecz częścią systematycznej struktury kodów statusu HTTP.

Dlaczego wybrano właśnie 404?

We wczesnym okresie HTTP kody statusu zostały uporządkowane, aby w standardowy sposób wyrażać różne wyniki protokołu. Zakres 4xx został przeznaczony na stany błędów związanych z klientem, a w tej grupie zdefiniowano kody o różnych znaczeniach.

Według źródła w dokumencie RFC 1945, opublikowanym w 1996 roku dla HTTP/1.0, 404 zostało wyraźnie zdefiniowane jako kod statusu "Not Found". Kod ten był używany również w późniejszych standardach HTTP.

Obraz dotyczący protokołu HTTP i kodów statusu

Nie ma osobnego słowa ani ukrytego znaczenia dla każdej cyfry liczby 404. Pierwsza cyfra określa ogólną klasę kodu, a pozostałe cyfry wyrażają zdefiniowany kod w tej klasie.

Podobną logikę można zauważyć w innych kodach HTTP. Pomyślne odpowiedzi są grupowane w 2xx, przekierowania w 3xx, błędy klienta w 4xx, a błędy serwera w 5xx. Ten porządek pozwala programistom ocenić odpowiedź serwera programowo, nie opierając się wyłącznie na treści komunikatu.

Czy historia pokoju numer 404 w CERN jest prawdziwa?

Według najpopularniejszej historii krążącej w internecie o 404, zespół pracujący nad World Wide Web znajdował się w pokoju numer 404 w CERN. W różnych wersjach opowieści twierdzi się, że serwery internetowe znajdowały się w tym pokoju lub że użytkownicy zwracali się do tego pokoju, aby otrzymać żądane pliki.

Obraz dotyczący historii CERN i World Wide Web

Jednak według źródła nie ma wiarygodnych dowodów historycznych potwierdzających to twierdzenie. Chociaż prace Tima Bernersa-Lee, który rozwijał World Wide Web w CERN, znajdują się w centrum narodzin HTTP, opowieść, że kod "404 Not Found" pochodzi z pokoju numer 404 w CERN, nie została potwierdzona przez źródła dotyczące historii sieci.

Co więcej, w oświadczeniach CERN dotyczących tej historii wskazuje się, że opowieść o tym pokoju jest legendą.

Powód rozprzestrzeniania się takich historii wydaje się zrozumiały. Proces tworzenia standardów technicznych może wydawać się większości użytkowników nudny, podczas gdy tajemniczy pokój i jego numer rozprzestrzeniający się po całym internecie mogą być znacznie bardziej zapadające w pamięć.

Jak powstały kody błędów HTTP?

Historia HTTP sięga pierwszych lat World Wide Web. Tim Berners-Lee, pracując w CERN, pracował nad systemem informacyjnym, w którym dokumenty na różnych komputerach mogły być łączone za pomocą linków.

Aby sieć mogła działać, nie wystarczały tylko HTML i URL; potrzebny był również protokół określający, jak komunikować się między przeglądarką a serwerem. HTTP podjął to zadanie.

Obraz dotyczący historii World Wide Web i HTTP

Pierwsze wersje HTTP były znacznie prostsze niż dzisiejszy protokół. W miarę rozwoju sieci komunikacja między przeglądarką a serwerem stawała się bardziej szczegółowa i konieczne było standardowe wyrażenie, czy żądanie zakończyło się sukcesem, zostało przekierowane na inny adres, czy nie powiodło się.

Dzięki trzycyfrowej strukturze oprogramowanie mogło szybko interpretować wynik. Kody zaczynające się od 2 ogólnie oznaczały klasę pomyślnych odpowiedzi, od 3 – przekierowania, od 4 – stany błędów związanych z klientem, a od 5 – błędy serwera.

System ten nadal istnieje jako jedna z podstawowych części sieci. Użytkownicy nie widzą większości tych kodów, ponieważ przeglądarka wykonuje operacje w tle. 404 miało jednak inny los; ponieważ sytuacja, w której żądana strona nie została znaleziona, bezpośrednio wpływa na użytkownika, przestało być technicznym kodem protokołu i stało się powszechnie znanym wyrażeniem.

Dlaczego nie widzimy 404 na każdej usuniętej stronie?

Gdy strona internetowa już nie istnieje, nie zawsze napotkamy kod 404. Wynika to z faktu, że witryny mogą używać innych kodów HTTP dla różnych sytuacji.

Jeśli treść została przeniesiona pod nowy adres, serwer może automatycznie przekierować użytkownika na nową stronę. W przypadku trwałych przekierowań używa się kodów takich jak 301, a ponieważ przeglądarka wykonuje operację automatycznie, użytkownik często nie widzi samego kodu.

Możliwe jest również użycie kodu 410 Gone dla zasobu trwale usuniętego. Różnica między nim a 404 jest subtelna, ale znacząca; 404 wskazuje, że serwer nie może znaleźć żądanego zasobu, podczas gdy 410 wyraźniej informuje, że zasób został usunięty.

W rzeczywistych witrynach nie każdy system stosuje to rozróżnienie z taką samą starannością i wiele usuniętych treści zwraca bezpośrednio 404.

Istnieje również sytuacja zwana "soft 404". Strona wyświetla użytkownikowi komunikat "nie znaleziono treści", podczas gdy serwer technicznie zwraca odpowiedź 200 OK. Z punktu widzenia użytkownika strona nie istnieje, ale z punktu widzenia HTTP żądanie wygląda na udane. Może to wpływać na sposób interpretacji strony przez wyszukiwarki.

Zatem napis "Nie znaleziono strony" na ekranie i faktyczne zwrócenie przez serwer kodu HTTP 404 nie zawsze oznaczają to samo.

Jak 404 stało się częścią kultury internetowej?

HTTP zawiera setki różnych kodów statusu, ale przeciętny użytkownik internetu nie musi znać większości z nich. 404 wyróżnia się jako duży wyjątek pod tym względem.

Głównym powodem jest to, że użytkownicy spotykają ten kod bezpośrednio i często. W miarę rozwoju witryn linki się zmieniają, stare treści są usuwane, a błędne adresy są udostępniane. W rezultacie strony 404 stają się nieuniknioną częścią doświadczenia internetowego.

Projektanci stron internetowych z czasem zaczęli używać standardowego komunikatu o błędzie w bardziej kreatywny sposób. Niektóre witryny dodały do stron 404 małe gry, inne użyły humorystycznych obrazków, a jeszcze inne przekierowały odwiedzającego do właściwej treści za pomocą pola wyszukiwania lub linku do strony głównej.

W ten sposób wyrażenie "404" wyszło poza swoje techniczne znaczenie i stało się nawet żartem używanym w kulturze internetowej do opisywania rzeczy zaginionych, nieodnalezionych lub nieobecnych.

Co ciekawe, za tą tak znaną liczbą nie kryje się tajemniczy pokój ani zapomniana historia z CERN. Prawdziwa historia 404 jest znacznie bardziej techniczna; kod powstał z potrzeby uporządkowania różnych wyników sieci i sklasyfikowania ich w sposób zrozumiały dla maszyn.

Udostępnij

Może Cię zainteresować

Komentarze (0)

Zaloguj się lub zarejestruj, aby dodać komentarz.

Brak komentarzy. Bądź pierwszy!