Wszystkie artykuły

Sitemap.xml: po co wyszukiwarkom mapa witryny

Sitemap.xml to plik XML z listą adresów URL witryny, który ma pomóc wyszukiwarkom szybciej znajdować strony — zwłaszcza te z niewielką liczbą linków wewnętrznych lub dodane niedawno.

Struktura pliku i wymagane tagi

Każdy URL opisuje element <url> z wymaganym elementem potomnym <loc> (adres strony) oraz opcjonalnymi <lastmod>, <changefreq> i <priority>. Protokół ogranicza jeden plik do 50 000 adresów URL i 50 MB bez kompresji.

Brak deklaracji UTF-8 a polskie znaki w pliku

Jeśli plik zawiera polskie znaki diakrytyczne, a mimo to brakuje jawnej deklaracji encoding="UTF-8" w nagłówku XML, niektóre parsery mogą przyjąć inne kodowanie domyślne i wyświetlić zniekształcony tekst — walidator sprawdza obecność tej deklaracji właśnie dlatego, że jej brak bywa niezauważalny, dopóki plik nie trafi na inny serwer.

Wiele sitemap i plik indeksu

Gdy adresów URL jest więcej, niż mieści jeden plik, stosuje się plik indeksu sitemapindex, który odsyła do kilku osobnych plików sitemap. To standardowa praktyka dla dużych witryn liczących dziesiątki tysięcy stron.

Do czego to służy

  • Sprawdzenie, czy struktura XML sitemap jest poprawna przed wysłaniem go do Google Search Console.
  • Potwierdzenie, że plik nie przekracza limitów protokołu co do liczby adresów URL lub rozmiaru.
  • Znalezienie uszkodzonych lub zdublowanych linków w dużym pliku sitemap.

Obecność w sitemap nie gwarantuje indeksacji

Poprawny sitemap tylko podpowiada robotowi, gdzie szukać — to lista kandydatów, a nie polecenie. Google samodzielnie decyduje, czy dany URL zasługuje na indeksację, biorąc pod uwagę jakość treści, duplikaty i inne sygnały, których walidator nie jest w stanie sprawdzić.

Wypróbuj narzędzie