Mapa witryny to obietnica dla crawlerów: te adresy istnieją, mają być indeksowane i tyle mają lat. Złamane obietnice kosztują budżet indeksowania i zaufanie: wymienione strony, które przekierowują albo odpowiadają 404, strony noindex na liście, lastmod taki sam dla każdego wpisu albo mapa, której nie ogłasza żaden robots.txt. To sprawdzenie znajduje mapę tak, jak robi to crawler, czyta indeks i do dziesięciu map potomnych, ocenia wpisy, a potem pobiera dwanaście stron rozłożonych po liście, by porównać obietnicę z rzeczywistością.
Z tego serwera: robots.txt, mapa witryny i do dziesięciu map potomnych (po maksymalnie 5 MB), potem dwanaście wymienionych stron po maksymalnie 64 KB. Hosty w sieciach prywatnych, loopback i link-local są odrzucane. Zapytanie chroni reCAPTCHA v3; adres IP wywołującego i cel są przechowywane przez godzinę w celu ograniczenia częstotliwości.
Granice, o których warto wiedzieć: z indeksu czytanych jest tylko pierwszych dziesięć map potomnych, a do statystyki trafia tylko pierwszych 20 000 wpisów; próbka to dwanaście stron równomiernie rozłożonych po liście, co wykrywa problemy systemowe, a pomija pojedyncze zepsute wpisy; noindex czytany jest tylko z HTML, nie z nagłówka X-Robots-Tag; a rozszerzenia obrazów, wideo i wiadomości liczą się jak zwykłe wpisy.