Pomóż klientom znaleźć Cię w Google.
Hawkly pomaga zwiększać widoczność stron internetowych i docierać do osób szukających konkretnych produktów oraz usług. Sprawdź nasze rozwiązania dla firm, sklepów i właścicieli stron.
Generator robots.txt
Przygotuj podstawowy plik robots.txt dla swojej strony. Wybierz reguły dla robotów, dodaj ścieżki Allow i Disallow oraz adres mapy witryny.
Ustaw reguły dla robotów
Wypełnij wybrane pola. Podgląd robots.txt będzie aktualizowany automatycznie.
Reguła Disallow ogranicza crawlowanie wskazanego adresu przez zgodne z nią roboty. Nie należy traktować jej jako pewnej metody usuwania strony z wyników wyszukiwania.
Jak może wyglądać robots.txt?
User-agent: * Disallow: /wp-admin/ Allow: /wp-admin/admin-ajax.php Sitemap: https://twojastrona.pl/sitemap_index.xml
W tym przykładzie reguły dotyczą wszystkich robotów. Dostęp do katalogu /wp-admin/ jest ograniczony, natomiast ścieżka /wp-admin/admin-ajax.php pozostaje dozwolona. Na końcu wskazany jest adres mapy witryny.
Utwórz plik w 3 krokach.
Określ, którego User-agent mają dotyczyć tworzone reguły.
Wprowadź ścieżki Allow i Disallow oraz opcjonalnie adres mapy witryny.
Sprawdź wygenerowaną treść i skopiuj ją do pliku robots.txt swojej domeny.
Co oznaczają poszczególne reguły?
User-agentWybór robotaOkreśla robota, którego dotyczą kolejne reguły. Gwiazdka * oznacza wszystkie roboty.
DisallowOgraniczenie crawlowaniaWskazuje ścieżki, których zgodny z regułą robot nie powinien pobierać.
AllowDozwolona ścieżkaMoże wskazać dozwolony fragment znajdujący się wewnątrz obszaru objętego regułą Disallow.
SitemapMapa witrynyPozwala wskazać pełny adres URL mapy XML zawierającej adresy strony.
O czym warto pamiętać?
Plik robots.txt znajduje się standardowo w katalogu głównym domeny, np. twojastrona.pl/robots.txt. Zawarte w nim reguły przekazują robotom informacje dotyczące crawlowania serwisu.
Nieprawidłowa konfiguracja może przypadkowo ograniczyć dostęp robotów do ważnych części strony. Szczególną ostrożność warto zachować przy szerokich regułach Disallow.
Robots.txt nie powinien być używany do ochrony poufnych danych. Sam plik jest publicznie dostępny, a respektowanie jego reguł zależy od konkretnego robota.
Generator pomaga przygotować składnię pliku, ale nie analizuje struktury Twojej strony. Przed wdrożeniem sprawdź, czy utworzone reguły nie ograniczają crawlowania adresów, które powinny być dostępne dla wyszukiwarek.