robots.txt WordPress: skąd się bierze, co blokuje i jak go naprawić

Robots.txt w WordPress to krótki tekst pod adresem twojadomena.pl/robots.txt, który mówi robotom Google, czego nie odwiedzać. Zwykle WordPress tworzy go sam, w locie. Gdy blokuje stronę, przyczyną jest najczęściej prawdziwy plik zostawiony na serwerze po przeprowadzce albo reguła dopisana we wtyczce SEO. Sprawdź przy okazji opcję widoczności w Ustawieniach, Czytanie.

Autor: Zespół TellMyShop. Piszemy o PrestaShop na podstawie pracy z zapleczem prawdziwych sklepów i testów na własnym sklepie testowym.
Aktualizacja: · 6 min czytania

Jak w minutę sprawdzić, czy robots.txt blokuje twoją stronę?

Otwórz w przeglądarce adres twojej strony z dopiskiem /robots.txt i przeczytaj, co tam jest. Plik ma kilka linii i czyta się go łatwiej, niż wygląda.

Co widzisz w plikuCo to znaczyCzy to problem
Disallow: /wp-admin/ i Allow: /wp-admin/admin-ajax.phpdomyślny plik WordPressa, panel jest zamknięty dla robotównie, tak ma być
Disallow: / pod User-agent: *zakaz odwiedzania całej witrynytak, cała strona jest zablokowana
Disallow: /sklep/ albo Disallow: /produkt/zakaz dla jednego działutak, jeśli ten dział ma być w Google
Disallow: /*?zakaz dla adresów z parametramizależy, bywa celowe przy filtrach sklepu
linia Sitemap: z adresem mapywskazówka, gdzie jest mapa witrynynie, to pomaga
strona błędu albo pusta stronapliku nie manie, Google uzna, że wolno odwiedzać wszystko

Google wyjaśnia, do czego służy ten plik i czego nie potrafi, w serii o robots.txt na blogu Search Central. Najważniejsze zdanie stamtąd: robots.txt steruje odwiedzinami robota, a nie tym, czy strona znajdzie się w wynikach.

Jeśli plik wygląda dobrze, a strony nadal nie ma w Google, przyczyna leży gdzie indziej. Pełną listę znajdziesz we wpisie o tym, czemu strona WordPress nie wyświetla się w Google.

Skąd WordPress bierze robots.txt?

Z trzech miejsc, i to jest źródło większości nieporozumień. Edytujesz jedno, a Google czyta drugie. Obok jest czwarte miejsce, które ludzie mylą z robots.txt: pole „Proś wyszukiwarki o nieindeksowanie tej witryny” w Ustawieniach, Czytanie. W obecnych wersjach WordPressa nie dopisuje ono blokady do robots.txt, tylko dodaje do stron znacznik noindex, a skutek jest podobny: strona wypada z Google.

  1. Wersja w locie z WordPressa. Gdy na serwerze nie ma prawdziwego pliku, WordPress składa robots.txt przy każdym wejściu. Treść zależy od ustawień, a wtyczki mogą do niej dopisywać reguły.
  2. Reguły od wtyczek. Wtyczka SEO albo wtyczka sklepu może dopisać do wersji w locie własne linie, a niektóre wtyczki SEO trzymają całą treść robots.txt w swoich ustawieniach.
  3. Prawdziwy plik w głównym folderze. Wgrał go developer, hosting albo wtyczka SEO. Gdy istnieje, serwer podaje go zamiast wersji WordPressa i wszystko, co ustawiasz w panelu, przestaje mieć znaczenie.

Wtyczki SEO dodają własne edytory. Yoast SEO ma edytor plików w swoich narzędziach i tworzy prawdziwy plik na serwerze, co opisuje w pomocy o pliku robots.txt w Yoast SEO. Rank Math działa odwrotnie: trzyma reguły w swoich ustawieniach i podaje je w locie, ale tylko wtedy, gdy na serwerze nie ma prawdziwego pliku. Opisuje to w artykule o edycji robots.txt w Rank Math. Gdy po zmianie przeniesiesz się z jednej wtyczki na drugą, stary plik często zostaje i dalej wygrywa.

Jak naprawić robots.txt w WordPress krok po kroku?

Zacznij od miejsca, które najczęściej jest winne, i sprawdzaj kolejne dopiero wtedy, gdy poprzednie jest w porządku.

  1. Ustawienia, Czytanie. Upewnij się, że pole o proszeniu wyszukiwarek o nieindeksowanie jest odznaczone. Pole nie zmienia robots.txt, ale to najczęstszy powód, dla którego cała strona znika z Google, więc sprawdź je najpierw.
  2. Znajdź prawdziwy plik. W menedżerze plików hostingu albo przez FTP zajrzyj do głównego folderu strony, tam gdzie jest folder wp-content. Jeśli leży tam robots.txt, to on trafia do Google, a nie wersja WordPressa. Jeśli pliku nie ma, blokadę dopisuje wtyczka, więc szukaj jej w edytorze robots.txt wtyczki SEO.
  3. Zrób kopię. Pobierz obecny plik na komputer, zanim cokolwiek zmienisz. Gdy coś pójdzie nie tak, wgrasz go z powrotem.
  4. Popraw albo usuń plik. Usuń linię blokującą albo cały plik, jeśli wolisz wersję WordPressa i wtyczki SEO. W Yoast SEO możesz zmienić ten sam plik z edytora wtyczki.
  5. Wyczyść pamięć podręczną. Wtyczka cache, hosting albo CDN potrafi jeszcze przez jakiś czas podawać starą wersję. Otwórz adres w oknie prywatnym.
  6. Powiadom Google. W Search Console w ustawieniach jest raport robots.txt. Poproś tam o ponowne pobranie pliku, a potem sprawdź stronę główną i jedną stronę produktu.

Uwaga na odruch „zablokuję, żeby zniknęło z Google”. Blokada w robots.txt sprawia, że robot nie zobaczy noindexu na stronie, więc adres może zostać w wynikach. Jak to rozplątać, opisuje wpis o stronie wykluczonej przez tag noindex.

Jak Claude sprawdzi robots.txt i poprawi go z kopią pliku?

Wtyczka TellMyShop dla WordPress i WooCommerce łączy twoją stronę z Claude'em. W darmowej wersji TellMyShop Free Claude sprawdza wskazaną stronę tak, jak widzi ją Google: kod odpowiedzi, noindex we wtyczce SEO i w opcji Czytanie, nagłówki strony, reguły robots.txt, mapę witryny. Na górze odpowiedzi podaje najbardziej prawdopodobną przyczynę. Przegląd całej witryny sprawdza też, czy strona prosi wyszukiwarki o nieindeksowanie.

W TellMyShop Pro Claude czyta także pliki strony, więc zobaczy, czy na serwerze leży prawdziwy plik robots.txt i co w nim jest. Poprawkę robi tam, gdzie jest przyczyna, a o tym, czy w ogóle może, decydują przełączniki w panelu wtyczki:

Gdzie jest przyczynaKto może poprawićCo jest potrzebne w TellMyShop Pro
opcja w Ustawieniach, Czytaniety w panelu albo Claudeprzełącznik Motyw, obejmuje ustawienia witryny (24 godziny, wymaga dzisiejszej kopii bazy)
prawdziwy plik w głównym folderzety przez FTP albo Claudeprzełącznik Serwis, pełny dostęp techniczny (3 godziny), kopia pliku przed zmianą
reguły w ustawieniach wtyczki SEOty w edytorze wtyczki albo Claudeprzełącznik Wtyczki, obejmuje ustawienia wtyczek (24 godziny)
Ty

Search Console pisze, że robots.txt blokuje sklep. Sprawdź, skąd to się bierze.

Claude

Sprawdziłem stronę główną i jedną kartę produktu. Opcja w Ustawieniach, Czytanie jest w porządku, noindexu nie ma. Blokuje prawdziwy plik robots.txt w głównym folderze strony, z datą sprzed przeprowadzki z wersji testowej. Proponuję zmianę:

było: User-agent: *

było: Disallow: /

będzie: User-agent: *

będzie: Disallow: /wp-admin/

będzie: Allow: /wp-admin/admin-ajax.php

będzie: Sitemap: https://twojsklep.pl/sitemap_index.xml

Przed zapisem zrobię kopię obecnego pliku. Do zapisu potrzebny jest przełącznik Serwis. Zapisać? (tak / nie)

Ty

Włączyłem Serwis. Tak.

Claude

Zapisane. Sprawdziłem /robots.txt na żywo, nowa treść jest widoczna. Teraz poproś w Search Console o ponowne pobranie pliku.

Ilustracja: produkty, liczby i odpowiedzi są przykładowe.

Adres mapy w przykładzie jest przykładowy, Claude wpisuje ten, który podaje twoja wtyczka SEO. Każda zmiana trafia do historii zmian, a plik da się przywrócić z kopii. Większość zmian cofniesz jednym poleceniem w rozmowie.

Czego TellMyShop nie robi: nie klika za ciebie w Search Console i nie przyspieszy tego, jak szybko Google odświeży kopię pliku. Nie zmienia też pliku .htaccess, który bywa drugim miejscem blokad. To zostaje po stronie hostingu albo developera.

Zacznij od darmowej wersji TellMyShop Free, która znajdzie blokadę. Działa też z darmowym kontem Claude. Szczegóły o wtyczce są na stronie TellMyShop dla WordPress i WooCommerce, a ceny Pro w cenniku. Gdy szukasz szerszej listy kontrolnej, przeczytaj tekst o audycie SEO WordPress.

Pytania i odpowiedzi

Gdzie jest plik robots.txt w WordPress?

Najczęściej nigdzie, bo WordPress tworzy go w locie, gdy ktoś otworzy adres twojadomena.pl/robots.txt. Prawdziwy plik leży w głównym folderze strony tylko wtedy, gdy ktoś go tam wgrał albo utworzyła go wtyczka SEO. Jeśli taki plik istnieje, wygrywa z wersją WordPressa.

Czy robots.txt usuwa stronę z Google?

Nie. Robots.txt mówi robotom, czego nie odwiedzać, ale zablokowany adres może nadal pojawić się w wynikach, tylko bez opisu. Żeby strona zniknęła z Google, potrzebny jest noindex, a robot musi móc go przeczytać, więc adresu nie blokujesz w robots.txt.

Co oznacza Disallow: / w robots.txt?

To zakaz odwiedzania całej witryny przez roboty. Na działającej stronie prawie zawsze jest błędem. W WordPress pojawia się zwykle po przeniesieniu strony z wersji testowej razem z jej plikiem albo po regule dopisanej we wtyczce SEO.

Po poprawce Google dalej pokazuje blokadę. Co zrobić?

Google trzyma kopię robots.txt przez jakiś czas. W Search Console otwórz raport robots.txt w ustawieniach i poproś o ponowne pobranie pliku, a potem sprawdź najważniejsze adresy narzędziem do sprawdzania adresu. Sprawdź też, czy hosting albo CDN nie podaje starej wersji z pamięci podręcznej.

Czy wtyczka TellMyShop sama zmieni robots.txt?

W darmowej wersji TellMyShop Free Claude sprawdzi, czy reguły robots.txt blokują stronę, i powie, skąd pochodzą, ale niczego nie zmieni. W TellMyShop Pro poprawi przyczynę po twojej zgodzie: opcję widoczności w ustawieniach Czytanie z przełącznikiem Motyw albo prawdziwy plik na serwerze z przełącznikiem Serwis, zawsze z kopią pliku przed zmianą.

WordPress jest znakiem towarowym WordPress Foundation. WooCommerce jest znakiem towarowym Automattic Inc. Claude jest znakiem towarowym Anthropic. TellMyShop nie jest powiązany z żadnym z tych podmiotów.

TellMyShop dla WordPress i WooCommerce

Claude czyta twoją stronę, pokazuje każdą zmianę przed zapisem i zapisuje dopiero po twoim „tak”. Każdą zmianę cofniesz jednym poleceniem. Działa też z darmowym Claude.

Przeczytaj też