robots.txt to plik tekstowy umieszczony w katalogu głównym witryny, np. pod adresem /robots.txt. Informuje obsługujące go roboty, które adresy mogą pobierać. Poprawna nazwa zawiera literę s: robots.txt.
Reguły User-agent, Disallow i Allow dotyczą pobierania zasobów. W pliku można też podać adres mapy witryny. Nie wszystkie roboty respektują te reguły, dlatego robots.txt nie zabezpiecza panelu Joomla, dokumentów ani danych użytkowników.
robots.txt a indeksowanie
Zablokowany adres może nadal pojawić się w wynikach Google, jeśli wyszukiwarka dowie się o nim z innych linków. Gdy potrzebne jest wykluczenie z indeksu, używa się odpowiedniego noindex, przy czym robot musi mieć możliwość odczytania tej instrukcji. Dane poufne wymagają rzeczywistej kontroli dostępu.
W Joomla sprawdź faktyczny plik na serwerze. Blokowanie CSS lub JavaScript może utrudnić wyszukiwarce ocenę wyglądu strony. Przed zmianą zachowaj kopię i sprawdź konkretne adresy.
Zobacz także: Sitemap XML, ACL.
Źródło: dokumentacja Google. Sprawdzono: 12 września 2026 r.