Proste wyjaśnienie
Robots.txt to plik tekstowy w głównym katalogu witryny zawierający reguły dostępu dla robotów internetowych do wskazanych obszarów serwisu.
Gdzie przydaje się w praktyce
Robots.txt steruje dostępem crawlerów do ścieżek, ale nie usuwa adresu z indeksu i jest publicznie widocznym plikiem.
Decyzja przed wdrożeniem
Każdą regułę oceniaj dla konkretnego user-agenta i środowiska, uważając na blokadę CSS, JS, produktów lub całej witryny.
Jak sprawdzić wynik
Testuj składnię, kod odpowiedzi, mapę witryny, logi botów i krytyczne adresy po każdym wdrożeniu.