Sari la conținut

Verificați ce crawleri lasă să intre fișierul robots.txt

Introduceți un site. sus.bot descarcă fișierul robots.txt și arată ce pagini poate vizita fiecare motor de căutare și fiecare crawler AI. Enumeră și căile pe care fișierul le dezvăluie oricui îl citește. Verificarea rulează în browser și este gratuită.

Preluăm /robots.txt de la originea site-ului. Căile și șirurile de interogare sunt ignorate.

Sau lipește un robots.txt

Primiți un mesaj când se schimbă un robots.txt

Monitorizarea verifică site-urile dvs. și ale concurenților la fiecare șase ore. Când un fișier se schimbă, primiți un mesaj în Slack, Discord sau Teams cu liniile modificate și crawlerii afectați.

Exemplu de mesaj
- Allow: /pricing/compare
+ Disallow: /pricing/compare
+ User-agent: GPTBot
+ Disallow: /

Linie de comandă și GitHub Action

Rulați aceleași verificări în terminal sau în CI. Build-ul poate eșua când se schimbă o regulă.

susbot audit https://example.com --fail-on warning

Citiți instrucțiunile CLI

Extensie de browser

Arată dacă pagina pe care vă aflați poate fi accesată de crawleri. Încă nu a fost lansată.