Robots.txt Tester
Zalijepite datoteku robots.txt, odaberite robota za indeksiranje — uključujući GPTBot, ClaudeBot i Google-Extended — i odmah vidite može li dohvatiti zadani URL put, s točnim pravilom i brojem retka koji su o tome odlučili.
🔒 U potpunosti se obrađuje u vašem pregledniku — ništa što ovdje unesete nikada se ne učitava.
Rezultat
Datoteka robots.txt varljivo je jednostavna za čitanje, a iznenađujuće lako se može pogriješiti: zalutali `Disallow: /` u pogrešnoj grupi User-agent može tiho deindeksirati cijelo web-mjesto, dok pravilo koje izgleda kao da blokira robota može biti nadjačano duljim, specifičnijim uzorkom na drugom mjestu u datoteci. Ovaj alat ponovno implementira stvarni algoritam sparivanja koji koriste tražilice i AI roboti za indeksiranje — de-facto Robots Exclusion Protocol formaliziran u RFC 9309 i dokumentiran od Googlea — umjesto da ga aproksimira jednostavnim skeniranjem redak po redak, tako da je presuda koju ovdje vidite presuda koju bi izračunao stvarni robot.
Zalijepite sadržaj vaše datoteke robots.txt, upišite URL put koji želite provjeriti (npr. `/admin/` ili `/blog/draft-post`) i odaberite robota za indeksiranje s uključenog popisa od 20 stvarnih tokena korisničkih agenata. Taj popis namjerno nadilazi klasike — Googlebot, Bingbot i `*` zamjensku grupu — kako bi uključio trenutačnu generaciju AI strugača: GPTBot i OAI-SearchBot (OpenAI), ClaudeBot i anthropic-ai (Anthropic), Google-Extended (Googleov signal za odjavu od AI treniranja, odvojen od Googlebotovog robota za pretraživanje), Applebot-Extended (Appleov ekvivalent odjave), PerplexityBot, CCBot (Common Crawl, čija arhiva hrani mnoge druge AI modele), Bytespider (ByteDance), Meta-ExternalAgent, Amazonbot i druge. Svaki token dolazi s kratkim, iskrenim objašnjenjem što on zapravo jest.
Sam algoritam precizno slijedi specifikaciju: grupe korisničkih agenata sparuju se neosjetljivo na velika i mala slova, pri čemu točno podudaranje ili podudaranje prefiksa tokena proizvoda uvijek pobjeđuje `*` zamjensku grupu, a više blokova koji deklariraju isti token spajaju se kao što to rade stvarni roboti. Unutar pobjedničke grupe, svako Allow i Disallow pravilo provjerava se prema putanji koristeći ispravnu semantiku zamjenskih znakova (`*` odgovara bilo kojem nizu, `$` na kraju sidri kraj putanje), a pobjeđuje najdulji podudarni uzorak — pri čemu Allow pobjeđuje u slučaju izjednačenja s Disallow iste duljine, točno kako je dokumentirano u Googleovoj vlastitoj implementaciji robots.txt.
Panel s rezultatima ne kaže samo DOPUŠTENO ili BLOKIRANO — imenuje točan redak i tekst pravila koji su odgovorni, tako da se možete izravno vratiti u svoju datoteku i ispraviti (ili potvrditi) direktivu koja je važna. To je detalj koji većina provjerivača robots.txt preskače, i to je razlika između nagađanja zašto se stranica ne indeksira i sigurnog znanja.