0

Meta Robots ja kanoonilise sildi koostaja

Koosta kehtiv meta robots-silt ja kanooniline link või kleebi olemasolev <head> HTML, et auditeerida seda tõeliste indekseerimiskonfliktide (nt duplikaatkanoonika ja vastuoluliste direktiivide) suhtes.

🔒 Töödeldud täielikult teie brauseris – midagi, mida siia sisestate, ei laadita kunagi üles.

Töötlen... 0%
Sisendi lugemine
Siltide koostamine või auditeerimine
Konfliktide kontrollimine
Valmis

Tulemus

Koostamise režiim paneb kokku `<meta name="robots" content="...">` sildi reaalsest, otsingumootorite poolt ka tegelikult dokumenteeritud direktiivide komplektist, mitte väljamõeldud nimekirjast: index/noindex ja follow/nofollow juhivad indekseerimist ja linkide järgimist, none on dokumenteeritud lühend noindex ja nofollow kooskasutusele ning noarchive, nosnippet, noimageindex ja notranslate lülitavad igaüks välja ühe konkreetse otsingutulemuste funktsiooni (puhverdatud koopiad, teksti-/videokatked, piltide indekseerimine ja automaatne tõlkepakkumine). max-snippet, max-image-preview ja max-video-preview võtavad vastu numbrilised või loendatavad väärtused, mida otsingumootorid ootavad (näiteks max-image-preview aktsepteerib väärtuseid none, standard või large ning max-snippet/max-video-preview aktsepteerivad -1 ehk "piiramatu" või mittenegatiivse arvu). Kanooniline `<link rel="canonical" href="...">` silt genereeritakse selle kõrvale ja kui sisestatud URL ei ole täielik absoluutne URL, ütleb tööriist sulle seda otse, kuna suhteline kanooniline aadress on üldtuntud valesti tõlgendamise allikas.

Auditi režiim on silmapaistev omadus: kleebi toores HTML, mis sul hetkel lehe `<head>` sees on (või sinna mõeldud) ja tööriist parsib selle brauseri sisseehitatud DOMParseriga, et leida iga `<meta name="robots">` ja `<link rel="canonical">` silt, mis seal tegelikult on. Seejärel kontrollib see mustreid, mis on tõeliselt ja sageli kahjulikud, mitte teoreetilised: kaks või enam kanoonilist silti samal lehel (otsingumootorid peavad ühe valima ja erinevad mootorid võivad valida erinevalt); kanooniline URL, mis ei ole täielikult kvalifitseeritud absoluutne URL; ja direktiivid, mis üksteisele otseselt vastu räägivad, olgu selleks kaks erinevat robots-meta silti, mis omavahel ei klapi, või üks silt kirjaveaga nagu "index, noindex" koos. Kui lisad ka lehe enda URL-i, suudab see tuvastada spetsiifilise juhtumi, kus lehe kanooniline aadress osutab iseendale, samal ajal kui see on märgitud noindex'iga – vastuoluline signaalide paar, mis on tavaline jääk lavastuskeskkondadest või CMS-i vaikeseadetest, sest iseendale viitav kanooniline leht on tavaliselt just see, mida sa indekseerida tahaksid.

Siinne ulatus on ausalt piiritletud. See tööriist vaatab ainult HTML-i (ja valikuliselt HTTP päise teksti), mille sa siia kleebid – see ei küsi sinu reaalset lehte, ei tea sinu tegelikke serveripäiseid, kui sa neid ise ei kleebi, ega rooma ega kontrolli midagi laiema veebi suhtes. Just sellepärast ongi X-Robots-Tag kontrolliks olemas valikuline "HTTP vastuse päised" väli: otsingumootorid kombineerivad seda HTTP päist lehel oleva metasildiga ja rakendavad kõige piiravamat direktiivi, nii et päise-taseme noindex võib vaikselt tühistada lehel oleva sildi, mis näeb täiesti korras välja – aga tööriist saab neid kahte võrrelda ainult siis, kui sa mõlemad sisestad. Iga kontroll siin põhineb dokumenteeritud Search Centrali käitumisel, mitte tagantjärele väljamõeldud SEO folklooril, ja iga parsimine ning võrdlus toimub lokaalselt sinu brauseri vahelehel; midagi, mida sa kleebid, ei saadeta kunagi ühelegi serverile.