Meta roboti un kanoniskais veidotājs
Izveidojiet derīgu meta robots tagu un kanonisko saiti vai ielīmējiet esošu <head> HTML, lai pārbaudītu, vai tajā nav reālu indeksēšanas konfliktu, piemēram, kanonisko dokumentu dublikātu un pretrunīgu direktīvu.
Rezultāts
Būvēšanas režīmā tiek apkopots tags `<meta name="robots" content="...">" no reālās direktīvu kopas meklētājprogrammas faktiski dokumentē, nevis izdomāts saraksts: index/noindex un follow/nofollow kontrolē indeksēšanu un saišu sekošanu, neviens nav dokumentēts saīsinājums noindex plus nofollow kopā, un noarchive, nosnippet, notransimageindex un no one specific search-witches kopijas, teksta/video fragmenti, attēlu indeksēšana un automātiskā tulkošanas piedāvājums). max-snippet, max-image-preview un max-video-preview izmanto meklētājprogrammu sagaidāmās skaitliskās vai uzskaitītās vērtības (piemēram, max-image-preview nevar pieņemt nevienu, standarta vai lielu, un max-snippet/max-video-preview akceptē -1 “bez ierobežojuma” vai skaitli, kas nav negatīvs). Līdzās tam tiek ģenerēts kanoniskais tags <link rel="canonical" href="...">", un, ja ievadītais URL nav pilns absolūtais URL, rīks to tieši norāda, jo relatīvais kanoniskais ir labi zināms nepareizas interpretācijas avots.
Audita režīms ir izcila funkcija: ielīmējiet neapstrādāto HTML, kas jums pašlaik ir (vai paredzēts) lapas <head>, un rīks to parsē ar pārlūkprogrammas vietējo DOMParser, lai atrastu katru faktiski esošo tagu `<meta name="robots">` un `<link rel="canonical">`. Pēc tam tiek pārbaudīti modeļi, kas ir patiesi, parasti kaitīgi, nevis teorētiski: divi vai vairāki kanoniskie tagi vienā lapā (meklētājprogrammām ir jāizvēlas viens, un dažādas programmas var izvēlēties atšķirīgi); kanoniskais URL, kas nav pilnībā kvalificēts absolūtais URL; un direktīvas, kas ir klajā pretrunā viena otrai, neatkarīgi no tā, vai tas ir divi atsevišķi robotu metatagi, kas nesakrīt, vai viens tags ar drukas kļūdu, piemēram, "index, noindex", kas rakstīts kopā. Ja norādāt arī pašas lapas URL, tā var noteikt konkrēto gadījumu, kad lapa ir vērsta uz sevi, bet tajā pašā laikā tā ir atzīmēta kā noindex — pašpretrunīgs signālu pāris, kas ir bieži sastopams pārpalikums no inscenēšanas vidēm vai SPS noklusējuma iestatījumiem, jo paškanoniskā lapa parasti ir tieši tā, kuru vēlaties indeksēt.
Šeit viss ir atklāts godīgi. Šis rīks apskata tikai jūsu ielīmēto HTML (un pēc izvēles arī HTTP galvenes tekstu) — tas neienes jūsu reāllaika lapu, nezina jūsu īstās servera galvenes, ja vien tās neielīmējat pats, kā arī nepārmeklē un nepārbauda, vai tas ir salīdzināts plašākā tīmeklī. Tieši šī iemesla dēļ X-Robots-Tag pārbaudei pastāv izvēles lauks "HTTP atbildes galvenes": meklētājprogrammas apvieno šo HTTP galveni ar lapas metatagu un piemēro direktīvu, kas ir visierobežojošākā, tāpēc galvenes līmeņa noindex var klusi ignorēt lapas tagu, kas izskatās lieliski, taču rīks var salīdzināt abus tikai tad, ja tiek nodrošināts abas. Katra pārbaude šeit ir balstīta uz dokumentētu meklēšanas centra darbību, nevis pēc tam izgudrotu SEO folkloru, un katra parsēšana un salīdzināšana tiek veikta lokāli jūsu pārlūkprogrammas cilnē. nekas, ko ielīmējat, nekad netiek nosūtīts uz serveri.