Robot Meta & Pembina Kanonik
Bina teg robot meta dan pautan kanonik yang sah, atau tampal HTML <head> sedia ada untuk mengauditnya bagi konflik pengindeksan sebenar seperti kanonik pendua dan arahan bercanggah.
Hasilnya
Mod binaan memasang teg `<meta name="robots" content="...">` daripada set arahan sebenar enjin carian sebenarnya mendokumenkan, bukan senarai ciptaan: indeks/noindex dan ikuti/nofollow kawalan pengindeksan dan pautan-mengikut, tiada satu pun adalah trengkas yang didokumenkan untuk noindex ditambah nofollow bersama-sama, dan noarchive, nosnippet, noimage offindex dan notranslate setiap satu capaian-teks/kopi-video yang khusus coretan, pengindeksan imej dan tawaran terjemahan automatik). coretan maks, pratonton-imej maks dan pratonton-video maks mengambil nilai angka atau terhitung yang diharapkan oleh enjin carian (contohnya pratonton imej maks tidak menerima satu pun, standard atau besar dan coretan maks/pratonton video maks menerima -1 untuk "tiada had" atau nombor bukan negatif). Teg `<link rel="canonical" href="...">` kanonik dijana bersamanya dan jika URL yang anda masukkan bukan URL mutlak penuh, alat itu memberitahu anda secara langsung, kerana kanonik relatif ialah sumber salah tafsiran yang terkenal.
Mod audit ialah ciri yang menonjol: tampalkan HTML mentah yang anda ada pada masa ini di dalam (atau bertujuan untuk) `<head>` halaman, dan alat menghuraikannya dengan DOMParser asli penyemak imbas untuk mencari setiap teg `<meta name="robots">` dan `<link rel="canonical">` yang sebenarnya ada. Ia kemudian menyemak corak yang benar-benar, biasanya berbahaya dan bukannya teori: dua atau lebih teg kanonik pada halaman yang sama (enjin carian perlu memilih satu dan enjin yang berbeza boleh memilih secara berbeza); URL kanonik yang bukan URL mutlak yang layak sepenuhnya; dan arahan yang bercanggah sama sekali, sama ada dua teg meta robot berasingan tidak bersetuju atau teg tunggal dengan kesilapan taip seperti "indeks, noindex" yang ditulis bersama. Jika anda turut menyediakan URL halaman itu sendiri, ia boleh mengesan kes khusus halaman yang berkanun menghala pada dirinya sendiri semasa ia ditandakan noindex secara serentak — sepasang isyarat bercanggah sendiri yang merupakan sisa biasa daripada persekitaran pementasan atau lalai CMS, kerana halaman berkanun sendiri biasanya betul-betul yang anda mahu diindeks.
Segala-galanya di sini adalah skop secara jujur. Alat ini hanya melihat HTML (dan, secara pilihan, teks pengepala HTTP) yang anda tampal — alat ini tidak mengambil halaman langsung anda, tidak mengetahui pengepala pelayan sebenar anda melainkan anda menampalnya sendiri dan tidak merangkak atau menyemak apa-apa pada web yang lebih luas. Itulah sebabnya medan "pengepala respons HTTP" pilihan wujud untuk semakan X-Robots-Tag: enjin carian menggabungkan pengepala HTTP tersebut dengan teg meta pada halaman dan menggunakan mana-mana arahan yang paling menyekat, jadi noindex peringkat pengepala boleh secara senyap-senyap mengatasi teg pada halaman yang kelihatan baik — tetapi alat itu hanya boleh membandingkan kedua-duanya jika anda membekalkan kedua-duanya. Setiap semakan di sini didasarkan pada tingkah laku Pusat Carian yang didokumenkan, bukan cerita rakyat SEO yang dicipta selepas fakta, dan setiap penghuraian dan perbandingan berjalan secara setempat dalam tab penyemak imbas anda; tiada apa yang anda tampalkan pernah dihantar ke pelayan.