Конструктор Meta Robots і Canonical
Створіть коректний тег meta robots і canonical-посилання, або вставте наявний HTML <head>, щоб перевірити його на реальні конфлікти індексації — дублікати canonical, суперечливі директиви тощо.
Результат
Режим побудови створює тег `<meta name="robots" content="...">` з реального набору директив, які справді документують пошукові системи, а не з вигаданого переліку: index/noindex і follow/nofollow керують індексацією та переходом за посиланнями, none — це задокументоване скорочення для noindex разом із nofollow, а noarchive, nosnippet, noimageindex і notranslate вимикають конкретну функцію результатів пошуку (кешовану копію, текстовий чи відео-сніпет, індексацію зображень і автоматичну пропозицію перекладу). max-snippet, max-image-preview і max-video-preview приймають числові або перелічені значення, яких очікують пошукові системи (наприклад, max-image-preview приймає none, standard або large, а max-snippet і max-video-preview — -1 для "без обмеження" або невід'ємне число). Поруч генерується тег canonical `<link rel="canonical" href="...">`, і якщо введена URL-адреса не є повною абсолютною адресою, інструмент прямо про це повідомляє, оскільки відносний canonical — відоме джерело неправильної інтерпретації.
Режим аудиту — головна особливість інструмента: вставте сирий HTML, який зараз є (або планується) всередині `<head>` сторінки, і інструмент розбере його нативним DOMParser браузера, щоб знайти кожен наявний тег `<meta name="robots">` і `<link rel="canonical">`. Далі він перевіряє шаблони, які справді, а не теоретично, шкідливі: два чи більше тегів canonical на одній сторінці (пошуковим системам доводиться обирати один, і різні системи можуть обрати по-різному); URL-адреса canonical, яка не є повністю кваліфікованою абсолютною адресою; і директиви, що прямо суперечать одна одній — чи то два окремі теги meta robots не узгоджуються між собою, чи то один тег містить одруківку на кшталт "index, noindex" разом. Якщо ви також вкажете URL-адресу самої сторінки, інструмент може виявити конкретний випадок, коли canonical сторінки вказує сама на себе, водночас позначена noindex, — суперечливу пару сигналів, яка часто є пережитком тестових середовищ чи типових налаштувань CMS, адже self-canonical сторінка зазвичай саме та, яку й хочуть індексувати.
Усе тут окреслено чесно. Інструмент дивиться лише на HTML (і, опційно, текст HTTP-заголовків), який ви вставили самі, — він не завантажує вашу реальну сторінку, не знає справжніх заголовків вашого сервера, якщо ви їх самі не вставите, і нічого не сканує та не перевіряє щодо решти інтернету. Саме тому існує опційне поле "HTTP-заголовки відповіді" для перевірки X-Robots-Tag: пошукові системи комбінують цей HTTP-заголовок із тегом meta на сторінці й застосовують найсуворішу директиву, тож noindex на рівні заголовка може непомітно перекрити тег на сторінці, який виглядає цілком нормально, — але інструмент може порівняти їх, лише якщо ви надасте обидва. Кожна перевірка тут спирається на задокументовану поведінку Search Central, а не на вигадані заднім числом SEO-міфи, і кожен розбір та порівняння виконується локально у вашій вкладці браузера; ніщо з вставленого ніколи не надсилається на сервер.