Meta Robots et constructeur canonique
Créez une balise méta robots et un lien canonique valides, ou collez le code HTML <head> existant pour le vérifier afin de déceler de véritables conflits d'indexation tels que des canoniques en double et des directives contradictoires.
Résultat
Le mode construction assemble une balise `<meta name="robots" content="...">` issue du véritable ensemble de directives que les moteurs de recherche documentent réellement, et non une liste inventée : index/noindex et follow/nofollow contrôlent l'indexation et le suivi des liens, none est le raccourci documenté pour noindex plus nofollow ensemble, et noarchive, nosnippet, noimageindex et notranslate désactivent chacun une fonctionnalité spécifique de résultat de recherche (copies en cache, extraits de texte/vidéo, indexation d'images, et l'offre de traduction automatique). max-snippet, max-image-preview et max-video-preview prennent les valeurs numériques ou énumérées attendues par les moteurs de recherche (par exemple max-image-preview n'accepte aucun, standard ou grand, et max-snippet/max-video-preview accepte -1 pour "aucune limite" ou un nombre non négatif). Une balise canonique `<link rel="canonical" href="...">` est générée à côté, et si l'URL que vous avez saisie n'est pas une URL absolue complète, l'outil vous l'indique directement, car une balise canonique relative est une source bien connue de mauvaise interprétation.
Le mode audit est la fonctionnalité la plus remarquable : collez le code HTML brut que vous avez actuellement dans (ou destiné à) le `<head>` d'une page, et l'outil l'analyse avec le DOMParser natif du navigateur pour trouver toutes les balises `<meta name="robots">` et `<link rel="canonical">` réellement présentes. Il vérifie ensuite les modèles qui sont véritablement, généralement nuisibles plutôt que théoriques : deux balises canoniques ou plus sur la même page (les moteurs de recherche doivent en choisir une, et différents moteurs peuvent en choisir différemment) ; une URL canonique qui n'est pas une URL absolue pleinement qualifiée ; et des directives qui se contredisent catégoriquement, qu'il s'agisse de deux balises méta de robots distinctes en désaccord ou d'une seule balise avec une faute de frappe comme "index, noindex" écrite ensemble. Si vous fournissez également la propre URL de la page, il peut détecter le cas spécifique d'une page dont la canonique pointe vers elle-même tout en étant simultanément marquée noindex - une paire de signaux auto-contradictoires qui est un héritage commun des environnements de test ou des paramètres par défaut du CMS, puisqu'une page auto-canonique est normalement exactement celle que vous souhaitez indexer.
Tout ici est défini honnêtement. Cet outil examine uniquement le HTML (et, éventuellement, le texte d'en-tête HTTP) que vous collez. Il ne récupère pas votre page en direct, ne connaît pas les en-têtes réels de votre serveur à moins que vous ne les colliez vous-même, et n'analyse ni ne vérifie quoi que ce soit par rapport au Web au sens large. C'est précisément pourquoi un champ facultatif « En-têtes de réponse HTTP » existe pour la vérification X-Robots-Tag : les moteurs de recherche combinent cet en-tête HTTP avec la balise méta sur la page et appliquent la directive la plus restrictive, de sorte qu'un noindex au niveau de l'en-tête peut remplacer silencieusement une balise sur la page qui semble parfaitement correcte - mais l'outil ne peut comparer les deux que si vous fournissez les deux. Chaque vérification ici est fondée sur le comportement documenté de Search Central, et non sur le folklore SEO inventé après coup, et chaque analyse et comparaison s'exécute localement dans l'onglet de votre navigateur ; rien de ce que vous collez n'est jamais envoyé à un serveur.