0

Metarobots y constructor canónico

Cree una metaetiqueta de robots válida y un enlace canónico, o pegue el HTML <head> existente para auditarlo en busca de conflictos de indexación reales, como canónicos duplicados y directivas contradictorias.

Buy Me a Coffee at ko-fi.com
Procesando... 0%
Entrada de lectura
Etiquetas de creación o auditoría
Comprobando conflictos
hecho

Resultado

El modo de compilación ensambla una etiqueta `<meta name="robots" content="...">` del conjunto de directivas real que los motores de búsqueda realmente documentan, no una lista inventada: index/noindex y follow/nofollow controlan la indexación y el seguimiento de enlaces, none es la abreviatura documentada de noindex más nofollow juntos, y noarchive, nosnippet, noimageindex y notranslate desactivan cada uno una característica específica de resultados de búsqueda (copias en caché, fragmentos de texto/vídeo, indexación de imágenes y la oferta de traducción automática). max-snippet, max-image-preview y max-video-preview toman los valores numéricos o enumerados que esperan los motores de búsqueda (por ejemplo, max-image-preview no acepta ninguno, estándar o grande, y max-snippet/max-video-preview acepta -1 para "sin límite" o un número no negativo). Junto a ella se genera una etiqueta canónica `<link rel="canonical" href="...">`, y si la URL que ingresó no es una URL absoluta, la herramienta se lo indica directamente, ya que una canónica relativa es una fuente bien conocida de mala interpretación.

El modo de auditoría es la característica destacada: pegue el HTML sin procesar que tiene actualmente dentro (o destinado a) `<head>` de una página, y la herramienta lo analiza con el DOMParser nativo del navegador para encontrar cada etiqueta `<meta name="robots">` y `<link rel="canonical">` realmente presente. Luego busca patrones que sean genuinamente dañinos en lugar de teóricos: dos o más etiquetas canónicas en la misma página (los motores de búsqueda tienen que elegir una y diferentes motores pueden elegir de manera diferente); una URL canónica que no es una URL absoluta totalmente calificada; y directivas que se contradicen rotundamente entre sí, ya sean dos metaetiquetas de robots separadas en desacuerdo o una sola etiqueta con un error tipográfico como "index, noindex" escritas juntas. Si también proporciona la propia URL de la página, puede detectar el caso específico de una página cuyo canonical apunta a sí misma mientras está marcada simultáneamente como noindex: un par de señales autocontradictorias que son un resto común de los entornos de prueba o valores predeterminados de CMS, ya que una página autocanónica normalmente es exactamente la que desea indexar.

Todo aquí tiene un alcance honesto. Esta herramienta solo mira el HTML (y, opcionalmente, el texto del encabezado HTTP) que usted pega: no recupera su página activa, no conoce los encabezados reales de su servidor a menos que los pegue usted mismo y no rastrea ni compara nada con la Web en general. Es precisamente por eso que existe un campo opcional de "encabezados de respuesta HTTP" para la verificación de X-Robots-Tag: los motores de búsqueda combinan ese encabezado HTTP con la metaetiqueta en la página y aplican la directiva que sea más restrictiva, por lo que un noindex a nivel de encabezado puede anular silenciosamente una etiqueta en la página que se ve perfectamente bien, pero la herramienta solo puede comparar las dos si proporciona ambas. Cada verificación aquí se basa en el comportamiento documentado de Search Central, no en el folklore de SEO inventado después del hecho, y cada análisis y comparación se ejecuta localmente en la pestaña de su navegador; Nada de lo que pegas se envía nunca a un servidor.