0

Meta Robot e costruttore canonico

Crea un meta tag robots e un collegamento canonico validi oppure incolla l'HTML <head> esistente per verificarne la presenza di reali conflitti di indicizzazione come canonici duplicati e direttive contraddittorie.

Buy Me a Coffee at ko-fi.com
Elaborazione... 0%
Ingresso di lettura
Creazione o controllo dei tag
Controllo dei conflitti
Fatto

Risultato

La modalità di creazione assembla un tag `<meta name="robots" content="...">` dal vero insieme di direttive che i motori di ricerca effettivamente documentano, non un elenco inventato: index/noindex e follow/nofollow controllano l'indicizzazione e il follow-link, none è la scorciatoia documentata per noindex e nofollow insieme e noarchive, nosnippet, noimageindex e notranslate disattivano ciascuno una specifica funzionalità dei risultati di ricerca (copie memorizzate nella cache, testo/video snippet, indicizzazione delle immagini e offerta di traduzione automatica). max-snippet, max-image-preview e max-video-preview accettano i valori numerici o enumerati previsti dai motori di ricerca (ad esempio max-image-preview accetta nessuno, standard o grande e max-snippet/max-video-preview accetta -1 per "nessun limite" o un numero non negativo). Insieme ad esso viene generato un tag canonico `<link rel="canonical" href="...">` e, se l'URL inserito non è un URL assoluto completo, lo strumento te lo dice direttamente, poiché un canonical relativo è una nota fonte di interpretazione errata.

La modalità di controllo è la caratteristica principale: incolla l'HTML grezzo che hai attualmente (o a cui sei destinato) nel `<head>` di una pagina e lo strumento lo analizza con il DOMParser nativo del browser per trovare ogni tag `<meta name="robots">` e `<link rel="canonical">` effettivamente presente. Quindi controlla i modelli che sono realmente, comunemente dannosi piuttosto che teorici: due o più tag canonici sulla stessa pagina (i motori di ricerca devono sceglierne uno e motori diversi possono sceglierne uno diverso); un URL canonico che non è un URL assoluto completo; e direttive che si contraddicono palesemente a vicenda, sia che si tratti di due meta tag robot separati in disaccordo o di un singolo tag con un errore di battitura come "index, noindex" scritto insieme. Se fornisci anche l'URL della pagina, può rilevare il caso specifico di una pagina il cui canonical punta a se stessa mentre è contemporaneamente contrassegnata come noindex — una coppia di segnali autocontraddittori che è un residuo comune degli ambienti di staging o delle impostazioni predefinite del CMS, poiché una pagina auto-canonica è normalmente esattamente quella che vuoi indicizzare.

Tutto qui è ambito onestamente. Questo strumento esamina sempre e solo il codice HTML (e, facoltativamente, il testo dell'intestazione HTTP) che incolli: non recupera la tua pagina live, non riconosce le intestazioni del tuo server reale a meno che non le incolli tu stesso e non esegue la scansione o controlla nulla rispetto al web più ampio. Questo è esattamente il motivo per cui esiste un campo opzionale "Intestazioni di risposta HTTP" per il controllo X-Robots-Tag: i motori di ricerca combinano quell'intestazione HTTP con il meta tag sulla pagina e applicano qualunque direttiva sia più restrittiva, quindi un noindex a livello di intestazione può sovrascrivere silenziosamente un tag sulla pagina che sembra perfettamente a posto, ma lo strumento può confrontare i due solo se li fornisci entrambi. Ogni controllo qui si basa sul comportamento documentato di Search Central, non sul folklore SEO inventato a posteriori, e ogni analisi e confronto viene eseguito localmente nella scheda del browser; nulla di ciò che incolli viene mai inviato a un server.