元机器人和规范生成器
构建有效的元机器人标签和规范链接,或粘贴现有的 <head> HTML 以审核其是否存在真正的索引冲突,例如重复的规范和矛盾的指令。
结果
构建模式从搜索引擎实际记录的真实指令集中组装一个`<meta name =“robots”content =“...”>`标签,而不是发明的列表:index / noindex和follow / nofollow控制索引和链接跟踪,none不是noindex加nofollow的记录简写,noarchive,nosnippet,noimageindex和notranslate每个都会关闭一个特定的搜索结果功能(缓存副本,文本/视频片段,图像)索引和自动翻译服务)。 max-snippet、max-image-preview 和 max-video-preview 采用搜索引擎期望的数字或枚举值(例如 max-image-preview 接受无、标准或大值,max-snippet/max-video-preview 接受 -1 表示“无限制”或非负数)。与它一起生成规范的`<link rel="canonical" href="...">`标签,如果您输入的URL不是完整的绝对URL,该工具会直接告诉您,因为相对规范是众所周知的误解来源。
审核模式是一个突出的功能:将您当前拥有的原始 HTML 粘贴到页面的“<head>”中(或用于),该工具使用浏览器的本机 DOMParser 对其进行解析,以查找实际存在的每个“<meta name="robots">”和“<link rel="canonical">”标记。然后,它会检查真正的、通常有害的模式,而不是理论上的模式:同一页面上有两个或多个规范标签(搜索引擎必须选择一个,不同的引擎可以选择不同的标签);规范 URL,但不是完全限定的绝对 URL;以及完全相互矛盾的指令,无论是两个不同的机器人元标签不一致,还是单个标签写在一起有“index,noindex”等拼写错误。如果您还提供页面自己的 URL,它可以检测规范指向自身的页面的特定情况,同时标记为 noindex — 一对自相矛盾的信号,是暂存环境或 CMS 默认值的常见遗留物,因为自我规范页面通常正是您想要索引的页面。
这里的一切都是诚实的。该工具仅查看您粘贴的 HTML(以及可选的 HTTP 标头文本),它不会获取您的实时页面,不知道您的真实服务器标头,除非您自己粘贴它们,并且不会在更广泛的网络上抓取或检查任何内容。这正是 X-Robots-Tag 检查存在可选“HTTP 响应标头”字段的原因:搜索引擎将该 HTTP 标头与页面元标记结合起来,并应用限制性最强的指令,因此标头级 noindex 可以默默地覆盖看起来完美的页面标记 - 但该工具只能在您提供两者的情况下比较两者。这里的每一项检查都基于记录的搜索中心行为,而不是事后发明的 SEO 民间传说,并且每一次解析和比较都在浏览器选项卡中本地运行;您粘贴的任何内容都不会发送到服务器。