Meta Robots وCanonical Builder
أنشئ علامة تعريف روبوتات صالحة ورابطًا أساسيًا، أو الصق HTML الموجود <head> لتدقيقه بحثًا عن تعارضات الفهرسة الحقيقية مثل القواعد الأساسية المكررة والتوجيهات المتناقضة.
النتيجة
يقوم وضع البناء بتجميع علامة `<meta name="robots" content="...">` من محركات بحث مجموعة التوجيهات الحقيقية التي توثق فعليًا، وليست قائمة مخترعة: الفهرسة/noindex وfollow/nofollow للتحكم في الفهرسة ومتابعة الارتباط، لا شيء هو الاختصار الموثق لـ noindex بالإضافة إلى nofollow معًا، كما يقوم noarchive وnosnippet وnoimageindex وnotranslate بإيقاف تشغيل ميزة واحدة محددة لنتائج البحث (النسخ المخزنة مؤقتًا، مقتطفات نصية/فيديو، وفهرسة الصور، وعرض الترجمة التلقائية). تأخذ max-snippet وmax-image-preview وmax-video-preview القيم الرقمية أو المعدودة التي تتوقعها محركات البحث (على سبيل المثال، لا تقبل max-image-preview أي شيء أو قياسي أو كبير، وتقبل max-snippet/max-video-preview -1 لـ "بلا حدود" أو رقم غير سالب). يتم إنشاء علامة `<link rel="canonical" href="...">` الأساسية بجانبها، وإذا كان عنوان URL الذي أدخلته ليس عنوان URL مطلقًا كاملاً، فستخبرك الأداة بذلك مباشرةً، نظرًا لأن العنوان الأساسي النسبي يعد مصدرًا معروفًا للتفسير الخاطئ.
وضع التدقيق هو الميزة البارزة: الصق HTML الخام الموجود لديك حاليًا داخل (أو مخصص) لـ `<head>` للصفحة، وتقوم الأداة بتحليله باستخدام DOMParser الأصلي للمتصفح للعثور على كل علامة `<meta name="robots">` و`<link rel="canonical">` موجودة بالفعل. ثم يتحقق بعد ذلك من الأنماط الضارة بشكل شائع وليست نظرية: علامتان أساسيتان أو أكثر في نفس الصفحة (يجب على محركات البحث اختيار واحدة، ويمكن لمحركات مختلفة الاختيار بشكل مختلف)؛ عنوان URL أساسي ليس عنوان URL مطلقًا مؤهلاً بالكامل؛ والتوجيهات التي تتعارض بشكل قاطع مع بعضها البعض، سواء كانت علامتين وصفيتين منفصلتين لبرامج الروبوت غير متفقتين أو علامة واحدة بها خطأ مطبعي مثل "index, noindex" مكتوبة معًا. إذا قمت أيضًا بتوفير عنوان URL الخاص بالصفحة، فيمكنه اكتشاف الحالة المحددة للصفحة التي تشير إلى نفسها بينما يتم وضع علامة noindex عليها في نفس الوقت - وهو زوج من الإشارات المتناقضة ذاتيًا والتي تعتبر بقايا شائعة من البيئات المرحلية أو افتراضيات CMS، نظرًا لأن الصفحة المتعارف عليها ذاتيًا هي عادةً بالضبط الصفحة التي تريد فهرستها.
كل شيء هنا يتم تحديده بأمانة. لا تنظر هذه الأداة إلا إلى HTML (ونص رأس HTTP اختياريًا) الذي تلصقه - فهي لا تجلب صفحتك المباشرة، ولا تعرف رؤوس الخادم الحقيقية إلا إذا قمت بلصقها بنفسك، ولا تزحف أو تتحقق من أي شيء على شبكة الإنترنت الأوسع. وهذا هو بالضبط سبب وجود حقل "رؤوس استجابة HTTP" الاختياري لفحص X-Robots-Tag: تجمع محركات البحث رأس HTTP هذا مع علامة التعريف الموجودة على الصفحة وتطبق أي توجيه أكثر تقييدًا، لذلك يمكن لعلامة noindex على مستوى الرأس أن تتجاوز بصمت علامة على الصفحة تبدو جيدة تمامًا - ولكن لا يمكن للأداة مقارنة الاثنين إلا إذا قمت بتوفير كليهما. يرتكز كل فحص هنا على سلوك Search Central الموثق، وليس على فولكلور تحسين محركات البحث الذي تم اختراعه بعد الحقيقة، ويتم تشغيل كل تحليل ومقارنة محليًا في علامة تبويب المتصفح الخاص بك؛ لا يتم إرسال أي شيء تلصقه إلى الخادم.