Robot Meta & Trình tạo Canonical
Xây dựng một thẻ meta robots hợp lệ và liên kết chuẩn hoặc dán HTML <head> hiện có để kiểm tra các xung đột lập chỉ mục thực tế như các chuẩn mực trùng lặp và các chỉ thị mâu thuẫn.
kết quả
Chế độ xây dựng tập hợp một thẻ `<meta name="robots" content="...">` từ bộ chỉ thị thực mà công cụ tìm kiếm thực sự ghi lại, không phải là một danh sách được phát minh: chỉ mục/noindex và follow/nofollow kiểm soát việc lập chỉ mục và theo dõi liên kết, không có cách viết tắt tài liệu nào cho noindex cộng với nofollow cùng nhau và noarchive, nosnippet, noimageindex và notranslate, mỗi tính năng đều tắt một tính năng kết quả tìm kiếm cụ thể (bản sao được lưu trong bộ nhớ đệm, đoạn văn bản/video, lập chỉ mục hình ảnh và ưu đãi dịch tự động). max-snippet, max-image-preview và max-video-preview lấy các giá trị số hoặc liệt kê mà công cụ tìm kiếm mong đợi (ví dụ: max-image-preview không chấp nhận, tiêu chuẩn hoặc lớn và max-snippet/max-video-preview chấp nhận -1 cho "không giới hạn" hoặc số không âm). Thẻ `<link rel="canonical" href="...">` chuẩn được tạo cùng với thẻ đó và nếu URL bạn đã nhập không phải là một URL tuyệt đối đầy đủ thì công cụ sẽ thông báo trực tiếp cho bạn điều đó, vì thẻ chuẩn tương đối là nguồn hiểu sai phổ biến.
Chế độ kiểm tra là tính năng nổi bật: dán HTML thô mà bạn hiện có bên trong (hoặc dự định cho) `<head>` của một trang và công cụ này sẽ phân tích cú pháp HTML đó bằng DOMParser gốc của trình duyệt để tìm mọi thẻ `<meta name="robots">` và `<link rel="canonical">` thực sự hiện diện. Sau đó, nó sẽ kiểm tra các mẫu thực sự có hại, thường có hại hơn là lý thuyết: hai hoặc nhiều thẻ chuẩn trên cùng một trang (các công cụ tìm kiếm phải chọn một và các công cụ khác nhau có thể chọn khác nhau); URL chuẩn không phải là URL tuyệt đối đủ điều kiện; và các chỉ thị hoàn toàn mâu thuẫn với nhau, cho dù đó là hai thẻ meta robot riêng biệt không đồng ý hay một thẻ duy nhất có lỗi đánh máy như "index, noindex" được viết cùng nhau. Nếu bạn cũng cung cấp URL riêng của trang, nó có thể phát hiện trường hợp cụ thể của một trang có trang chuẩn hướng vào chính nó trong khi trang đó được đánh dấu noindex đồng thời — một cặp tín hiệu tự mâu thuẫn thường còn sót lại từ môi trường dàn dựng hoặc mặc định CMS, vì trang tự chuẩn thường chính xác là trang bạn muốn được lập chỉ mục.
Mọi thứ ở đây đều được tính toán một cách trung thực. Công cụ này chỉ xem xét HTML (và, tùy chọn, văn bản tiêu đề HTTP) mà bạn dán vào — nó không tìm nạp trang trực tiếp của bạn, không biết tiêu đề máy chủ thực của bạn trừ khi bạn tự dán chúng và không thu thập dữ liệu hoặc kiểm tra bất cứ điều gì trên web rộng hơn. Đó chính xác là lý do tại sao tồn tại trường "tiêu đề phản hồi HTTP" tùy chọn cho kiểm tra X-Robots-Tag: công cụ tìm kiếm kết hợp tiêu đề HTTP đó với thẻ meta trên trang và áp dụng bất kỳ lệnh nào hạn chế nhất, do đó, noindex cấp tiêu đề có thể âm thầm ghi đè thẻ trên trang trông hoàn toàn ổn — nhưng công cụ chỉ có thể so sánh cả hai nếu bạn cung cấp cả hai. Mọi hoạt động kiểm tra ở đây đều dựa trên hành vi được ghi lại của Trung tâm Tìm kiếm, chứ không phải văn hóa dân gian SEO được phát minh sau thực tế, đồng thời mọi phân tích cú pháp và so sánh đều chạy cục bộ trong tab trình duyệt của bạn; không có gì bạn dán được gửi đến máy chủ.