Công cụ SEO

Kiểm tra Robots.txt

Dán nội dung robots.txt của bạn và kiểm tra xem các đường dẫn URL cụ thể có được phép hay bị chặn cho các bot công cụ tìm kiếm khác nhau hay không.

Kiểm tra Ngay Lập Tức

Dán robots.txt của bạn và kiểm tra các đường dẫn URL ngay lập tức. Xem kết quả theo thời gian thực khi bạn nhập.

Hỗ Trợ Nhiều Bot

Kiểm tra với Googlebot, Bingbot và các trình thu thập thông tin phổ biến khác. Xem chính xác cách mỗi bot diễn giải quy tắc của bạn.

100% Bên Khách Hàng

Tất cả việc phân tích và kiểm tra diễn ra trong trình duyệt của bạn. Nội dung robots.txt của bạn không bao giờ rời khỏi thiết bị của bạn.

Hiểu về Robots.txt

Tệp robots.txt là một tiêu chuẩn được các trang web sử dụng để giao tiếp với các trình thu thập thông tin của công cụ tìm kiếm và các robot web khác. Nó cho biết các bot phần nào của trang web của bạn có thể và không thể truy cập.

Robots.txt là gì?

Robots.txt là một tệp văn bản thuần được đặt tại gốc của trang web của bạn (ví dụ: example.com/robots.txt) theo Giao thức Loại trừ Robots. Nó chứa các quy tắc cho biết các trình thu thập thông tin URL nào có thể truy cập trên trang web của bạn.

Cách Sử Dụng Công Cụ Này

Dán nội dung robots.txt của bạn vào vùng văn bản (hoặc tải nó từ một miền), nhập một đường dẫn URL bạn muốn kiểm tra, chọn một user-agent và nhấp vào 'Kiểm tra URL'. Công cụ sẽ ngay lập tức cho bạn biết nếu đường dẫn được phép hay bị chặn.

Tại Sao Nên Kiểm Tra Robots.txt của Bạn?

  • Ngăn chặn việc vô tình chặn các trang quan trọng khỏi các công cụ tìm kiếm
  • Đảm bảo các trang riêng tư hoặc quản trị được ẩn đúng cách khỏi các trình thu thập thông tin
  • Gỡ lỗi các vấn đề thu thập thông tin trước khi chúng ảnh hưởng đến thứ hạng tìm kiếm của bạn
  • Xác thực các thay đổi trước khi triển khai vào sản xuất

Bảo Mật Đảm Bảo

Công cụ này hoạt động hoàn toàn trong trình duyệt của bạn. Nội dung robots.txt và các URL kiểm tra của bạn không bao giờ được gửi đến bất kỳ máy chủ nào. Hoàn hảo để kiểm tra các quy tắc chứa các đường dẫn nhạy cảm.

Câu Hỏi Thường Gặp

Cách hoạt động của việc khớp robots.txt?
Robots.txt sử dụng khớp tiền tố đường dẫn. Một quy tắc như 'Disallow: /admin/' chặn tất cả các URL bắt đầu bằng '/admin/'. Ký tự đại diện (*) có thể được sử dụng để khớp mẫu, và ký hiệu đô la ($) gắn một khớp vào cuối một URL.
Điều gì có ưu tiên hơn: Allow hay Disallow?
Khi cả hai quy tắc Allow và Disallow khớp với một URL, quy tắc cụ thể nhất (dài nhất) sẽ thắng. Nếu chúng có cùng độ dài, Allow sẽ có ưu tiên. Điều này tuân theo cách giải thích tiêu chuẩn của Google.
Robots.txt có ngăn chặn các trang được lập chỉ mục không?
Không, robots.txt chỉ kiểm soát việc thu thập thông tin, không phải lập chỉ mục. Một trang bị chặn bởi robots.txt vẫn có thể xuất hiện trong kết quả tìm kiếm nếu các trang khác liên kết đến nó. Sử dụng thẻ meta 'noindex' để ngăn chặn lập chỉ mục.
Điều gì xảy ra nếu không có robots.txt?
Nếu không có tệp robots.txt, các trình thu thập thông tin giả định rằng họ có thể truy cập tất cả các phần của trang web của bạn. Đây là hành vi mặc định cho các bot hoạt động tốt.
Tôi có thể kiểm tra các quy tắc ký tự đại diện không?
Có, công cụ này hỗ trợ khớp ký tự đại diện (*) và gắn kết cuối URL ($) như được sử dụng bởi Google và các công cụ tìm kiếm lớn khác.