Cấu hình chuẩn cho trang web phổ biến
Cho phép tất cả bot quét toàn bộ trang web nhưng chặn thư mục /admin/ và /api/, đồng thời chỉ định vị trí sitemap.
User-agent: *
Disallow: /admin/
Disallow: /api/
Sitemap: https://example.com/sitemap.xmlTạo tệp robots.txt hợp lệ với đầy đủ các lệnh User-agent, Allow, Disallow, Crawl-delay và đường dẫn Sitemap XML giúp tối ưu hóa ngân sách thu thập thông tin SEO cho website của bạn.
The rules below update the file automatically.
No sitemaps added.
Review, copy, download, or manually adjust the final content.
Simulate how the current file responds for a specific bot and path.
Điền các giá trị cần thiết, dán văn bản hoặc tải lên tệp bạn muốn xử lý.
Hầu hết các công cụ cập nhật theo thời gian thực khi bạn nhập liệu; một số công cụ sử dụng một nút hành động duy nhất.
Sao chép, tải xuống hoặc chia sẻ kết quả được tạo — bạn luôn có toàn quyền kiểm soát dữ liệu của mình.
Trình tạo tệp robots.txt là công cụ giúp bạn tạo và kiểm tra tệp hướng dẫn thu thập dữ liệu cho các bot tìm kiếm (Googlebot, Bingbot), điều hướng bot và bảo vệ các thư mục riêng tư.
Tìm hiểu cú pháp chuẩn của tệp robots.txt, các lệnh User-agent, Allow, Disallow, Crawl-delay và cách chèn đường dẫn Sitemap XML giúp tối ưu hóa thu thập dữ liệu tìm kiếm.
Tệp robots.txt được đặt tại thư mục gốc của tên miền (ví dụ: domain.com/robots.txt) nhằm hướng dẫn bot thu thập dữ liệu của các công cụ tìm kiếm biết phần nào của trang web được phép hoặc không được phép quét nội dung.
Lệnh 'User-agent: *' áp dụng quy tắc cho tất cả các bot. Lệnh 'Disallow: /admin/' yêu cầu bot không thu thập dữ liệu trong trang quản trị, và lệnh 'Allow: /admin/public.css' cho phép bot truy cập tài nguyên cần thiết trong thư mục bị chặn.
Cho phép tất cả bot quét toàn bộ trang web nhưng chặn thư mục /admin/ và /api/, đồng thời chỉ định vị trí sitemap.
User-agent: *
Disallow: /admin/
Disallow: /api/
Sitemap: https://example.com/sitemap.xmlChỉ thị Disallow chỉ ngăn các bot tìm kiếm tuân thủ quy chuẩn quét nội dung, chứ không mã hóa hay ngăn người dùng truy cập trực tiếp đường link. Các trang nhạy cảm luôn cần được bảo vệ bằng mật khẩu và phân quyền.
Toàn bộ quá trình tạo và cấu hình quy tắc robots.txt diễn ra 100% trên trình duyệt của bạn. Không có cấu hình máy chủ hay đường link nào được lưu trữ.
Tệp robots.txt bắt buộc phải nằm ở thư mục gốc (root directory) của website và có thể truy cập trực tiếp qua đường dẫn https://tenmiencuaban.com/robots.txt.
Không hoàn toàn. Nếu URL đó được liên kết từ trang web khác, Google vẫn có thể lập chỉ mục URL mà không đọc nội dung bên trong. Để ngăn chặn hoàn toàn, hãy sử dụng thẻ meta 'noindex'.
Rất nên. Việc thêm dòng 'Sitemap: https://tenmiencuaban.com/sitemap.xml' giúp bot tìm kiếm nhanh chóng khám phá toàn bộ các bài viết và trang con quan trọng trên web của bạn.
Có. Đường dẫn trong robots.txt phân biệt chính xác chữ hoa và chữ thường (/Admin/ khác với /admin/).
Tạo thẻ meta HTML chuẩn SEO, Open Graph Facebook và Twitter Card.
Tính địa chỉ mạng, dải IP khả dụng, broadcast và subnet mask theo CIDR.
Tạo đường dẫn liên kết gắn mã UTM chuẩn để theo dõi trên Google Analytics.
Kiểm tra lỗi cú pháp, tính hợp lệ cấu trúc và các thẻ URL trong Sitemap XML.
Phân tích tên trình duyệt, hệ điều hành, loại thiết bị và engine từ chuỗi User-Agent.
Tra cứu ý nghĩa, nguyên nhân và cách khắc phục các mã trạng thái HTTP (200, 301, 404, 500...).
Tra cứu định dạng Content-Type MIME theo phần mở rộng tệp và ngược lại.
Chuyển đổi tên miền có dấu tiếng Việt sang dạng mã hóa Punycode (xn--) và ngược lại.
Ước tính thời gian tải xuống hoặc tải lên tệp tin dựa trên dung lượng và tốc độ mạng.
Phân tích giao thức, tên miền, cổng, đường dẫn, tham số query và hash của URL.