分類: 開發工具

Robots.txt 產生器

產生包含允許、禁止與 Sitemap 規則的 robots.txt 檔案

設定 User-agent、允許與禁止路徑、選填的 Crawl-delay 以及 Sitemap 網址,即可產生可直接使用的 robots.txt 檔案。所有處理都在瀏覽器中完成。

robots.txt
robots.txt
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /private/

Sitemap: https://example.com/sitemap.xml

本頁的所有處理都在瀏覽器中完成,不會上傳任何內容。

這個工具能做什麼

robots.txt 檔案會告訴搜尋引擎爬蟲網站的哪些部分可以與不可以抓取,並可以指向 Sitemap。本產生器會根據 User-agent、允許路徑清單、禁止路徑清單、選填的 Crawl-delay 以及 Sitemap 網址,建立符合標準格式的檔案。

使用方式

  1. 設定 User-agent,或保留 * 以套用到所有爬蟲。
  2. 每行輸入一個允許或禁止路徑,並加入 Sitemap 網址。
  3. 把產生的 robots.txt 複製到你網站的根目錄。

隱私說明

本工具完全在你的瀏覽器中執行。輸入的內容不會被上傳、儲存或分享,關閉分頁就隨之消失。

常見問題

我網站的資訊會被傳送到其他地方嗎?
不會。檔案是由頁面內執行的 JavaScript 根據你輸入的內容組成,不會上傳任何資料。
robots.txt 需要放在哪裡?
需要放在網域的根目錄,例如 https://example.com/robots.txt,這樣爬蟲才能在請求其他頁面之前先找到它。
所有爬蟲都會遵守 Crawl-delay 嗎?
不會。Crawl-delay 是廣泛採用的慣例,但並非正式標準,因此有些爬蟲會完全忽略它。