SEO / 爬取
robots.txt產生器
建立robots.txt檔案,為各個爬蟲設定規則、加入sitemap項目,並使用允許所有爬蟲、封鎖測試網站或封鎖AI訓練爬蟲的預設設定。
robots.txt產生器: robots.txt會告訴爬蟲哪些路徑可以擷取;RFC 9309將其標準化為:每個群組先列出使用者代理程式,再列出Disallow和Allow規則,符合條件的規則中以最具體者為準。AI訓練預設設定會為GPTBot、ClaudeBot、Google-Extended、Applebot-Extended、CCBot和meta-externalagent加入一個群組;這些名稱是各營運方文件中用於選擇退出訓練的爬蟲名稱。產生器會提醒您注意沒有前置斜線的路徑、相對sitemap網址,以及會封鎖所有爬蟲的規則。 全程在瀏覽器中於本機執行,檔案不會上傳至伺服器。
- 分類
- 網路工具
- 使用次數
- 在瀏覽器中
- 費用
- 免費・免註冊
- 可用狀態
- 可立即使用
全程在瀏覽器中執行
User-agent: * Disallow: /admin/ Disallow: /cart/ Sitemap: https://example.com/sitemap.xml
請將檔案放在網站根目錄,例如https://example.com/robots.txt。這會要求爬蟲不要進入,但不會隱藏或保護任何內容,而且Google會忽略Crawl-delay。AI爬蟲名稱已於2026年10月2日確認;各公司可能會新增爬蟲,請查閱其文件。
常見錯誤
封鎖 CSS 和 JavaScript 會使搜尋引擎無法正確呈現頁面;封鎖想移除的頁面,會讓爬蟲看不到其中的 noindex 標籤;網站上線後仍保留測試網站的 Disallow: /,則會隱藏整個網站。每次部署後都請檢查線上檔案。
若要測試現有檔案,請使用robots.txt 檢查工具;若要檢查它指向的 sitemap,請使用sitemap 檢查工具。
萬用字元
Google 和 Bing 支援代表任意字元的 *,以及代表網址結尾的 $:Disallow: /*.pdf$ 會封鎖所有 PDF。最長的相符規則優先,因此 Allow: /shop/sale/ 會覆寫 Disallow: /shop/。
使用方式
- 從預設設定開始,或編輯使用者代理程式群組和路徑。
- 加入sitemap網址。
- 複製或下載robots.txt,並將它放在網站根目錄。
隱私與限制
檔案會在您的瀏覽器中建立。
相關工具
常見問題
robots.txt會阻擋Google搜尋中的頁面嗎?
它會停止爬取,而不是停止建立索引:如果其他網站連結到被封鎖的頁面,該頁面仍可能出現在搜尋結果中。若要讓頁面不出現在搜尋結果,請允許爬取,並加入noindex中繼標籤。
封鎖AI爬蟲後,AI工具會移除我的內容嗎?
這會要求這些爬蟲從現在起不要收集您的頁面;已經收集的內容不會因此移除,而且只有遵守robots.txt的爬蟲才會配合。
Crawl-delay有效嗎?
Bing和部分其他爬蟲會遵守;Google會忽略這項設定,並自動調整爬取速率。
免費工具・使用在瀏覽器中次・免註冊