AI Readable
← 全部规则
AI 爬虫可达性中权重 1

robots.txt 可访问

crawlability/robots-exists

为什么这条重要

robots.txt 是爬虫的第一个请求。缺失时多数爬虫按“全部允许”处理,尚可工作,但你也失去了声明 sitemap 和分 UA 控制的能力。

怎么修

具体适用哪条建议,取决于评估的实际发现。标签是触发该建议的条件。

  • server-error

    修复 robots.txt 的服务端错误。即使没有抓取限制,也应返回 200 和一个可解析的文件。

  • missing

    在站点根目录添加 robots.txt,至少声明 `Sitemap:` 地址,并显式放行需要被 AI 引擎收录的路径。

检查你自己的页面

跑一次免费评估,看看这些规则里你的页面已经满足了哪些。

免费评估一次

在你的站点上试一试

AI 爬虫可达性 的其他规则