除了向 AI 模型询问你之外,扫描还会审计你自己的网站的 AI 就绪度。审计最多抓取三个 URL——你的 robots.txt、llms.txt 和首页——并运行 9 项检查。
检查项
P0 —— 阻断项
- 可达性(
reach)——你的首页必须成功响应。否则其他一切都无从谈起:模型及其爬虫无法读取宕机或报错的网站。 - HTTPS(
https)——网站必须解析到 https:// URL。未加密的网站会被大多数爬虫降权或跳过。 - AI 爬虫访问(
robots)——将你的 robots.txt 与已知 AI 爬虫的 user-agent 比对。屏蔽它们等于彻底退出 AI 回答。没有 robots.txt 算通过(什么都没屏蔽);显式屏蔽为失败,部分屏蔽为警告。
P1 —— 高影响
- llms.txt(
llms)——一项新兴约定:位于/llms.txt的纯文本文件,向语言模型说明你的网站是做什么的。很容易添加——我们的免费生成器可以生成一份。 - 本地/组织结构化数据(
schema_local)——JSON-LD 结构化数据(LocalBusiness、Organization 或特定业务类型),毫不含糊地告诉模型你是谁、在哪里、做什么。 - 标题与元描述(
title)——首页需要真正的标题和长度合理的元描述;它们是关于你企业身份的高权重信号。 - NAP 一致性(
nap)——名称、地址、电话必须能在首页找到(可见文本、tel:链接或结构化数据)。有其一而缺其二时,该检查会警告。
P2 —— 值得修复
- FAQ 结构化数据(
schema_faq)——FAQPage 结构化数据标记问答内容——这恰恰是 AI 回答的构建格式。 - H1 标题(
h1)——首页应有一个真正的一级标题;它锚定了页面(以及企业)的主题。
解读结果
每项检查返回 pass、warn 或 fail,并附严重级别(P0/P1/P2)。先修 P0 失败项——它们卡住其他一切。仪表盘会把失败项转化为可逐项处理并验证的页面级修复处方。