检测结论:
www.exb1.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 12 项,得分 12⁄15,判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
www.exb1.com 在《GEO 就绪度标准 v1.0》15 项检测中通过 12 项,判定等级为「不可见」。站点基础面尚可:正文不依赖 JS 渲染、TDK 完整、JSON-LD 中的 WebSite 与 Organization 均已声明、llms.txt 正常、结论前置且含 107 处具体数字,说明内容本身具备被 AI 摘录的素材。最致命的缺口集中在可抓取性与可引用性两端:robots.txt 未声明 DeepSeekBot、QwenBot,且已声明的 AI 爬虫规则被放在 User-agent: * 之后,按爬虫只匹配第一条命中规则的机制,这些放行声明实际不生效;sitemap.xml 返回 404,站点缺失向 AI 爬虫提交 URL 清单的通道;正文可见区没有任何第三方引用链接、出处标注或 sameAs 站外身份声明,AI 无法交叉核验内容可信度。修完 A1、A3、C5 三项后,得分可达 15/15,站点可从「不可见」进入可被稳定抓取与引用的状态。
二、逐项判定结果
判定时间:2026-09-19 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.exb1.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未声明 DeepSeekBot、QwenBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 2736 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 未通过 | sitemap.xml HTTP 404 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 603 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 39 字符,description 82 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 通过 | JSON-LD 块 1 个,WebSite 有,Organization 有 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 16 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 通过 | llms.txt 正常,1665 字符 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:安企CMS小语种企业网站模板与anqicms个人博客模板下载 - 二向箔模板库 首页 模板标签 视频教程 网站模板 客户… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 3 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 107 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
三、优先修复的三件事
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未声明 DeepSeekBot、QwenBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。
2. A3 · 有 sitemap 且内容有效
- 现状:sitemap.xml HTTP 404
- 怎么改:生成 sitemap.xml(sitemapindex 亦可),并在 robots.txt 中声明它的地址。
3. C5 · 有第三方引用证据
- 现状:正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明
- 怎么改:两条路任选:①把一手数据整理成可独立引用的结论块,发布到知乎/CSDN 等平台,并在正文里链回;②在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。「被站外引用」的真实证据另见报告中的「外部引用线索」一节。
四、重点问题分析
A1 robots.txt 中 AI 爬虫规则位置错误且覆盖不全
当前 robots.txt 未声明 DeepSeekBot、QwenBot,已声明的 Bytespider、GPTBot、ClaudeBot、PerplexityBot 被放在 User-agent: * 之后。爬虫解析 robots.txt 时只匹配第一条命中的规则组,User-agent: * 属于通配规则,会先于其后的具名规则被命中,因此这些具名放行声明对目标爬虫不生效——AI 爬虫实际读到的是通配组的内容,而非为其单独写的 Allow。后果是国产大模型侧的抓取入口处于未声明状态,而国际侧虽然写了规则却可能被通配组拦截或产生歧义。修改要点:把每个 AI 爬虫写成独立的 User-agent: DeepSeekBot / User-agent: QwenBot / User-agent: Bytespider / User-agent: GPTBot / User-agent: ClaudeBot / User-agent: PerplexityBot 段落,每段下跟 Allow: /,全部置于 User-agent: * 之前,通配组只保留兜底规则。
A3 sitemap.xml 缺失,AI 爬虫无 URL 清单可依
sitemap.xml 返回 HTTP 404,站点没有可用的站点地图。对传统搜索引擎而言,sitemap 是发现新页面的加速器;对 AI 爬虫而言,它的作用更接近一份「可引用内容清单」——生成式引擎在构建索引时倾向优先处理 sitemap 中声明的 URL,缺失意味着新页面与模板详情页只能依赖站内链接被逐步发现,收录延迟明显。同时 robots.txt 中也未声明 sitemap 地址,进一步降低了爬虫主动获取清单的可能。修改要点:生成 sitemap.xml(或 sitemapindex 索引文件),覆盖首页、模板列表页、模板详情页与教程页,在 robots.txt 末尾以 Sitemap: https://www.exb1.com/sitemap.xml 形式声明绝对地址,并确保返回 HTTP 200 与正确的 Content-Type: application/xml。
C5 缺少第三方引用证据,可信度无法交叉核验
正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。这一项影响的是 AI 生成回答时的「可归因性」:生成式引擎在引用一个来源前,会评估该来源是否可被外部信息印证。站点目前所有内容都是自述,没有外部锚点,AI 在需要给出处时缺少可指向的旁证,容易在多个候选来源中跳过本站。修改要点有两条路可任选:其一,把站内已有的一手数据(页面中已出现 107 处具体数字)整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文相应位置链回原文;其二,在正文中为数据标注出处(如「来源:××」),并在 JSON-LD 的 Organization 或 WebSite 节点中补充 sameAs 字段,声明站外身份主页地址。两条路并用效果更稳。
其余通过项的维持建议
A2、B1、B2、B3、B4、C1 至 C4 均已通过,属于站点的既有优势,改动 robots.txt 与新增 sitemap 时不要破坏现有结构:JSON-LD 块、llms.txt、TDK 与标题层级保持现状即可,重点是补齐 A1、A3、C5 三处。
五、行动建议
重写 robots.txt:将
User-agent: DeepSeekBot、User-agent: QwenBot、User-agent: Bytespider、User-agent: GPTBot、User-agent: ClaudeBot、User-agent: PerplexityBot六个段落依次写在文件最前面,每段下加一行Allow: /;把现有的User-agent: *段落移到全部具名规则之后,仅保留兜底规则;文件末尾追加一行Sitemap: https://www.exb1.com/sitemap.xml。生成并上线 sitemap.xml:覆盖首页、模板标签页、视频教程页、网站模板列表页与各模板详情页,使用绝对 URL;确保该文件返回 HTTP 200、
Content-Type为application/xml,并在上线后用浏览器直接访问https://www.exb1.com/sitemap.xml确认不再 404。在模板详情页模板中补充第三方引用区块:在正文数据段落后插入一行出处标注,格式为「来源:××(附链接)」;链接指向已发布到知乎或 CSDN 的同主题文章,该文章内容取自站内现有的一手数字。
在首页 JSON-LD 的 Organization 节点中增加
sameAs字段,填入站外身份主页的绝对地址(如知乎主页、CSDN 主页),与第 3 步发布的平台账号保持一致,便于 AI 交叉核验主体身份。上线后复检:重新抓取 robots.txt 确认具名规则位于通配规则之前,访问 sitemap.xml 确认 200,检查模板详情页源码中出处标注与 sameAs 均已生效,再对照《GEO 就绪度标准 v1.0》复核 A1、A3、C5 三项。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.exb1.com的页面。检索方式:Bing RSS,查询式
"www.exb1.com" -site:www.exb1.com(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.exb1.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-19 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 603 ms | 31933 B |
| robots.txt | 200 | 319 ms | 652 B |
| sitemap.xml | 404 | 271 ms | — B |
| llms.txt | 200 | 258 ms | 3236 B |
| 不存在路径探测 | 404 | 180 ms | — B |
八、如何引用本报告
安企 GEO《www.exb1.com GEO 就绪度检测报告》(2026-09-19):该站按《GEO 就绪度标准 v1.0》15 项判定通过 12 项,得分 12/15,判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.exb1.com GEO 就绪度检测报告
- 检测日期:2026-09-19
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.exb1.com GEO 就绪度检测报告,安企 GEO,2026