检测结论www.exb1.com 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 12 项,得分 1215,判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

www.exb1.com 在《GEO 就绪度标准 v1.0》15 项检测中通过 12 项,判定等级为「不可见」。站点基础面尚可:正文不依赖 JS 渲染、TDK 完整、JSON-LD 中的 WebSite 与 Organization 均已声明、llms.txt 正常、结论前置且含 107 处具体数字,说明内容本身具备被 AI 摘录的素材。最致命的缺口集中在可抓取性与可引用性两端:robots.txt 未声明 DeepSeekBot、QwenBot,且已声明的 AI 爬虫规则被放在 User-agent: * 之后,按爬虫只匹配第一条命中规则的机制,这些放行声明实际不生效;sitemap.xml 返回 404,站点缺失向 AI 爬虫提交 URL 清单的通道;正文可见区没有任何第三方引用链接、出处标注或 sameAs 站外身份声明,AI 无法交叉核验内容可信度。修完 A1、A3、C5 三项后,得分可达 15/15,站点可从「不可见」进入可被稳定抓取与引用的状态。

二、逐项判定结果

判定时间:2026-09-19 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.exb1.com

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 未声明 DeepSeekBot、QwenBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
A2 关键内容不依赖 JS 渲染 可抓取性 通过 源码中可见正文 2736 字符,h1 1 个
A3 有 sitemap 且内容有效 可抓取性 未通过 sitemap.xml HTTP 404
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 通过 协议 HTTPS,首页 HTTP 200,响应 603 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 39 字符,description 82 字符
B2 结构化数据(JSON-LD) 可理解性 通过 JSON-LD 块 1 个,WebSite 有,Organization 有
B3 标题层级语义化 可理解性 通过 h1 1 个,h2 16 个
B4 有 llms.txt(纯文本) 可理解性 通过 llms.txt 正常,1665 字符
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:安企CMS小语种企业网站模板与anqicms个人博客模板下载 - 二向箔模板库 首页 模板标签 视频教程 网站模板 客户…
C2 存在可摘录结构块 可引用性 通过 列表/表格标签 3 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 107 处
C4 有明确更新时间 可引用性 通过 页面可见更新时间为 有
C5 有第三方引用证据 可引用性 未通过 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明

三、优先修复的三件事

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:未声明 DeepSeekBot、QwenBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。

2. A3 · 有 sitemap 且内容有效

  • 现状:sitemap.xml HTTP 404
  • 怎么改:生成 sitemap.xml(sitemapindex 亦可),并在 robots.txt 中声明它的地址。

3. C5 · 有第三方引用证据

  • 现状:正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明
  • 怎么改:两条路任选:①把一手数据整理成可独立引用的结论块,发布到知乎/CSDN 等平台,并在正文里链回;②在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。「被站外引用」的真实证据另见报告中的「外部引用线索」一节。

四、重点问题分析

A1 robots.txt 中 AI 爬虫规则位置错误且覆盖不全

当前 robots.txt 未声明 DeepSeekBot、QwenBot,已声明的 Bytespider、GPTBot、ClaudeBot、PerplexityBot 被放在 User-agent: * 之后。爬虫解析 robots.txt 时只匹配第一条命中的规则组,User-agent: * 属于通配规则,会先于其后的具名规则被命中,因此这些具名放行声明对目标爬虫不生效——AI 爬虫实际读到的是通配组的内容,而非为其单独写的 Allow。后果是国产大模型侧的抓取入口处于未声明状态,而国际侧虽然写了规则却可能被通配组拦截或产生歧义。修改要点:把每个 AI 爬虫写成独立的 User-agent: DeepSeekBot / User-agent: QwenBot / User-agent: Bytespider / User-agent: GPTBot / User-agent: ClaudeBot / User-agent: PerplexityBot 段落,每段下跟 Allow: /,全部置于 User-agent: * 之前,通配组只保留兜底规则。

A3 sitemap.xml 缺失,AI 爬虫无 URL 清单可依

sitemap.xml 返回 HTTP 404,站点没有可用的站点地图。对传统搜索引擎而言,sitemap 是发现新页面的加速器;对 AI 爬虫而言,它的作用更接近一份「可引用内容清单」——生成式引擎在构建索引时倾向优先处理 sitemap 中声明的 URL,缺失意味着新页面与模板详情页只能依赖站内链接被逐步发现,收录延迟明显。同时 robots.txt 中也未声明 sitemap 地址,进一步降低了爬虫主动获取清单的可能。修改要点:生成 sitemap.xml(或 sitemapindex 索引文件),覆盖首页、模板列表页、模板详情页与教程页,在 robots.txt 末尾以 Sitemap: https://www.exb1.com/sitemap.xml 形式声明绝对地址,并确保返回 HTTP 200 与正确的 Content-Type: application/xml

C5 缺少第三方引用证据,可信度无法交叉核验

正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。这一项影响的是 AI 生成回答时的「可归因性」:生成式引擎在引用一个来源前,会评估该来源是否可被外部信息印证。站点目前所有内容都是自述,没有外部锚点,AI 在需要给出处时缺少可指向的旁证,容易在多个候选来源中跳过本站。修改要点有两条路可任选:其一,把站内已有的一手数据(页面中已出现 107 处具体数字)整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文相应位置链回原文;其二,在正文中为数据标注出处(如「来源:××」),并在 JSON-LD 的 Organization 或 WebSite 节点中补充 sameAs 字段,声明站外身份主页地址。两条路并用效果更稳。

其余通过项的维持建议

A2、B1、B2、B3、B4、C1 至 C4 均已通过,属于站点的既有优势,改动 robots.txt 与新增 sitemap 时不要破坏现有结构:JSON-LD 块、llms.txt、TDK 与标题层级保持现状即可,重点是补齐 A1、A3、C5 三处。

五、行动建议

  1. 重写 robots.txt:将 User-agent: DeepSeekBotUser-agent: QwenBotUser-agent: BytespiderUser-agent: GPTBotUser-agent: ClaudeBotUser-agent: PerplexityBot 六个段落依次写在文件最前面,每段下加一行 Allow: /;把现有的 User-agent: * 段落移到全部具名规则之后,仅保留兜底规则;文件末尾追加一行 Sitemap: https://www.exb1.com/sitemap.xml

  2. 生成并上线 sitemap.xml:覆盖首页、模板标签页、视频教程页、网站模板列表页与各模板详情页,使用绝对 URL;确保该文件返回 HTTP 200、Content-Typeapplication/xml,并在上线后用浏览器直接访问 https://www.exb1.com/sitemap.xml 确认不再 404。

  3. 在模板详情页模板中补充第三方引用区块:在正文数据段落后插入一行出处标注,格式为「来源:××(附链接)」;链接指向已发布到知乎或 CSDN 的同主题文章,该文章内容取自站内现有的一手数字。

  4. 在首页 JSON-LD 的 Organization 节点中增加 sameAs 字段,填入站外身份主页的绝对地址(如知乎主页、CSDN 主页),与第 3 步发布的平台账号保持一致,便于 AI 交叉核验主体身份。

  5. 上线后复检:重新抓取 robots.txt 确认具名规则位于通配规则之前,访问 sitemap.xml 确认 200,检查模板详情页源码中出处标注与 sameAs 均已生效,再对照《GEO 就绪度标准 v1.0》复核 A1、A3、C5 三项。

六、外部引用线索(仅证据,不计分)

  • 未检出站外提及:外部索引里还没有提到 www.exb1.com 的页面。

  • 检索方式:Bing RSS,查询式 "www.exb1.com" -site:www.exb1.com打开这次检索

  • 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。

七、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 www.exb1.com 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-19 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 603 ms 31933 B
robots.txt 200 319 ms 652 B
sitemap.xml 404 271 ms — B
llms.txt 200 258 ms 3236 B
不存在路径探测 404 180 ms — B

八、如何引用本报告

安企 GEO《www.exb1.com GEO 就绪度检测报告》(2026-09-19):该站按《GEO 就绪度标准 v1.0》15 项判定通过 12 项,得分 12/15,判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:www.exb1.com GEO 就绪度检测报告
  • 检测日期:2026-09-19
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:www.exb1.com GEO 就绪度检测报告,安企 GEO,2026