检测结论www.exbsy.com 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 13 项得分 13 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

这个站的基础工程条件已经相当完整:正文不依赖 JS 渲染、sitemap 有效、HTTPS 与响应速度正常,TDK、JSON-LD、标题层级、llms.txt、备案与主体信息、结论前置、更新时间等 13 项均通过,本次得分 13 分。真正卡住它的是两项:一是 robots.txt 里没有为 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 单独声明规则,而已声明的 GPTBot、ClaudeBot、Bytespider、PerplexityBot 又都放在 User-agent: * 之后,按爬虫只匹配第一条命中规则的机制,这些声明很可能不生效,等于把国产大模型爬虫全部挡在门外;二是正文中没有任何第三方引用链接、出处标注或 sameAs 站外身份声明,AI 无法交叉验证内容可信度。这两项都属于低成本可修复项,改完后可达满分 15 分。

二、逐项判定结果

判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.exbsy.com

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 未声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
A2 关键内容不依赖 JS 渲染 可抓取性 通过 源码中可见正文 9619 字符,h1 1 个
A3 有 sitemap 且内容有效 可抓取性 通过 robots.txt 声明的 https://www.exbsy.com/sitemap.txt 有效(3 条 URL)
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 通过 协议 HTTPS,首页 HTTP 200,响应 232 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 30 字符,description 62 字符
B2 结构化数据(JSON-LD) 可理解性 通过 JSON-LD 块 2 个,WebSite 有,Organization 有
B3 标题层级语义化 可理解性 通过 h1 1 个,h2 10 个
B4 有 llms.txt(纯文本) 可理解性 通过 llms.txt 正常,83312 字符
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:手机游戏下载_热门手游排行榜_手游攻略与评测 - 二向箔手游 二向箔手游攻略网站! 0.1折手游 0.05折手游 咪噜游…
C2 存在可摘录结构块 可引用性 通过 列表/表格标签 1 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 533 处
C4 有明确更新时间 可引用性 通过 页面可见更新时间为 有
C5 有第三方引用证据 可引用性 未通过 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明

内页抽样(按模板各取一页)

首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。

抽样页面 HTTP TDK 可见正文 JSON-LD 更新时间 内链
/game 200 title 12 / desc 4 4193 字 1 180
/syzx 200 title 14 / desc 57 4163 字 1 106
/yxwd 200 title 34 / desc 58 6549 字 1 100

小结:抽样的 3 个内页中,TDK 完整 3 个、含结构化数据 3 个、标注更新时间 3 个。

三、优先修复(含可直接复制粘贴的代码)

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:未声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。

可直接复制的修复

放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)

# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
#    爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写

User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek

User-agent: QwenBot
Allow: /
# 对应产品:通义千问

User-agent: KimiBot
Allow: /
# 对应产品:Kimi(模型训练)

User-agent: Kimi-SearchBot
Allow: /
# 对应产品:Kimi 搜索

User-agent: Bytespider
Allow: /
# 对应产品:豆包

User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT

User-agent: ClaudeBot
Allow: /
# 对应产品:Claude

User-agent: PerplexityBot
Allow: /
# 对应产品:Perplexity

# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/

# ④ 声明站点地图
Sitemap: https://www.exbsy.com/sitemap.xml

本次检测里,这个文件缺少 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 DeepSeek、通义千问、Kimi(模型训练)、Kimi 搜索)。 另有 Bytespider、GPTBot、ClaudeBot、PerplexityBot 写在了 User-agent: * 之后,等同于没声明。

2. C5 · 有第三方引用证据

  • 现状:正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明
  • 怎么改:两条路任选:①把一手数据整理成可独立引用的结论块,发布到知乎/CSDN 等平台,并在正文里链回;②在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。「被站外引用」的真实证据另见报告中的「外部引用线索」一节。

可直接复制的修复

两条路任选其一即可(都做更好):

路线 A:在正文里给出可核验的出处

放到:引用数据的那一段之后。写成「来源:××」或「据××报道」,并链到原出处

<p>数据来源:<a href="https://权威来源地址" rel="nofollow">中国互联网络信息中心《第 55 次中国互联网络发展状况统计报告》</a>,2026-01。</p>

路线 B:在 JSON-LD 里声明站外身份主页

注意:真正的“被第三方引用”机器读不到——本站报告第六节《外部引用线索》会用搜索引擎查一次,但那只是线索。要积累真实引用,还是得把一手数据整理成可引用结论块,投到知乎/公众号等行业平台

{"@context":"https://schema.org","@type":"Organization","name":"二向箔手游",
 "url":"https://www.exbsy.com/",
 "sameAs":["https://www.zhihu.com/org/你的主页",
           "https://mp.weixin.qq.com/你的公众号"]}

四、重点问题分析

A1 robots.txt 未正确放行 AI 爬虫

站点现状:robots.txt 中未声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 四个国产大模型爬虫;已经写出的 Bytespider、GPTBot、ClaudeBot、PerplexityBot 规则,位置排在 User-agent: * 之后。

实际后果:主流爬虫解析 robots.txt 时只采用第一条命中的 User-agent 规则。既然 User-agent: * 写在前面,这四个已声明的爬虫会先匹配到通配规则,后面专门为它们写的 Allow 或 Disallow 等于没写。而国产大模型爬虫目前连声明都没有,只能落到通配规则上,抓取权限完全取决于通配规则的内容。结果是站点在 DeepSeek、通义、Kimi 这几条国内最常被用户使用的问答入口里,被收录和被引用的概率被显著压低。

修改要点:把每个需要放行的爬虫单独成段,格式为「User-agent: DeepSeekBot」加一行「Allow: /」,并把这些段落整体放到 User-agent: * 之前。已声明的 GPTBot、ClaudeBot、Bytespider、PerplexityBot 同样要上移到通配规则之前。通配规则保留在文件末尾即可。改完后建议用各家的爬虫 UA 实测一次返回内容。

C5 缺少第三方引用证据

站点现状:正文可见区域没有指向第三方平台的引用链接,没有「来源:××」这类出处标注,JSON-LD 里也没有 sameAs 站外身份声明。

实际后果:生成式引擎在决定是否引用一段内容时,除了看内容本身,还会做可信度交叉验证。一个站点的数据如果只在自己站内出现,没有任何外部锚点,模型很难判断它是一手信息还是转述。缺少 sameAs 时,模型也无法把「二向箔手游」这个站点与知乎、CSDN、微博等平台上的同名主体关联起来,实体识别链条是断的。这会让站点在同类内容中处于引用顺位的后段。

修改要点:两条路任选其一或同时做。第一,把站内已有的具体数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文相应位置链回原文。第二,在正文中为关键数据标注出处,例如「来源:××」,同时在 JSON-LD 的 Organization 节点中补充 sameAs 字段,列出站外身份主页的完整 URL。

其余通过项中的隐患

C2 只有 1 个列表或表格标签,可摘录结构块偏少。AI 摘录时更偏好结构清晰的块,建议在攻略和评测类页面中把要点改成列表或对比表格,便于模型整块取用。B4 的 llms.txt 达到 83312 字符,体量偏大,建议保留精简版入口,避免关键信息被稀释。

五、行动建议

  1. 修改根目录 robots.txt。在文件最顶部依次写入四段:User-agent: DeepSeekBot、User-agent: QwenBot、User-agent: KimiBot、User-agent: Kimi-SearchBot,每段下各加一行 Allow: /。随后把已有的 GPTBot、ClaudeBot、Bytespider、PerplexityBot 段落整体上移到 User-agent: * 之前。通配规则保留在文件末尾。改完后用对应 UA 请求首页验证返回 200。

  2. 在 JSON-LD 的 Organization 节点中补充 sameAs 字段,填入站外身份主页的完整 URL,多个平台用数组形式列出。同时确认 WebSite 节点的 url 与首页一致。

  3. 在攻略、评测类页面的正文中为关键数据加出处标注,统一写成「来源:××」的短句,放在对应数据所在段落之后。优先处理含具体数字较多的页面。

  4. 挑选站内已有的一手数据,整理成独立结论块发布到知乎或 CSDN,并在站内对应页面正文中加上指向该外链的引用链接。

  5. 把 llms.txt 拆分为精简入口与完整版两个文件,精简版保留站点定位、栏目结构和核心页面链接,控制长度,避免关键信息被长文本稀释。

六、外部引用线索(仅证据,不计分)

  • 未检出站外提及:外部索引里还没有提到 www.exbsy.com 的页面。

  • 检索方式:Bing RSS,查询式 "www.exbsy.com" -site:www.exbsy.com打开这次检索

  • 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。

七、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 www.exbsy.com 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 232 ms 108511 B
robots.txt 200 172 ms 762 B
sitemap.xml 404 196 ms — B
llms.txt 200 272 ms 196465 B
不存在路径探测 404 201 ms — B

八、如何引用本报告

安企 GEO《www.exbsy.com GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 13 项,得分 13 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:www.exbsy.com GEO 就绪度检测报告
  • 检测日期:2026-09-20
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:www.exbsy.com GEO 就绪度检测报告,安企 GEO,2026