检测结论www.qiandougeo.com 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 10 项得分 10 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

该站当前 GEO 就绪度得 10 分(满分 15),判定为不可见。可抓取性层面基础尚可,正文不依赖 JS 渲染、sitemap 有效、无死链、HTTPS 稳定,但 robots.txt 未对国内主流 AI 爬虫做显式放行,存在被默认规则拦截的风险。可理解性层面,页面缺少 JSON-LD 结构化数据,且 h1 出现 3 个,标题层级混乱,AI 难以准确识别页面主题与站点实体。可引用性层面问题最集中:页面没有可见更新时间,也没有任何第三方引用、出处标注或 sameAs 站外身份声明,导致内容新鲜度与可信度都无法被 AI 判断。这五项是当前最致命的缺口。修完后可达到满分 15 分,站点将从不可见转为可被 AI 稳定抓取、理解并引用的状态。

二、逐项判定结果

判定时间:2026-09-21 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.qiandougeo.com

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
A2 关键内容不依赖 JS 渲染 可抓取性 通过 源码中可见正文 7525 字符,h1 3 个
A3 有 sitemap 且内容有效 可抓取性 通过 sitemap.xml HTTP 200,内容有效
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 通过 协议 HTTPS,首页 HTTP 200,响应 605 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 25 字符,description 131 字符
B2 结构化数据(JSON-LD) 可理解性 未通过 JSON-LD 块 0 个,WebSite 无,Organization 无
B3 标题层级语义化 可理解性 未通过 h1 3 个,h2 11 个
B4 有 llms.txt(纯文本) 可理解性 通过 llms.txt 正常,65212 字符
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:技术派GEO优化公司 - 千豆云智能GEO优化系统 NEWS 千豆云 AI 体检报告经全行业实操验证,收获大量客户一致好…
C2 存在可摘录结构块 可引用性 通过 列表/表格标签 8 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 1491 处
C4 有明确更新时间 可引用性 未通过 页面可见更新时间为 无
C5 有第三方引用证据 可引用性 未通过 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明

内页抽样(按模板各取一页)

首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。

抽样页面 HTTP TDK 可见正文 JSON-LD 更新时间 内链
/zi-xun-dong-tai 200 title 19 / desc 0 2385 字 0 84
/gong-si-xin-wen 200 title 36 / desc 65 2395 字 0 80
/xing-ye-dong-cha 200 title 37 / desc 57 2991 字 0 83

小结:抽样的 3 个内页中,TDK 完整 2 个、含结构化数据 0 个、标注更新时间 3 个。

内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。

三、优先修复(含可直接复制粘贴的代码)

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。国外组建议补齐(做外贸时必需)。

可直接复制的修复

放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)

# 【1】AI 爬虫(下面按 国内 / 国外核心 / 国外建议 / 用途令牌 分组,逐个显式声明)
#       爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写

# ① 国内 AI 爬虫(中文 AI 流量的入口,硬门槛)

User-agent: Bytespider
Allow: /
# 对应:豆包

User-agent: DeepSeekBot
Allow: /
# 对应:DeepSeek

User-agent: QwenBot
Allow: /
# 对应:通义千问 / 元宝

User-agent: KimiBot
Allow: /
# 对应:Kimi(模型训练)

User-agent: Kimi-SearchBot
Allow: /
# 对应:Kimi 搜索

# ② 国外 AI 爬虫 · 核心(外贸站点最关键,硬门槛)

User-agent: GPTBot
Allow: /
# 对应:ChatGPT(训练)  # 你已声明过,这里保持一致

User-agent: OAI-SearchBot
Allow: /
# 对应:ChatGPT(搜索索引)  # 你已声明过,这里保持一致

User-agent: ClaudeBot
Allow: /
# 对应:Claude(训练)  # 你已声明过,这里保持一致

User-agent: Claude-SearchBot
Allow: /
# 对应:Claude(搜索索引)  # 你已声明过,这里保持一致

User-agent: PerplexityBot
Allow: /
# 对应:Perplexity  # 你已声明过,这里保持一致

User-agent: meta-externalagent
Allow: /
# 对应:Meta AI  # 你已声明过,这里保持一致

# ③ 国外 AI 爬虫 · 建议(覆盖越全越好,不作硬门槛)

User-agent: ChatGPT-User
Allow: /
# 对应:ChatGPT(用户触发)

User-agent: Claude-User
Allow: /
# 对应:Claude(用户触发)

User-agent: Perplexity-User
Allow: /
# 对应:Perplexity(用户触发)

User-agent: Google-CloudVertexBot
Allow: /
# 对应:Google Vertex AI

User-agent: meta-externalfetcher
Allow: /
# 对应:Meta(用户触发)

User-agent: FacebookBot
Allow: /
# 对应:Meta / Facebook

User-agent: Amazonbot
Allow: /
# 对应:Amazon / Alexa

User-agent: Applebot
Allow: /
# 对应:Apple Siri / Spotlight

User-agent: CCBot
Allow: /
# 对应:Common Crawl(众多模型的训练语料)

User-agent: DuckAssistBot
Allow: /
# 对应:DuckDuckGo AI

User-agent: MistralAI-User
Allow: /
# 对应:Mistral(用户触发)

# ④ AI 用途令牌(不会单独来抓,只在 robots.txt 生效)
#    Allow 表示你授权 AI 使用你的内容;要保留内容可改成 Disallow。

User-agent: Google-Extended
Allow: /
# 对应:Gemini / Vertex AI

User-agent: Applebot-Extended
Allow: /
# 对应:Apple Intelligence

# ② 本次检测显示以下爬虫你已经声明过,无需重复:
#    GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent

# 【2】通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/

# 【3】声明站点地图
Sitemap: https://www.qiandougeo.com/sitemap.xml

本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 豆包、DeepSeek、通义千问 / 元宝、Kimi(模型训练)、Kimi 搜索)。

2. B2 · 结构化数据(JSON-LD)

  • 现状:JSON-LD 块 0 个,WebSite 无,Organization 无
  • 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。

可直接复制的修复

放到:<head>sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"千豆云GEO","url":"https://www.qiandougeo.com/",
 "sameAs":["https://www.zhihu.com/org/你的主页",
           "https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
 "name":"千豆云GEO","url":"https://www.qiandougeo.com/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->

3. B3 · 标题层级语义化

  • 现状:h1 3 个,h2 11 个
  • 怎么改:每页只保留一个 h1,用 h2/h3 组织层级;不要用加粗的 div 冒充标题。

可直接复制的修复

不要用加粗的 div 冒充标题——AI 靠标签层级判断哪句话是结论、哪些是支撑

<h1>千豆云GEO:这一页的主题(每页只准有 1 个 h1)</h1>
  <h2>第一部分</h2>
    <h3>小节</h3>
  <h2>第二部分</h2>

四、重点问题分析

robots.txt 未显式放行国内 AI 爬虫

当前 robots.txt 未声明 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 等国内主流 AI 爬虫的规则。爬虫匹配只认第一条命中的 User-agent 规则,如果站点在 User-agent: * 中设置了任何限制,这些爬虫会直接沿用该限制,而不会自动获得放行。后果是 AI 引擎在抓取阶段就可能拿不到内容,后续的理解与引用无从谈起。修改要点:在 robots.txt 中把每个 AI 爬虫的 User-agent 加 Allow: / 单独成组,并放在 User-agent: * 之前。国外组爬虫属建议项,做外贸时需一并补齐。

缺少 JSON-LD 结构化数据

检测显示 JSON-LD 块为 0 个,WebSite 与 Organization 均未声明。结构化数据是 AI 识别「这是什么站点、由谁运营、页面属于什么类型」最直接的信号。没有它,AI 只能靠正文文本猜测实体关系,站点在生成式回答中出现的概率和准确度都会下降。修改要点:至少补 WebSite 与 Organization 两类 JSON-LD,放在全站模板的 head 中;文章页追加 Article,问答页追加 FAQPage。Organization 中应包含站点名称、logo、备案主体等可核验信息。

标题层级语义化不足

页面存在 3 个 h1、11 个 h2。一个页面出现多个 h1,会让 AI 无法判断哪个才是页面主题,标题层级失去组织内容的作用。后果是 AI 在摘要或引用时可能抓错主标题,把次要区块当成核心内容。修改要点:每页只保留一个 h1,作为页面唯一主题;用 h2/h3 组织内容层级,不要用加粗的 div 冒充标题。检查模板中是否在 logo、侧栏、页脚等位置误用了 h1。

页面缺少明确更新时间

页面可见区域没有更新时间。AI 在决定是否引用一段内容时,会判断其新鲜度,没有时间标注的内容容易被当作陈旧信息降权。修改要点:在页面显著位置标注「更新于 YYYY-MM-DD」,并同步到 JSON-LD 的 dateModified 字段。时间应随内容实际修改而更新,不要写死。

缺少第三方引用证据与站外身份声明

正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。AI 判断内容可信度时,会看该内容是否被外部平台引用、是否有可追溯的出处。完全自说自话的内容,引用优先级会明显偏低。修改要点:两条路任选其一或并用。其一,把站内一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文中链回;其二,在正文中标注数据出处,如「来源:××」,并在 JSON-LD 的 sameAs 中声明站外身份主页。

五、行动建议

  1. 修改 robots.txt,在 User-agent: * 之前插入国内 AI 爬虫的放行组。每个爬虫单独成组,格式为「User-agent: Bytespider」换行「Allow: /」,依次覆盖 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot。做外贸时再补国外组。

  2. 在全站模板的 head 中注入 WebSite 与 Organization 两类 JSON-LD。Organization 中填写站点名称、logo、备案主体;WebSite 中填写站点名称与 URL。文章页模板追加 Article,问答页模板追加 FAQPage。

  3. 检查页面模板,把 logo、侧栏、页脚等位置误用的 h1 改为 div 或 p,确保每页只有一个 h1。正文区块统一用 h2/h3 组织,不要用加粗的 div 冒充标题。

  4. 在文章页与关键落地页的显著位置加入「更新于 YYYY-MM-DD」文本,并同步写入对应 JSON-LD 的 dateModified 字段。建议在发布流程中固定该字段的更新动作。

  5. 选一批站内一手数据,整理成可独立引用的结论块,发布到知乎或 CSDN,并在正文中链回原页;同时在 JSON-LD 的 sameAs 中补上站外身份主页地址。正文中涉及外部数据的位置,统一加「来源:××」标注。

六、外部引用线索(仅证据,不计分)

  • 未检出站外提及:外部索引里还没有提到 www.qiandougeo.com 的页面。

  • 检索方式:Bing RSS,查询式 "www.qiandougeo.com" -site:www.qiandougeo.com打开这次检索

  • 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。

七、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 www.qiandougeo.com 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-21 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 605 ms 222838 B
robots.txt 200 146 ms 59 B
sitemap.xml 200 189 ms 434 B
llms.txt 200 241 ms 144519 B
不存在路径探测 404 157 ms — B

八、如何引用本报告

安企 GEO《www.qiandougeo.com GEO 就绪度检测报告》(2026-09-21):该站按《GEO 就绪度标准 v1.0》15 项判定通过 10 项,得分 10 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:www.qiandougeo.com GEO 就绪度检测报告
  • 检测日期:2026-09-21
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:www.qiandougeo.com GEO 就绪度检测报告,安企 GEO,2026