检测结论www.zixunhk.com 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 9 项得分 9 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

本次检测依据《GEO 就绪度标准 v1.0》的 15 项检查,www.zixunhk.com 通过 9 项,得分 9 分,判定等级为「不可见」。站点基础条件并不差:HTTPS 有效、首页响应 338 ms、正文不依赖 JS 渲染、sitemap 有效、TDK 完整、无死链,说明抓取通道本身是通的。最致命的缺口集中在「AI 能不能读懂、敢不敢引用」这一层:robots.txt 未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot 等 AI 爬虫,等于把入口让给了默认规则;页面没有任何 JSON-LD,标题层级只有 h1 没有 h2,llms.txt 返回 404,正文中列表和表格标签为 0,也没有任何站外引用与出处标注。结果是即使被抓到,AI 也难以判定站点身份、难以切分要点、难以找到可引用的依据。这几项都属于低成本的配置与结构改造,修完可达到满分 15 分。

二、逐项判定结果

判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.zixunhk.com

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等
A2 关键内容不依赖 JS 渲染 可抓取性 通过 源码中可见正文 4152 字符,h1 1 个
A3 有 sitemap 且内容有效 可抓取性 通过 sitemap.xml HTTP 200,含 url 节点
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 通过 协议 HTTPS,首页 HTTP 200,响应 338 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 30 字符,description 128 字符
B2 结构化数据(JSON-LD) 可理解性 未通过 JSON-LD 块 0 个,WebSite 无,Organization 无
B3 标题层级语义化 可理解性 未通过 h1 1 个,h2 0 个
B4 有 llms.txt(纯文本) 可理解性 未通过 llms.txt 返回 HTTP 404
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:香港公司注册-年审报税-公司开户-律师公证-港通香港公司业务 欢迎您的到来,港通公司是香港公司注册年审、做账报税、商标注…
C2 存在可摘录结构块 可引用性 未通过 列表/表格标签 0 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 264 处
C4 有明确更新时间 可引用性 通过 页面可见更新时间为 有
C5 有第三方引用证据 可引用性 未通过 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明

内页抽样(按模板各取一页)

首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。

抽样页面 HTTP TDK 可见正文 JSON-LD 更新时间 内链
/a/2.html 200 title 31 / desc 150 3113 字 1 77

小结:抽样的 1 个内页中,TDK 完整 1 个、含结构化数据 1 个、标注更新时间 1 个。

三、优先修复(含可直接复制粘贴的代码)

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。

可直接复制的修复

放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)

# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
#    爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写

User-agent: Bytespider
Allow: /
# 对应产品:豆包

User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek

User-agent: QwenBot
Allow: /
# 对应产品:通义千问

User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT

# ② 本次检测显示以下爬虫你已经声明过,无需重复:
#    ClaudeBot、PerplexityBot、KimiBot、Kimi-SearchBot

# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/

# ④ 声明站点地图
Sitemap: https://www.zixunhk.com/sitemap.xml

本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、GPTBot(对应 豆包、DeepSeek、通义千问、ChatGPT)。

2. B2 · 结构化数据(JSON-LD)

  • 现状:JSON-LD 块 0 个,WebSite 无,Organization 无
  • 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。

可直接复制的修复

放到:<head>sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁

<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
 "name":"年审报税","url":"https://www.zixunhk.com/",
 "sameAs":["https://www.zhihu.com/org/你的主页",
           "https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
 "name":"年审报税","url":"https://www.zixunhk.com/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->

3. B3 · 标题层级语义化

  • 现状:h1 1 个,h2 0 个
  • 怎么改:每页只保留一个 h1,用 h2/h3 组织层级;不要用加粗的 div 冒充标题。

可直接复制的修复

不要用加粗的 div 冒充标题——AI 靠标签层级判断哪句话是结论、哪些是支撑

<h1>年审报税:这一页的主题(每页只准有 1 个 h1)</h1>
  <h2>第一部分</h2>
    <h3>小节</h3>
  <h2>第二部分</h2>

四、重点问题分析

一、robots.txt 未放行 AI 爬虫,抓取入口存在不确定性

站点当前 robots.txt 中没有出现 Bytespider、DeepSeekBot、QwenBot、GPTBot 等任何 AI 爬虫的 User-agent 声明。多数爬虫只匹配第一条命中的规则,如果文件里先出现 User-agent: * 的通用规则,后续针对具体爬虫的声明就不会被读取;反之,没有显式声明时,抓取行为完全取决于各爬虫对默认规则的解释,站点无法掌控。对 AI 引用而言,这一步是前置条件:内容再完整,抓不到就不会进入任何生成式答案。修改要点是把每个 AI 爬虫的 User-agentAllow: / 单独成段,放在 User-agent: * 之前,并确保不误伤 sitemap 与静态资源路径。

二、缺少 JSON-LD 结构化数据,站点身份与页面类型无法被机器确认

检测显示页面中 JSON-LD 块为 0 个,WebSite 与 Organization 均未声明。这意味着 AI 在解析页面时,只能依赖正文文本去猜测「这是谁、做什么、页面属于什么类型」,无法获得明确的实体信息。对生成式引擎来说,实体不明确的页面在需要归属来源时容易被跳过,因为它无法确认信息由谁发布、是否可核验。修改要点是至少补齐 WebSite 与 Organization 两个基础类型,包含站点名称、URL、logo、联系方式;文章页补 Article,问答页补 FAQPage,让页面类型与内容形态一一对应。

三、标题层级语义化不足,正文缺少可摘录结构

页面 h1 有 1 个,但 h2 为 0 个,说明正文没有用层级标签组织内容;同时列表与表格标签为 0 个,全站没有编号清单、对比表格或 FAQ 结构。这两项叠加的后果是:AI 无法按段落主题切分内容,也难以找到可以整段摘录的结论块。生成式答案偏好结构清晰、边界明确的片段,纯连续段落即便信息量足够,被完整引用的概率也明显偏低。修改要点是把每个主题段落用 h2 标注、子要点用 h3,把并列信息改写成有序或无序列表,把对比信息做成表格,把常见问题整理成问答对。

四、缺少 llms.txt 与站外引用证据,可引用性支撑不足

llms.txt 返回 HTTP 404,站点没有为 AI 提供一份纯文本的站点说明,模型无法快速获知站点定位、核心页面与可引用结论。同时,正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明,站点的可信度信号完全依赖自述。修改要点是在根目录放置纯文本 llms.txt,写明定位、核心页面与可引用结论,并确认服务器不会把首页 HTML 返回在该路径上;同时把一手数据整理成可独立引用的结论块发布到站外平台并在正文链回,或在正文标注「来源:××」,并在 JSON-LD 的 sameAs 中声明站外身份主页。

五、行动建议

  1. 修改根目录 robots.txt:为 Bytespider、DeepSeekBot、QwenBot、GPTBot 各写一段 User-agent: <名称>Allow: /,全部放在 User-agent: * 之前,保存后用浏览器直接访问 /robots.txt 确认返回纯文本且顺序正确。

  2. 在首页 <head> 内新增 JSON-LD 脚本块,至少包含 WebSite 与 Organization 两个类型,填入站点名称、URL、logo、联系方式;文章页模板追加 Article,问答页模板追加 FAQPage。改完后用结构化数据测试工具逐页验证无报错。

  3. 在根目录新建纯文本 llms.txt,写明站点定位、核心页面清单与可引用结论,并在服务器配置中确认 /llms.txt 直接返回该文本文件,而不是被重写成首页 HTML。

  4. 调整正文模板的标题标签:每页只保留一个 h1,按主题补 h2、子要点补 h3,替换掉用加粗 div 冒充标题的写法;同时把并列信息改成有序或无序列表,把对比信息改成表格,优先在服务介绍与流程说明类页面落地。

  5. 在正文中为数据加上出处标注(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页;同时把一手数据整理成可独立引用的结论块发布到知乎、CSDN 等平台,再在正文中链回对应页面。

六、外部引用线索(仅证据,不计分)

  • 未检出站外提及:外部索引里还没有提到 www.zixunhk.com 的页面。

  • 检索方式:Bing RSS,查询式 "www.zixunhk.com" -site:www.zixunhk.com打开这次检索

  • 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。

七、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 www.zixunhk.com 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 338 ms 43978 B
robots.txt 200 327 ms 394 B
sitemap.xml 200 324 ms 1048 B
llms.txt 404 335 ms — B
不存在路径探测 404 358 ms — B

八、如何引用本报告

安企 GEO《www.zixunhk.com GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 9 项,得分 9 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:www.zixunhk.com GEO 就绪度检测报告
  • 检测日期:2026-09-20
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:www.zixunhk.com GEO 就绪度检测报告,安企 GEO,2026