检测结论:
www.gtzxhk.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 11 项,得分 11 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
本站当前 GEO 就绪度得分 11 分(满分 15),判定为「不可见」。基础可抓取性、可理解性的大多数项已经通过:HTTPS 有效、首页响应 70 ms、源码中可见 4175 字符正文、sitemap 有效、TDK 完整、h1/h2 层级正常,并已部署 llms.txt 与 Organization 型 JSON-LD,说明站点在「能被读到」这一层没有硬伤。真正致命的是四个缺口:robots.txt 未声明 DeepSeekBot,可能使该爬虫落到通配规则上;JSON-LD 缺少 WebSite 节点,站点身份无法被完整识别;正文中列表与表格标签为 0,缺少可被整段摘录的结构块;正文可见区没有任何第三方引用链接、出处标注或 sameAs 站外身份声明,导致内容缺少外部可核验性。这四项集中在「被谁读」「被怎么理解」「被怎么引用」三个环节,属于可修复的配置与结构问题,不涉及站点架构重写。补齐后预计可达到 14-15 项通过,进入可被 AI 稳定引用的区间。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.gtzxhk.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未声明 DeepSeekBot |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 4175 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | sitemap.xml HTTP 200,含 url 节点 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 70 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 23 字符,description 83 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 2 个,WebSite 无,Organization 有 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 9 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 通过 | llms.txt 正常,3500 字符 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:港通咨询 - 香港公司注册与海外企业一站式服务 欢迎您的到来,港通咨询是海外公司注册年审、做账报税、商标注册、律师公证等… |
| C2 | 存在可摘录结构块 | 可引用性 | 未通过 | 列表/表格标签 0 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 674 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/p/76.html |
200 | title 22 / desc 15 | 1751 字 | 0 | 有 | 76 |
/a/102439.html |
200 | title 22 / desc 150 | 8349 字 | 2 | 有 | 99 |
小结:抽样的 2 个内页中,TDK 完整 2 个、含结构化数据 1 个、标注更新时间 2 个。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未声明 DeepSeekBot
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# Bytespider、QwenBot、GPTBot、ClaudeBot、PerplexityBot
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://www.gtzxhk.com/sitemap.xml
本次检测里,这个文件缺少 DeepSeekBot(对应 DeepSeek)。
2. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 2 个,WebSite 无,Organization 有
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"港通咨询","url":"https://www.gtzxhk.com/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"港通咨询","url":"https://www.gtzxhk.com/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
3. C2 · 存在可摘录结构块
- 现状:列表/表格标签 0 个
- 怎么改:把要点整理成编号清单、对比表格或 FAQ,这类结构最容易被整段摘录。
可直接复制的修复
清单、对比表格、FAQ 是最容易被整段摘录的结构。问答类内容还可以加 FAQPage 结构化数据
<table>
<thead><tr><th>对比项</th><th>A 方案</th><th>B 方案</th></tr></thead>
<tbody><tr><td>成本</td><td>…</td><td>…</td></tr></tbody>
</table>
<ul>
<li><strong>要点一</strong>:一句话讲完</li>
<li><strong>要点二</strong>:一句话讲完</li>
</ul>
四、重点问题分析
A1 robots.txt 未声明 DeepSeekBot,抓取许可存在不确定性
站点 robots.txt 中没有针对 DeepSeekBot 的独立规则。按爬虫匹配机制,未单独声明的 UA 会落到 User-agent: * 这一条上,而各 AI 爬虫对通配规则的处理并不一致:部分会放行,部分会保守地降低抓取频率甚至跳过。对本站而言,这意味着即使内容质量达标,也可能在 DeepSeek 一侧拿不到与其它引擎同等的抓取机会。
修改要点是把每个需要放行的 AI 爬虫写成独立的 User-agent + Allow: / 段落,并放在 User-agent: * 之前——爬虫只匹配第一条命中的规则,顺序错了等于没写。这一项改动成本极低,但直接决定后续所有优化是否被看到。
B2 JSON-LD 缺少 WebSite 节点,站点身份不完整
当前页面有 2 个 JSON-LD 块,Organization 已存在,但 WebSite 缺失。Organization 描述的是「谁在说话」,WebSite 描述的是「这是哪个站点、站内搜索入口在哪」,两者缺一不可。缺少 WebSite 时,AI 在跨页面聚合信息时难以把多个 URL 归并到同一站点实体下,容易把同一站点的不同页面当作互不相关的来源,削弱整体权重。
修改要点:在首页 <head> 中补充 WebSite 节点,包含 name、url、inLanguage,以及 potentialAction 的 SearchAction;Organization 节点补充 sameAs 指向站外身份主页。内容页按类型补 Article,问答页补 FAQPage。
C2 正文无列表与表格,缺少可摘录结构块
检测显示页面内列表与表格标签为 0 个。本站已有 674 处具体数字,一手信息是够的,但这些数字散落在连续段落里,AI 引用时需要自行切分和重组,抽取成本高、出错概率大。相比之下,编号清单、对比表格、FAQ 这类结构块边界清晰,最容易被整段摘录,也最容易被当作「结论」直接引用。
修改要点:把现有的服务流程、办理条件、时间节点、费用构成等要点,改写为 <ol>/<ul> 编号清单或 <table> 对比表;常见问题整理成问答对,配合 FAQPage 结构化数据。不需要新增内容,只需对已有内容做结构化重排。
C5 缺少第三方引用证据,内容外部可核验性不足
正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。AI 在决定是否引用一段内容时,会评估其可核验程度:只有站点自述、没有任何外部锚点的内容,被当作权威来源的概率明显偏低。这一项与 C2 叠加,会同时削弱内容的「可摘录性」和「可信度」。
修改要点有两条路径,可任选其一或并用:一是把站内的一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文中链回原页面;二是在正文中直接标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。前者建立外部引用,后者建立身份一致性。
五、行动建议
修改站点根目录
robots.txt:在User-agent: *之前,为每个需要放行的 AI 爬虫单独添加段落,格式为User-agent: DeepSeekBot换行Allow: /,其余已支持的爬虫同样逐条列出,确保每条规则位于通配规则之前。修改首页模板的
<head>部分(通常是index.html或对应的布局文件):新增一段<script type="application/ld+json">,写入 WebSite 节点,字段包含name、url、inLanguage,以及potentialAction下的 SearchAction;同时在已有的 Organization 节点中补充sameAs数组,填入站外身份主页地址。对内容页做结构化重排:把服务流程、办理条件、时间节点等要点从连续段落改为
<ol>或<ul>编号清单;把多方案对比改为<table>;把常见问题改为问答对,并在对应页面加入 FAQPage 型 JSON-LD。目标是让列表与表格标签数量从当前的 0 提升到每页至少 1-2 处。在正文中补充出处标注:对已有的 674 处具体数字,挑选其中可追溯的部分,在句末或段末加「来源:××」标注,并在正文中加入指向该来源的链接。优先处理首页与主要服务页。
把站内一手数据整理成 1-2 篇可独立引用的结论块,发布到知乎或 CSDN,并在原文正文中加入链回本站对应页面的链接。发布后回填到 JSON-LD 的 sameAs 中,形成站内与站外身份的一致声明。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.gtzxhk.com的页面。检索方式:Bing RSS,查询式
"www.gtzxhk.com" -site:www.gtzxhk.com(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.gtzxhk.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 70 ms | 76324 B |
| robots.txt | 200 | 133 ms | 861 B |
| sitemap.xml | 200 | 116 ms | 3326 B |
| llms.txt | 200 | 116 ms | 6780 B |
| 不存在路径探测 | 404 | 119 ms | — B |
八、如何引用本报告
安企 GEO《www.gtzxhk.com GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 11 项,得分 11 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.gtzxhk.com GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.gtzxhk.com GEO 就绪度检测报告,安企 GEO,2026