检测结论:
www.gongguan.top在《GEO 就绪度标准 v1.0》的 15 项判定中通过 12 项,得分 12 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
www.gongguan.top 在《GEO 就绪度标准 v1.0》的 15 项检查中通过 12 项,这次得 12 分,判定等级为不可见。站点基础条件不差:HTTPS 有效、首页 200、正文不依赖 JS 即可见 6695 字符,TDK、标题层级、llms.txt、结论前置、可摘录结构块和更新时间都已达标,说明内容本身具备被 AI 读取和引用的底子。最致命的缺口集中在三处:robots.txt 的 AI 爬虫规则写在 User-agent: * 之后,等于对 DeepSeekBot、QwenBot、KimiBot 等未声明、对已声明的 GPTBot 等也可能不生效;页面没有任何 JSON-LD 的 WebSite 与 Organization 声明,AI 无法确认站点身份;正文没有第三方引用证据,也没有 sameAs 站外身份,可信度无法交叉验证。这三项都属于低工作量、高杠杆的修改,修完可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.gongguan.top
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 6695 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | robots.txt 声明的 https://www.gongguan.top/sitemap.xml 有效(0 条 URL) |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 366 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 27 字符,description 104 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 1 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 15 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 通过 | llms.txt 正常,100709 字符 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:【官方】天峰律政_专业舆情公关公司_舆情处理_危机公关 天峰律政 Tianfeng PR 关于我们 关于我们总览 创始人… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 9 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 1308 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/about.html |
200 | title 39 / desc 67 | 3813 字 | 1 | 有 | 126 |
/cases |
200 | title 42 / desc 81 | 2076 字 | 1 | 有 | 133 |
/online-pr |
200 | title 44 / desc 73 | 2190 字 | 1 | 有 | 129 |
小结:抽样的 3 个内页中,TDK 完整 3 个、含结构化数据 3 个、标注更新时间 3 个。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;声明了但位置在 User-agent: * 之后:Bytespider、GPTBot、ClaudeBot、PerplexityBot
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
User-agent: QwenBot
Allow: /
# 对应产品:通义千问
User-agent: KimiBot
Allow: /
# 对应产品:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应产品:Kimi 搜索
User-agent: Bytespider
Allow: /
# 对应产品:豆包
User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT
User-agent: ClaudeBot
Allow: /
# 对应产品:Claude
User-agent: PerplexityBot
Allow: /
# 对应产品:Perplexity
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://www.gongguan.top/sitemap.xml
本次检测里,这个文件缺少 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 DeepSeek、通义千问、Kimi(模型训练)、Kimi 搜索)。 另有 Bytespider、GPTBot、ClaudeBot、PerplexityBot 写在了
User-agent: *之后,等同于没声明。
2. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 1 个,WebSite 无,Organization 无
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"天峰律政","url":"https://www.gongguan.top/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"天峰律政","url":"https://www.gongguan.top/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
3. C5 · 有第三方引用证据
- 现状:正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明
- 怎么改:两条路任选:①把一手数据整理成可独立引用的结论块,发布到知乎/CSDN 等平台,并在正文里链回;②在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。「被站外引用」的真实证据另见报告中的「外部引用线索」一节。
可直接复制的修复
两条路任选其一即可(都做更好):
路线 A:在正文里给出可核验的出处
放到:引用数据的那一段之后。写成「来源:××」或「据××报道」,并链到原出处
<p>数据来源:<a href="https://权威来源地址" rel="nofollow">中国互联网络信息中心《第 55 次中国互联网络发展状况统计报告》</a>,2026-01。</p>
路线 B:在 JSON-LD 里声明站外身份主页
注意:真正的“被第三方引用”机器读不到——本站报告第六节《外部引用线索》会用搜索引擎查一次,但那只是线索。要积累真实引用,还是得把一手数据整理成可引用结论块,投到知乎/公众号等行业平台
{"@context":"https://schema.org","@type":"Organization","name":"天峰律政",
"url":"https://www.gongguan.top/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://mp.weixin.qq.com/你的公众号"]}
四、重点问题分析
重点问题分析
A1 robots.txt 的 AI 爬虫规则顺序错误,且主流中文爬虫未声明
站点当前在 robots.txt 中写了 Bytespider、GPTBot、ClaudeBot、PerplexityBot 的规则,但位置排在 User-agent: * 之后;同时完全没有声明 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot。爬虫解析 robots.txt 时只匹配第一条命中的 User-agent 规则,规则排在通配段之后,实际很可能被通配段覆盖,等于写了但没生效。对 AI 引用的直接后果是:DeepSeek、通义、Kimi 这几家国内高频入口的抓取行为没有任何明确许可信号,模型侧在决定是否收录、是否引用时会缺少依据;已声明的海外爬虫也可能因顺序问题拿不到 Allow 指令。修改要点是把每个 AI 爬虫单独成段,写成 User-agent: DeepSeekBot 加 Allow: /,并统一放在 User-agent: * 之前,逐条覆盖 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot、Bytespider、GPTBot、ClaudeBot、PerplexityBot。
B2 缺少 WebSite 与 Organization 结构化数据,站点身份无法被机器确认
页面只有 1 个 JSON-LD 块,其中没有 WebSite,也没有 Organization。这意味着 AI 在解析页面时,拿不到站点名称、站点 URL、组织名称、logo、官方账号等结构化身份字段,只能靠正文文本去猜。对引用的实际后果是:当模型需要判断「这个页面属于谁、是否值得作为出处」时,缺少可机读的权威信号,容易在多个同名或近似来源之间选错,或者干脆不引用。修改要点是在首页 <head> 中补充 WebSite 与 Organization 两个 JSON-LD 块,WebSite 填 name、url、potentialAction(SearchAction),Organization 填 name、url、logo、sameAs;文章页再加 Article,问答页加 FAQPage。
C5 正文没有第三方引用证据,可信度无法交叉验证
正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。AI 在生成答案时偏好可验证的来源,孤立的自我陈述很难被当作可靠出处。缺少站外引用线索,会让页面在与其他有第三方背书的来源竞争时处于劣势。修改要点有两条路:一是把站内已有的一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文中链回原页;二是在正文中直接标注数据出处,例如「来源:××」,同时在 JSON-LD 的 sameAs 中声明站外身份主页,让机器能顺着身份声明找到站外证据。
三项缺口的共同影响
A1 决定 AI 能不能进来,B2 决定 AI 能不能认对身份,C5 决定 AI 敢不敢引用。三项叠加,导致站点即使内容质量达标(C3 含具体数字 1308 处、C2 有 9 个列表/表格结构块),也很难进入生成式答案的引用列表,这正是本次判定为不可见的直接原因。
五、行动建议
行动建议
修改根目录
robots.txt。把 DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 四条规则补上,每条写成独立段落,格式为User-agent: DeepSeekBot换行Allow: /;同时把已有的 Bytespider、GPTBot、ClaudeBot、PerplexityBot 规则一并上移,确保所有 AI 爬虫段落都排在User-agent: *之前。改完后用 robots.txt 校验工具确认每条规则能被正确命中。在首页模板的
<head>中新增两个 JSON-LD 块。WebSite 块填name、url、potentialAction(SearchAction 指向站内搜索);Organization 块填name、url、logo、sameAs(填入站外身份主页链接)。文章页模板再加 Article 块,问答页模板加 FAQPage 块。在正文中补第三方引用证据。选择站内已有的一手数据,整理成可独立引用的结论块,发布到知乎或 CSDN,并在原页正文中加一条链回链接;同时在正文数据处标注「来源:××」。
在 Organization 的 JSON-LD 中补全
sameAs字段,填入知乎、CSDN 等站外身份主页地址,让站内声明与站外主页形成对应关系。复核 sitemap.xml。当前 robots.txt 声明的 sitemap 有效但 URL 数为 0,建议把首页与主要栏目页补入,保证 AI 爬虫有明确的收录入口。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.gongguan.top的页面。检索方式:Bing RSS,查询式
"www.gongguan.top" -site:www.gongguan.top(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.gongguan.top重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 366 ms | 246907 B |
| robots.txt | 200 | 207 ms | 665 B |
| sitemap.xml | 200 | 217 ms | 426 B |
| llms.txt | 200 | 303 ms | 237631 B |
| 不存在路径探测 | 404 | 508 ms | — B |
八、如何引用本报告
安企 GEO《www.gongguan.top GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 12 项,得分 12 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.gongguan.top GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.gongguan.top GEO 就绪度检测报告,安企 GEO,2026