检测结论:
www.chng.com.cn在《GEO 就绪度标准 v1.0》的 15 项判定中通过 7 项,得分 7 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
本次检测依据《GEO 就绪度标准 v1.0》共 15 项,www.chng.com.cn 通过 7 项,得分 7 分,判定等级为不可见。站点基础条件尚可:HTTPS 有效、首页响应 159 ms、无软 404、备案与主体信息可核验,正文含 631 处具体数字,具备一手信息底子;但最致命的缺口集中在可抓取性与可理解性两组——robots.txt、sitemap.xml、llms.txt 三个根目录文件全部返回 404,首页源码无 h1、无 h2、无 JSON-LD,title 仅 15 字符且 description 为空。这意味着 AI 爬虫既缺少进入站点的通行证与地图,也拿不到判断页面主题的结构信号,即使抓到正文也难以确认页面讲什么、由谁发布。优先补齐 robots.txt、sitemap.xml、llms.txt 与首页 TDK、JSON-LD、标题层级后,可抓取性与可理解性将大幅改善,得分可升至 12 分以上;再补上第三方引用证据,可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.chng.com.cn
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | robots.txt 返回 HTTP 404 |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 4213 字符,h1 0 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 未通过 | sitemap.xml HTTP 404 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 159 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 未通过 | title 15 字符,description 0 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 0 个,h2 0 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回 HTTP 404 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:首页 - 中国华能集团有限公司 快速导航 投资者 华能国际 华能蒙电 新能泰山 华能水电 长城证券 求职者 人才政策 招… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 20 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 631 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/relations.html#relation0 |
200 | title 18 / desc 0 | 1925 字 | 0 | 有 | 157 |
/list_rczc/-/article/e7QXJDO2ekps/list/23519/ |
200 | title 17 / desc 0 | 1596 字 | 0 | 无 | 163 |
/list_zpxx/-/article/cQQKaBtwslFy/list/23524/ |
200 | title 17 / desc 0 | 3357 字 | 0 | 有 | 175 |
小结:抽样的 3 个内页中,TDK 完整 0 个、含结构化数据 0 个、标注更新时间 2 个。
内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:robots.txt 返回 HTTP 404
- 怎么改:在站点根目录创建 robots.txt,并在 User-agent: * 之前逐条显式放行 AI 爬虫。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: Bytespider
Allow: /
# 对应产品:豆包
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
User-agent: QwenBot
Allow: /
# 对应产品:通义千问
User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT
User-agent: ClaudeBot
Allow: /
# 对应产品:Claude
User-agent: PerplexityBot
Allow: /
# 对应产品:Perplexity
User-agent: KimiBot
Allow: /
# 对应产品:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应产品:Kimi 搜索
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://www.chng.com.cn/sitemap.xml
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 4213 字符,h1 0 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
可直接复制的修复
若源码里几乎没有正文,三种改法(任选):
- Next.js:
getServerSideProps/ Server Component 输出内容; - Nuxt:
ssr: true(默认)并把关键内容放在服务端; - 静态站:构建时预渲染(
nuxt generate/next export/ 或纯 HTML)。 同时给不执行 JS 的客户端留一份<noscript>说明。
# 先用这条确认正文是否出现在源码里(AI 爬虫大多不执行 JS)
curl -s https://www.chng.com.cn/ | grep -c "<h1"
curl -s https://www.chng.com.cn/ | wc -c
3. A3 · 有 sitemap 且内容有效
- 现状:sitemap.xml HTTP 404
- 怎么改:生成 sitemap.xml(sitemapindex 亦可),并在 robots.txt 中声明它的地址。
可直接复制的修复
放到:站点根目录 /sitemap.xml,并在 robots.txt 里加一行 Sitemap: https://www.chng.com.cn/sitemap.xml。文章量大的站建议用 sitemapindex 分片
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.chng.com.cn/</loc>
<lastmod>2026-09-19</lastmod>
<changefreq>daily</changefreq>
<priority>1.0</priority>
</url>
</urlset>
四、重点问题分析
一、robots.txt、sitemap.xml 双双 404,AI 爬虫没有入口也没有地图
站点根目录的 robots.txt 返回 HTTP 404,sitemap.xml 同样返回 404。这不是内容问题,而是通道问题。主流 AI 爬虫在抓取前会先读取 robots.txt 判断允许范围,缺失该文件时,不同爬虫的默认行为并不一致,部分会保守限流,部分会按全站放行但缺少优先级线索;而 sitemap.xml 缺失,则意味着爬虫只能靠站内链接自行发现页面,更新频率低、入口深的页面(如年报、公告、项目进展)几乎不会被及时抓取。对 AI 引用而言,抓不到就等于不存在。修改要点:在站点根目录新增 robots.txt,在 User-agent: * 之前逐条显式放行 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 等 AI 爬虫,并在文件内用 Sitemap: 声明 sitemap 地址;同时生成 sitemap.xml(页面量大时用 sitemapindex 分片),确保其中列出的 URL 均返回 200。
二、首页无 h1、无 h2,标题层级完全缺失
源码中可见正文 4213 字符,但 h1 为 0 个、h2 为 0 个。正文能读到,标题结构却是空的,这会让 AI 在解析页面时失去主题锚点:它无法判断这一页的核心对象是集团本身、某家上市公司还是某条业务线,只能从零散段落里猜。同一问题也直接影响 B1——title 仅 15 字符、description 为 0 字符,页面在检索结果与 AI 摘要中都缺少一句可用的自我说明。修改要点:每页只保留一个 h1,用 h2/h3 组织层级,不要用加粗的 div 冒充标题;补齐 TDK,title 控制在 60 字符内,description 不少于 50 字符,且各页互不重复。
三、JSON-LD 为 0,站点身份无法被机器确认
检测显示 JSON-LD 块 0 个,WebSite 与 Organization 均未声明。B5 虽已通过(备案信息与主体信息入口齐全),但那是给人看的,不是给机器读的。缺少结构化数据,AI 无法把「中国华能集团有限公司」这个名称、站点域名、站外身份主页稳定地关联为同一实体,在涉及企业主体的提问中容易被同名或近似名称干扰。修改要点:至少补 WebSite 与 Organization 两类,文章页加 Article,问答页加 FAQPage,并在 Organization 的 sameAs 中声明站外身份主页。
四、C5 无第三方引用证据,一手数据的可信度未被外部验证
C3 已通过,正文含具体数字 631 处,说明站点本身有可引用的一手素材;但 C5 未通过——正文可见区没有指向第三方平台的引用链接,没有出处标注,也没有 sameAs 站外身份声明。结果是这些数字只能被本站自述,AI 在需要交叉验证时缺少旁证,倾向于选择有外部来源支撑的表述。修改要点:两条路任选其一或并行——把一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台并在正文链回;或在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。
五、行动建议
在站点根目录新增 robots.txt 文件。内容按「先逐条放行 AI 爬虫、再统一规则」的顺序书写:先写 User-agent: GPTBot / ClaudeBot / PerplexityBot / Google-Extended 并配 Allow: /,再写 User-agent: * 与 Allow: /,最后一行用 Sitemap: https://www.chng.com.cn/sitemap.xml 声明地图地址。部署后用浏览器直接访问 /robots.txt 确认返回 200 且为纯文本。
生成 sitemap.xml 并放到根目录。优先收录首页、上市公司页面、公告与年报、业务板块等核心页;页面数量大时改用 sitemapindex 分片,每个分片不超过 5 万条 URL。生成后抽查若干条,确认均返回 200,避免把 404 或重定向地址写进地图。
在站点根目录新增 llms.txt 纯文本文件。写明站点定位(中国华能集团有限公司官网)、核心页面清单及各自 URL、可引用的关键结论与数据口径。部署后务必确认该路径返回的是纯文本而非首页 HTML,避免服务器把首页内容回退到该路径。
修改首页及各栏目页的模板文件,补齐标题层级与 TDK。确保每页有且仅有一个 h1,正文用 h2/h3 分层;在模板的 head 中为每页输出独立的 title(不超过 60 字符)与 description(不少于 50 字符),替换当前 15 字符 title 与空 description。
在页面 head 中注入 JSON-LD。至少补 WebSite 与 Organization 两类,填入站点名称、域名、logo 与站外身份主页的 sameAs 声明;文章页补 Article,问答页补 FAQPage。同时按 C5 要求,在正文中为关键数据标注出处,或把一手数据整理成独立结论块发布到知乎、CSDN 等平台并在正文链回。
六、外部引用线索(仅证据,不计分)
- 搜索引擎检出站外提及 7 条(判定口径:结果标题/摘要/链接中确实出现了该域名或品牌词),来源站点:chng.toobiao.com、ec.chng.com.cn、eoffcn.com、mail.chng.com.cn、zhaopin.chng.com.cn
| 来源 | 标题 | 链接 |
|---|---|---|
| mail.chng.com.cn | 中国华能外网邮箱 | https://mail.chng.com.cn/ |
| zhaopin.chng.com.cn | 招聘官网 | https://zhaopin.chng.com.cn/ |
| ec.chng.com.cn | ec.chng.com.cn | https://ec.chng.com.cn/channel/home/ |
| chng.toobiao.com | 华能集团公司电子商务平台_首页 | http://chng.toobiao.com/ |
| eoffcn.com | 2026年中国华能招聘报名入口http://zhaopin.chng.com.cn | https://eoffcn.com/kszx/detail/1847271.html |
- 检索方式:Bing RSS,查询式
"www.chng.com.cn" -site:www.chng.com.cn(打开这次检索) - 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.chng.com.cn重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 159 ms | 84779 B |
| robots.txt | 404 | 114 ms | — B |
| sitemap.xml | 404 | 137 ms | — B |
| llms.txt | 404 | 145 ms | — B |
| 不存在路径探测 | 404 | 190 ms | — B |
八、如何引用本报告
安企 GEO《www.chng.com.cn GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 7 项,得分 7 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.chng.com.cn GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.chng.com.cn GEO 就绪度检测报告,安企 GEO,2026