检测结论:
suiyan.cn在《GEO 就绪度标准 v1.0》的 15 项判定中通过 1 项,得分 1⁄15,判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
suiyan.cn 在《GEO 就绪度标准 v1.0》的 15 项检查中仅通过 1 项(A4 无死链污染),得分 1/15,判定为「不可见」。核心问题不在内容质量,而在基础层:站点根目录未取到 robots.txt 与 sitemap.xml,首页源码中可见正文 0 字符、h1 0 个,说明正文完全依赖 JS 渲染,AI 爬虫取到的只是一个空壳;同时首页 HTTP 探测无响应,可达性本身存疑。可理解性与可引用性两组 10 项全部未通过:title 与 description 均为 0 字符,无 JSON-LD、无 llms.txt、无标题层级、无备案与主体信息,页面也没有结论前置、列表表格、具体数字和更新时间。最致命的缺口是「抓不到 + 读不懂」叠加,使站点在生成式引擎中几乎不产生任何可引用素材。优先修复 A2、A5、A1/A3 后,站点即可从「不可见」进入「可被抓取」;再补齐 B1、B2、B3 与 C1、C2、C4,具备进入候选引用池的条件。
二、逐项判定结果
判定时间:2026-09-19 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:suiyan.cn
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未取到 robots.txt |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 0 字符,h1 0 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 未通过 | sitemap.xml HTTP 0 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 0 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 未通过 | 协议 HTTPS,首页 HTTP 无,响应 330 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 未通过 | title 0 字符,description 0 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 0 个,h2 0 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | 未取到 llms.txt |
| B5 | 主体与作者信息可核验 | 可理解性 | 未通过 | 备案信息 无,主体信息入口 无 |
| C1 | 结论前置 | 可引用性 | 未通过 | 首屏可见文本前 120 字: |
| C2 | 存在可摘录结构块 | 可引用性 | 未通过 | 列表/表格标签 0 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 未通过 | 含具体数字 0 处 |
| C4 | 有明确更新时间 | 可引用性 | 未通过 | 页面可见更新时间为 无 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 第三方平台引用 无 |
三、优先修复的三件事
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未取到 robots.txt
- 怎么改:在站点根目录创建 robots.txt,并在 User-agent: * 之前逐条显式放行 AI 爬虫。
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 0 字符,h1 0 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
3. A3 · 有 sitemap 且内容有效
- 现状:sitemap.xml HTTP 0
- 怎么改:生成 sitemap.xml(sitemapindex 亦可),并在 robots.txt 中声明它的地址。
四、重点问题分析
正文依赖 JS 渲染,源码中没有任何可读内容
证据显示首页源码中可见正文 0 字符、h1 0 个。这意味着 AI 爬虫请求页面时拿到的 HTML 里没有正文,只有脚本与容器节点。当前主流生成式引擎的抓取器大多不执行完整 JS,或执行预算极低,取到空源码后无法建立任何语义索引,页面等同于不存在。修改要点是把正文与标题改为服务端渲染或预渲染,确保关闭 JS 后源码中仍能读到完整段落与唯一的 h1;若短期内无法改造框架,至少对文章页做静态化输出。
可达性异常,robots.txt 与 sitemap 双双缺失
A5 显示协议为 HTTPS,但首页 HTTP 探测无响应,响应时间 330 ms 也无法作为有效可达的证明;A1 未取到 robots.txt,A3 的 sitemap.xml 返回 HTTP 0。对 AI 爬虫而言,返回 403/5xx 或取不到内容与站点不存在是同一结果。同时缺少 robots.txt,就无法显式放行 GPTBot、ClaudeBot、PerplexityBot 等抓取代理,默认策略下部分爬虫会直接放弃抓取;缺少 sitemap,则新页面只能靠外链被动发现,收录周期被显著拉长。修改要点是先确认服务器对根路径与静态资源的响应策略,排除 WAF 或地域拦截误伤爬虫;随后在根目录创建 robots.txt,逐条放行主流 AI 爬虫并声明 sitemap 地址,再生成覆盖全站的 sitemap.xml。
页面元信息与结构语义全部为空
B1 显示 title 0 字符、description 0 字符,B3 显示 h1 与 h2 均为 0 个,B2 显示 JSON-LD 块 0 个,WebSite 与 Organization 均无。这一组问题决定了 AI 能否判断「这是什么站、这一页讲什么」。没有 title 和 description,引擎无法生成准确的摘要锚点;没有标题层级,正文的从属关系无法还原,长文会被切碎成无意义片段;没有结构化数据,站点名称、组织主体、页面类型都只能靠猜测。修改要点是按页面类型补全唯一 TDK,title 控制在 60 字符内、description 不少于 50 字符;正文使用单一 h1 加 h2/h3 的层级;在模板层注入 WebSite 与 Organization 的 JSON-LD,文章页追加 Article,问答页追加 FAQPage。
主体不可核验,且缺少可被摘录的内容形态
B5 显示备案信息与主体信息入口均无,C1 首屏前 120 字为空,C2 列表与表格标签 0 个,C3 含具体数字 0 处,C4 无可见更新时间。生成式引擎在多个候选来源之间做取舍时,会优先选择主体清晰、结论明确、带一手数据且时效可判断的页面。当前站点四项全缺,即使被抓取也难以进入引用环节。修改要点是在页脚展示备案号并提供「关于我们」或联系方式入口;把每页开头 100 字改为直接给结论;将要点整理为编号清单或对比表格;补充可核查的数字,如样本量、比例、耗时;在显著位置标注「更新于 YYYY-MM-DD」。
五、行动建议
在站点根目录新增 robots.txt,内容按爬虫逐条放行:为 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 各写一条
User-agent: <名称>加Allow: /,最后写User-agent: *加Allow: /,并在文件末尾加一行Sitemap: https://suiyan.cn/sitemap.xml。同时排查服务器对该路径的响应,确保返回 200 与 text/plain。生成 sitemap.xml 并放在根目录,覆盖首页与全部栏目页、文章页,每条的
<lastmod>填真实更新时间。若站点已有构建流程,在构建后自动输出该文件,避免手工维护导致失效。改造页面模板,把正文与标题改为服务端渲染。验收标准是:用 curl 取首页 HTML,源码中能直接读到正文段落,且
<h1>恰好出现一次。若使用前端框架,开启 SSR 或对内容页做预渲染输出。在模板的
<head>中补全 TDK 与 JSON-LD。title 按「页面主题 - 站点名」生成且不超过 60 字符;description 每页独立撰写、不少于 50 字符。JSON-LD 至少包含 WebSite(含 name、url)与 Organization(含 name、url、logo),文章页追加 Article(含 headline、datePublished、dateModified、author)。在页脚加入备案号与「关于我们」链接,并在每篇文章正文开头 100 字内写出结论句,正文中至少插入一个编号清单或对比表格,标注「更新于 YYYY-MM-DD」。完成后在根目录放置纯文本 llms.txt,写明站点定位、核心页面地址与可引用结论,并确认该路径返回的是纯文本而非首页 HTML。
六、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
suiyan.cn重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C1/C3/C5 三项由规则推断,标准中已标注「需人工确认」;数据是 2026-09-19 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | — | 330 ms | — B |
| robots.txt | — | 289 ms | — B |
| sitemap.xml | — | 256 ms | — B |
| llms.txt | — | 299 ms | — B |
| 不存在路径探测 | — | 261 ms | — B |
七、如何引用本报告
安企 GEO《suiyan.cn GEO 就绪度检测报告》(2026-09-19):该站按《GEO 就绪度标准 v1.0》15 项判定通过 1 项,得分 1/15,判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:suiyan.cn GEO 就绪度检测报告
- 检测日期:2026-09-19
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:suiyan.cn GEO 就绪度检测报告,安企 GEO,2026