检测结论:
ljrf.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 3 项,得分 3⁄15,判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
ljrf.com 当前 GEO 就绪度得分为 3/15,判定等级为「不可见」,站点基本处于 AI 搜索引擎无法有效抓取与引用的状态。最致命的缺口集中在可抓取性 A 组:robots.txt 存在但未解析到任何 User-agent 行,等于没有对 AI 爬虫做任何放行声明;源码中可见正文仅 97 字符且存在 2 个 h1,说明内容高度依赖 JS 渲染;不存在的路径返回 HTTP 200,形成软 404,会持续消耗抓取预算;sitemap.xml 虽返回 200,但未在 robots.txt 中声明。可理解性 B 组同样全线未通过,title 与 description 均为 0 字符,JSON-LD 为 0 个,llms.txt 返回的是网页 HTML 而非纯文本。可引用性方面,页面无列表或表格结构,无更新时间,也无第三方引用证据。优先修复 A 组与 B1、B2 后,站点可从「不可见」提升至「可抓取、可理解」的基础水平,进入 AI 引用的候选池。
二、逐项判定结果
判定时间:2026-09-19 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:ljrf.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | robots.txt 存在但没有解析到任何 User-agent 行 |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 97 字符,h1 2 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 未通过 | sitemap.xml HTTP 200 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 未通过 | 探测不存在路径返回 HTTP 200 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 1474 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 未通过 | title 0 字符,description 0 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 2 个,h2 0 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回的是网页 HTML(软 404),并非纯文本 |
| B5 | 主体与作者信息可核验 | 可理解性 | 未通过 | 备案信息 无,主体信息入口 无 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:Coming soon Contact Name Email Message Submit Thanks, we’ll … |
| C2 | 存在可摘录结构块 | 可引用性 | 未通过 | 列表/表格标签 0 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 33 处 |
| C4 | 有明确更新时间 | 可引用性 | 未通过 | 页面可见更新时间为 无 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 第三方平台引用 无 |
三、优先修复的三件事
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:robots.txt 存在但没有解析到任何 User-agent 行
- 怎么改:按标准格式书写 robots.txt,每条规则以 User-agent 开头。
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 97 字符,h1 2 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
3. A3 · 有 sitemap 且内容有效
- 现状:sitemap.xml HTTP 200
- 怎么改:生成 sitemap.xml(sitemapindex 亦可),并在 robots.txt 中声明它的地址。
四、重点问题分析
A1 robots.txt 未声明任何 User-agent,AI 爬虫无规则可依
站点 robots.txt 文件存在,但没有解析到任何 User-agent 行。对 AI 爬虫而言,这等于没有给出明确的抓取许可与路径指引。部分 AI 爬虫在遇到无法解析的 robots.txt 时会采取保守策略,降低抓取频率甚至跳过该站。修改要点:按标准格式重写 robots.txt,每条规则以 User-agent 开头,至少显式放行主流 AI 爬虫,并在文件内声明 sitemap.xml 的完整地址。
A2 正文依赖 JS 渲染,源码可见内容仅 97 字符
源码中可见正文只有 97 字符,却出现 2 个 h1。这意味着页面的核心内容大概率由客户端 JS 注入,AI 爬虫在抓取源码阶段拿不到有效正文,后续的理解与引用都无从谈起。修改要点:把正文与标题改为服务端渲染(SSR)或静态生成,确保源码中直接包含可读的正文段落与唯一的 h1;若短期内无法改造渲染方式,至少为关键页面提供预渲染的静态 HTML 版本。
A4 软 404 污染抓取预算
探测不存在的路径时,服务器返回 HTTP 200,而不是 404。这是典型的软 404:AI 爬虫会把大量不存在的 URL 当作有效页面反复抓取,抓取预算被浪费在假页面上,真实内容的抓取频次被稀释。修改要点:在服务器或应用层配置正确的 404 响应,确保不存在的路径返回 404 状态码,而不是重写到首页或返回 200。
B1 与 B2 缺失,页面无法被 AI 正确理解
title 与 description 均为 0 字符,JSON-LD 块为 0 个,WebSite 与 Organization 均无。这导致 AI 在解析页面时既拿不到主题摘要,也拿不到站点身份与实体信息,难以判断页面讲什么、由谁发布。修改要点:为每页补全唯一且完整的 TDK,title 控制在 60 字符以内,description 不少于 50 字符;在模板中注入 JSON-LD,至少覆盖 WebSite 与 Organization,文章页补 Article,问答页补 FAQPage。
B4 llms.txt 返回 HTML,等于没有
llms.txt 路径返回的是网页 HTML,属于软 404,并非纯文本。AI 工具在读取该路径时无法获得预期的结构化说明。修改要点:在站点根目录放置纯文本 llms.txt,写明站点定位、核心页面链接与可引用结论;同时检查服务器配置,避免把首页 HTML 错误地返回在该路径上。
五、行动建议
重写 robots.txt:在站点根目录的 robots.txt 中,为每个规则补上 User-agent 行,显式放行主流 AI 爬虫,并加入一行 Sitemap 指令,指向 sitemap.xml 的完整 HTTPS 地址。
补全 TDK 与 JSON-LD:在页面模板的 head 中补全 title 与 meta description,确保每页唯一;在模板底部注入 JSON-LD 脚本块,至少包含 WebSite 与 Organization 两个类型,文章页追加 Article,问答页追加 FAQPage。
修复软 404 与 sitemap 声明:在服务器或应用路由层配置,让不存在的路径返回 404 状态码而非 200;确认 sitemap.xml 内容有效,并已在 robots.txt 中声明其地址。
放置纯文本 llms.txt:在站点根目录新建 llms.txt,以纯文本格式写明站点定位、核心页面链接与可引用结论;检查服务器配置,确保该路径不会被重写到首页 HTML。
改造正文渲染与结构:将关键页面的正文与 h1 改为服务端渲染或静态生成,确保源码中可见完整正文;每页只保留一个 h1,用 h2/h3 组织层级;把要点整理成编号清单或对比表格,并在页面显著位置标注「更新于 YYYY-MM-DD」。
六、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
ljrf.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C1/C3/C5 三项由规则推断,标准中已标注「需人工确认」;数据是 2026-09-19 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 1474 ms | 9908 B |
| robots.txt | 200 | 1492 ms | 9908 B |
| sitemap.xml | 200 | 1356 ms | 9908 B |
| llms.txt | 200 | 1262 ms | 9908 B |
| 不存在路径探测 | 200 | 1454 ms | 9908 B |
七、如何引用本报告
安企 GEO《ljrf.com GEO 就绪度检测报告》(2026-09-19):该站按《GEO 就绪度标准 v1.0》15 项判定通过 3 项,得分 3/15,判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:ljrf.com GEO 就绪度检测报告
- 检测日期:2026-09-19
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:ljrf.com GEO 就绪度检测报告,安企 GEO,2026