检测结论xueag.com 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 10 项,得分 1015,判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

xueag.com 在《GEO 就绪度标准 v1.0》15 项检查中通过 10 项,判定为「不可见」。站点基础面是健康的:HTTPS 可达、响应 390ms、正文不依赖 JS 渲染(源码可见 3609 字符)、TDK 与标题层级规范、有 sitemap 与真实 404、正文含 288 处具体数字,具备被 AI 引用的原料。最致命的缺口集中在两处:一是可抓取性上 robots.txt 未声明 DeepSeekBot、QwenBot,国内主流 AI 爬虫可能拿不到放行信号;二是可理解性上 JSON-LD 结构化数据为 0、llms.txt 返回 404,AI 缺少机器可读的站点与内容语义。可引用性上,页面无可见更新时间、无第三方引用证据,削弱了内容的时效可信度与外部佐证。这五项均属配置层改动,不涉及内容重构,修完后预计可达到 14-15 项通过,进入「可引用」区间。

二、逐项判定结果

判定时间:2026-09-19 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:xueag.com

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 未声明 DeepSeekBot、QwenBot
A2 关键内容不依赖 JS 渲染 可抓取性 通过 源码中可见正文 3609 字符,h1 1 个
A3 有 sitemap 且内容有效 可抓取性 通过 sitemap.xml HTTP 200,含 url 节点
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 通过 协议 HTTPS,首页 HTTP 200,响应 390 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 35 字符,description 82 字符
B2 结构化数据(JSON-LD) 可理解性 未通过 JSON-LD 块 0 个,WebSite 无,Organization 无
B3 标题层级语义化 可理解性 通过 h1 1 个,h2 14 个
B4 有 llms.txt(纯文本) 可理解性 未通过 llms.txt 返回 HTTP 404
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:农学网(学农网) - 农业知识_农业政策_智慧农业_种植技术_养殖技术 欢迎访问农学网(学农网) · 知农惠农兴农 收藏…
C2 存在可摘录结构块 可引用性 通过 列表/表格标签 19 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 288 处
C4 有明确更新时间 可引用性 未通过 页面可见更新时间为 无
C5 有第三方引用证据 可引用性 未通过 第三方平台引用 无

三、优先修复的三件事

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:未声明 DeepSeekBot、QwenBot
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。

2. B2 · 结构化数据(JSON-LD)

  • 现状:JSON-LD 块 0 个,WebSite 无,Organization 无
  • 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。

3. B4 · 有 llms.txt(纯文本)

  • 现状:llms.txt 返回 HTTP 404
  • 怎么改:在站点根目录放置纯文本 llms.txt,写明定位、核心页面与可引用结论;注意别让服务器把首页 HTML 返回在这个路径上。

四、重点问题分析

robots.txt 未对国内 AI 爬虫显式放行

站点当前 robots.txt 未声明 DeepSeekBot、QwenBot。爬虫匹配规则时只认第一条命中的 User-agent 段,若这些 UA 落到 User-agent: * 的兜底规则下,一旦兜底段含 Disallow,抓取就会被拦。对 AI 引用的实际后果是:内容再优质,也不会进入这两个引擎的候选池,等于在中文问答场景里主动缺席。修改要点是在 User-agent: * 之前,为每个需要放行的 AI 爬虫单独写一段 User-agent: DeepSeekBot + Allow: /,逐个确认后再保留兜底规则。

结构化数据完全缺失

检测显示 JSON-LD 块 0 个,WebSite 与 Organization 均无。这意味着 AI 无法从机器可读层面确认「这是哪个站点、由谁运营、页面属于什么类型」,只能靠正文文本猜测。后果是实体归属模糊,站点在生成式答案里难以被稳定指认为来源,多页面内容也缺少互相关联的语义锚点。修改要点是先在首页注入 WebSite(含站点名、URL)与 Organization(含主体名称、备案主体)两段 JSON-LD;再对文章页补 Article(headline、datePublished、dateModified、author),问答类页面补 FAQPage。字段值需与页面可见内容一致,避免出现标注与正文不符。

llms.txt 缺失

访问 llms.txt 返回 HTTP 404,站点没有面向大模型的纯文本说明文件。当前 AI 只能逐页抓取正文自行归纳站点定位,效率低且容易误判栏目边界。修改要点是在站点根目录放置纯文本 llms.txt,用简短段落写明站点定位(农业知识、农业政策、智慧农业、种植与养殖技术)、核心栏目入口 URL,以及若干条可被直接引用的结论性表述。需注意服务器配置,确保该路径返回 text/plain 内容,而不是把首页 HTML 兜底返回,否则等同于无效。

页面缺少可见更新时间

检测未在页面找到可见的更新时间。农业政策与种植养殖技术属于强时效内容,AI 在组织答案时倾向于选择能判断新鲜度的来源;没有日期,内容可能被当作陈旧信息降权,或无法进入「最新政策」类问题的候选。修改要点是在文章页显著位置(标题下方或正文开头)标注「更新于 YYYY-MM-DD」,并与 Article 结构化数据中的 dateModified 保持一致,避免页面标注与标注数据互相矛盾。

缺少第三方引用证据

检测未发现第三方平台对站点的引用。AI 在交叉验证时依赖外部信号,完全没有外部引用意味着站点结论缺少旁证,被采信的概率下降。修改要点是把站内已有的一手数据(正文中 288 处具体数字是现成素材)整理成可独立引用的结论块,投稿到知乎、CSDN 等平台,并在文中保留回链,逐步积累可被检索到的外部引用记录。

五、行动建议

  1. 修改站点根目录 robots.txt:在 User-agent: * 段之前,为 DeepSeekBot、QwenBot 各新增一段 User-agent: <爬虫名>Allow: /,保存后逐个 UA 验证匹配顺序,确认兜底规则不会先命中。

  2. 在首页 <head> 中注入两段 JSON-LD:一段 @type: WebSite,填 name 与 url;一段 @type: Organization,填站点主体名称与备案主体。字段值必须与页面可见信息一致。

  3. 在文章模板中补充 @type: Article 的 JSON-LD,至少包含 headline、datePublished、dateModified、author;问答类模板补 @type: FAQPage。同时把 dateModified 同步为页面可见的「更新于 YYYY-MM-DD」。

  4. 在站点根目录新建 llms.txt,纯文本格式,写明站点定位、核心栏目 URL 与可引用结论;随后检查服务器配置,确认该路径返回 text/plain 而非首页 HTML。

  5. 在文章页标题下方或正文开头固定输出「更新于 YYYY-MM-DD」,并抽取站内已有具体数字整理为独立结论块,投稿至知乎、CSDN 等平台并保留回链,作为第三方引用证据的起点。

六、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 xueag.com 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C1/C3/C5 三项由规则推断,标准中已标注「需人工确认」;数据是 2026-09-19 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 390 ms 42609 B
robots.txt 200 308 ms 2149 B
sitemap.xml 200 368 ms 399 B
llms.txt 404 452 ms — B
不存在路径探测 404 380 ms — B

七、如何引用本报告

安企 GEO《xueag.com GEO 就绪度检测报告》(2026-09-19):该站按《GEO 就绪度标准 v1.0》15 项判定通过 10 项,得分 10/15,判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:xueag.com GEO 就绪度检测报告
  • 检测日期:2026-09-19
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:xueag.com GEO 就绪度检测报告,安企 GEO,2026