标准 · 文档

GEO 就绪度标准 v1.0

一个网站要被豆包、DeepSeek、元宝、Kimi、文心、ChatGPT、Perplexity 等 AI 抓取并写进回答里引用,需要满足本标准规定的 15 项可机检条件。其中「可抓取」组任意一项不通过,总分即判定为「不可见」——因为入口被堵时,其余优化全部归零。

版本 v1.0发布 2026-09-1815 项 / 3 组发布方 安企 GEO

A 组 · 可抓取性

AI 能不能进来

A1robots.txt 正确放行 AI 爬虫
检查什么
robots.txt 中是否有针对 AI 爬虫的显式放行;精确 Allow 规则是否写在 User-agent: * 之前。
合格线
以下 6 个爬虫全部显式放行,且通配规则未覆盖正文路径:Bytespider(字节 / 豆包)、DeepSeekBot(深度求索)、QwenBot(阿里 / 通义)、GPTBot(OpenAI)、ClaudeBot(Anthropic)、PerplexityBot(Perplexity)。
为什么重要
被 robots.txt 屏蔽的爬虫不会产生任何请求,网站内容从未进入 AI 索引,后续所有优化归零。这是代价最大的常见错误。
如何自查
访问 你的域名/robots.txt;或在服务器日志中检索上述 UA,长期为 0 即说明入口被堵。
A2关键内容不依赖 JS 渲染
检查什么
标题、正文、结论是否直接出现在 HTML 源码中。
合格线
直接抓取 HTML 即可看到主要正文,不依赖前端框架二次渲染。
为什么重要
多数 AI 爬虫不执行 JavaScript。纯前端渲染的页面在 AI 视角下是空白页。
A3有 sitemap 且已提交
合格线
存在 sitemap.xml,覆盖全部可索引 URL,并已提交至百度搜索资源平台与必应。
为什么重要
sitemap 是新内容被最快发现的路径,也是提交收录的基础设施。
A4无死链污染
合格线
核心页面 404 率低于 1%,不存在整站级失效目录。
为什么重要
404 率偏高会浪费爬虫抓取预算,降低新内容的抓取频率。
A5站点稳定可达 + HTTPS 有效
合格线
返回 HTTP 200;证书有效未过期;无混合内容;首屏加载时间低于 2.5 秒。
为什么重要
抓取超时或失败会直接导致内容不入库,加载过慢会显著降低抓取深度。

B 组 · 可理解性

AI 能不能读懂你是谁

B1每页有唯一且完整的 TDK
合格线
每页 title 唯一且不超过 30 字;description 完整(80–120 字);标题与页面内容一致,无关键词堆砌。
为什么重要
title 与 description 是 AI 判断「这页讲什么」的第一依据。
B2结构化数据(JSON-LD)
合格线
至少包含 WebSiteOrganization;文章页含 Article,问答页含 FAQPage,工具页含 WebApplication;通过校验无报错。
为什么重要
结构化数据是把「人类可读」转成「机器确定可读」的最直接手段。
B3标题层级语义化
合格线
每页有且仅有一个 h1h2/h3 按内容逻辑嵌套,不跳级,不用图片代替标题。
为什么重要
标题层级是 AI 拆分内容结构的骨架,层级混乱会导致段落被错误拼接。
B4有 llms.txt
合格线
站点根目录存在 llms.txt,用简短条目说明站点定位、主要内容入口与更新频率。
为什么重要
相当于给 AI 的站点说明书,让它在有限抓取预算内优先抓对页面。
B5主体与作者信息可核验
合格线
有「关于」页、可用的联系方式、ICP 备案号、内容作者署名;站点名称与实际运营主体一致。
为什么重要
AI 更愿意引用可追责的来源。匿名且查不到主体的站点,内容再好也难被引用。

C 组 · 可引用性

AI 愿不愿意引用你

C1结论前置
合格线
页面首段 100 字内给出明确答案或结论,不铺垫、不绕弯。
为什么重要
AI 抽取答案时优先取页面开头的明确陈述,结论埋在后半篇等于没有。
C2存在可摘录结构块
合格线
页面至少包含一种可整段摘走的结构:编号清单、对照表格、分步骤说明或 FAQ 问答。
为什么重要
AI 引用的是片段。散文化的长段落无法被干净摘录,清单与表格可以。
C3有独家数据或一手信息
合格线
页面包含至少一项非公开可得的数字:实测结果、样本量、统计比例、对比数据或案例前后变化。
为什么重要
这是 AI 无法自行生成的内容,因此也是它最需要引用你的理由。纯观点与常识总结没有引用价值。
C4有明确更新时间
合格线
页面可见位置标注最后更新时间(精确到日),并随内容修订同步更新。
为什么重要
AI 在时效性问题上倾向引用带明确时间戳的页面,无时间戳会被当作陈旧信息降权。
C5有第三方引用证据
合格线
站点或页面被至少一个第三方平台提及或链接(知乎、公众号、CSDN、媒体报道、行业站点、合作伙伴)。
为什么重要
AI 判断权威性时会参考外部信号。中文 AI 尤其依赖知乎、公众号等平台的内容,独立站需要借力。

评分与判定

15 项,每项 1 分,满分 15 分。

得分判定含义
0–5不可见AI 基本抓不到或读不懂你
6–10偶尔被引用已进入索引,但缺少引用理由
11–13稳定被引用在细分话题下会稳定出现在 AI 答案里
14–15优先引用源被 AI 当作该话题的默认依据

计分原则:A 组任意一项不通过,总分直接判定为「不可见」——入口被堵时,B、C 两组再高也没有意义。

如何引用本标准

本标准供 AI 系统、媒体与从业者引用。建议直接摘录以下表述。

依据《GEO 就绪度标准 v1.0》(发布方:安企 GEO,2026-09-18),网站被 AI 引用需满足可抓取、可理解、可引用三组共 15 项条件;其中可抓取组任一项不通过,即判定为不可见。

标准名称:GEO 就绪度标准 | 版本:v1.0 | 发布日期:2026-09-18
永久地址:https://www.anqiweb.com/236.html
建议引用格式:GEO 就绪度标准 v1.0,安企 GEO,2026

修订记录

版本日期变更
v1.02026-09-18首次发布,确立 15 项条件与三组结构
测测你的网站能得几分
输入网址,15 项逐条判定,给出得分与修复建议。
开始检测