检测结论:
www.tianyundazl.cn在《GEO 就绪度标准 v1.0》的 15 项判定中通过 7 项,得分 7 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
太原天运达汽车租赁有限公司站点当前的 GEO 就绪度为 7 分(满分 15),判定等级为「不可见」。也就是说,主流 AI 搜索与问答产品在多数情况下抓不到、读不懂、也不会优先引用这个站的内容。最致命的缺口集中在「可抓取性」与「可理解性」两组:robots.txt 未对 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 等国内 AI 爬虫作出放行声明,站点仍以 HTTP 协议提供服务,sitemap 虽返回 200 但未在 robots.txt 中声明,源码中 h1 为 0 个、JSON-LD 块为 0 个、llms.txt 返回 404。可引用性一组相对健康,结论前置、可摘录结构块、具体数字与更新时间均已通过,唯一失分在缺少第三方引用证据。若优先修复 A1、A5、B2、B3 四项,即可把最关键的抓取与理解障碍清除,修完可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-21 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.tianyundazl.cn
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 1967 字符,h1 0 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 未通过 | sitemap.xml HTTP 200 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 未通过 | 协议 HTTP,首页 HTTP 200,响应 144 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 32 字符,description 80 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 0 个,h2 4 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回 HTTP 404 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:太原租车-太原租车公司-会议租车包车-太原天运达汽车租赁有限公司 联系我们 / 在线留言 / 网站首页 公司简介 企业租… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 4 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 230 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/contact.html |
200 | title 16 / desc 0 | 551 字 | 0 | 有 | 18 |
/p/4 |
200 | title 16 / desc 0 | 469 字 | 0 | 有 | 39 |
/a/1 |
200 | title 16 / desc 4 | 1027 字 | 0 | 有 | 30 |
小结:抽样的 3 个内页中,TDK 完整 1 个、含结构化数据 0 个、标注更新时间 3 个。
内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。国外组建议补齐(做外贸时必需)。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# 【1】AI 爬虫(下面按 国内 / 国外核心 / 国外建议 / 用途令牌 分组,逐个显式声明)
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
# ① 国内 AI 爬虫(中文 AI 流量的入口,硬门槛)
User-agent: Bytespider
Allow: /
# 对应:豆包
User-agent: DeepSeekBot
Allow: /
# 对应:DeepSeek
User-agent: QwenBot
Allow: /
# 对应:通义千问 / 元宝
User-agent: KimiBot
Allow: /
# 对应:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应:Kimi 搜索
# ② 国外 AI 爬虫 · 核心(外贸站点最关键,硬门槛)
User-agent: GPTBot
Allow: /
# 对应:ChatGPT(训练) # 你已声明过,这里保持一致
User-agent: OAI-SearchBot
Allow: /
# 对应:ChatGPT(搜索索引) # 你已声明过,这里保持一致
User-agent: ClaudeBot
Allow: /
# 对应:Claude(训练) # 你已声明过,这里保持一致
User-agent: Claude-SearchBot
Allow: /
# 对应:Claude(搜索索引) # 你已声明过,这里保持一致
User-agent: PerplexityBot
Allow: /
# 对应:Perplexity # 你已声明过,这里保持一致
User-agent: meta-externalagent
Allow: /
# 对应:Meta AI # 你已声明过,这里保持一致
# ③ 国外 AI 爬虫 · 建议(覆盖越全越好,不作硬门槛)
User-agent: ChatGPT-User
Allow: /
# 对应:ChatGPT(用户触发)
User-agent: Claude-User
Allow: /
# 对应:Claude(用户触发)
User-agent: Perplexity-User
Allow: /
# 对应:Perplexity(用户触发)
User-agent: Google-CloudVertexBot
Allow: /
# 对应:Google Vertex AI
User-agent: meta-externalfetcher
Allow: /
# 对应:Meta(用户触发)
User-agent: FacebookBot
Allow: /
# 对应:Meta / Facebook
User-agent: Amazonbot
Allow: /
# 对应:Amazon / Alexa
User-agent: Applebot
Allow: /
# 对应:Apple Siri / Spotlight
User-agent: CCBot
Allow: /
# 对应:Common Crawl(众多模型的训练语料)
User-agent: DuckAssistBot
Allow: /
# 对应:DuckDuckGo AI
User-agent: MistralAI-User
Allow: /
# 对应:Mistral(用户触发)
# ④ AI 用途令牌(不会单独来抓,只在 robots.txt 生效)
# Allow 表示你授权 AI 使用你的内容;要保留内容可改成 Disallow。
User-agent: Google-Extended
Allow: /
# 对应:Gemini / Vertex AI
User-agent: Applebot-Extended
Allow: /
# 对应:Apple Intelligence
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent
# 【2】通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# 【3】声明站点地图
Sitemap: https://www.tianyundazl.cn/sitemap.xml
本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 豆包、DeepSeek、通义千问 / 元宝、Kimi(模型训练)、Kimi 搜索)。
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 1967 字符,h1 0 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
可直接复制的修复
若源码里几乎没有正文,三种改法(任选):
- Next.js:
getServerSideProps/ Server Component 输出内容; - Nuxt:
ssr: true(默认)并把关键内容放在服务端; - 静态站:构建时预渲染(
nuxt generate/next export/ 或纯 HTML)。 同时给不执行 JS 的客户端留一份<noscript>说明。
# 先用这条确认正文是否出现在源码里(AI 爬虫大多不执行 JS)
curl -s https://www.tianyundazl.cn/ | grep -c "<h1"
curl -s https://www.tianyundazl.cn/ | wc -c
3. A3 · 有 sitemap 且内容有效
- 现状:sitemap.xml HTTP 200
- 怎么改:生成 sitemap(XML 或纯文本均可),在 robots.txt 中用 Sitemap: 声明地址——站内页面多时优先做 sitemap 索引,别让爬虫只靠一条条链接发现页面。
可直接复制的修复
放到:站点根目录 /sitemap.xml,并在 robots.txt 里加一行 Sitemap: https://www.tianyundazl.cn/sitemap.xml。文章量大的站建议用 sitemapindex 分片
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.tianyundazl.cn/</loc>
<lastmod>2026-09-19</lastmod>
<changefreq>daily</changefreq>
<priority>1.0</priority>
</url>
</urlset>
四、重点问题分析
A1 robots.txt 未放行国内 AI 爬虫
站点 robots.txt 中未对 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 这五个国内 AI 爬虫作出声明。爬虫匹配规则是「只认第一条命中的 User-agent」,如果 User-agent: * 写在前面并带有任何限制,后续针对具体爬虫的规则就不会生效;而当前这些爬虫根本没有被单独列出,等于把是否抓取交给默认策略去猜。后果是字节、DeepSeek、通义、Kimi 等产品的检索侧可能直接跳过本站,站内 230 处具体数字、可摘录结构块这些已有优势无法进入 AI 的候选池。修改要点:在 robots.txt 顶部、User-agent: * 之前,逐个写出这些爬虫的 User-agent 与 Allow: /,并补上 Sitemap: 声明。
A5 站点仍为 HTTP,未启用 HTTPS
检测显示协议为 HTTP,首页返回 200、响应 144 ms。站点本身可达且速度正常,但缺少 HTTPS。对 AI 爬虫而言,明文 HTTP 的页面在多数抓取管线中会被降权或直接跳过,尤其是需要回传引用来源的场景,非加密来源的可信度更低。同时,浏览器与部分中间层对 HTTP 站点的抓取限制也在收紧。修改要点:为域名部署有效证书,将 HTTP 全量 301 跳转到 HTTPS,并确认跳转后首页、sitemap、robots.txt 均通过 HTTPS 可访问。
B2 缺少 JSON-LD 结构化数据
源码中 JSON-LD 块为 0 个,WebSite、Organization 均未声明。这直接导致 AI 无法确认「这个站是谁、做什么、属于哪个实体」,在需要给出机构名称、服务范围、联系方式时只能靠正文文本猜测。对于一家汽车租赁公司,实体信息不明确会显著降低被引用的概率。修改要点:在首页 <head> 中至少补 WebSite 与 Organization 两个 JSON-LD 块,填入公司全称、logo、联系方式与站内主页地址;服务页可补 Service,问答类内容补 FAQPage,文章页补 Article。
B3 标题层级缺失,h1 为 0 个
源码中可见正文 1967 字符,但 h1 为 0 个,h2 有 4 个。正文内容本身存在,但缺少唯一的 h1 意味着 AI 无法判断这一页的主题是什么,h2 的四个层级也就失去了挂靠的根节点。这会让页面在「这段内容在回答什么问题」的判断上失分,即使内容质量不错,也难以被精准匹配到用户提问。修改要点:每页保留且仅保留一个 h1,用 h2/h3 组织下属层级,不要用加粗的 div 冒充标题,也不要为了视觉效果跳过层级。
C5 缺少第三方引用证据
正文可见区没有指向第三方平台的引用链接、没有出处标注、也没有 sameAs 站外身份声明。C1 到 C4 已经通过,说明站内内容具备被引用的底子,但 AI 在交叉验证一个说法时,会优先采信有站外来源或身份互证的内容。缺少这一层,站内 230 处具体数字只能算「自称」,可信度打折。修改要点:把一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台并在正文链回;同时在 JSON-LD 的 sameAs 中声明站外身份主页,正文中标注「来源:××」。
五、行动建议
修改根目录
robots.txt:在文件最顶部、User-agent: *之前,依次写入User-agent: Bytespider、User-agent: DeepSeekBot、User-agent: QwenBot、User-agent: KimiBot、User-agent: Kimi-SearchBot,每条后面各跟一行Allow: /,最后补一行Sitemap: https://www.tianyundazl.cn/sitemap.xml。部署 HTTPS:为 www.tianyundazl.cn 申请并安装有效证书,配置 HTTP 到 HTTPS 的全站 301 跳转,确认
robots.txt、sitemap.xml、首页在 HTTPS 下均返回 200,且 sitemap 内所有 URL 使用 https 前缀。在首页
<head>中插入 JSON-LD:一个WebSite块(含站点名称与 url),一个Organization块(含公司全称、logo、联系方式、sameAs 指向知乎或 CSDN 等站外主页)。服务页补Service,问答页补FAQPage,文章页补Article。修正标题层级:在页面模板中为每页正文顶部补一个唯一的
<h1>,内容与该页 title 主题一致;现有 4 个 h2 保留并检查是否从属于该 h1,不要用加粗 div 代替标题标签。在站点根目录新建纯文本
llms.txt:写明站点定位(太原汽车租赁)、核心页面地址(首页、服务页、联系方式),以及 3 到 5 条可被直接引用的结论。确认该路径返回纯文本内容,不要被服务器配置成返回首页 HTML。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.tianyundazl.cn的页面。检索方式:Bing RSS,查询式
"www.tianyundazl.cn" -site:www.tianyundazl.cn(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.tianyundazl.cn重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-21 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
- 取数说明:仅支持 HTTP(未启用 HTTPS)。抓取遇到 WAF 拦截时会依次改用浏览器 UA 与 HTTP/2 重试,所有方式都拿不到首页时代码会拒绝出报告,不会把「读不到」判成「网站不行」
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 144 ms | 32619 B |
| robots.txt | 200 | 208 ms | 116 B |
| sitemap.xml | 200 | 633 ms | 35 B |
| llms.txt | 404 | 161 ms | — B |
| 不存在路径探测 | 404 | 379 ms | — B |
八、如何引用本报告
安企 GEO《www.tianyundazl.cn GEO 就绪度检测报告》(2026-09-21):该站按《GEO 就绪度标准 v1.0》15 项判定通过 7 项,得分 7 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.tianyundazl.cn GEO 就绪度检测报告
- 检测日期:2026-09-21
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.tianyundazl.cn GEO 就绪度检测报告,安企 GEO,2026