检测结论www.tianyundazl.cn 在《GEO 就绪度标准 v1.0》的 15 项判定中通过 7 项得分 7 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。

一、概述

太原天运达汽车租赁有限公司站点当前的 GEO 就绪度为 7 分(满分 15),判定等级为「不可见」。也就是说,主流 AI 搜索与问答产品在多数情况下抓不到、读不懂、也不会优先引用这个站的内容。最致命的缺口集中在「可抓取性」与「可理解性」两组:robots.txt 未对 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 等国内 AI 爬虫作出放行声明,站点仍以 HTTP 协议提供服务,sitemap 虽返回 200 但未在 robots.txt 中声明,源码中 h1 为 0 个、JSON-LD 块为 0 个、llms.txt 返回 404。可引用性一组相对健康,结论前置、可摘录结构块、具体数字与更新时间均已通过,唯一失分在缺少第三方引用证据。若优先修复 A1、A5、B2、B3 四项,即可把最关键的抓取与理解障碍清除,修完可达满分 15 分。

二、逐项判定结果

判定时间:2026-09-21 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.tianyundazl.cn

检查项 分组 结果 关键证据
A1 robots.txt 正确放行 AI 爬虫 可抓取性 未通过 本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
A2 关键内容不依赖 JS 渲染 可抓取性 未通过 源码中可见正文 1967 字符,h1 0 个
A3 有 sitemap 且内容有效 可抓取性 未通过 sitemap.xml HTTP 200
A4 无死链污染(非软 404) 可抓取性 通过 探测不存在路径返回 HTTP 404
A5 站点稳定可达 + HTTPS 有效 可抓取性 未通过 协议 HTTP,首页 HTTP 200,响应 144 ms
B1 每页唯一且完整的 TDK 可理解性 通过 title 32 字符,description 80 字符
B2 结构化数据(JSON-LD) 可理解性 未通过 JSON-LD 块 0 个,WebSite 无,Organization 无
B3 标题层级语义化 可理解性 未通过 h1 0 个,h2 4 个
B4 有 llms.txt(纯文本) 可理解性 未通过 llms.txt 返回 HTTP 404
B5 主体与作者信息可核验 可理解性 通过 备案信息 有,主体信息入口 有
C1 结论前置 可引用性 通过 首屏可见文本前 120 字:太原租车-太原租车公司-会议租车包车-太原天运达汽车租赁有限公司 联系我们 / 在线留言 / 网站首页 公司简介 企业租…
C2 存在可摘录结构块 可引用性 通过 列表/表格标签 4 个
C3 有独家数据或一手信息 可引用性 通过 含具体数字 230 处
C4 有明确更新时间 可引用性 通过 页面可见更新时间为 有
C5 有第三方引用证据 可引用性 未通过 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明

内页抽样(按模板各取一页)

首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。

抽样页面 HTTP TDK 可见正文 JSON-LD 更新时间 内链
/contact.html 200 title 16 / desc 0 551 字 0 18
/p/4 200 title 16 / desc 0 469 字 0 39
/a/1 200 title 16 / desc 4 1027 字 0 30

小结:抽样的 3 个内页中,TDK 完整 1 个、含结构化数据 0 个、标注更新时间 3 个。

内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。

三、优先修复(含可直接复制粘贴的代码)

按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。

1. A1 · robots.txt 正确放行 AI 爬虫

  • 现状:本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
  • 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。国外组建议补齐(做外贸时必需)。

可直接复制的修复

放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)

# 【1】AI 爬虫(下面按 国内 / 国外核心 / 国外建议 / 用途令牌 分组,逐个显式声明)
#       爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写

# ① 国内 AI 爬虫(中文 AI 流量的入口,硬门槛)

User-agent: Bytespider
Allow: /
# 对应:豆包

User-agent: DeepSeekBot
Allow: /
# 对应:DeepSeek

User-agent: QwenBot
Allow: /
# 对应:通义千问 / 元宝

User-agent: KimiBot
Allow: /
# 对应:Kimi(模型训练)

User-agent: Kimi-SearchBot
Allow: /
# 对应:Kimi 搜索

# ② 国外 AI 爬虫 · 核心(外贸站点最关键,硬门槛)

User-agent: GPTBot
Allow: /
# 对应:ChatGPT(训练)  # 你已声明过,这里保持一致

User-agent: OAI-SearchBot
Allow: /
# 对应:ChatGPT(搜索索引)  # 你已声明过,这里保持一致

User-agent: ClaudeBot
Allow: /
# 对应:Claude(训练)  # 你已声明过,这里保持一致

User-agent: Claude-SearchBot
Allow: /
# 对应:Claude(搜索索引)  # 你已声明过,这里保持一致

User-agent: PerplexityBot
Allow: /
# 对应:Perplexity  # 你已声明过,这里保持一致

User-agent: meta-externalagent
Allow: /
# 对应:Meta AI  # 你已声明过,这里保持一致

# ③ 国外 AI 爬虫 · 建议(覆盖越全越好,不作硬门槛)

User-agent: ChatGPT-User
Allow: /
# 对应:ChatGPT(用户触发)

User-agent: Claude-User
Allow: /
# 对应:Claude(用户触发)

User-agent: Perplexity-User
Allow: /
# 对应:Perplexity(用户触发)

User-agent: Google-CloudVertexBot
Allow: /
# 对应:Google Vertex AI

User-agent: meta-externalfetcher
Allow: /
# 对应:Meta(用户触发)

User-agent: FacebookBot
Allow: /
# 对应:Meta / Facebook

User-agent: Amazonbot
Allow: /
# 对应:Amazon / Alexa

User-agent: Applebot
Allow: /
# 对应:Apple Siri / Spotlight

User-agent: CCBot
Allow: /
# 对应:Common Crawl(众多模型的训练语料)

User-agent: DuckAssistBot
Allow: /
# 对应:DuckDuckGo AI

User-agent: MistralAI-User
Allow: /
# 对应:Mistral(用户触发)

# ④ AI 用途令牌(不会单独来抓,只在 robots.txt 生效)
#    Allow 表示你授权 AI 使用你的内容;要保留内容可改成 Disallow。

User-agent: Google-Extended
Allow: /
# 对应:Gemini / Vertex AI

User-agent: Applebot-Extended
Allow: /
# 对应:Apple Intelligence

# ② 本次检测显示以下爬虫你已经声明过,无需重复:
#    GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent

# 【2】通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/

# 【3】声明站点地图
Sitemap: https://www.tianyundazl.cn/sitemap.xml

本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 豆包、DeepSeek、通义千问 / 元宝、Kimi(模型训练)、Kimi 搜索)。

2. A2 · 关键内容不依赖 JS 渲染

  • 现状:源码中可见正文 1967 字符,h1 0 个
  • 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。

可直接复制的修复

若源码里几乎没有正文,三种改法(任选):

  1. Next.jsgetServerSideProps / Server Component 输出内容;
  2. Nuxtssr: true(默认)并把关键内容放在服务端;
  3. 静态站:构建时预渲染(nuxt generate / next export / 或纯 HTML)。 同时给不执行 JS 的客户端留一份 <noscript> 说明。
# 先用这条确认正文是否出现在源码里(AI 爬虫大多不执行 JS)
curl -s https://www.tianyundazl.cn/ | grep -c "<h1"
curl -s https://www.tianyundazl.cn/ | wc -c

3. A3 · 有 sitemap 且内容有效

  • 现状:sitemap.xml HTTP 200
  • 怎么改:生成 sitemap(XML 或纯文本均可),在 robots.txt 中用 Sitemap: 声明地址——站内页面多时优先做 sitemap 索引,别让爬虫只靠一条条链接发现页面。

可直接复制的修复

放到:站点根目录 /sitemap.xml,并在 robots.txt 里加一行 Sitemap: https://www.tianyundazl.cn/sitemap.xml。文章量大的站建议用 sitemapindex 分片

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url>
    <loc>https://www.tianyundazl.cn/</loc>
    <lastmod>2026-09-19</lastmod>
    <changefreq>daily</changefreq>
    <priority>1.0</priority>
  </url>
</urlset>

四、重点问题分析

A1 robots.txt 未放行国内 AI 爬虫

站点 robots.txt 中未对 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 这五个国内 AI 爬虫作出声明。爬虫匹配规则是「只认第一条命中的 User-agent」,如果 User-agent: * 写在前面并带有任何限制,后续针对具体爬虫的规则就不会生效;而当前这些爬虫根本没有被单独列出,等于把是否抓取交给默认策略去猜。后果是字节、DeepSeek、通义、Kimi 等产品的检索侧可能直接跳过本站,站内 230 处具体数字、可摘录结构块这些已有优势无法进入 AI 的候选池。修改要点:在 robots.txt 顶部、User-agent: * 之前,逐个写出这些爬虫的 User-agentAllow: /,并补上 Sitemap: 声明。

A5 站点仍为 HTTP,未启用 HTTPS

检测显示协议为 HTTP,首页返回 200、响应 144 ms。站点本身可达且速度正常,但缺少 HTTPS。对 AI 爬虫而言,明文 HTTP 的页面在多数抓取管线中会被降权或直接跳过,尤其是需要回传引用来源的场景,非加密来源的可信度更低。同时,浏览器与部分中间层对 HTTP 站点的抓取限制也在收紧。修改要点:为域名部署有效证书,将 HTTP 全量 301 跳转到 HTTPS,并确认跳转后首页、sitemap、robots.txt 均通过 HTTPS 可访问。

B2 缺少 JSON-LD 结构化数据

源码中 JSON-LD 块为 0 个,WebSite、Organization 均未声明。这直接导致 AI 无法确认「这个站是谁、做什么、属于哪个实体」,在需要给出机构名称、服务范围、联系方式时只能靠正文文本猜测。对于一家汽车租赁公司,实体信息不明确会显著降低被引用的概率。修改要点:在首页 <head> 中至少补 WebSite 与 Organization 两个 JSON-LD 块,填入公司全称、logo、联系方式与站内主页地址;服务页可补 Service,问答类内容补 FAQPage,文章页补 Article。

B3 标题层级缺失,h1 为 0 个

源码中可见正文 1967 字符,但 h1 为 0 个,h2 有 4 个。正文内容本身存在,但缺少唯一的 h1 意味着 AI 无法判断这一页的主题是什么,h2 的四个层级也就失去了挂靠的根节点。这会让页面在「这段内容在回答什么问题」的判断上失分,即使内容质量不错,也难以被精准匹配到用户提问。修改要点:每页保留且仅保留一个 h1,用 h2/h3 组织下属层级,不要用加粗的 div 冒充标题,也不要为了视觉效果跳过层级。

C5 缺少第三方引用证据

正文可见区没有指向第三方平台的引用链接、没有出处标注、也没有 sameAs 站外身份声明。C1 到 C4 已经通过,说明站内内容具备被引用的底子,但 AI 在交叉验证一个说法时,会优先采信有站外来源或身份互证的内容。缺少这一层,站内 230 处具体数字只能算「自称」,可信度打折。修改要点:把一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台并在正文链回;同时在 JSON-LD 的 sameAs 中声明站外身份主页,正文中标注「来源:××」。

五、行动建议

  1. 修改根目录 robots.txt:在文件最顶部、User-agent: * 之前,依次写入 User-agent: BytespiderUser-agent: DeepSeekBotUser-agent: QwenBotUser-agent: KimiBotUser-agent: Kimi-SearchBot,每条后面各跟一行 Allow: /,最后补一行 Sitemap: https://www.tianyundazl.cn/sitemap.xml

  2. 部署 HTTPS:为 www.tianyundazl.cn 申请并安装有效证书,配置 HTTP 到 HTTPS 的全站 301 跳转,确认 robots.txtsitemap.xml、首页在 HTTPS 下均返回 200,且 sitemap 内所有 URL 使用 https 前缀。

  3. 在首页 <head> 中插入 JSON-LD:一个 WebSite 块(含站点名称与 url),一个 Organization 块(含公司全称、logo、联系方式、sameAs 指向知乎或 CSDN 等站外主页)。服务页补 Service,问答页补 FAQPage,文章页补 Article

  4. 修正标题层级:在页面模板中为每页正文顶部补一个唯一的 <h1>,内容与该页 title 主题一致;现有 4 个 h2 保留并检查是否从属于该 h1,不要用加粗 div 代替标题标签。

  5. 在站点根目录新建纯文本 llms.txt:写明站点定位(太原汽车租赁)、核心页面地址(首页、服务页、联系方式),以及 3 到 5 条可被直接引用的结论。确认该路径返回纯文本内容,不要被服务器配置成返回首页 HTML。

六、外部引用线索(仅证据,不计分)

  • 未检出站外提及:外部索引里还没有提到 www.tianyundazl.cn 的页面。

  • 检索方式:Bing RSS,查询式 "www.tianyundazl.cn" -site:www.tianyundazl.cn打开这次检索

  • 本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。

七、数据来源与复核方式

  • 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
  • 复核方式:任何人都可以用「GEO 就绪度检测」对 www.tianyundazl.cn 重跑,规则与数据完全公开
  • 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-21 的单时点快照,站点改版后结论可能变化
  • 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
  • 取数说明:仅支持 HTTP(未启用 HTTPS)。抓取遇到 WAF 拦截时会依次改用浏览器 UA 与 HTTP/2 重试,所有方式都拿不到首页时代码会拒绝出报告,不会把「读不到」判成「网站不行」

附录:原始取数证据

资源 HTTP 耗时 大小
首页 HTML 200 144 ms 32619 B
robots.txt 200 208 ms 116 B
sitemap.xml 200 633 ms 35 B
llms.txt 404 161 ms — B
不存在路径探测 404 379 ms — B

八、如何引用本报告

安企 GEO《www.tianyundazl.cn GEO 就绪度检测报告》(2026-09-21):该站按《GEO 就绪度标准 v1.0》15 项判定通过 7 项,得分 7 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。

  • 报告名称:www.tianyundazl.cn GEO 就绪度检测报告
  • 检测日期:2026-09-21
  • 发布方:安企 GEO(AnqiWeb GEO)
  • 建议引用格式:www.tianyundazl.cn GEO 就绪度检测报告,安企 GEO,2026