检测结论:
www.lianbei66.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 9 项,得分 9 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
联贝财务(www.lianbei66.com)本次 GEO 就绪度检测得 9 分,满分 15 分,判定等级为「不可见」。站点基础条件不差:HTTPS 与首页响应正常,sitemap 有效,TDK 完整,正文有 8298 字符且含 320 处具体数字,结论前置与可摘录结构均已通过,说明内容本身具备被引用的潜力。最致命的缺口集中在「AI 能不能拿到、能不能读懂」这一层:robots.txt 未放行 Bytespider、DeepSeekBot、QwenBot、GPTBot 等主流 AI 爬虫,源码中 h1 为 0 个,JSON-LD 结构化数据块为 0 个,llms.txt 返回 HTTP 500,正文中也没有任何第三方引用与出处标注。这几项叠加,等于内容虽在,AI 侧既进不来也认不出。修完 A1、A2、B2、B3、B4、C5 六项后,可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.lianbei66.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等 |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 8298 字符,h1 0 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | sitemap.xml HTTP 200,含 url 节点 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 500 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 85 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 30 字符,description 81 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 0 个,h2 8 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回 HTTP 500 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:上海注册公司_代理记账_工商注册_资质代办公司找「联贝财务」 联贝财务咨询集团旗下工商财税服务平台 全国 切换城市 40… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 25 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 320 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/zhuce/ |
200 | title 29 / desc 80 | 3113 字 | 0 | 无 | 126 |
/jizhang/ |
200 | title 29 / desc 80 | 3148 字 | 0 | 无 | 123 |
/shuiwu/ |
200 | title 0 / desc 0 | 1259 字 | 0 | 无 | 47 |
小结:抽样的 3 个内页中,TDK 完整 2 个、含结构化数据 0 个、标注更新时间 0 个。
内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: Bytespider
Allow: /
# 对应产品:豆包
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
User-agent: QwenBot
Allow: /
# 对应产品:通义千问
User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# ClaudeBot、PerplexityBot
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://www.lianbei66.com/sitemap.xml
本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、GPTBot(对应 豆包、DeepSeek、通义千问、ChatGPT)。
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 8298 字符,h1 0 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
可直接复制的修复
若源码里几乎没有正文,三种改法(任选):
- Next.js:
getServerSideProps/ Server Component 输出内容; - Nuxt:
ssr: true(默认)并把关键内容放在服务端; - 静态站:构建时预渲染(
nuxt generate/next export/ 或纯 HTML)。 同时给不执行 JS 的客户端留一份<noscript>说明。
# 先用这条确认正文是否出现在源码里(AI 爬虫大多不执行 JS)
curl -s https://www.lianbei66.com/ | grep -c "<h1"
curl -s https://www.lianbei66.com/ | wc -c
3. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 0 个,WebSite 无,Organization 无
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"联贝财务","url":"https://www.lianbei66.com/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"联贝财务","url":"https://www.lianbei66.com/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
四、重点问题分析
A1 robots.txt 未放行 AI 爬虫
站点当前的 robots.txt 中没有出现 Bytespider、DeepSeekBot、QwenBot、GPTBot 等任何一条 AI 爬虫的声明。这属于最上游的阻断:爬虫抓取前先读 robots.txt,规则按第一条命中的 User-agent 生效,如果通配规则 User-agent: * 写在前面且包含限制,AI 爬虫会直接沿用该限制,后面的单独声明形同虚设。后果是内容再完整也不会进入 AI 的索引与引用候选池。修改要点:在 robots.txt 中把每个 AI 爬虫的 User-agent: Bytespider / DeepSeekBot / QwenBot / GPTBot 加 Allow: / 逐条写在 User-agent: * 之前,并确认通配段没有对正文路径做 Disallow。
A2 与 B3 正文可抓取但缺少 h1 标题层级
源码中可见正文 8298 字符,说明内容并非完全依赖 JS,但 h1 为 0 个、h2 为 8 个。这带来两个问题:一是页面缺少唯一的主题标识,AI 在切分与摘要时无法确定这一页「讲的是什么」;二是层级从 h2 直接起步,语义树断裂,模型难以判断段落之间的从属关系。对引用的实际影响是,即使正文被抓到,也可能被当成无主题的散段,降低被选为答案来源的概率。修改要点:每页只保留一个 h1,内容与页面主题一致;将现有 h2 按逻辑归入 h1 之下,h3 用于细分;不要用加粗的 div 或纯样式元素冒充标题。若正文目前由前端渲染,应改为服务端渲染或在源码中直接输出可读正文与 h1。
B2 缺少 JSON-LD 结构化数据
检测显示 JSON-LD 块为 0 个,WebSite 与 Organization 均未声明。结构化数据是 AI 识别「这是谁、这是什么页面」的主要机器可读入口,缺失后模型只能靠正文文本猜测站点身份与页面类型,实体归属不确定,引用时也难以给出准确的来源描述。修改要点:全站模板至少补 WebSite 与 Organization 两块 JSON-LD,Organization 中写明品牌名、logo、联系方式与官网;文章页加 Article,问答页加 FAQPage;所有 JSON-LD 用 <script type="application/ld+json"> 放在 head 或 body 末尾均可,但需保证语法可解析。
B4 llms.txt 返回 HTTP 500
访问 /llms.txt 返回 HTTP 500,说明该路径要么不存在、要么被服务器错误地指向了动态入口。llms.txt 是给 AI 用的纯文本站点说明,用来直接告诉模型站点的定位、核心页面与可引用结论。当前状态下 AI 无法通过这个约定路径获取站点概览。修改要点:在站点根目录放置纯文本 llms.txt,内容包含站点定位、主要栏目链接与可被引用的核心结论;同时检查服务器配置,避免把首页 HTML 或动态路由错误地映射到该路径,确保返回 200 与 text/plain。
C5 正文缺少第三方引用与出处标注
正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中同样没有 sameAs 站外身份声明。这会让 AI 难以判断内容的信息来源与可信度,尤其在财税这类需要权威背书的领域,缺少出处的结论更容易被降权。修改要点:两条路任选其一或并行——把一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台并在正文中链回;或在正文中标注数据出处,并在 JSON-LD 的 sameAs 中声明站外身份主页。
五、行动建议
修改站点根目录的 robots.txt:在
User-agent: *之前逐条加入User-agent: Bytespider、User-agent: DeepSeekBot、User-agent: QwenBot、User-agent: GPTBot,每条后跟Allow: /;同时检查通配段是否存在对正文路径的 Disallow,若有则移除。改完后用浏览器直接访问 /robots.txt 确认顺序与内容。在站点根目录新增 llms.txt:以纯文本写入站点定位(工商财税服务平台)、核心栏目链接(注册公司、代理记账、资质代办等)与可引用结论;同步检查服务器配置,确保 /llms.txt 返回 HTTP 200 与 text/plain,而不是落到首页 HTML 或返回 500。
在全站模板 head 中注入 JSON-LD:先补 WebSite 与 Organization 两块,Organization 包含品牌名、logo、联系方式与官网地址;随后为文章页模板加 Article、为问答页模板加 FAQPage。上线后用结构化数据校验工具逐页确认无语法错误。
调整页面标题层级:在每个页面模板中确保有且仅有一个 h1,内容与页面主题一致;把现有 8 个 h2 按内容逻辑归入 h1 之下,需要细分时使用 h3;排查并替换用加粗 div 冒充标题的写法。若正文当前由前端渲染,改为服务端渲染或在源码中直接输出正文与 h1。
在正文模板中增加出处模块:为含数据的段落添加「来源:××」标注,并在 JSON-LD 的 sameAs 中声明知乎、CSDN 等站外身份主页;同时把一手数据整理成可独立引用的结论块发布到上述平台,并在正文中链回本站对应页面。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.lianbei66.com的页面。检索方式:Bing RSS,查询式
"www.lianbei66.com" -site:www.lianbei66.com(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.lianbei66.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 85 ms | 73543 B |
| robots.txt | 200 | 195 ms | 1013 B |
| sitemap.xml | 200 | 620 ms | 1120175 B |
| llms.txt | 500 | 184 ms | 572 B |
| 不存在路径探测 | 500 | 61 ms | 170 B |
八、如何引用本报告
安企 GEO《www.lianbei66.com GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 9 项,得分 9 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.lianbei66.com GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.lianbei66.com GEO 就绪度检测报告,安企 GEO,2026
复检记录
| 复检时间 | 得分 | 变化 | 本次新通过 | 本次仍未通过 |
|---|---|---|---|---|
| 2026-09-20 | 9 分(满分 15) | 持平 | 无 | 无 |
- 复检口径与首次检测完全一致:同一套 15 项条件、同一工具、同一判定代码;
- 分数变动的来源就是上面两列——新通过的项说明这一轮改动生效了,仍未通过的项是下一步要做的事。