检测结论:
www.worldwayhk.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 12 项,得分 12 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
这个站的基础面是扎实的:正文不依赖 JS 渲染、sitemap 有效、TDK 完整、JSON-LD 中有 WebSite 与 Organization、标题层级清晰、结论前置、含大量具体数字,15 项里过了 12 项。但按《GEO 就绪度标准 v1.0》的判定,当前等级仍是「不可见」,得分 12 分。最致命的缺口集中在三处:robots.txt 存在却没有解析到任何 User-agent 行,等于没有向 AI 爬虫发出明确放行信号;根目录 llms.txt 返回 HTTP 504,站点主动向模型说明自身定位与可引用结论的通道是断的;正文可见区没有任何第三方引用链接、出处标注或 sameAs 站外身份声明,AI 在交叉验证时找不到外部锚点。三项都属于低成本可修项,改完可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.worldwayhk.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | robots.txt 存在但没有解析到任何 User-agent 行 |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 4399 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | sitemap.xml HTTP 200,含 url 节点 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 504 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 6375 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 47 字符,description 145 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 通过 | JSON-LD 块 1 个,WebSite 有,Organization 有 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 10 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回 HTTP 504 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:世贸通移民-专业正规移民机构_美国移民·欧洲移民·英联邦移民_AI免费移民评估 - 世贸通移民 首页 关于世贸通 美洲移… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 4 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 5381 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/assessment.html |
未取到 | — | — | — | — | — |
/about/index.html |
0 | title 0 / desc 0 | 3 字 | 0 | 无 | 0 |
/article/default.html |
0 | title 0 / desc 0 | 3 字 | 0 | 无 | 0 |
小结:抽样的 2 个内页中,TDK 完整 0 个、含结构化数据 0 个、标注更新时间 0 个。
内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:robots.txt 存在但没有解析到任何 User-agent 行
- 怎么改:按标准格式书写 robots.txt,每条规则以 User-agent 开头。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: Bytespider
Allow: /
# 对应产品:豆包
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
User-agent: QwenBot
Allow: /
# 对应产品:通义千问
User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT
User-agent: ClaudeBot
Allow: /
# 对应产品:Claude
User-agent: PerplexityBot
Allow: /
# 对应产品:Perplexity
User-agent: KimiBot
Allow: /
# 对应产品:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应产品:Kimi 搜索
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://www.worldwayhk.com/sitemap.xml
2. B4 · 有 llms.txt(纯文本)
- 现状:llms.txt 返回 HTTP 504
- 怎么改:在站点根目录放置纯文本 llms.txt,写明定位、核心页面与可引用结论;注意别让服务器把首页 HTML 返回在这个路径上。
可直接复制的修复
放到:站点根目录 /llms.txt。注意别让服务器把首页 HTML 返回在这个路径上(软 404),检测时会判为无效
# 世贸通移民
> 一句话定位:世贸通移民 是做什么的,服务谁,有什么独家数据。
## 核心页面
- [首页](https://www.worldwayhk.com/):一句话说明
- [产品/服务页](https://www.worldwayhk.com/xxx):一句话说明
## 可引用的结论(AI 可直接摘录)
- 结论一,带具体数字,例如「样本 120 个,平均 8.6 分」
- 结论二,带时间范围
## 引用格式
引用建议表述:世贸通移民《标题》,2026
更新时间:2026-09-19
3. C5 · 有第三方引用证据
- 现状:正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明
- 怎么改:两条路任选:①把一手数据整理成可独立引用的结论块,发布到知乎/CSDN 等平台,并在正文里链回;②在正文中标注数据出处(如「来源:××」),并在 JSON-LD 的 sameAs 中声明站外身份主页。「被站外引用」的真实证据另见报告中的「外部引用线索」一节。
可直接复制的修复
两条路任选其一即可(都做更好):
路线 A:在正文里给出可核验的出处
放到:引用数据的那一段之后。写成「来源:××」或「据××报道」,并链到原出处
<p>数据来源:<a href="https://权威来源地址" rel="nofollow">中国互联网络信息中心《第 55 次中国互联网络发展状况统计报告》</a>,2026-01。</p>
路线 B:在 JSON-LD 里声明站外身份主页
注意:真正的“被第三方引用”机器读不到——本站报告第六节《外部引用线索》会用搜索引擎查一次,但那只是线索。要积累真实引用,还是得把一手数据整理成可引用结论块,投到知乎/公众号等行业平台
{"@context":"https://schema.org","@type":"Organization","name":"世贸通移民",
"url":"https://www.worldwayhk.com/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://mp.weixin.qq.com/你的公众号"]}
四、重点问题分析
A1 robots.txt 没有 User-agent 行,AI 爬虫拿不到放行信号
站点根目录确实存在 robots.txt,但解析结果里没有任何 User-agent 行。对常规搜索引擎这可能只是配置瑕疵,对生成式引擎则更直接:多数 AI 抓取器在决定是否抓取、抓取哪些路径时,会先读 robots.txt 的 User-agent 段。文件里没有这一行,抓取器无法判断站点的授权意图,部分实现会退回保守策略,降低抓取频率甚至跳过。
修改要点:重写 robots.txt,让每条规则都以 User-agent 开头。至少显式写出对主流 AI 爬虫的放行(如 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 等),并附上 Sitemap 绝对地址。规则之间用空行分隔,避免多条规则被解析成一条。改完用抓取器视角实测一次,确认能读到 User-agent 行。
B4 llms.txt 返回 504,站点自我说明通道是断的
访问 /llms.txt 返回 HTTP 504。注意这不是「文件不存在」的 404,而是服务器在超时,说明该路径被某个后端逻辑接住了却没有正常返回。标准要求的是根目录下一份纯文本文件,用来说明站点定位、核心页面与可引用结论。
这个文件的作用是让模型不必先解析整站 HTML,就能拿到一份结构化摘要,直接决定哪些页面值得引用。504 会让抓取器把该路径标记为不可用,短期内不会重试。另外要留意证据里提示的一点:不要让服务器把首页 HTML 返回在这个路径上,那会造成内容与路径语义不符。
修改要点:在站点根目录放一个静态的 llms.txt,Content-Type 为 text/plain,内容包含站点一句话定位、核心栏目 URL 列表、以及三到五条可直接被引用的结论句。确认它不经过会超时的动态路由。
C5 正文缺少第三方引用证据,外部锚点为零
正文可见区里,既没有指向第三方平台的引用链接,也没有「来源:××」这类出处标注,JSON-LD 中也没有 sameAs 站外身份声明。这意味着当 AI 需要交叉验证站点的可信度时,站内没有任何可跳转的外部依据。
对移民这类高决策成本的领域,模型更倾向于引用能被多方印证的信息。缺少外部锚点,会直接降低内容被选为引用来源的概率,即便站内数字很多、结构也规整。
修改要点:两条路任选其一或同时做。一是把站内的一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台,并在正文相应位置链回;二是在正文中标注数据出处,同时在 JSON-LD 的 sameAs 字段里声明站外身份主页。外部被引用的真实情况另见报告中的「外部引用线索」一节。
五、行动建议
重写根目录 robots.txt。每条规则以 User-agent 开头,逐条列出对 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 等 AI 爬虫的 Allow 规则,规则之间留空行,文件末尾加上 Sitemap: https://www.worldwayhk.com/sitemap.xml。改完用文本方式访问一次,确认能解析出 User-agent 行。
新建根目录 llms.txt,以 text/plain 返回。内容依次写:站点一句话定位、核心栏目与对应 URL 列表、三到五条可直接引用的结论句。务必确认该路径由静态文件直接返回,不经过会返回 504 的动态路由,也不要让它回落到首页 HTML。
在首页与主要栏目页的 JSON-LD 中补 sameAs 字段。把已备案的主体对应的站外身份主页(如官方知乎、CSDN 等账号主页)逐一列入 Organization 的 sameAs 数组,确保 URL 可访问且与站点主体一致。
在正文关键数据段落补出处标注。对引用的行业数据、政策条款,在句末加「来源:××」并在可行时给出可点击链接;同时把站内一手数据整理成独立结论块,发布到知乎或 CSDN,并在正文中链回原页面。
复核 A4 与 A5 两项的稳定性。当前不存在路径返回的是 504 而非 404,首页响应 6375 ms 偏慢,两者都会影响抓取器对站点可用性的判断。建议把不存在的路径统一改为返回 404,并排查首页响应时间,确认超时不是服务器层面的普遍问题。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.worldwayhk.com的页面。检索方式:Bing RSS,查询式
"www.worldwayhk.com" -site:www.worldwayhk.com(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.worldwayhk.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 6375 ms | 283700 B |
| robots.txt | 200 | 157 ms | 632 B |
| sitemap.xml | 200 | 357 ms | 7479 B |
| llms.txt | 504 | 380 ms | 566 B |
| 不存在路径探测 | 504 | 268 ms | 566 B |
八、如何引用本报告
安企 GEO《www.worldwayhk.com GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 12 项,得分 12 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.worldwayhk.com GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.worldwayhk.com GEO 就绪度检测报告,安企 GEO,2026