检测结论:
www.senximachinery.ru在《GEO 就绪度标准 v1.0》的 15 项判定中通过 9 项,得分 9 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
这个站目前处于「不可见」状态:15 项 GEO 就绪度检查通过 9 项,得分 9 分。基础面并不差——正文不依赖 JS 即可读到 7685 字符、HTTPS 与 404 处理正常、llms.txt 有 21642 字符、首屏结论前置、页面含 328 处具体数字,可抓取与可引用的底子是在的。最致命的缺口在 A1:作为外贸多语言站点,robots.txt 既没有为 GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent 这 6 个国外核心爬虫单独放行,也没有声明国内的 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot,等于把 AI 入口整体关在门外,后面的内容质量再高也用不上。其次是 B1 标题与描述长度失控、B2 缺 WebSite 结构化数据、B5 主体信息不可核验,以及 C4 无更新时间、C5 无任何第三方引用证据。把 A1 与 B1、B2、B5、C4、C5 这 6 项补齐,即可达到满分 15 分。
二、逐项判定结果
判定时间:2026-10-01 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.senximachinery.ru
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 本站定位:外贸/多语言站点(页面语言标记为外语、出现海外渠道:wa、whatsapp、标题为纯英文),国外核心 6 个为硬门槛;未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;未声明(国外核心):GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 7685 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | robots.txt 声明的 https://www.senximachinery.ru/sitemap.xml 有效(0 条 URL) |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 1440 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 未通过 | title 69 字符,description 203 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 1 个,WebSite 无,Organization 有 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 8 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 通过 | llms.txt 正常,21642 字符 |
| B5 | 主体与作者信息可核验 | 可理解性 | 未通过 | 备案信息 无,主体信息入口 无 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:Горно-шахтное оборудование: сушилки, печи, дробилки / Senxi … |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 3 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 328 处 |
| C4 | 有明确更新时间 | 可引用性 | 未通过 | 页面可见更新时间为 无 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/contact |
200 | title 64 / desc 166 | 1437 字 | 1 | 无 | 37 |
/about |
200 | title 65 / desc 189 | 2226 字 | 1 | 无 | 32 |
/news/company |
200 | title 60 / desc 162 | 1669 字 | 1 | 无 | 42 |
小结:抽样的 3 个内页中,TDK 完整 3 个、含结构化数据 3 个、标注更新时间 0 个。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:本站定位:外贸/多语言站点(页面语言标记为外语、出现海外渠道:wa、whatsapp、标题为纯英文),国外核心 6 个为硬门槛;未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot;未声明(国外核心):GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。本站判为外贸/多语言站点,国外核心 6 个是硬门槛。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# 【1】AI 爬虫(下面按 国内 / 国外核心 / 国外建议 / 用途令牌 分组,逐个显式声明)
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
# ① 国内 AI 爬虫(中文 AI 流量的入口,硬门槛)
User-agent: Bytespider
Allow: /
# 对应:豆包
User-agent: DeepSeekBot
Allow: /
# 对应:DeepSeek
User-agent: QwenBot
Allow: /
# 对应:通义千问 / 元宝
User-agent: KimiBot
Allow: /
# 对应:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应:Kimi 搜索
# ② 国外 AI 爬虫 · 核心(外贸站点最关键,硬门槛)
User-agent: GPTBot
Allow: /
# 对应:ChatGPT(训练) # 你已声明过,这里保持一致
User-agent: OAI-SearchBot
Allow: /
# 对应:ChatGPT(搜索索引) # 你已声明过,这里保持一致
User-agent: ClaudeBot
Allow: /
# 对应:Claude(训练) # 你已声明过,这里保持一致
User-agent: Claude-SearchBot
Allow: /
# 对应:Claude(搜索索引) # 你已声明过,这里保持一致
User-agent: PerplexityBot
Allow: /
# 对应:Perplexity # 你已声明过,这里保持一致
User-agent: meta-externalagent
Allow: /
# 对应:Meta AI # 你已声明过,这里保持一致
# ③ 国外 AI 爬虫 · 建议(覆盖越全越好,不作硬门槛)
User-agent: ChatGPT-User
Allow: /
# 对应:ChatGPT(用户触发)
User-agent: Claude-User
Allow: /
# 对应:Claude(用户触发)
User-agent: Perplexity-User
Allow: /
# 对应:Perplexity(用户触发)
User-agent: Google-CloudVertexBot
Allow: /
# 对应:Google Vertex AI
User-agent: meta-externalfetcher
Allow: /
# 对应:Meta(用户触发)
User-agent: FacebookBot
Allow: /
# 对应:Meta / Facebook
User-agent: Amazonbot
Allow: /
# 对应:Amazon / Alexa
User-agent: Applebot
Allow: /
# 对应:Apple Siri / Spotlight
User-agent: CCBot
Allow: /
# 对应:Common Crawl(众多模型的训练语料)
User-agent: DuckAssistBot
Allow: /
# 对应:DuckDuckGo AI
User-agent: MistralAI-User
Allow: /
# 对应:Mistral(用户触发)
# ④ AI 用途令牌(不会单独来抓,只在 robots.txt 生效)
# Allow 表示你授权 AI 使用你的内容;要保留内容可改成 Disallow。
User-agent: Google-Extended
Allow: /
# 对应:Gemini / Vertex AI
User-agent: Applebot-Extended
Allow: /
# 对应:Apple Intelligence
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent
# 【2】通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# 【3】声明站点地图
Sitemap: https://www.senximachinery.ru/sitemap.xml
本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 豆包、DeepSeek、通义千问 / 元宝、Kimi(模型训练)、Kimi 搜索)。
2. B1 · 每页唯一且完整的 TDK
- 现状:title 69 字符,description 203 字符
- 怎么改:补全并压缩:title ≤60 字符,description ≥50 字符,且每页互不重复。
可直接复制的修复
放到:每个页面 <head> 里,且每页各不相同(现在很多站的 TDK 直接套模板、全站重复,AI 会认为是同一页)
<title>Senxi Machinery - 一句话说清你提供什么(30 字内)</title>
<meta name="description" content="一句话说明这个页面是什么、给谁看、有什么结论(80-150 字)。">
<link rel="canonical" href="https://www.senximachinery.ru/当前页面路径">
<meta property="og:title" content="Senxi Machinery - 一句话说清你提供什么">
<meta property="og:description" content="同 description">
3. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 1 个,WebSite 无,Organization 有
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Senxi Machinery","url":"https://www.senximachinery.ru/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"Senxi Machinery","url":"https://www.senximachinery.ru/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
四、重点问题分析
A1 robots.txt 未放行 AI 爬虫:这是当前最优先的问题
站点现状:robots.txt 中没有针对任何 AI 爬虫的 User-agent 声明。作为外贸多语言站点(页面语言标记为外语、出现 wa / whatsapp 海外渠道、标题为纯英文),国外核心 6 个爬虫属于硬门槛,而这 6 个——GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent——全部未声明;国内侧的 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 同样未声明。
实际后果:爬虫匹配 robots.txt 时只认第一条命中的规则。如果站点当前用的是 User-agent: * 加 Disallow 的写法,AI 爬虫会直接继承这条禁止规则而被挡在门外;即使 * 是放行的,未显式声明的爬虫也无法获得明确的抓取许可,在抓取预算分配上处于劣势。结果是页面内容根本进不了 AI 的语料与检索索引,A2、B3、C1、C3 这些已通过的项目等于白做。
修改要点:在 robots.txt 最顶部、User-agent: * 之前,为上述每个爬虫单独写一段 User-agent + Allow: /。国外 6 个必须写全,国内 5 个建议一并补上。顺序不能颠倒,否则规则不生效。
B1 TDK 长度失控:AI 难以提取页面主题
站点现状:title 为 69 字符,description 为 203 字符。标题超出 60 字符后会在结果页被截断,描述超出常规长度后也会被裁剪。
实际后果:AI 在判断「这个页面讲什么、是否值得引用」时,标题与描述是最先被读取的摘要字段。标题过长会导致核心主题词被挤到截断位置之后,描述过长则让关键信息淹没在冗余表述里,页面在生成式答案中被选中的概率下降。
修改要点:把 title 压到 60 字符以内,把核心产品词放在最前;description 控制在 50 字符以上、但去掉重复堆砌,保留一句能独立说明页面价值的话。同时确认每个页面的 TDK 互不重复。
B2 结构化数据缺失 WebSite:站点身份无法被机器确认
站点现状:页面有 1 个 JSON-LD 块,其中 Organization 已有,WebSite 缺失。
实际后果:WebSite 是声明站点名称、URL 与搜索入口的标准载体,缺失后 AI 只能靠正文猜测站点身份,容易把不同页面归到错误的实体上;Organization 单点存在也无法与站点形成完整对应关系。
修改要点:在首页 JSON-LD 中补 WebSite 节点,与现有 Organization 通过 @id 关联;文章页追加 Article,问答页追加 FAQPage。
B5 主体信息不可核验:影响可信度判断
站点现状:页面无备案信息,也没有主体信息入口(如「关于我们」或联系方式页)。
实际后果:AI 在引用来源时会评估来源的可信度。缺少可核验的主体信息,站点在生成式答案中更难被当作可靠来源推荐,尤其对外贸站点而言,采购方与 AI 都缺少判断「这家公司是否真实存在」的依据。
修改要点:页脚展示备案号或公司注册信息,并提供「关于我们」入口,写明公司名称、地址与联系方式。
C4、C5 引用信号缺失:内容新鲜度与外部佐证都无法判断
站点现状:页面可见区域没有更新时间;正文既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 中也没有 sameAs 站外身份声明。
实际后果:没有更新时间,AI 无法判断内容是当期还是过期,倾向选择有明确时间戳的来源;没有第三方引用与出处标注,内容缺少外部佐证,被引用的优先级进一步降低。
修改要点:在页面显著位置标注「更新于 YYYY-MM-DD」;把一手数据整理成可独立引用的结论块发布到知乎、CSDN 等平台并在正文链回,或在正文标注「来源:××」,同时在 JSON-LD 的 sameAs 中声明站外身份主页。
五、行动建议
修改根目录 robots.txt:在文件最顶部、User-agent: * 之前,依次为 GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent 各写一段「User-agent: 爬虫名」加「Allow: /」,其后再补 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot。顺序不能调换,否则规则不生效。
逐页重写 TDK:把每页 title 压到 60 字符以内、核心产品词前置,description 保留 50 字符以上但去掉重复堆砌。改完后抽查 10 个主要页面,确认标题与描述互不重复。
补全 JSON-LD:在首页 head 中新增 WebSite 节点,用 @id 与现有 Organization 关联;产品页与文章页追加 Article,问答页追加 FAQPage。同时在 Organization 节点内补 sameAs,填入站外身份主页地址。
完善页脚与主体信息:在页脚加入备案号或公司注册信息,并新增「关于我们」页面,写明公司名称、地址、联系方式,从全站页脚链接进入。
增加更新时间与出处标注:在页面显著位置(首屏或正文开头)加一行「更新于 YYYY-MM-DD」;在正文中为引用数据标注「来源:××」;把站内已有的一手数据整理成可独立引用的结论块,发布到知乎或 CSDN 等平台,并在正文中链回原文。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.senximachinery.ru的页面。检索方式:Bing RSS,查询式
"www.senximachinery.ru" -site:www.senximachinery.ru(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.senximachinery.ru重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-10-01 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 1440 ms | 67967 B |
| robots.txt | 200 | 2796 ms | 158 B |
| sitemap.xml | 200 | 709 ms | 446 B |
| llms.txt | 200 | 1364 ms | 36061 B |
| 不存在路径探测 | 404 | 1336 ms | — B |
八、如何引用本报告
安企 GEO《www.senximachinery.ru GEO 就绪度检测报告》(2026-10-01):该站按《GEO 就绪度标准 v1.0》15 项判定通过 9 项,得分 9 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.senximachinery.ru GEO 就绪度检测报告
- 检测日期:2026-10-01
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.senximachinery.ru GEO 就绪度检测报告,安企 GEO,2026