检测结论:
www.304-316.com在《GEO 就绪度标准 v1.0》的 15 项判定中通过 11 项,得分 11 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
www.304-316.com 这次拿到 11 分,判定为「不可见」等级。基础面是好的:页面不依赖 JS 渲染、TDK 完整、标题层级清晰、正文有大量具体数字、更新时间可见,抓取和可读性没有硬伤。真正卡住 AI 引用的是四处缺口——robots.txt 没有为国内 AI 爬虫单独放行、页面没有任何 JSON-LD 结构化数据、根目录缺少 llms.txt、正文缺少第三方引用与出处标注。其中影响最直接的是 A1 和 B2:前者决定国内 AI 爬虫能不能稳定抓取,后者决定抓到的内容能不能被机器准确识别为「谁、做什么、在哪」。这四项都属于一次性配置类改动,不涉及内容重写,按建议补齐后可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-21 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:www.304-316.com
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 通过 | 源码中可见正文 2873 字符,h1 1 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | robots.txt 声明的 https://www.304-316.com/sitemap.xml 有效(0 条 URL) |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 235 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 31 字符,description 100 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 0 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 通过 | h1 1 个,h2 6 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 未通过 | llms.txt 返回 HTTP 404 |
| B5 | 主体与作者信息可核验 | 可理解性 | 通过 | 备案信息 有,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:不锈钢管件_不锈钢法兰_高压锻制管件厂家-温州航锐管业有限公司 我们专注于制造锻制承插焊及螺纹系列高压管件、法兰 24小… |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 13 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 1504 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 未通过 | 正文可见区既没有指向第三方平台的引用链接,也没有出处标注、也没有 sameAs 站外身份声明 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/p/8zmb-bzmb.html |
200 | title 16 / desc 176 | 1825 字 | 0 | 无 | 74 |
/p/117.html |
200 | title 26 / desc 200 | 805 字 | 0 | 无 | 68 |
/a/Sweepolet-N08825.html |
200 | title 55 / desc 163 | 1896 字 | 0 | 无 | 77 |
小结:抽样的 3 个内页中,TDK 完整 3 个、含结构化数据 0 个、标注更新时间 0 个。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:本站定位:国内站点,国外组为建议项(做外贸时必需);未声明(国内):Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。国外组建议补齐(做外贸时必需)。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# 【1】AI 爬虫(下面按 国内 / 国外核心 / 国外建议 / 用途令牌 分组,逐个显式声明)
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
# ① 国内 AI 爬虫(中文 AI 流量的入口,硬门槛)
User-agent: Bytespider
Allow: /
# 对应:豆包
User-agent: DeepSeekBot
Allow: /
# 对应:DeepSeek
User-agent: QwenBot
Allow: /
# 对应:通义千问 / 元宝
User-agent: KimiBot
Allow: /
# 对应:Kimi(模型训练)
User-agent: Kimi-SearchBot
Allow: /
# 对应:Kimi 搜索
# ② 国外 AI 爬虫 · 核心(外贸站点最关键,硬门槛)
User-agent: GPTBot
Allow: /
# 对应:ChatGPT(训练) # 你已声明过,这里保持一致
User-agent: OAI-SearchBot
Allow: /
# 对应:ChatGPT(搜索索引) # 你已声明过,这里保持一致
User-agent: ClaudeBot
Allow: /
# 对应:Claude(训练) # 你已声明过,这里保持一致
User-agent: Claude-SearchBot
Allow: /
# 对应:Claude(搜索索引) # 你已声明过,这里保持一致
User-agent: PerplexityBot
Allow: /
# 对应:Perplexity # 你已声明过,这里保持一致
User-agent: meta-externalagent
Allow: /
# 对应:Meta AI # 你已声明过,这里保持一致
# ③ 国外 AI 爬虫 · 建议(覆盖越全越好,不作硬门槛)
User-agent: ChatGPT-User
Allow: /
# 对应:ChatGPT(用户触发)
User-agent: Claude-User
Allow: /
# 对应:Claude(用户触发)
User-agent: Perplexity-User
Allow: /
# 对应:Perplexity(用户触发)
User-agent: Google-CloudVertexBot
Allow: /
# 对应:Google Vertex AI
User-agent: meta-externalfetcher
Allow: /
# 对应:Meta(用户触发)
User-agent: FacebookBot
Allow: /
# 对应:Meta / Facebook
User-agent: Amazonbot
Allow: /
# 对应:Amazon / Alexa
User-agent: Applebot
Allow: /
# 对应:Apple Siri / Spotlight
User-agent: CCBot
Allow: /
# 对应:Common Crawl(众多模型的训练语料)
User-agent: DuckAssistBot
Allow: /
# 对应:DuckDuckGo AI
User-agent: MistralAI-User
Allow: /
# 对应:Mistral(用户触发)
# ④ AI 用途令牌(不会单独来抓,只在 robots.txt 生效)
# Allow 表示你授权 AI 使用你的内容;要保留内容可改成 Disallow。
User-agent: Google-Extended
Allow: /
# 对应:Gemini / Vertex AI
User-agent: Applebot-Extended
Allow: /
# 对应:Apple Intelligence
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# GPTBot、OAI-SearchBot、ClaudeBot、Claude-SearchBot、PerplexityBot、meta-externalagent
# 【2】通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# 【3】声明站点地图
Sitemap: https://www.304-316.com/sitemap.xml
本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot(对应 豆包、DeepSeek、通义千问 / 元宝、Kimi(模型训练)、Kimi 搜索)。
2. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 0 个,WebSite 无,Organization 无
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"www.304-316.com","url":"https://www.304-316.com/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"www.304-316.com","url":"https://www.304-316.com/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
3. B4 · 有 llms.txt(纯文本)
- 现状:llms.txt 返回 HTTP 404
- 怎么改:在站点根目录放置纯文本 llms.txt,写明定位、核心页面与可引用结论;注意别让服务器把首页 HTML 返回在这个路径上。
可直接复制的修复
放到:站点根目录 /llms.txt。注意别让服务器把首页 HTML 返回在这个路径上(软 404),检测时会判为无效
# www.304-316.com
> 一句话定位:www.304-316.com 是做什么的,服务谁,有什么独家数据。
## 核心页面
- [首页](https://www.304-316.com/):一句话说明
- [产品/服务页](https://www.304-316.com/xxx):一句话说明
## 可引用的结论(AI 可直接摘录)
- 结论一,带具体数字,例如「样本 120 个,平均 8.6 分」
- 结论二,带时间范围
## 引用格式
引用建议表述:www.304-316.com《标题》,2026
更新时间:2026-09-19
四、重点问题分析
A1 robots.txt 未放行国内 AI 爬虫
当前 robots.txt 中没有为 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 声明独立的 User-agent 与 Allow: / 规则。爬虫匹配只认第一条命中的规则,如果这些 UA 落在 User-agent: * 的规则之下,一旦通配规则里存在任何 Disallow,它们就会被一并拦掉。对国内站点来说,这几家正好是生成式答案的主要来源,抓不到就等于在这些引擎里不存在。修改要点:把每个 AI 爬虫的 User-agent 加 Allow: / 两行规则,统一写在 User-agent: * 之前;做外贸的话再补国外组。
B2 结构化数据完全缺失
页面 JSON-LD 块数量为 0,WebSite 和 Organization 都没有声明。AI 在抽取实体时缺少机器可读的锚点,只能靠正文文本猜,容易把公司名、业务范围、联系方式识别错,也不利于生成带来源的引用卡片。修改要点:至少补 WebSite(含站点名、URL)与 Organization(含公司名、logo、联系方式、sameAs);文章页加 Article,问答页加 FAQPage。
B4 缺少 llms.txt
访问 /llms.txt 返回 404。这个文件是给大模型看的站点说明书,缺失意味着模型只能逐页爬取、自己归纳站点定位,效率低且容易归纳偏差。修改要点:在站点根目录放纯文本 llms.txt,写明站点定位、核心页面清单和可直接引用的结论句;同时确认服务器不会把首页 HTML 错误地返回在这个路径上。
C5 缺少第三方引用证据
正文可见区既没有指向第三方平台的引用链接,也没有出处标注,JSON-LD 里也没有 sameAs 站外身份声明。AI 判断内容可信度时会看「这个说法有没有别处佐证」,完全没有外部指向的内容,被引用优先级会明显偏低。修改要点:两条路任选,一是把站内一手数据整理成可独立引用的结论块,发布到知乎、CSDN 等平台并在正文链回;二是在正文标注数据出处,并在 JSON-LD 的 sameAs 中声明站外身份主页。
五、行动建议
- 改 robots.txt:在 User-agent: * 之前,为 Bytespider、DeepSeekBot、QwenBot、KimiBot、Kimi-SearchBot 各写一组「User-agent: 爬虫名 + Allow: /」,保存后直接访问 /robots.txt 确认顺序正确。
- 在首页模板(通常是 head 部分或公共 header 文件)注入 WebSite 与 Organization 两段 JSON-LD,Organization 中填公司全称、logo 地址、联系方式,并预留 sameAs 字段填知乎、CSDN 等站外主页链接。
- 在站点根目录新建 llms.txt 纯文本文件,内容包含站点定位一句话、核心页面 URL 列表、3 至 5 条可直接引用的结论句;部署后访问 /llms.txt 确认返回的是纯文本而非首页 HTML。
- 在文章页与产品页的正文中增加「来源:××」式出处标注,并在对应页面 JSON-LD 中补 Article 或 FAQPage,把出处信息写进字段。
- 把站内已有的一手数据(如 1504 处具体数字中的关键结论)整理成独立段落,同步发布到知乎或 CSDN,并在站内正文中加上指向该外链的引用链接。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
www.304-316.com的页面。检索方式:Bing RSS,查询式
"www.304-316.com" -site:www.304-316.com(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
www.304-316.com重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-21 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 235 ms | 140400 B |
| robots.txt | 200 | 239 ms | 162 B |
| sitemap.xml | 200 | 338 ms | 92210 B |
| llms.txt | 404 | 302 ms | — B |
| 不存在路径探测 | 404 | 472 ms | — B |
八、如何引用本报告
安企 GEO《www.304-316.com GEO 就绪度检测报告》(2026-09-21):该站按《GEO 就绪度标准 v1.0》15 项判定通过 11 项,得分 11 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:www.304-316.com GEO 就绪度检测报告
- 检测日期:2026-09-21
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:www.304-316.com GEO 就绪度检测报告,安企 GEO,2026