检测结论:
cplastics.net在《GEO 就绪度标准 v1.0》的 15 项判定中通过 10 项,得分 10 分(满分 15),判定为「不可见」。其中 A1(robots.txt 正确放行 AI 爬虫) 是最关键的缺口。
一、概述
cplastics.net 在本次 GEO 就绪度检测中通过 10 项,得分 10 分,判定等级为不可见。站点基础条件尚可:HTTPS 有效、首页响应正常、sitemap 可用、TDK 完整、llms.txt 存在,且正文包含大量具体数字与更新时间,具备一定被引用潜力。但最致命的缺口集中在可抓取性与可理解性两端:robots.txt 未显式放行 Bytespider、DeepSeekBot、QwenBot、GPTBot 等 AI 爬虫,正文与标题又依赖 JS 渲染导致源码中 h1 为 0 个,AI 很可能既进不来、也读不懂页面结构。此外 JSON-LD 仅 1 个且缺少 WebSite 与 Organization,主体备案信息缺失,进一步削弱可信度。优先修复 robots.txt 与标题层级、补齐结构化数据与主体信息后,可达满分 15 分。
二、逐项判定结果
判定时间:2026-09-20 | 依据:《GEO 就绪度标准 v1.0》 | 检测对象:cplastics.net
| 项 | 检查项 | 分组 | 结果 | 关键证据 |
|---|---|---|---|---|
| A1 | robots.txt 正确放行 AI 爬虫 | 可抓取性 | 未通过 | 未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等 |
| A2 | 关键内容不依赖 JS 渲染 | 可抓取性 | 未通过 | 源码中可见正文 3952 字符,h1 0 个 |
| A3 | 有 sitemap 且内容有效 | 可抓取性 | 通过 | sitemap.xml HTTP 200,含 url 节点 |
| A4 | 无死链污染(非软 404) | 可抓取性 | 通过 | 探测不存在路径返回 HTTP 404 |
| A5 | 站点稳定可达 + HTTPS 有效 | 可抓取性 | 通过 | 协议 HTTPS,首页 HTTP 200,响应 1445 ms |
| B1 | 每页唯一且完整的 TDK | 可理解性 | 通过 | title 54 字符,description 114 字符 |
| B2 | 结构化数据(JSON-LD) | 可理解性 | 未通过 | JSON-LD 块 1 个,WebSite 无,Organization 无 |
| B3 | 标题层级语义化 | 可理解性 | 未通过 | h1 0 个,h2 8 个 |
| B4 | 有 llms.txt(纯文本) | 可理解性 | 通过 | llms.txt 正常,2883 字符 |
| B5 | 主体与作者信息可核验 | 可理解性 | 未通过 | 备案信息 无,主体信息入口 有 |
| C1 | 结论前置 | 可引用性 | 通过 | 首屏可见文本前 120 字:青岛云塑 - 改性工程塑料研发生产厂家_PP/PA/PC/ABS/PPS定制_青岛云塑高分子材料科技有限公司 简体中文 … |
| C2 | 存在可摘录结构块 | 可引用性 | 通过 | 列表/表格标签 4 个 |
| C3 | 有独家数据或一手信息 | 可引用性 | 通过 | 含具体数字 663 处 |
| C4 | 有明确更新时间 | 可引用性 | 通过 | 页面可见更新时间为 有 |
| C5 | 有第三方引用证据 | 可引用性 | 通过 | 正文标注了明确出处「据市场消息」 |
内页抽样(按模板各取一页)
首页之外,按 URL 形态从站点地图里各取一个代表页面,看内页的 TDK、正文、结构化数据、更新时间与内链。本节只作补充证据,不参与 15 项评分——评分口径对全站一致,仍按首页判定。
| 抽样页面 | HTTP | TDK | 可见正文 | JSON-LD | 更新时间 | 内链 |
|---|---|---|---|---|---|---|
/news/xin-wen-dong-tai |
200 | title 20 / desc 0 | 3173 字 | 0 | 有 | 79 |
/news/xing-ye-xin-wen |
200 | title 20 / desc 19 | 930 字 | 0 | 有 | 56 |
/news/qi-ye-xin-wen |
200 | title 20 / desc 22 | 3181 字 | 0 | 有 | 80 |
小结:抽样的 3 个内页中,TDK 完整 2 个、含结构化数据 0 个、标注更新时间 3 个。
内页 TDK 不完整时,AI 抓到内页只能看到一个泛化标题。修法与首页相同(见第三节 B1 的片段),但要改的是列表页/详情页模板,而不是某一篇文章。
三、优先修复(含可直接复制粘贴的代码)
按投入产出排序——「可抓取性」组的问题优先,不修完这一组,后面的优化都不会被 AI 看到。每一项都给出可以整段复制的修复内容,把域名、品牌名和你实际缺失的爬虫都填好了。
1. A1 · robots.txt 正确放行 AI 爬虫
- 现状:未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot等
- 怎么改:把每个 AI 爬虫的 User-agent + Allow: / 放在 User-agent: * 之前——爬虫只匹配第一条命中的规则。
可直接复制的修复
放到:站点根目录 /robots.txt(一个纯文本文件,整份替换即可)
# ① AI 爬虫必须逐个显式声明,且放在 User-agent: * 之前
# 爬虫只匹配第一条命中自己的规则组,写在 * 后面等于没写
User-agent: Bytespider
Allow: /
# 对应产品:豆包
User-agent: DeepSeekBot
Allow: /
# 对应产品:DeepSeek
User-agent: QwenBot
Allow: /
# 对应产品:通义千问
User-agent: GPTBot
Allow: /
# 对应产品:ChatGPT
# ② 本次检测显示以下爬虫你已经声明过,无需重复:
# ClaudeBot、PerplexityBot、KimiBot、Kimi-SearchBot
# ③ 通用规则放最后
User-agent: *
Allow: /
Disallow: /admin/
Disallow: /api/
# ④ 声明站点地图
Sitemap: https://cplastics.net/sitemap.xml
本次检测里,这个文件缺少 Bytespider、DeepSeekBot、QwenBot、GPTBot(对应 豆包、DeepSeek、通义千问、ChatGPT)。
2. A2 · 关键内容不依赖 JS 渲染
- 现状:源码中可见正文 3952 字符,h1 0 个
- 怎么改:把正文与标题改为服务端渲染(SSR),或在源码中提供可读的正文与 h1。
可直接复制的修复
若源码里几乎没有正文,三种改法(任选):
- Next.js:
getServerSideProps/ Server Component 输出内容; - Nuxt:
ssr: true(默认)并把关键内容放在服务端; - 静态站:构建时预渲染(
nuxt generate/next export/ 或纯 HTML)。 同时给不执行 JS 的客户端留一份<noscript>说明。
# 先用这条确认正文是否出现在源码里(AI 爬虫大多不执行 JS)
curl -s https://cplastics.net/ | grep -c "<h1"
curl -s https://cplastics.net/ | wc -c
3. B2 · 结构化数据(JSON-LD)
- 现状:JSON-LD 块 1 个,WebSite 无,Organization 无
- 怎么改:至少补 WebSite + Organization;文章页加 Article,问答页加 FAQPage。
可直接复制的修复
放到:<head> 内。sameAs 是关键——它把「这个域名」和「你的知乎/公众号/GitHub 主页」关联成同一个实体,AI 才能确认你是谁
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"ABS","url":"https://cplastics.net/",
"sameAs":["https://www.zhihu.com/org/你的主页",
"https://github.com/你的账号"]}
</script>
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"WebSite",
"name":"ABS","url":"https://cplastics.net/"}
</script>
<!-- 文章页再加 Article:headline / datePublished / dateModified / author -->
四、重点问题分析
一、AI 爬虫未被显式放行,抓取入口存在不确定性
站点当前 robots.txt 未声明 Bytespider、DeepSeekBot、QwenBot、GPTBot 等 AI 爬虫的 User-agent 与 Allow 规则。按标准要求,每个 AI 爬虫的 User-agent + Allow: / 必须放在 User-agent: * 之前,因为爬虫只匹配第一条命中的规则。现状意味着这些爬虫只能落到通配规则上,若通配规则中存在任何 Disallow 或未明确允许,抓取行为就不可控。对 AI 引用而言,抓不到页面等于不存在,后续所有内容优化都无从谈起。修改要点是在 robots.txt 顶部逐条列出目标 AI 爬虫并显式 Allow: /,再保留通配规则兜底。
二、正文与标题依赖 JS 渲染,源码中 h1 缺失
检测显示源码中可见正文 3952 字符,但 h1 为 0 个。这说明页面虽然有一定文本量,但标题层级没有以服务端可读的形式输出,很可能由前端框架动态生成。AI 爬虫在抓取时通常不执行完整 JS,源码里没有 h1,模型就无法确认页面主题与内容归属,容易把页面判定为低价值或结构混乱。修改要点是把正文与主标题改为服务端渲染,或在源码中直接提供可读的 h1 与正文;若使用前端框架,应启用 SSR 或预渲染,确保首屏关键内容出现在 HTML 源码中。
三、结构化数据不足,缺少 WebSite 与 Organization
当前 JSON-LD 块仅 1 个,WebSite 与 Organization 均未声明。结构化数据是 AI 理解站点身份、品牌归属与页面类型的重要信号。缺少 WebSite 与 Organization,模型难以确认站点名称、官网地址与运营主体;文章页缺少 Article、问答页缺少 FAQPage,也会降低内容被分类与摘录的概率。修改要点是至少补齐 WebSite 与 Organization 两类 JSON-LD,并在文章页增加 Article、问答页增加 FAQPage,字段与页面可见内容保持一致。
四、标题层级语义化缺失,主体信息不可核验
h1 为 0 个、h2 为 8 个,说明页面有分层意识但没有唯一主标题,AI 难以判断页面核心主题。同时备案信息缺失,仅有主体信息入口,页脚没有备案号,主体可核验性不足。对 AI 引用而言,来源可信度是重要权重,主体信息不完整会直接影响内容被采纳的优先级。修改要点是每页只保留一个 h1,用 h2/h3 组织层级,不要用加粗的 div 冒充标题;并在页脚展示备案号,提供「关于我们」或联系方式等可核验的主体信息。
五、行动建议
修改根目录 robots.txt:在文件最顶部、User-agent: * 之前,逐条写入 Bytespider、DeepSeekBot、QwenBot、GPTBot 等 AI 爬虫的 User-agent,每条下方紧跟 Allow: /,确保爬虫匹配到第一条命中规则时即被放行。
改造页面渲染方式:在首页及栏目页模板中,将正文与主标题改为服务端渲染输出,确保 HTML 源码中直接出现唯一的 h1 标签;若使用前端框架,启用 SSR 或预渲染,避免标题与正文只存在于 JS 执行结果中。
补齐 JSON-LD:在首页 head 中新增 WebSite 与 Organization 两个 JSON-LD 块,字段与页面可见信息一致;文章页模板增加 Article,问答页模板增加 FAQPage,避免重复或冲突。
规范标题层级:每页只保留一个 h1,用 h2/h3 组织内容层级,替换当前用加粗 div 充当标题的写法,确保源码中标题标签语义清晰。
完善主体信息:在页脚模板中展示备案号,并保留「关于我们」或联系方式入口,使主体信息可核验,提升 AI 对站点来源的信任度。
六、外部引用线索(仅证据,不计分)
未检出站外提及:外部索引里还没有提到
cplastics.net的页面。检索方式:Bing RSS,查询式
"cplastics.net" -site:cplastics.net(打开这次检索)本节只作证据、不计分:搜索结果随时变化,把它纳入评分会破坏本报告「同一站点重复检测结果一致」的承诺。
七、数据来源与复核方式
- 检测方式:程序抓取首页 HTML、robots.txt、sitemap.xml、llms.txt,并按标准逐项判定;每项都保留原始证据(状态码、耗时、命中的原文片段)
- 复核方式:任何人都可以用「GEO 就绪度检测」对
cplastics.net重跑,规则与数据完全公开 - 局限性:只检测首页,未覆盖文章页与列表页;C5 只认站内可核验的引用痕迹(指向第三方平台的正文链接、出处标注、JSON-LD sameAs),真正的「被站外引用」见第六节,该节由搜索引擎查询得出、只作证据不计分;C1/C3 由规则推断,标准中已标注「需人工确认」;数据是 2026-09-20 的单时点快照,站点改版后结论可能变化
- 本报告由程序自动检测 + AI 撰写(撰写引擎:deepseek)。如你是本站主体,认为结论有误或希望撤下,可通过「关于我们」的联系方式告知,我们会在核实后更正或删除
附录:原始取数证据
| 资源 | HTTP | 耗时 | 大小 |
|---|---|---|---|
| 首页 HTML | 200 | 1445 ms | 50526 B |
| robots.txt | 200 | 2274 ms | 175 B |
| sitemap.xml | 200 | 1044 ms | 430 B |
| llms.txt | 200 | 1176 ms | 4667 B |
| 不存在路径探测 | 404 | 1190 ms | — B |
八、如何引用本报告
安企 GEO《cplastics.net GEO 就绪度检测报告》(2026-09-20):该站按《GEO 就绪度标准 v1.0》15 项判定通过 10 项,得分 10 分(满分 15),判定「不可见」。首要缺口为 A1「robots.txt 正确放行 AI 爬虫」。
- 报告名称:cplastics.net GEO 就绪度检测报告
- 检测日期:2026-09-20
- 发布方:安企 GEO(AnqiWeb GEO)
- 建议引用格式:cplastics.net GEO 就绪度检测报告,安企 GEO,2026