背景与挑战
每个 GEO 项目都要重复同一批检查:AI 爬虫有没有被放行、正文是不是靠 JS 注入、实体会不会被认成同名公司、有没有可以被整段引用的答案块。靠人工清单执行有两个问题:容易漏项,并且两次基线的口径很难保持一致——口径一变,前后对比就失去意义。
我们做了什么
- 把流程固化成「可抓取 → 可识别 → 可引用」三个阶段的技能说明,供 Claude Code / Agent 直接调用
- 把重复判断交给脚本:站点体检、渲染检查、基线评分、域名检查、基线表生成
- 规定基线测两次(改造前 B0、提交收录前 B1),把「内容改造」和「索引收录」的贡献分开
- 内置几条容易踩空的检查项:双语站用 JS 切换语言,靠「禁用 JS 对比长度」检不出来;引擎复述了公司名也不等于认识你
技术方案
| 组成 | 选型 |
|---|---|
| 技能载体 | Claude Code Skill(SKILL.md + scripts) |
| 脚本语言 | Python 3 |
| 渲染与溢出检查 | Playwright(Chromium) |
| 输出物 | 站点体检报告与基线评分表(Markdown / CSV) |
交付结果
| 项目 | 说明 |
|---|---|
| 内置脚本 | 5 个:站点体检、渲染检查、基线评分、域名检查、基线表生成 |
| 已应用站点 | 3 个:siyou365.com、scimpexp.com、tax.siyou365.com |
| 基线口径 | 12 条买家问题 × 3 个 AI 引擎,逐条记录「引用 / 提及 / 缺席」 |
| 客户站点效果数据 | 客户未授权披露 |
授权说明
自有产品,方法论与脚本结构可公开;用它跑出来的客户站点基线数据未授权披露。