GenGrowth

GEO 工具

页面可引用性检查

贴一个网址,查看抓取访问、答案结构模式与原始/渲染证据。基础检查不需要账号或语言模型;可选 AI 语义复核需要登录并另行确认。

单页检查 · 基础检查无需登录

输入

一个页面,不是整站。该页需要返回 200 且是 HTML。

填了这项,开头直答那一行才会对着它检查;不填时那一行显示「不适用」,不会算成未通过。

基础检查不调用语言模型;可选 AI 复核需另行确认。

这项检查不做什么

  • 两个全新 Chromium 上下文在 12 秒、40 次 GET 和 2 MB 内对比同一 HTML,先关闭再开启 JavaScript。主动省略公开图片、媒体和字体;拦截私网、worker、socket、下载与跳转。不保留原始 HTTP CSP,而是施加更严格的安全策略。测量的是受控正文,不是完整图片/布局或所有浏览器的复现;不完整捕获不算比值。
  • 只读一个页面,外加该站的 robots.txt 与 llms.txt。不爬全站,也不去抓 canonical 指向的那一页。
  • 不涉及排名、流量,也不代表任何模型真的引用过这一页。它描述的是页面,不是市场。
  • ClaudeBot 与 GPTBot 的训练访问、Google-Extended 的 Gemini 训练/检索增强控制与 /llms.txt 不进入通用通过数。未测量 Claude-SearchBot 搜索抓取与 Claude-User 用户请求抓取。Google Search 抓取、AI Overviews 与 AI Mode 使用独立的 Search 控制。
  • 有三行采用模式匹配,不做语义或事实验证:开头回答标记、限定条件量化与数字来源线索。请查看证据后再判断。
  • 它只读页面的前一段。文档超出这个范围时,凡是要报「不存在」的检查都改说「读不到」。

关于这项检查

全部通过就代表模型会引用这一页吗?
不代表。这些行说的是访问与形态:抓取器是否被放行、正文是否在 HTML 里、一条结论能否被抽出来。模型是否真的用你的页面回答,取决于被问的问题以及网上还有什么,本工具从不声称能替你判断这件事。
为什么 ClaudeBot 与 GPTBot 只展示不计分?
ClaudeBot 与 GPTBot 采集训练材料,屏蔽它们不能证明检索失败。Anthropic 使用 Claude-SearchBot 搜索抓取、Claude-User 按用户请求抓取;本工具未测量这两项。Google-Extended 还控制 Gemini Apps 与 Vertex AI 中的 Gemini 检索增强,但不控制 Google Search 收录或排名,包括 AI Overviews 与 AI Mode。这些控制独立展示,不拼成通用引用分。
为什么没有 robots.txt 反而算通过?
RFC 9309 规定:robots.txt 不可得(404)等于完全放行,所以没有这个文件的站点并没有拦谁。robots.txt 读不到(例如 500)是另一回事——该站的规则未知,那一行会如实写「读不到」,而不是猜。
页面在我浏览器里正常,为什么 HTML 那行没通过?
本检查对比本次精确抓取的 HTML 与隔离 Chromium 渲染。如果大部分正文在脚本执行后才出现,不渲染的读者收到的内容就更少。报告会显示两次捕获;资源被拦、截断或渲染服务缺失时,比值是未知,不会算通过。

接下来去哪

这项检查只回答关于一个页面的一个问题,其余的在别处。