免费可引用性检测工具
粘贴一个页面 URL,逐信号查看 AI 引擎摘取答案所依赖的结构:自包含内容块、直接答案块、问答与步骤结构、可引用的表格、标题层级。每个负面结论都引用导致它的段落原文。这里没有 0 到 100 的综合分,这正是设计的一部分。
免费使用,无需注册:每天 10 次;登录后每天 30 次。 使用 Google 登录
只抓取一次页面的原始 HTML,不执行 JavaScript:这正是不渲染页面的 AI 爬虫所看到的内容。七个可引用性信号中六个由机器判定;第七个(可整段引述的句子)属于人的判断,工具明说这一点,而不是假装能判。
七大信号
结论怎么读
- ✅ 所测结构存在。
- ⚠️ 机器能确认的部分没问题或处在边界,实质好坏需要你自己读一遍(信号 2 的上限就是它)。
- ❌ 发现失败形态,旁边引用了证据原文。
- N/A 未适用:页面形态不需要这个信号。这不是失败;硬造出缺失的形态,正是手册警告的「假修复」反模式。
1 · 自包含内容块
— 单独摘出一段,离开上下文还能独立成立吗?
这项怎么测
实测内容:实质段落中以代词或回指开头(这、它、该、上述……)的比例,以及「如上所述」「见上文」「上表」这类断链引用。命中的段落会被引用原文。 定义 · 改法
2 · 直接答案块
— 答案是否出现在开头一两句话里?
这项怎么测
实测内容:第一个 H2 之前是否存在一段导语规模的开篇段落,以及章节是否以更深层标题开场。导语是否真的回答了问题属于语义判断,机器无法验证,因此该信号的上限被有意设为 ⚠️。 定义 · 改法
3 · 问答 / FAQ 结构
— 问句式小标题下面有真实的回答吗?
这项怎么测
实测内容:H2 至 H4 中的问句式标题,以及每个标题下是否跟着实质内容。标题是否命中真实用户查询无法机器判定。页面没有问句式标题时给「未适用」而不是 ❌:不要硬造 FAQ。 定义 · 改法
4 · 步骤 / HowTo 结构
— 页面若包含操作流程,是否写成了编号列表?
这项怎么测
实测内容:有序列表,以及出现「如何」「步骤」类标题却没有编号列表的情况,外加步骤长度。祈使句式不做检查。页面没有操作流程时给「未适用」而不是 ❌。 定义 · 改法
5 · 可引用的表 / 列表
— 每一行单独读,配合表名和列名还能成立吗?
这项怎么测
实测内容:表格是否带 caption(或紧邻其上的标题),以及是否有表头单元格。单独摘出即失去含义的行会被引用原文。页面没有数据表时给「未适用」。 定义 · 改法
6 · 标题层级规范
— 单一 H1、逐级嵌套、没有跳级?
这项怎么测
实测内容:H1 数量、跳级(H2 直接到 H4)、空的装饰性标题。这是唯一可以完全机械判定的信号,跳级会把前后两个标题一起引用出来。 定义 · 改法
7 · 可整段引述的句子
人工判定 每个章节是否有一句独立成立、摘出后依然完整的论断?
永远不由机器判定。一句话是否值得引述,恰恰是结构检查无法替代的语义判断,所以这一行留给人。审计手册配有正反例,可以照着自查。 定义
为什么不给分数
市面上的可引用性打分工具,没有一家公布计算公式。方法不透明的裸分数是传闻,不是测量:两家工具算出不同的分,谁也无法验证。可引用性审计手册记录了这一行业现状,点了名,并从原则上拒绝综合分。
这里交付的是真正可复现的东西:逐信号结论,附上证据原文,也就是以代词开头的段落、从 H2 跳到 H4 的标题、没有表头的表格。每一条结论你都能在自己的页面上几秒钟内核实。
检测过程
- 抓取一次页面,只取原始 HTML,不执行 JavaScript。这是刻意为之:不渲染页面的 AI 爬虫读到的就是它。如果 HTML 里几乎没有可读文本,这本身就成为头号发现,六个信号一律不再判定。
- 把文档裁剪到正文区域(优先 main 或 article,否则取 body 并剥离导航、页头、页脚与侧边栏),按文档顺序收集标题、段落、有序列表与表格。
- 按阶梯顺序对六个信号执行上方卡片里写明的结构检查。代词、问句形态与流程线索的识别支持英文和中文页面。
- 输出四态结论:✅、⚠️、❌ 与「未适用」,每个负面结论都附上导致它的原文。条件信号(3、4、5)在页面形态不需要时报「未适用」。
这个检测能判什么、不能判什么
- 它判定的是结构,不是真实性或权威性。六个结构信号全部就位的页面仍可能不被引用:检索、新鲜度与 E-E-A-T 是各自独立的关卡,可引用性只是采信阶段的那一根杠杆。
- 信号 2 只做结构验证,不做语义验证:工具确认答案位上有一段导语规模的段落,不确认它真的回答了问题。这就是它的最好结论止步于 ⚠️ 的原因。
- 信号 7(可整段引述的句子)被有意排除在机器判定之外。任何声称能用正则给它打分的工具,量的是句子长度,不是可引述性。
- 启发式词表针对英文和中文校准。其他语言只跑结构信号,被跳过的信号会明说,而不是硬猜。
- 抓取不执行 JavaScript。若内容只在客户端渲染后才出现,工具会如实报告,而这恰恰是此类页面最要紧的可引用性发现(改法见面向 AI 引用的写作)。
常见问题
为什么这个工具拒绝给 0 到 100 的可引用性分数?
因为分数要成为测量,前提是公布公式,而市面上打分的可引用性工具没有一家公布。可引用性审计手册第 8 节记录了这一点:商业打分器交付的是权重不公开的综合数字,从构造上就无法验证。逐信号结论附证据原文则是可复现的,每一条你都能对着自己的页面核实。再加一个综合分,只会添上一层虚假的权威感。
「未适用」是什么意思?没有 FAQ 会拖累可引用性吗?
「未适用」表示页面形态不需要那个信号,这完全正常。信号 3、4、5 是条件信号:定义型页面不需要步骤清单,叙事型页面不需要 FAQ。手册明确警告不要在形态不合的页面上硬造问句标题或编号步骤,那是「假修复」反模式,只会触发 AI 的内容过滤而不是帮助引用。该修的是 ❌,「未适用」不用动。
为什么信号 2 永远不显示绿色的 ✅?
因为机器只能验证答案位上确实有一段导语规模的段落,无法验证它真的回答了问题。给 ✅ 就是夸大了实际测量的东西,而这恰恰是这个工具要避免的毛病。信号 2 的 ⚠️ 应读作「结构已就位;现在请你亲自读一遍导语,问问第一句话是否就是答案」。
为什么抓取时不执行 JavaScript?
因为多数 AI 爬虫同样不执行。检测刻意采集 GPTBot 或 ClaudeBot 看到的东西:原始 HTML 响应。如果内容要等客户端渲染后才出现,工具会报告页面实际上是空的。对这类站点而言,这是最要紧的一条可引用性发现,而基于浏览器的检测器恰恰完全看不见它。
六个信号全过了,AI 引擎就会引用我吗?
不一定。可引用性是采信阶段的结构就绪度:它决定的是已经检索到你页面的引擎能否从中摘出可用的段落。能否被检索到取决于索引、爬虫访问与相关性,能否被信任取决于 E-E-A-T 信号。这个检测告诉你的是:段落层面的结构不再是瓶颈。其余关卡的位置,可引用性词条里有完整的地图。
延伸阅读