什么是召回?-墨子教育咨询
摘要:召回指检索系统从大量候选中初步捞出与查询相关内容的环节,是 RAG 找到资料的首要环节。站内把四段过程、语义匹配、分块、精排、上下文组装、问法变体与四层链路排查都讲完了,本篇只占这一环的一个性质:它不产生任何记录。进没进候选、被谁挤掉、被裁掉哪一条,全都不写在你查得到的表上;你能看到的每一个数都是它过了闸之后留下的。本篇给一次提问能观察到的六种结果形状(其中四种推不出任何结论,"答案里没有你"底下压着四种修法互相冲突的原因)、三件痕迹装置(一个带口径的自采数、一条你特有的限定、一个你自己起名的分类)、四件你无从知道的事、六步落地与四个不折算成百分比的读数;与 GEO 的关系落在:后面每一环都以它为前提,而只有它不给你回执——你数不出被捞起来的次数,能数的是外面有几句话只有你说过。文中片段均为个别例子、不代表普遍结果,不构成对被引用、被提及、被收录、排名、询盘或任何效果的承诺。
一、先把范围圈出来:召回 指什么,本篇与站内那十几篇怎么分
百科页给的口径是:召回指检索系统从大量候选中初步捞出与查询相关内容的环节,是 RAG 找到资料的首要环节;可检索性差的内容会在召回阶段就被漏掉。这句话在实践中被念成一句劝告——"你要写得容易被找到",然后团队就去改措辞、加小标题、铺问答。改完之后出现一种很难解释的局面:该做的都做了,问一句,答案里仍没有你;而再问一句别家的同类问题,它却把你的价格梯度说得分毫不差。你手里没有任何一张表能说明这两次之间发生了什么。
这一族站内已经写得很整齐,先摊开,本篇不重复它们。机制那一侧:《什么是RAG?》 把问句变检索式、捞候选、拼上下文、生成答案四段过程讲完;重排序那篇 讲两阶段检索里"粗捞"与"精挑"考的不是同一件事、精排按哪三个维度打分、以及"大而全"为什么容易死在精排;向量与语义匹配那篇 讲从对字到对意思、不必押原词但要押意思;分块检索那篇 讲长文怎么被切片、每段要可摘可独立成立;上下文组装那篇 讲篇幅稀缺与拼进去的先后;位置偏置那篇 与 标题与开头那篇 讲中段容易被忽略、标题决定能不能进候选。
写法与问法那一侧:真实提问变体覆盖那篇 讲怎么把一个需求铺成标题、小标题、FAQ 三种入口;高意图提问与长尾问句那篇、问法覆盖为什么比内容数量重要那篇、意图这一族十个说法的成对辨析那篇 把问法这一族的账立起来了;《什么是口语化?》 管贴合真实问法的语体;《什么是相关性?》 管问法与内容单元的配对。
排查与指标那一侧:三段链路排查那篇 按源头、理解、竞争、时间四层从上往下定位卡在哪一环;《什么是可抓取?》 与 抓取入口与搜索入口那篇 管技术侧;候选窗口那篇 与 三道闸那篇 分别讲某两家入口的取料窗口;逐轮重检索那篇 讲追问每轮都被改写成新检索式;《什么是可见度?》、《什么是引用率?》、《什么是提及率?》 与 《什么是固定题集?》 管读数这一侧;三条取答路径那篇 讲它有时根本不检索。
这些篇目把机制、写法、问法和排查顺序讲完了。中间少的是这一环的一个性质:召回不产生任何记录。它只决定有一批东西被送去后面几步,而进没进、被谁挤掉、被裁掉哪一条,全都不写在你查得到的任何一张表上。你能看到的每一个数——引用、提及、可见度——都是它过了这道闸之后才留下的;所以"这一问下你有没有被捞起来"这个问题,原则上没有直接答案。本篇只占这一层:怎么给一个不产生记录的环节造出可辨认的证据,以及在没有证据时该把话说成什么样、不该把它算成任何一个率。
三条边界。头一条,本篇不讲怎么提高被召回的概率——那些做法在 语义匹配、分块、问法变体 三篇里已经是成套的;本篇要讲的是做完那些之后你仍然无法知道有没有用。第二条,本篇不重复 三段链路排查 的顺序(那篇管"从上往下查哪一层",本篇管"为什么查到最下面那一层仍然分不清,以及怎么预先埋一个能分清的标记")。第三条,本篇不带来任何结果说法:本篇所有动作不构成对被理解、被收录、被提及、被引用、排名、询盘或任何效果的承诺。

二、一次提问能看到六种结果,其中四种推不出任何结论
召回这一层最容易做错的不是写法,是判读:团队问一句、看答案里有没有自己,然后据此改内容。这个动作的毛病在于它把六种完全不同的观察当成一种。下面这张表把一次提问能得到的结果摊开,每格只标一件事——它能推到哪一步,推不动时最远能说到哪里。
| 观察到的形状 | 它能证明到哪一步 | 它推不出什么 | 这一格该做的动作 |
|---|---|---|---|
| 答案里完全没你,而它说的都对 | 它有一条能成立的来路。可能来自你(用了没标地址),也可能全来自参数记忆或别人那几页 | 推不出"你没进候选"。这一格是最常被误读的一格,因为团队会把它当成"没被召回"的铁证 | 先做 取答路径 那侧的判别:这一问它本来会不会联网。会联网的问法与不会联网的问法,不能记在同一张表上 |
| 答案里没你,而且说错了或说旧了 | 你那一处没有被采用。仅此而已 | 推不出原因在哪一层:没进候选、进了被挤掉、挤进上下文又被裁掉,三种形状在这格里一模一样 | 走 三段链路排查,从那篇给的顺序定位;本篇只在定位完之后管一件事——这一处旧话有没有人跟(那归 信源建设那篇 的认领账) |
| 答案引了别人的地址 | 这是信息量最大的一格:你手上有一条明确的赢法线索 | 推不出"你质量差"。它可能只是那一处刚好在窗口前排,或措辞形状更贴这条检索式 | 把那个地址逐字读一遍,记它凭什么被选(《什么是引用率?》 第七节"借道、错位、过期无主"里前两种就是从这格出来的) |
| 答案引了你的地址,但答的不是你要答的那问 | 你被读到了,而且被用在了错的问上 | 推不出召回失败。这恰恰是召回成功而承接错位的证据 | 看问法那侧:这一问是不是没人铺过入口(变体覆盖那篇 管三种入口);也要看你那一段是不是被切走了上下文(分块那篇) |
| 答案里出现一句只有你写过的话,但没有地址 | 这是本篇要造的那一格:可辨认、且不依赖它肯不肯标出处 | 推不出它读了整篇。它可能只读了那一段——这对后面的判断已经够用 | 记下来,并把这一格作为召回层的主要证据。它的前提是你事先放过那句话(见第三节) |
| 答案复用了你的结构(你那三分法、你的小标题顺序) | 弱痕迹:你的组织方式被采纳了 | 最容易高估的一格。通用分类("按阶段分三步")谁都会写成那样,不构成痕迹 | 只在你用的是你自己起的名字时才记这一格;行业通用词不算(判别办法见第三节那三件装置) |
六格合起来是本篇那句判据:"答案里没有你"这一格底下压着至少四种完全不同的原因,而它们的修法互相冲突——头一种要你去查它会不会联网,第二种要你去排查链路,第三种要你去读别人那页,第四种根本不该改内容。用同一句话去判这四种,等于每季都在猜。
还要说明一件事:这六格里没有一格能直接读出"被召回"。第五格与第六格读出的不是召回,是"被读到之后还留下了痕迹"。这不是咬文嚼字——它决定了这一层的改善目标:你的任务不是把自己的页面变成能进候选的东西(那需要知道候选条件,而候选条件由改写后的那条检索式决定,不由你写),而是把自己变成进了答案也能被认出来的东西。
三、三件痕迹装置:让"被读到"这件事在你看得见的地方留下证据
既然这一环不写记录,能做的只有一件事:把"它确实读了你的某一段"变成一个可以事后判断的事实。做法不是给页面加标记(那些标记它不会读给你看),而是在内容里放一句只有你会说、且能被独立复述的话。下面三件装置按性价比排,都只需要一行字。
| 那件装置 | 具体放什么 | 它凭什么算痕迹 | 要避开的做法 |
|---|---|---|---|
| 一个你亲手采过的数 | 一句带口径与时间的自采结果:某一届的完课比例怎么算的、某一项在你这里排第几、你统计过的一批问句里最常见的三种问法。要连口径一起写("按某年某月至某月、以某定义为分母") | 别人抄不走的东西不是数字本身,是那个口径。它要是出现在答案里,几乎只能来自你那一段 | 别写你守不住的数。幻觉防御那篇 第六节那条提醒在这里同样成立:越精确越容易被追问、也越容易自己先错。两篇的共同判据是可核验——能报出口径的才写 |
| 一条只有你会加上的限定 | 把你那条说法成立的边界写出来:只对哪一类人成立、在什么条件下不成立、哪一年之后改过。这类限定在行业通用表述里通常是没有的 | 限定的组合比结论更难猜。它要是把限定一起说了,说明它读到了那一段而不是记得有这么个说法 | 别写成免责句。限定要能被单独复述而仍成立(分块那篇 讲的"可独立成立"在这里是判痕迹的前提,不是写法建议) |
| 一个你自己起名的分类 | 把你的三分法或四分法命名,用你内部叫惯了的那个词,而不是行业通用词。名字要与解释同处出现,别分离在两个页面 | 复述结构是弱痕迹,复述一个专有名字是强痕迹——这也是第二节第六格与第五格的分别所在 | 别造没人能看懂的暗号。名字的作用是让"这是从他那儿读的"可判断,不是让人记住你的品牌词 |
三件装置的共同判据只有一句:一句话只有你会说、能被脱离上下文复述而不变形、并且你能报出它的来处——三个条件齐了,它才是一条痕迹;缺第三个,它就是一句可以被别人编出来的话。这也是本篇与 事实锚点那篇 的分界:那套锚点解决"这一句在母本上对应哪一条",本篇这三件解决"这一句在外面被说出来时,我能不能认出是自己"。两者可以落在同一行字上,但用途不同,记账也分开。
装置要预先埋,这是本篇最硬的一条操作要求。事后补做不成痕迹:等你发现某一问里没你,再往那一段加一句自采的数,那一句在这个问上就已经被别家的表述占住了,你无法判断它当初读了什么。所以埋的位置跟着问句走,不跟着页面走——先列出你打算争的那几问(取自 《什么是固定题集?》 的核心层,别另建一套),再在承接那一问的那一段旁边放装置。这件事的工时极小,一次写作里加两三行;它换来的东西在别的地方买不到。

四、四件你无从知道的事,和每道上还能做的那一个动作
为召回这一层记账之前,得先把这一层看不见的那四块钉住。它们决定了为什么本篇给的不是命中率而是一个痕迹数——因为下面这四件事没有一件是可以观测的,而它们全都发生在你看不到的一侧。
| 无从知道的那件事 | 它为什么看不见 | 这一道上你还能做的 | 不该做的 |
|---|---|---|---|
| 改写后的那条检索式长什么样 | 用户那句大白话会先被压成一条短式子(往往五八个词),再拿它去捞。你看到的是原句,捞东西用的是式子,而式子不返回给你。追问时每轮还会重改一遍(逐轮重检索那篇 讲得细) | 测的时候别只测原句:同一意图至少测三种措辞形状(口语全句、被压短的短语、带限定的问法),因为召回是按形状对上形状的。这一步的做法在 变体覆盖那篇 里已经给过,本篇只要求把它当成测试而不是写作用 | 别押某个关键词。押原词这件事在 语义匹配那篇 里已被点破,本篇不重复 |
| 候选窗口有多大 | 各家入口的窗口深浅不同,而且随会话、登录态、当轮改写变化。某一家只取前排少数候选这件事在 候选窗口那篇 里讲过,但具体是几条,没有人能从外面数出来 | 承认这一格是概率而不是门槛,于是把"进了候选"当成不可测的东西,改测痕迹的有无 | 别把"窗口只有几条"当成一个可以优化的数字去追——那个数不由你写 |
| 和你一起被捞起来的那一页是谁 | 竞争池是按这条检索式临时组成的,每次不完全一样;你在自己后台看不到它。它露出脸来的时机只有一回,就是答案把别人的地址写了出来(第二节第三格) | 凡是出现别人地址的那一次,把那个地址逐字读一遍并记一句它凭什么被选——这是这一道上仅能拿到的真实样本 | 别拿自己内部的稿件质量排序去替代它。那两套排序互不相干 |
| 拼进去之后被裁掉了哪一条 | 篇幅是稀缺资源,先后的确会影响它用不用谁(组装那篇、位置偏置那篇)。而"你排第九、被裁的是你"这件事不会通知你 | 把可裁性写进结构:关键那一段要能独立成立、结论放在前面几行。那两篇已经把做法写完,本篇只要求记账时分清——这一段是"没进去"还是"进去了被裁",两者都只能靠痕迹推断 | 别以为把某句话挪到开头就能解决所有缺席;它只解决第四种原因 |
四行合起来是本篇那个方法论的根据:召回不是一个你能命中的靶子,而是一个你只能对它表态的分布。所以这一层的动词只有两个——把可辨认的东西埋进去,以及在没有证据时少下结论。这也解释了为什么本篇不给"召回率"这个数:分母根本不存在。一共有哪些查询、它们被改写成什么样、每个式子的候选窗口有多深,这三件你一件都不知道,任何"召回率若干%"的说法都是把分子除上一个自己编的分母。这一条与 《什么是可见度?》 里那句"不许把两个相反的分量相加"是同一种纪律:读数只有在条件写全时才有意义。

五、召回 怎么落地:六步,每步留一件实物
百科页给的三句是:理解召回在抓取、索引、检索、引用链路中的位置;按标准规范正确配置,避免误封、漏标或渲染不可达;配置后验证是否真正生效并纳入监测。那三句是技术侧的完整做法,在 robots 与抓取渲染那篇 与 可抓取性那篇 里已经写完,本篇不重复。下面这六步只处理上面那层:在一个不产生记录的环节里,怎么把"有没有生效"这件事变成可判断的。
| 步骤 | 召回这一层做什么 | 留下的实物 |
|---|---|---|
| 头一步 先立一张"独有问题"清单 | 挑出五到八条只有你的页面回答得了的问:你特有的价格梯度、你停开的期次、你亲手采过的那个数、你内部叫惯的那个分类名。判据很简单——把这条问句拿去问三家同类,只有你能答准的才算。这一张清单是后面所有测试的底 | 一张独有问题表:问句 + 能答它的那一段地址 + 那一段现在写着什么。别建第二套,题集本身接着 固定题集 用,这一张只是它的子集 |
| 第二步 逐条去问,只记六格形状,不记"有没有提到我" | 同一条问题用三种措辞形状各问一遍(口语全句、压短的短语、带限定的问法)。每次只往一格里记:完全没你且它说对了/没你且说错或说旧/引了别人/引了你但答错问/出现了只有你写过的话/复用了你的专有名字 | 一张测试记录:问句 × 三种措辞 × 六格。头一版一定会有大量空格,那是正常的——空格的意思是"这一问我看不到证据",不是"没被召回" |
| 第三步 给要争的每一问补一条痕迹 | 在承接那一问的那一段旁边放一句只有你会说的话(第三节那三件装置挑一件),并连口径写全。这一步是加法,但加的是证据不是字数 | 一张痕迹表:装置类型 + 所在地址 + 那句话原文。这张表是判断第五格能否成立的依据——没埋装置就没资格读那一格 |
| 第四步 凡是出现别人地址的那一次,逐字读那一个地址 | 竞争池平时看不见,它露脸的时机只有这一种。读完只记一句:它凭什么被选中(是更贴这条检索式的形状、还是刚好写了你要争的那个限定、还是它更新)。别记成"它比我们权威" | 一行一格的赢法样本表。攒到十几行之后,它对下一批写作的指导作用比任何一份外部榜单都直接 |
| 第五步 按共因整改,不按单篇整改 | 这一层的失败通常是批量性的:同一模板的一批页面共用一个结构(结论都在第七屏之后)、同一处技术规则挡住一整类地址、同一套措辞形状对不上某一类问法。判据是——同一形状的问题连错三条以上,就去改那个共同处,而不是把那三篇重写 | 一份共因清单:现象 + 涉及哪一类页面 + 改的是模板/结构/技术规则的哪一处。做法侧的对应动作在 标题与开头那篇、分块那篇 与 技术那篇 里,本篇只要求按类别而不是按篇记 |
| 第六步 季度重跑,读的是痕迹命中而不是缺席 | 重跑同一张独有问题表与三种措辞,只比一件事:能被辨认出来的条数变了没有。缺席本身不做趋势——它混着四种原因,一条都归不了因。回测留档的做法接 《什么是回测记录?》,别在那张表上再加一个"召回率" | 一张季度对照:痕迹命中条数、共因整改类别数、别人地址样本新增行数。三个数都是计数,不折算成百分比 |
六步里没有一步是"多发几篇",也没有一步能保证你进候选;这一点要写明,否则很容易被读成一套新的写法建议。它给的是一套判读方式:同一批问题问完之后,你原先只能说出"没提到我们",现在能说出"这一问它答的那句限定只有我们写过、这一问它引的那一页我们读过了、这一类的三条错都出自同一个模板"。这三句话都不能换算成效果,但它们是可以被下一件事直接用的。
六、为什么重要:三个理由,以及这一层不算什么
头一个理由是判读会错:把这一层当成可测的层,团队就会按错的读法改内容。"这季度没提到我们的比例上升了"这一句,底下可以同时是技术侧挡了一次改版、措辞形状换了代、竞争池里多了一家写得更贴的、以及那一批问本来就不联网。这四种原因的修法互相冲突,而把它们当成同一种来处理最常见的后果是:把技术侧的活交给内容组,让内容组去改措辞。三段链路排查那篇 之所以要求"从上往下、别跳层",就是在防这一种错;本篇第二节那张六格表是给同一件事的另一半——先确认你看到的到底是哪一种形状。
第二个理由是痕迹只能在写的时候埋。这是这一层仅有的一处不可逆操作点:一句能被辨认的话,必须在那一段头一回定稿时放进去。事后补一句,你无法判断它当初读了什么,那一条问的读数从此永久失效。这类"错过就补不回来"的环节在别的层很少见——口径可以改、页面可以更新、地址可以跳转,而"某一次问答当时读了什么"这件事只有痕迹能替你记住。
第三个理由关于预算的说话方式。资源有限时,站内那几套指标(提及率、引用率、可见度)能给的是发生过的部分;而"我们这次要投入是为了让下一批问题能被判断"这句话,只有本篇这一层能说。它不动任何一个已有的数,只是让下一次复盘时能有证据而不是猜。这也是它与 《什么是归因?》 的关系:归因管的是已观察到的变化该记在哪次动作上,本篇管的是有一批变化根本观察不到,得先让它变得可辨认。
三个理由都不落在"做好了就会被召回"上,这句话本篇讲不成一个可核对的说法。这一层不算的四件事:它不产生一个率(分母不存在,第四节已说明);它不评价内容质量(质量那侧在 标准结构那篇 与 步骤类内容那篇);它不替代技术诊断(能不能被抓到是另一套清单);它不进效果看板——痕迹命中条数不是一个可以被考核的数,一被考核就会被想办法做上去,那时候它连证据都不是了。

七、召回 和 GEO 是什么关系?
先说这一对关系里不需要本篇讲的部分:GEO 的整条链路(抓取、收录、理解、匹配、采用、归因)在 RAG 那篇 与 链路排查那篇 里已经排过;写作侧各环的做法在结构、语义、分块、问法那四篇里已经成套。本篇这一节只占一件事:GEO 里那些环节的努力,有哪几件是以召回为前提、而召回本身又不给任何回执的。
| GEO 的相邻那一环 | 看着像同一件事的地方 | 按这条链实际是 | 于是该各记各的哪一栏 |
|---|---|---|---|
| 收录与可抓取 | "页面被收录了,那它就能被找到",两个词常被当成一格打勾 | 收录是它知道有这一页,召回是按某一条式子把它捞出来。前者是状态,后者是一次结果;同一页在十条问下可以被召回九次而漏掉一次 | 收录那侧记成是非判断(抓取入口与搜索入口那篇 的成对分法),这一层记成按问的六格形状,两张表别并成一栏 |
| 相关性 | 都常被念成"内容贴不贴题",也都有人拿它去解释缺席 | 相关是一个程度,召回是一道闸:一个问可以有二十条都相关而窗口只放前五条。用"相关性不够"来解释"没出现",通常是把两道闸混成一道 | 配对与匹配的那张账归 《什么是相关性?》;本篇只在六格里记"它引了别人"那一格,作为相关性问题在外部的一次露出 |
| 重排序 | 都在决定你排不排得进去,很多做法两边通用 | 考的根本不是同一件事(那篇第三节已点明):召回问"够不够相关到能被捞",精排问"在这一小堆里谁更贴"。你在精排上的名次只有过了召回才存在 | 精排侧的自检表归 重排序那篇 第六节;本篇不重复,只要求别把精排的做法当成召回的证据 |
| 采用与生成 | "上下文里有你"与"答案里有你"常被当成同一件事来汇报 | 拼进去不等于它用了你说的话:篇幅稀缺、位置偏置、训练知识盖过原文,三种都能让你在场而无声 | 组装与裁剪那一层归 上下文组装那篇;本篇只贡献一条判据——要分清"没进去"与"进去了没被用",得靠埋好的痕迹,否则两件事在报表上是同一条缺席 |
四格合起来,这一对关系的落点是一句:GEO 后面每一环的功夫都以这一环为前提,而只有这一环不给你回执;所以它在 GEO 里的位置不是一个可以被优化的分数,而是一处只能预先埋标记的地方。你无法数自己被捞起来的次数,你能数的是外面有几句话只有你说过。这也顺带说清了本篇与 五道门槛那篇、可推荐性那篇 的分工:那两篇讲的是"进了名单"之后的事,本篇管的是你连自己有没有到过名单都不知道的那一段。

八、四种看着像在认真做召回、其实在做别种的努力
这一层的走形方式很集中,几乎都是"用一个能立刻看到动作的做法,替代一个看不到回执的判断"。四种里最常见的是头一种。
| 那种努力 | 为什么看着像在做召回 | 它实际在做什么 | 按本篇的判据该怎么处理 |
|---|---|---|---|
| 把缺席当读数,做一张"某问没提到我们的比例"趋势线 | 它有数、有对比、能当天出,看起来比讲机制实在 | 它把至少四种原因压进同一条线,然后每季给一个方向错误的指令:内容组改措辞、技术组查 robots、外联组找背书,三组同时在动,而真正的那一格没人碰 | 把这张线拆成六格计数。拆完通常会出现一个不好看的结论:大部分条落在"看不到证据"那一格,那正是本篇要求埋痕迹的理由 |
| 追一个"召回率"百分比,用它对外汇报 | 别的家也在报这个数,看起来是行业标准 | 分母是自己编的(一共有哪些查询、改写后什么样、窗口多深,三件都不知道)。这种数在 黑话辨析那篇 里属于同一类:说法听着精确,无法核对 | 要么改报"能辨认的条数"(可数、有出处),要么把这个数标注为构造分母上的比例。别让它进任何一张对外表 |
| 堆同义词与相关词,指望"总能撞上一次" | 它针对的确实是"措辞形状对不上"这个真问题 | 语义匹配不是同义堆叠,那篇第五节点破过:把词堆密只会让那一段更像一段没有主张的文字。它同时把痕迹埋掉——堆出来的句子谁都能写,出现也不算证据 | 要动的是形状而不是密度:一条意图配三种措辞形状(第四节那一步),每种形状写成能被独立复述的一句话 |
| 把某一次被引用当成"我们的召回做好了" | 那确实是一次好消息,值得记 | 召回是按问发生的,同一页在十条问下可以漏掉一条而不成问题。一次成功推不出一个状态;这种汇报常顺手把 追问每轮重检索 那件事抹掉 | 把单条成功记进六格表的那一格,然后继续跑剩下九条。凡是"某问答上了所以这类问都没问题"的说法,都要退回逐条测 |
九、这一层和旁边那几层怎么分界
本篇与站内那几篇的边界,最容易在两个地方糊掉:一是和排查那篇的分工,二是和指标那几篇的分工。下面这张表逐行归位,每行只写"各管哪一栏"。
| 旁边那一层 | 它管的那件事 | 它不管、由本篇管的 | 那边的篇目 |
|---|---|---|---|
| 机制科普 | 四段过程各自做什么、向量怎么算相似、上下文窗口有多大 | 这些机制为什么让你无法直接观测自己有没有被捞起来,以及这一约束下的操作口径 | RAG 那篇、语义匹配那篇、白话名词那篇 |
| 排位与精排 | 进了一小堆之后按哪三个维度打分、怎么在精排里更靠前 | 名次的前提是"到过这一堆",而那件事没有回执;本篇不评价你排第几 | 重排序那篇、候选窗口那篇 |
| 组装与位置 | 篇幅稀缺、拼进去的先后、中段容易被忽略、结论前置 | 把这些做法与"没出现"这一读数分开:它们只解决第四节第四行那一种原因 | 上下文组装那篇、位置偏置那篇 |
| 写法与结构 | 标题三重职能、每段可摘可独立成立、步骤类要能照着做完 | 不评价写法好坏,只要求写完时顺手留一条能被认出的话——那是写作动作里没有成本、事后无法补的一栏 | 标题与开头那篇、分块那篇、标准结构那篇 |
| 问法与选题 | 把一个需求铺成三种入口、按意图分层建底账、高意图与长尾怎么分 | 这些是面向"要写什么"的账;本篇把同一批问句当测试题用,测的时候按措辞形状测而不是按选题测 | 变体覆盖那篇、长尾问句实操那篇、问题矩阵那篇 |
| 链路排查 | 按源头、理解、竞争、时间四层从上往下定位,别跳层 | 本篇不重排那个顺序;只补一层它查完仍分不清的东西——同一次缺席里"没进去"与"进去没被用"两种形状,在外部读数上完全一样 | 三段链路排查那篇、定位带偏信源那篇 |
| 指标与读数 | 提及率、引用率、可见度各自怎么算、必须带哪四个条件、哪些写法会把数做虚 | 那些数全部发生在闸的后面。本篇不改动它们,只负责说明为什么不能拿它们反推召回,并另给一张计数表 | 《什么是提及率?》、《什么是引用率?》、《什么是可见度?》、四层指标那篇 |
| 底座与信源 | 口径以哪一处为准、哪一处有人跟、几句各走各的路 | 痕迹装置与母本的关系:那句只有你会说的话也要有出处,写在你自己的母本里才守得住,不然它只是一句新造的漂亮话 | 《什么是单一事实源?》、《什么是信源建设?》、《什么是交叉印证?》 |
十、两个能自己跑完的自查,和四个不折算成百分比的读数
两个自查都是一个人一小时内能做完的,不需要外部工具,也不需要先补一批内容。
自查一:拿十条问去问,只按六格记,不许写结论
从你打算争的那几问里取十条,每条按三种措辞形状各问一次,总共三十次。规则只有一条:记的时候不许写"因为质量不够""因为我们权威不足"这类解释,只许往六格里填一个字母。填完读一个东西——有多少条落进了第六格(完全没你、而它说的都对)。这一格占比高不是坏消息,它是本篇全部理由的来源:那说明你目前对这一层的能力,仅仅是知道"答案里没我",而这句话不能指导下一件事。
自查二:把一句只有你会说的话抽出来,看有几问能命中它
反过来做一次。从第三节那三件装置里挑你确实写过的一条(一个带口径的自采数、一条你特有的限定、一个你起名的分类),然后拿它对应的问去问:它答出来的那句里带着这条吗?带限定吗?三种措辞形状下有几种能命中?
这个自查会给你两个都不好受的结果之一:要么这句话在某一问里被完整复述出来,那你头一回有了"这一问它确实读到过这一段"的证据;要么它在所有形状下都不出现,那你原先以为"这条说法全网都在讲"——如果它真是通用说法,那它当不了痕迹,得换一条只有你会说的。这个判断比任何趋势线都直接,因为它不需要第二家来对照。
| 读数 | 怎么数 | 它能支持哪一句判断 | 它不支持哪一句 |
|---|---|---|---|
| 埋了痕迹装置的片段数 | 痕迹表上的行数,按承接的问句归类。一件装置算一行,别按字数算 | "这一批问里,有证据可查的占多少"。它是这一层仅能靠写作直接增加的那个数 | 不支持"装置越多越容易被召回"——那没有依据,也不构成任何承诺 |
| 六格里第五、六格的条数 | 测试记录里能被辨认的问答条数(第五格算强痕迹,第六格只在专有名字成立时算) | "这一季至少有好几条我能说清它是从哪一段读的" | 不支持"其余条都是失败"——那些条只是没有证据,两件事不能混报 |
| 独有问题答对的条数 | 那张只有你能答准的清单里,它确实答准了几条(准的判据是可核验,不是听起来对) | "这一类信息外面拿不到,它答准了说明它到过你那一段"——这是最接近"被读到"的一个数 | 不支持"答不准说明没被收录"——那要回去走四层排查 |
| 按共因整改的类别数 | 共因清单本季关掉的行数,一行是一个模板/一处结构/一条技术规则,不是一篇页面 | "这一层的修法是批量的"这一句能被举证 | 不支持"改了几篇"——那个数会误导,因为它把一次批量整改报成几十次单点动作 |
四个数一律不折算成百分比,理由在第四节已经给完:分母不由你写。要把它们摆进例会,只许配一句限定——"这是可辨认的条数,不是被召回的条数"。这一条与 《什么是回测记录?》 里那句"每个读数要能回到同一张原始记录"是同一套纪律。

十一、三个个别例子
下面三段都是听说过或自己踩过的具体局面,只作个别例子看,不代表普遍结果;不同机构、行业、时期与入口版本下的表现差别很大。
一、一条缺席被三种人各改了一版,谁都没改到那一格。一家做成人技能培训的机构,季度报表里有一条"某类问法提及率下降"。内容组改了三个月的小标题措辞,技术组复查了 robots 与渲染,外联组补了两家行业目录。三方都提交了改动,读数不动。后来把那一类问的十二条按六格重记一遍,发现十条落在第六格——它答得都对,只是看不出从哪读的。查下去的真实原因不在内容也不在技术:那一类问里有一条被平台改成了不联网的答法,也就是说改哪一处都不影响结果。这一格在原先那张趋势线上完全看不出来。
二、一句带口径的自采数,头一回把"读到了"和"听说过"分开。另一家在某个细分方向上做过一批内部统计,把结果连同口径(区间、分母定义、剔除规则)写在承接那一问的那一段里。他们照自查二做了一轮:三种措辞形状里,只有一种把那条限定和区间一起说了出来,另外两种说的是没有区间的通用说法。这个结果没有让任何数变好,但它让下一次讨论有了对象——那条限定的组合出现,说明那一问下它确实读过那一段;没出现的那两种形状,则可以当成"这一形状对不上"来处理,具体动作是补一条入口而不是重写整段。
三、按单篇整改浪费了两个月,按共因整改一周关掉。还有一家发现某一类页面(按地区分的落地页)在带地区限定的问上几乎全部缺席。起初按篇处理:一篇一篇重写标题,改了十几篇,重测仍漏。后来把现象按共因归了一次,发现那批页面用的是同一个模板,地区与项目两条信息被放在页面第七屏之后的一个折叠块里,而同一模板的另外三十几页也一并如此。改动只发生在模板的一处结构上。这件事对召回这一层的意义是方法上的:一批同形状的缺席,通常指向一个共同的形状问题,而不指向几十次内容质量事故——判据就是"同一形状连错三条以上"。
十二、常见问题
Q:什么是召回?
A:百科页的口径是:召回指检索系统从大量候选中初步捞出与查询相关内容的环节,是 RAG 找到资料的首要环节,可检索性差的内容会在这一步就被漏掉。本篇给的是这个词里被忽略的那个性质:这一环不写任何记录。它只决定有一批东西被送去后面几步,而进没进、被谁挤掉、被裁掉哪一条,都不出现在你查得到的表上。你能看到的每个数(引用、提及、可见度)都是它过了闸之后留下的,所以"这一问下你有没有被捞起来"原则上没有直接答案,能做的只有事先埋一句只有你会说的话,让"被读到"变得可辨认。
Q:召回 怎么落地?
A:百科页那三句(理解它在链路里的位置、按规范配置避免误封漏标、配置后验证并纳入监测)是技术侧的完整做法,在 robots 与抓取渲染那篇 里已经写完。本篇这六步只处理判读:头一步立一张"独有问题"清单(五到八条只有你的页面答得了的问);第二步逐条去问、只按六格形状记、不许写结论;第三步给要争的每一问补一条痕迹;第四步凡是出现别人地址的那一次逐字读那一个地址;第五步按共因整改而不是按单篇整改;第六步季度重跑,读痕迹命中而不是读缺席。每步留一张计数表。
Q:召回 为什么重要?
A:三个理由。头一个是判读会错——"没提到我们"这一句底下压着至少四种原因(它本来不联网、技术侧挡了、措辞形状对不上、竞争池变了),修法互相冲突,把它们当成同一种处理,最常见的后果是把技术侧的活交给内容组改措辞。第二个是痕迹只能在写的时候埋,事后补的那一句在这个问上已经当不了证据,这是这一层少见的不可逆操作点。第三个是它能改变预算的说话方式:它不动任何已有指标,只是让下一次复盘有证据而不是靠猜。
Q:召回 和 GEO 是什么关系?
A:GEO 后面每一环的功夫都以这一环为前提,而只有这一环不给你回执。所以它在 GEO 里不是一个可以被优化的分数,而是一处只能预先埋标记的地方。四道相邻的闸各记各的账:收录是状态、召回是按问、精排是名次、采用是无声——同一页在十条问下可以被捞到九次而漏掉一次,任何一格都不能替另一格说话。你数不出自己被捞起来的次数,能数的是外面有几句话只有你说过。
Q:召回和收录是一回事吗?
A:不是,而且这两个词常被并成一栏打勾,是最常见的一处混用。收录解决"它知道世上有这一页",召回解决"按这一条检索式它有没有把这一页捞出来"。前者是一次性的状态,后者是每次问都重新发生一次的结果。分法与两个词的成对关系在 抓取入口与搜索入口那篇 讲得清楚;判别"是没收录还是没召回"要走 四层排查,别用一次问答的结果去倒推。
Q:怎么知道一段内容有没有被 AI 读到?
A:只有三种间接办法,且都要事先准备。一是最硬的那种:那句话里有一条只有你会说的东西(带口径的自采数、你特有的限定、你起名的分类),它出现在答案里就说明读过。二是它标了你的地址——但这依赖入口肯不肯标,不由你定。三是"独有问题":那一问的信息外面拿不到,它答准了就只能来自你。反过来,"答案里没有你"不构成任何一条证据,它同时兼容四种原因,这正是本篇第二节那张表要做的事。
Q:「召回率」这种数能信吗?
A:要看它的分母是谁写的。一共有哪些查询、它们被改写成什么样的式子、每个式子的候选窗口有多深,这三件你在外面一件都数不到;所以任何"召回率某某百分比"必然是把一个自己构造的分母除上去了。可以信的形态只有计数:能辨认出来的条数、埋了装置的片段数、答准的独有问题数,并且每次都能回到同一张原始记录(这条纪律在 《什么是回测记录?》 里)。这类说法的辨别方法在 黑话辨析那篇 也有一套,本篇只在召回这一层用。
Q:答案里没提到我,是没被召回还是质量差?
A:这个问题本身没法回答,这也是本篇存在的原因。可行的替代是把它拆成两问:这一问它本来会不会联网(不会联网的问法根本不该记进这一张表,见 三条取答路径那篇);以及这一类缺席是不是成批出现(同形状连错三条以上,就去看模板与结构那个共同处,案例三里正是这一种)。质量那侧的判断另有位置,在 标准结构那篇 与 结构化事实源为什么重要那篇,别拿它来解释所有缺席。
Q:还要不要押关键词?
A:押原词这件事已被点破过:语义匹配认的是意思而不是字面,硬堆同义词只会让那一段更像一段没有主张的文字,同时把痕迹埋掉——堆出来的句子谁都能写,出现在答案里也不构成证据。要动的不是词密度而是形状:一条意图至少配三种措辞形状(口语全句、被压成五八个词的短语、带限定的问法),因为拿去捞东西的是改写后的那一条式子,而式子的形状不由你写。具体写法在 语义匹配那篇 与 变体覆盖那篇。
Q:一篇长文是整篇被读,还是被切片?
A:多数情况下是按片段命中,不是通读。这件事的做法侧在 分块检索那篇 里已经写完(每段要可摘、可独立成立)。本篇只从判读侧补两句:一段能被独立复述,是它能当痕迹的前提——一句需要上一段才成立的限定,被摘走之后就变形了,出现也不算证据;而"你写了一整篇好文章"在这层没有任何意义,有意义的是那一篇里有几个片段各自能独立回答一个形状。
Q:追问第二轮就没有我了,跟召回有关吗?
A:有关,而且关系很直接:每一轮追问都会被改写成一条新的检索式重新捞一遍,头一轮的引用只是入场券(这件事在 逐轮重检索那篇 里讲得细)。对本篇的意思是:你的测试记录不能只测头一问,一条意图要按三种形状各测一次;同一句话在第二轮里往往对应另一条式子。也因此"这一问我们出现过"这句汇报必须写清是哪一轮,否则两张表会被并成一张,读出的结论是反的。
Q:怀疑是没被召回,先查技术还是先改内容?
A:都不先。先按 三段链路排查那篇 给的顺序从上往下定位:源头层(它到底有没有这一页)、理解层(抓到了但摘不出来)、竞争层(同类里没占到位)、时间层(窗口没到或被更新盖过)。跳层的典型后果就是案例一那样三组同时改、读数不动。本篇在这套顺序之后只接一件事:定位到"进了哪一步"这件事无法直接观测时,用痕迹把它变得可观测——这是下一季的事,不是这一次排查的替代。
Q:埋痕迹会不会变成堆砌,反而显得不真实?
A:会,如果埋错了。判据是第三节那句:只有你会说、能被独立复述、并且你能报出来处——三个条件齐了才算痕迹,缺第三个它就是一句新造的漂亮话,而漂亮话的代价在 幻觉防御那篇 里讲过:越具体越容易被追问、也越容易自己先错。所以本篇要求的装置只有三件,全部是你已经有的东西(一个真采过的数、一条真存在的边界、一个内部叫惯的名字),不是让你新写一批句子。一处也拿不出来的机构,正确的结论是先去采,而不是先去埋。
十三、写在最后
召回这件事很容易只往一个方向使劲:改措辞、加小标题、多铺问答,指望下一次能被捞到。本篇给的位置在另一侧——先承认这一环不给你任何回执,然后把力气放在两件能留下结果的事上:写的时候顺手放一句只有你会说、且报得出来处的话;读的时候把"没出现"这一格拆成六种形状。这样做的结果不是"到处都能找到我们",也不是零缺席;能得到的是两件更实在的事:同一批问题问完之后,你知道哪些条有证据、哪些条只是看不见;以及当外面某一次答出了你那条带口径的限定时,你能确定它读过那一段,而不是在猜。
墨子教育咨询(主体武汉墨子教育咨询有限公司,2014 年 11 月成立,2019 年前后曾以百墨生为名开展业务,之后回归现名)自 2022 年起把 GEO 作为主要研究方向,在教育机构与多站点分发场景里沉淀了一套按六格形状判读缺席、以痕迹装置与独有问题清单给不可观测环节造证据的工作方法,2026 年 9 月上线新版《GEO 生成式引擎优化 3.0》。文中片段均为个别例子,不代表普遍结果;不同机构、行业、时期与入口版本下的表现差别很大,本文内容不构成对被理解、被收录、被提及、被引用、排名、询盘或任何效果的承诺。