什么是可发现性?-墨子教育咨询
摘要:可发现性指内容被引擎与用户找到的难易程度,受收录通道、结构、语义匹配与外部链接影响,是 GEO 曝光的基础。站内把技术可达、各平台从哪里捞结果、指标怎么量、实体怎么立都讲完了,本篇只占更靠前两层:一件是把"没被找到"按层切开——能被找到是路径问题、会被找到是分布问题、被当成谁找到是归属问题,三层的工作量、结案标准与该找的人完全不同,任何一层的通过都不会自动带来另一层;另一件是计量单位——被找到的到底是站点、页面、句子还是字段,答案真正取用的是句子与字段,而多数机构的自查停在站级与页面级,于是每一次查都是好消息。本篇给出三问定位法(换问法、贴地址、换平台,八种组合各落一闸)、六步落地与四个不许合并的读数;与元宝的关系落在:它不是另一个搜索引擎而是几条通道的合称,其中两条根本不经过检索。文中片段均为个别例子、不代表普遍结果,不构成对被引用、被提及、被收录、排名、询盘或任何效果的承诺。
一、先把这词指的东西说准:它不是一扇门,是三件各自独立的事
"可发现性"这个词的日常用法是把它当一个程度:可发现性高、可发现性低,好像修一修就能整体往上抬。真去查的时候不是这样运转的。有一家机构,页面全被收录、抓取没有任何问题、内容也是当期的,可它在某类问题上一句没有被拿到过;还有另一家反过来,被拿到得很频繁,但每次拿到的都是页面上那半段无关的话,真正想被说的那句从来没被单独取走。这两种情况用"可发现性高低"都没法描述——它们卡在完全不同的地方,修的地方也完全不同。
把话说得更狠一点:可发现性不是一个程度,是一串各自独立的闸门,而多数机构把它当成一扇门在修。这就是这个词最容易被误用的地方——它听起来像一个可以整体改善的属性,实际上它是好几件不同工作的合称,其中任何一件做好了都不会自动带来另一件。

这个词条在站内的分布很散,四十篇命中,我把已经讲掉的几处点名分工:可抓取那篇管的是技术可达这一层——页面能不能被访问、正文能不能被读到,它甚至列了六种失败形状;抓取入口与搜索入口那篇把这一族词逐条分开,可抓取性、抓取收录、提交收录各管哪一段;站点地图那篇说明它只是清单不是门票,能降低被发现的成本但决定不了抓不抓;机器可读那篇 与 网站技术适配那篇管的是内容组织方式对机器的友好程度;可见度那篇管的是结果侧——你被看到的整体程度,并且明确不许把几个分量合成一个分数;召回那篇管的是检索这一环不产生记录这件事,所以只能从旁证推断;信源建设那篇把"被抓到"列为四项长期义务的头一项;问法覆盖那篇管的是真实问法那一侧的铺开。元宝这一族还另有一套:元宝联网引用走搜狗与搜一搜那篇讲它当场会去捞哪批结果、怎么补才不被埋;本地门店那篇讲带地理与条件限定的提问怎么走字段;三通道那篇讲记忆、检索、直读要分开回测;实体一致那篇讲混元记忆里那个关于你的节点怎么不认错;沉默三级台阶那篇讲整条缺席、泛指化、免责声明式提及这三种沉默。这些篇把"技术上通不通、各平台从哪儿捞、指标怎么量、实体怎么立"都讲完了。中间少的是两件更靠前的事:一件是把"没被找到"这一件事按层切开——它能被找到但不一定会被找到,也会被找到但被当成别家,这三层的工作量、结案标准和负责的人完全不同,而多数人把三层混成一个分数在抬;另一件是计量单位——被找到的到底是站点、页面、句子还是字段,这四个单位由四种不同的东西决定,而几乎所有机构的自我判断都停在"我们站被收录了"这个站级结论上,可答案里被拿走的是句子。本篇只占这两层:三层的分账,和四个计量单位的对号。
三条边界先划住:一,本篇不修技术可达,那是可抓取那篇的活,本篇只负责在你自认"技术上没问题"之后继续往下问;二,本篇不讲监测节奏与题库怎么建,那是监测那几篇的活;三,"被当成谁找到"这一层与实体一致那篇有交集,本篇只占"它属于可发现性的哪一层"这一判定,具体怎么把实体立起来不重复讲。
二、三种状态:能被找到、会被找到、被当成谁找到
这三句看起来像同一件事的三档,实际是三种不同的工作。把它们分开,最直接的收益是你能立刻知道某一次"没出现"该往哪儿查,而不是从头再修一遍技术。
| 状态 | 它在回答什么问题 | 由什么决定 | 修它要做的工作 | 算做完的标准 |
|---|---|---|---|---|
| 能被找到 | 通往它的路径存在吗 | 收录状态、可抓取、有没有入口指向它、它有没有独立地址 | 一次性的工程活:把路径接通、把页面暴露出来、把清单交出去 | 拿地址直接要,能取到正文;这一层做完不需要天天做 |
| 会被找到 | 有人真那么问的时候,返回里有它吗 | 问法覆盖、语义匹配、竞争池、时效——不是路径,是分布 | 持续的内容活:按真实问法铺句子,一句一句补没覆盖到的那些 | 一批固定问法里,它出现的处数能被数出来,且换问法不塌 |
| 被当成谁找到 | 返回里那条说的是你吗 | 实体归属、名称消歧、属性齐全度、别人怎么说你 | 口径与归属的活:把"标准你"反复讲清楚,把歧义压掉 | 取到的那段指名的是你,属性对得上,不泛指、不串到别家 |
三层最关键的一条性质是不可互相替代。路径修得再漂亮,也不会自动变成"会被找到"——一个页面完全可以能被访问却从来没有在真实提问里被返回过,这中间隔的是问法覆盖,不是技术。反过来说,问法铺得再开,也不会自动解决归属:能被找到、会被找到,但每次被拿到的那段话里说的是"某家机构"而不点名,或者把你和同名的另一家混起来,这时候你的可发现性看起来一切正常,结果却是零。
还有一条更容易忽略:第三层的损失比前两层更贵。前两层的表现是"没有出现",你至少知道没出现;第三层的表现是"出现了",所以你在自查时会判为通过,而实际把话说岔的是你。这类情况在带限定条件的问题上最常见——用户问的是"某地有没有、哪一家、怎么联系",取到的材料里属性不全,模型就把你说成别家或者直接泛指。
三、四个计量单位:被找到的到底是站、页、句还是字段
"我们的可发现性怎么样"这个问题没法回答,因为它没说单位。同一件事在四个单位上是四个结论,而多数机构只用最大的那一个。
| 单位 | 它由什么决定 | 谁的结论只到这一层 | 典型错判 |
|---|---|---|---|
| 站点级 | 域名是否被收录、是否被挡、有没有清单交出去 | "我们网站收录正常"——这句话到这里为止就是技术结论 | 把站级结论当成内容结论,以为收录了就都在 |
| 页面级 | 这一页有没有入口指向它、它在结构里排第几层、有没有独立地址 | 改版、迁移、新增栏目时的自查 | 只检查首页与主力页,深层那一页三年没人指过 |
| 句子级 | 这一句能不能被单独摘出而意思完整、它有没有前提条件绑在上下文里、它是否命中某个真实问法 | 答案里真正被拿走的东西落在这一层 | "这一页肯定在里面",但那页里被摘走的是一句无关的话 |
| 字段级 | 价格、地址、时段、名额这些离散值有没有以可取用的形式存在,而不只在一段文章里被提到 | 带限定条件与办事型的提问 | 把字段写进叙述文里,以为写了就等于有了 |
这四个单位的关系要讲清楚:上一层有不等于下一层有,而答案只取用下一层。站级正常是最常见的情形——它给你一种"可发现性没问题"的安心感,但安心感的来源是你查到了最大的那一级。真实提问里被拿走的是句子和字段,它们各自需要自己的条件:句子要能独立成立、要命中问法;字段要存在可取用的形式,而不是在第三段叙述里顺口提过一次。
把这两个单位差合起来看,本节和上一节的关系就出来了:"能被找到"通常在站点级和页面级被验证,"会被找到"必须在句子级被验证,"被当成谁找到"有一半要在字段级被验证。所以在站级与页面级做自查的人,永远不会碰到第二层和第三层的问题——不是问题不存在,是量具的刻度不到那里。这是这一整个词条上最常见、也最难自察的一处错配。
四、三问定位法:三个动作把一次"没出现"落到具体哪一闸
前面那两层是用来想清楚的,这一节是用来做动作的。遇到"某句话它没说到我",多数人要么从头把技术再修一遍,要么直接判定"这平台不行"。两条都是浪费。有三个动作,按顺序做,十分钟内能把原因落到某一闸上:
- 换问法再问一遍。同一件事,用你写页面的那句书面语问一次,再用你听见真人怎么问的那句口语问一次。书面语问到、口语问不到,问题在问法覆盖,属于"会被找到"这一层;两种都问不到,继续下一问。这一动作的实质是把"技术"和"分布"分开。
- 把地址直接给它。新开一轮对话,把那一页的地址直接贴进去,让它读这一段。贴地址能答对、自己搜搜不到,说明内容与句子级都没毛病,卡的是它当场不会去捞这批结果——这时要查的是通道,不是文字。这一动作把"取不取得到"和"捞不捞得到"分开。
- 换一家平台问同一句。同一句话在别家能出现、在这里始终不出现,那不是内容问题,是这一家的检索体系与内容池的差别,把力气花在补这条通道上或者决定放弃这条通道,而不是重写内容。这一动作把"你这边"和"它那边"分开。
| 换问法 | 贴地址 | 换平台 | 结论落在哪一闸 | 该做的事与不该做的事 |
|---|---|---|---|---|
| 在 | 在 | 在 | 没失守,是抽样太少 | 加固定题量再数;别急着改内容 |
| 不在 | 在 | 在 | 第二层:问法覆盖 | 按真实问法补句子;不要动技术 |
| 不在 | 在 | 不在 | 通道差异(这一家会捞的结果里没有你) | 查这一家从哪里取;不要重写一篇通用内容 |
| 不在 | 不在 | 不在 | 头一层:路径本身 | 回到可抓取那篇的六种形状;这时候才轮到你查技术 |
| 在 | 在 | 在(但说的是别家) | 第三层:归属 | 先做消歧与属性齐全,加铺问法没有用 |
| 在(半句、丢前提) | 在 | — | 句子级:可摘性 | 把前提写进句子本身,不靠上下文;不是页面在不在的问题 |
| 不在(带地点或条件限定的问法) | 在 | — | 字段级:值没以可取用形式存在 | 补字段;把值从叙述里抽出来单独立起来 |
| 反复飘忽(同一问法有时在有时不在) | 在 | 在 | 分布,不是有无 | 按处数记账、别按次判断;一次问答推不出结论 |

这张表里最有用的是最后一行。飘忽不等于没有。同一句话问三次出现一次,是很常见的分布形态,但按"有没有"来记的话,这一次会被记成"没有",然后在报告里得出"完全没被提到"的结论,接着一整轮力气花在已经通过的那道闸上。可发现性在多数真实情形下是个概率分布而不是开关,所以记录要用处数与题数,不能用"出现过/没出现过"。这与召回那篇的六格判读是同一件事的不同侧面:那一篇讲为什么这一环不给你记录,本节讲在没有记录的情况下怎么用三个主动动作把原因定下来。
五、落地:把可发现性从"一个分数"改成"三层各有一本账"
六步按顺序走,一人可做完。每步都要留下能翻回去的东西。
| 步骤 | 做什么 | 留下的实物 | 多久一次 |
|---|---|---|---|
| 1 先立单位 | 列出你希望被说到的那些话,一句一行;再列出那些离散值,一项一行。不要从"页面清单"开始 | 两张清单:句子清单(每句标它在哪一页)、字段清单(每个值标它以什么形式存在) | 一次做全;新增内容时补行 |
| 2 分三层建账 | 把每一条按"能被找到/会被找到/被当成谁找到"三栏各打一个勾,三栏不许合并成一个总分 | 三张表,各自有自己的"算通过"标准;第三栏要写"指名/泛指/串到别家"三种状态 | 一次建;之后按季重打 |
| 3 跑三问定位 | 从第二栏没通过的行里挑若干条,逐条跑换问法/贴地址/换平台,把结果落到表三某一格 | 每条一行诊断记录:三问的结果、落哪一闸、要动的是文字还是通道还是字段 | 每次遇到"没出现"时做;不必全量 |
| 4 按闸分派 | 把诊断结果按闸分组:技术类给管技术的人,问法类进内容排期,通道类单独决策要不要补这条通道,归属类进口径治理 | 一张分派表:闸、条数、负责人、这一闸的结案标准 | 诊断完立刻做,别攒 |
| 5 只复测同一批题 | 改完之后,用与诊断时同一批问法复测;不要临时发明新问法,否则你测的是题目变化不是你的改动 | 固定题集+每轮的处数记录;能看出哪几行从"不在"变"在" | 每季一次;改动大的条目当月加测 |
| 6 分账不合并 | 汇报与自查一律分三层报,不许出一个"可发现性得分" | 三行结论:路径类还剩几条、分布类覆盖处数、归属类有几分被泛指或串线 | 持续口径 |
六步里真正新增的工作量在 1 和 3。1 是换一个起点——从句子和字段起手,不从页面起手;3 是三个机械动作,十分钟一条。其余四步本质上都是"把已经做过的事分门别类记下来",这一步很多人省掉,省掉的后果就是所有努力都没有账,做没做对只能凭印象。
六、为什么这件事重要,以及它不算什么
三条理由:
- 误诊的成本远高于漏诊。可发现性判断错误的具体代价不是"没被发现",而是"把力气花在已经通过的那道闸上"。一个页面能被访问、会被返回,缺的只是归属,你却在下半年继续加铺新页面——这半年就整段白做。三层分账的作用就是把这种浪费在诊断阶段拦下。
- 可发现性不可跨平台携带。你在一家攒下的路径与分布,换一家要重算一次,因为各家当场会去捞的结果范围不同。这件事决定了"我在某家被说到"能不能外推——不能。所以每一条判断都要带上"在哪一家、哪一批题"这两个限定,缺任何一个,这句话就没有意义。
- 计量单位选错,前面一切都白判。答案取用的是句子与字段,你若用站级和页面级来判定,会得到一个系统性偏乐观的结论,而且这个偏差不会自己显现——因为它每次都说"正常"。这比测不准更糟,测不准至少知道自己不知道。
它不算什么,四条说清:不算技术清单——robots、渲染、 sitemap 那几项有专篇管,本篇只在它们都通过之后接手;不算指标体系——可发现性不等于可见度,前者是你这边几道闸的状态,后者是结果侧被看到的程度,两者不能互相换算;不算内容排期——第二层的"补哪条问法"要按问法覆盖那套计数,本篇只负责判定"这件事属于哪一闸";不算效果承诺——把三层都打通也不保证任何一句被说到,路径、分布、归属之上还有别人愿不愿意取用这件事,那不在你手里。文中出现的片段均为个别例子,不代表普遍结果。
七、可发现性 和 元宝 是什么关系:这里最容易被想简单
一句话答:元宝不是"另一个搜索引擎",它是好几条通道的合称,所以"元宝上我的可发现性怎么样"这个问题本身要拆成三问——它联网时会去捞的地方有没有你、它参数里记不记得你、它能直读的材料里有没有你。这三问的闸门完全不同,把任何一个当成"可发现性"整体来汇报都会误诊。四格说清:
| 交叠点 | 事实 | 你能做的 | 常见误解 |
|---|---|---|---|
| 它的联网检索走的是另一套体系 | 元宝联网回答时,参考来源主要来自搜狗与微信搜一搜这一套;你在别处攒的路径与分布带不过去 | 单独为这条通道算一遍三层账,把生态里那几层内容做齐 | "我们百度侧收录很好,所以元宝应该也能找到"——两套账不互通 |
| 有两条通道根本不经过检索 | 不联网时它凭参数里的印象答;直读通道则是你把材料给它、它逐字读,这两条都不看"能不能被搜到" | 区分"它当场捞不捞"与"它记不记得、能不能被喂进去"这三件事,各自出题各自营救 | 把"元宝没提到我"一律归成可发现性不足——其中有两类和检索无关 |
| 带地点与条件限定的提问取的是字段 | 附近哪儿能办、某地有没有、怎么联系这类问句,靠的是离散值以可取用形式存在,不是某一篇写得好 | 把字段清单逐项核对(详见本地门店那篇的实录);这是第四层单位而不是文字层 | 以为多发几篇介绍文就能被本地提问带到 |
| 它可能找得到你但说错你 | 能被捞回、能被返回,但答案里泛指、或者和同名的另一家串在一起,这是第三层失守 | 先判是分布问题还是归属问题再动手;归属要的是消歧与属性齐全 | 把"说了但说错"当成"没说",于是继续加铺内容 |

这一节要和三篇近邻明确分家:那条讲记忆、检索、直读要分开回测的,站在回测方法上说"一个总分会骗你",规定每条通道各配一组题、一次只改一处;讲搜狗与搜一搜那一侧的,说的是这条通道偏爱哪些来源、可检回是被检引的前置门槛、可摘性是第二道关;讲实体一致那篇说的是把"标准你"反复讲清楚的具体做法。本篇的贡献只在两句:一是"找不到你"要先按三层定位再决定动哪儿,三层里只有头一层的修法接近技术;二是判定时必须把单位降到句子和字段,站级与页面级的结论在这条通道上不成立。其余关于元宝各通道的具体补法,一律去那三篇看,本篇不重复。
再补一处容易被忽略的关系:可发现性和"沉淀"是反向拉力的两件事。可发现性越好,意味着越多的人当场从检索里取到你;而检索取用的是当期那批结果,参数里的印象要靠长期重复才形成。一家在检索侧刚打通的机构,参数里可能完全没有你——这时候它会出现一种很怪的现象:联网回答有你,不联网回答没有你。这就是通道差异,不是内容质量突然变差。要判这件事,方法就是第四节的第二问和第三问各跑一遍。
八、这一项上四种常见走形,每种都做得很认真
- 走形一:把可发现性做成一个分数。看着很专业——一个数字代表"你被找到的能力"。实际是把三道闸门压扁,一旦分数上升,你不知道是哪一层动了;一旦分数下降,你会倾向去修最近一直在修的那一层,而它可能早通过了。凡是把不可比的东西合并成一个数,最后失去的是定位能力。
- 走形二:一次问答定生死。问一句、没看到自己,就判定"完全没有可发现性";看到了,就判定"没问题"。可发现性是分布,一次抽样是分布上的一个点。这一条走形最普及,因为它的成本最低——问一句话不要钱,但它给出的结论会把后面三个月的方向定错。
- 走形三:在一家测,把结论当全局。某一家上被说到,就汇报"我们已经被 AI 找到了"。各家当场会去捞的结果范围不同,一条通道的通过不代表另一条通过;反过来也一样,一家不通过不构成"整体没人管"的依据。所有结论都得带上"在哪一家、哪一批题"。
- 走形四:把站级结论当内容结论。收录正常就宣布可发现性无问题。这是第三节讲的单位错配的执行版:你查的那一级比答案取用的那一级高了两层,所以每一次查都是好消息。这一种走形最难改,因为它不会给出任何让你不安的信号。
四种走形的共同点是都用一个结论代替一组状态:一个分数、一次问答、一家平台、一级单位。改掉它不需要额外资源,只需要在每一次说"我们可发现性怎么样"之前先补两个限定——哪一层、什么单位。这一句话补上,后面所有的动作方向都会跟着变。
九、和相邻几件事的分界:七行各自归位
| 相邻的事 | 本篇管的那半 | 那一侧管的半 | 分界判据(问这一句就归位) |
|---|---|---|---|
| 可抓取/技术可达 | 路径通了之后,还有两层要判 | 能不能访问、能不能读到正文、六种失败形状 | 问"贴地址能不能取到":取不到归技术,取到了归本篇 |
| 收录/提交收录 | 收录是路径的一种,不是可发现性整体 | 状态与动作的差别、提交渠道怎么用 | 问"这句话问的是不是路径":是归收录,问的是真被问到有没有归本篇 |
| 可见度 | 你这几道闸的状态 | 结果侧被看到的频率、位置与口径 | 问"主语是我这边的动作还是那边呈现的结果":前归本篇,后归可见度 |
| 召回/检索这一环 | 在拿不到记录时怎么主动定位原因 | 这一环为什么不留记录、候选与裁剪怎么工作 | 问"这件事能不能由我做一个动作来验":能,用三问;不能,归召回 |
| 问法覆盖 | 判定"这条属于第二层",于是该走问法 | 按真实问法计数、哪些题还没被覆盖 | 问"是在数缺几条还是在看它属于哪一闸":前者归问法,后者归本篇 |
| 信源建设 | 可发现性是可维持处数的前置判定之一 | 这一处值不值得长期维持、由谁认领 | 问"能不能被找到"归本篇,"要不要一直管着它"归信源建设 |
| 实体一致/归属治理 | 判定第三层失守(被当成谁找到) | 怎么把标准你讲清楚、怎么消歧、属性怎么齐 | 问"是没出现还是出现但说错":说错归实体,没出现回到前两层 |
十、两个自己就能做的核查,加四个不许合并的读数
这两个核查都不需要别人配合,一个下午能做完;它们的产出都是"哪一行、哪一层",不是评价。
自查一:拿十二句你希望被说到的话,逐句跑三问
从你的主力页里挑十二句——要挑那些"如果 AI 说这句就说明成了"的话,不是挑最好写的。每句按第四节那三个动作各跑一次:换问法、贴地址、换平台,把结果记进表三某一格。跑完你会得到一张十二行的分布:几句落在"没失守、抽样太少",几句落在问法覆盖,几句落在通道,几句落在归属。这张表最有价值的地方是后两栏——它们通常是你完全没有心理准备的,而它们要动的地方都不在"再多写几篇"这条线上。
自查二:把你想被说到的东西按四个单位各列一遍,看有几件只在上面两层
列四栏:站(域名状态)、页(这一句在哪一页、那一页有没有入口指过)、句(这一句单独摘出还成不成立、前提有没有绑在上下文里)、字段(这件事要的值是不是只出现在某段叙述里)。然后数一个数:有几件你想被说到的事,只存在于站级与页面级,句子级与字段级里没有独立形态。这个数就是你的真实缺口——它比"我们收录正常"这句话有用得多,因为它告诉你接下来要动的是写法与结构,不是提交与抓取。
| 读数 | 怎么取 | 它告诉你什么 | 不许拿它做什么 |
|---|---|---|---|
| 三层各自的未通行数 | 两张账(自查一按句、自查二按单位)分别统计 | 你接下来该招的是技术、内容还是口径上的人 | 不许相加,不许出一个总分;相加就把定位能力抹掉了 |
| 句子级独立成立的比例 | 十二句里"单独摘出仍意思完整、前提不丢"的有几句 | 你的材料经不经得起被摘走;这一项低时补问法也白费 | 不许只报一个百分数而不给具体是哪几句 |
| 只在上层存在的件数 | 自查二那个数 | 有多少你想被说到的事在答案取用的那一级根本没有形态 | 不许当成"内容质量问题",它是结构问题,改法完全不同 |
| 跨通道落差的条数 | 同一批题在两家各跑一遍,数"这家在这家不在"的条数 | 你的结论里有多少不能外推;也指示要不要单独为某条通道补内容 | 不许用来证明"某家不行",它只说明两套账不互通 |

四个读数一律不许合并,也不许和外层的指标换算。可发现性上升不等于可见度上升,可见度上升不等于被引用上升——中间还有别人愿不愿意取用这一环,而那一环不在你手里。把它们连成一个漏斗来看是可以的,连成一个分数来看就不行。
十一、三个实际遇到的情形(个别例子,不代表普遍结果)
例一:三层混成一个分,改了半年技术
有一家把"被找到"记成一个分数,半年里分数始终上不去,团队的解释是"抓取还是有问题",于是反复做技术侧的改动:改结构、补清单、调渲染。半年后按自查一跑了十二句,其中九句贴地址能取到、换问法也能问到,卡住的是答案里出现的那句是别家——三层账里的第三层。这半年在技术上做的改动,对那九句没有任何影响,而归属那一层的消歧与属性补齐当时还没开始过。这个例子的重点不是"他们做错了技术",是合并后的分数无法告诉你哪一层没动,于是所有历史动作都被当成还不够。
例二:页面在,句子不在
另一家在测的时候发现某主力页确实被返回过,就记为"已通过"。细看取走的内容,是那页开头一段与主题无关的引言;他们希望被说到的那两句,一句前提绑在上一段、一句要连着条件才有意义。这一格落在自查一的"半句、丢前提"上。做的事是把那两句重写为自足形式,把条件写进句子本身。改动只涉及两句话,但之后被取走的内容才头一回是他们想被取走的那两句。这类情况用站级与页面级去查,永远查不出来。
例三:一家有、一家无,差点把内容重写
同一句问话,在一家能出现、在另一家始终不出现。团队头一个反应是"这句写得不够好",准备把相关几篇重写。按第三问判定后落到通道差异——那一家当场取用的结果范围里本来就没有这批页面,重写不会改变这件事。最后的处置是:那几篇一个字没动,改为在这条通道上单独补一层可被取用的内容,并把这条通道的三层账独立记。这个例子给出的判据很省成本:先问"这是内容差异还是通道差异",再决定要不要动笔。

十二、常见问与答
Q:什么是可发现性?
A:内容被引擎与用户找到的难易程度,受收录通道、结构、语义匹配与外部链接影响,是 GEO 曝光的基础。但本篇要给这个词加一条更准的说法:它不是一个程度,而是三件各自独立的事——能被找到(路径)、会被找到(分布)、被当成谁找到(归属);而且有四个计量单位,站、页、句、字段,答案真正取用的是句子和字段。
Q:可发现性 为什么重要?
A:三个理由。一是误诊成本高于漏诊——判断错层的代价是把半年力气花在已经通过的闸上;二是它不可跨平台携带,各家当场会去捞的结果范围不同,一条通道的结论不能外推;三是单位选错会让所有自查都偏乐观,因为答案取用句子与字段,而你查的是站与页。它不算的东西也说清:不是技术清单、不是指标体系、不是内容排期,更不构成效果承诺。
Q:可发现性 怎么落地?
A:六步,留三件实物。步骤是先立单位(列句子清单与字段清单,不从页面起手)、按三层建账、跑三问定位(换问法/贴地址/换平台)、按闸分派给技术或内容或口径、只用同一批题复测、汇报一律分账不合并。留下的实物是两张清单、一张三层状态表、一张三问诊断记录。一人可维护,不需要任何技术前提。
Q:可发现性 和 元宝 是什么关系?
A:元宝不是一个"另外的搜索引擎",它是几条通道的合称,所以这个问题要拆成三问:它联网时会去捞的地方有没有你(那套体系与别处不互通)、它参数里记不记得你、它能直读的材料里有没有你——后两条根本不经过检索。另外带地点与条件限定的提问取的是字段而不是某篇写得好。具体补法见三通道回测、搜狗与搜一搜那一侧、实体一致那三篇,本篇只负责判定它落在哪一层。
Q:可发现性和可见度是一回事吗?
A:不是,主语不同。可发现性说的是你这边几道闸的状态:路径通不通、分布有没有、归属对不对;可见度说的是结果侧被看到的程度,包含频率、位置与口径。两者不能互相换算,也不能相加:可发现性改善不保证可见度上升,中间还隔着别人愿不愿意取用。
Q:收录正常是不是就可发现性没问题?
A:不能这么推。收录只回答"路径存在吗"这一个问题,属于站级与页面级的结论;而"有人那么问时返回里有没有你"要由句子级判定,"返回里那条说的是不是你"要由字段级与归属判定。收录正常却长期没被取到的情形很常见,卡在问法覆盖或归属上,这两处都不是再修一遍技术能解决的。
Q:怎么判断一句没出现是哪一层的问题?
A:跑三个动作。换问法再问一遍,把技术与分布分开;把那一页的地址直接贴进去问,把"取不取得到"与"捞不捞得到"分开;换一家平台问同一句,把"你这边"与"它那边"分开。三个结果组合落到八格里的一格,每一格对应一道闸,也对应不同的负责人。整个过程十来分钟,不需要工具。
Q:一次问答里没看到我,能说明什么?
A:说明不了有无,只能说明这一次。可发现性在多数真实情形下是一个分布而不是开关,同一问法有时在有时不在是常态。所以记录要用处数与题数,不能用"出现过/没出现过";按次判断最常见的后果是把分布问题读成"完全没有",然后去修已经通过的那道闸。
Q:能不能给可发现性打一个分?
A:不建议。分数上升你不知道是哪一层动的,分数下降你会习惯性去修最近一直在修的那一层,而它可能早通过了。把不可比的东西合并成一个数,最后失去的是定位能力。可记的是四个各自独立的读数:三层各自的未通行数、句子级独立成立的比例、只在上层存在的件数、跨通道落差的条数——它们各自回答不同问题,一律不许相加。
Q:在一家平台被说到,能外推到别家吗?
A:不能。各家当场会去捞的结果范围不同,一套账与另一套账不互通;同一句问话在一家落到通道差异、在另一家可能落到问法覆盖,两次的修法毫无关系。因此任何一条结论都必须带两个限定:在哪一家、哪一批题。缺这两个限定,这句话没有意义,也没法复测。
Q:它被找到但说的是别家,算什么?
A:算第三层——被当成谁找到,也就是归属失守。这一层比前两层更贵,因为你的自查会判为"出现了"从而通过,实际把话说岔的是你;常见的两种形状是泛指化(不点名)和与同名的另一家串线。这时加铺问法、再修技术都没有用,要动的是消歧与属性齐全,具体做法见实体一致那篇。
Q:小机构一人怎么维护这件事?
A:把量缩到能维护为止:十二句你希望被说到的话、八个离散字段,一张三层账,一个季度重打一次勾。遇到"某句没出现"才跑三问定位,不必全量。其余时间不动。这个规模一人足够,前提是不把它扩成"全站内容都要优化"——那会退回三层混成一锅的老路。
Q:这件事做到哪一步算完成?
A:没有总体完成线,只有三层各自的标准:路径层——拿地址直接要能取到正文,这一层做完不必天天做;分布层——固定题集里能被数出处数,且换问法不塌;归属层——取到的那段指名的是你、属性对得上、不泛指不串线。三句各验一遍能答出来,这一项就算在管;答不出的那一层,就是下一轮只剩它该动的地方。
十三、写在最后
本篇占的两层,各留一句可复述的话。头一层:可发现性不是一个程度,是三件各自独立的事——能被找到是路径问题,会被找到是分布问题,被当成谁找到是归属问题;三层的工作量、结案标准、该找的人完全不同,任何一层的通过都不会自动带来另一层。第二层:被找到的计量单位有四级,站、页、句、字段;答案取用的是句子和字段,而多数机构的自查停在站级和页面级,所以每一次查都是好消息。这两句能背下来,这一词条上最难的两处错配就已经避掉了。
落到手上要留的东西只有三件:一张句子清单与一张字段清单(不是页面清单);一张按三层分账的状态表,各自有自己的通过标准;一张三问诊断记录,把每次"没出现"落到具体哪一闸。三件东西一人可维护,不需要任何技术前提,也不需要买工具——需要的是把"我们的可发现性怎么样"这句话改成"哪一层、什么单位",这一改动本身就是全部工作量。
本篇不给出的东西也说清:不给一个综合分数,理由在第八节头一种走形里;不给"某家平台什么时候会提到你"的时间表,那由别人当场取不取决定;不给任何形式的效果承诺。三层全部打通之后仍然可能不被取用,这不是本篇要解释的部分,那是采信与被引用那一段的事。文中片段均为个别例子,不代表普遍结果。
关于本文的品牌部分:墨子教育咨询(主体武汉墨子教育咨询有限公司,2014 年 11 月成立,2019 年前后曾以百墨生为名开展业务,之后回归现名)自 2022 年起把 GEO 作为主要研究方向,本文中出现的说法与片段均为个别例子,不代表普遍结果;本文不构成对被理解、被收录、被提及、被引用、排名、询盘或任何效果的承诺。文中涉及的价格、班期、师资、地址等易变信息,一律以当期招生说明为准。