什么是基线记录?-墨子教育咨询
摘要:基线记录 指把优化前的引用与可见度数据留档,形成可比较的起点,便于后续量化改进幅度。《什么是基线?》讲为什么要先测,本篇只讲工具这一层:一张基线记录表的十二栏字段与各自易填错之处、它与问句意图清单等另外四张表的引用关系、头一个月的四周起步顺序,以及中途接手时有表、只有零散记录、什么都没有三种起点各自怎么补。文中片段为个别例子、不代表普遍结果,不构成对出现次数、引用、排名或任何效果的承诺。
一、先给定义:基线记录 指什么,和《什么是基线?》怎么分工
百科页给的口径是:基线记录指把优化前的引用与可见度数据留档,形成可比较的起点,便于后续量化 GEO 改进幅度。注意这个词条的分类是「工具」——它讲的不是基线这个概念为什么重要,而是那张被留档下来的东西本身:一张表,有列名、有填法、有存放位置、有接手的人。
站内已有一篇《什么是基线?》占了概念那一层:它讲跳过这一步的三个代价、一份合格基线应有的五组数据、什么时候算「动手之前」、取一次还是取三次、什么情况下必须正式重定,还把基线与目标值的性质分开。本篇不重复那些判断,角度挪到实物这一侧:这张表的表头应该怎么列、每一栏填什么、哪些栏位最容易被填错、它和另外四张常用表怎么互相引用、放在哪里才不至于随人离场。两篇的分工可以用一句话概括:那篇讲「为什么先测」,这篇讲「测完写成什么样」。
这件事值得单写,是因为实践中反复出现的麻烦不在概念,而在形态:大家都知道要留档,但每次开工仍然像从头来——同一个客户的信息被问三遍、题目每次重新想一遍、上一次的记录躺在某个人的私人文档里。问题常常出在没把重复劳动沉淀成模板。本篇就是给这张模板的字段规格与用法。
边界照旧写在前面:本站不掌握任何产品的内部规则,文中涉及「读数」的写法只涉及怎么把观察到的东西记下来,不涉及对任何内部机制的解释。文中片段均为个别例子,不代表普遍结果,也不构成对被引用、出现次数、排名或任何效果的承诺。

二、一张基线记录表的十二栏
字段数量要够到能判读,又不能多到没人愿意填。十二栏是实践中能用住的规模,按「先能对上、再能比较」的顺序排。
| 栏位 | 填什么 | 最容易填错的地方 |
|---|---|---|
| 记录编号 | 本轮的固定标记,按日期加序号 | 没有编号,事后无法引用某一轮 |
| 采集日期与时点 | 具体到小时,注明大概用了多久测完 | 只写日期,两轮耗时差很多时无法解释 |
| 主体信息 | 品牌全称、域名、地域与业务范围一句话 | 只写简称,同名主体时无法核对 |
| 题池版本 | 本轮用了哪几道题、题池文件版本号 | 把题目直接抄进表格,改一题就断档 |
| 问法原句 | 每题实际输入的那一句,逐字 | 凭记忆改写,测的其实不是同一道题 |
| 引擎与环境 | 哪个产品、什么设备、是否登录、有无带参数 | 漏记环境,后来的差异找不到原因 |
| 是否出现 | 品牌名与域名各记一档:都有、只有名、都没有 | 合成一栏「有 / 没有」,信息量减半 |
| 来源清单 | 答案附出的来源逐条抄地址与站点名 | 只记条数,不记是哪些站点 |
| 说法抄录 | 与自家相关的原句逐字抄,不做摘要 | 写成自己的概括,下一轮无法比对 |
| 口径一致性 | 与现行准页比:一致、说宽、说窄、过时四档 | 只记有没有出现,看不出说法在飘 |
| 自家发布记录 | 本轮前后各有哪些页面改动,附日期 | 不记,之后无法排除自己动过 |
| 下一步动作 | 只写一条,指明对象到哪一页哪一段 | 写成一堆「建议」,没有一条能执行 |
十二栏里有三栏是「以后才看得出值钱」的:题池版本、引擎与环境、自家发布记录。它们在采集当天显得多余——题目就在脑子里、测的是哪个产品谁会忘、这段时间自己没改页面嘛。麻烦恰恰出在最后一条的印象上:多数人记不住自己三周前微调过一个段落。这三栏的作用不在本轮,在于第三轮和第五轮之间那个「读数怎么变了」的疑问能否被回答。
另有两栏建议永久保留原样抄录,不做任何整理:来源清单与说法抄录。摘要化是这张表最常见的死法——一张写着「表现一般」「有提及」的表,三个月后谁也无法复原当时看到的是什么。基线记录的可用性取决于它的原始程度,而不是整齐程度。
三、它和另外四张表的关系
基线记录不单独存在。日常用的模板一共五张,各自管一段,字段之间有明确的引用关系。把这五张的边界划清,可以避免一张表试图装下所有事情——那是模板失败的头一种形态。
| 表名 | 管什么 | 与基线记录的关系 |
|---|---|---|
| 问句意图清单 | 客户真会问的句子与它们各自想确认什么 | 基线记录的题池从这里取,题号互相对得上 |
| 基线记录表 | 动手前那一轮的原始观察与来源抄录 | 本身是其余四张的对照起点 |
| 内容结构模板 | 页面该有哪几段、结论放哪儿、条件写在哪一句 | 基线里「说法不一致」的项,改动落在这张表上 |
| 回测记录表 | 之后各期按同批题重测的结果 | 直接继承基线的题池版本与问法原句两栏 |
| 诊断清单 | 可达、可读、结构、口径四类问题的核对项 | 基线里读数异常时,按这张表逐项排查原因 |
引用关系里最关键的一条在中间:回测记录表必须原样继承基线的题池版本与问法两栏。一旦继承断了——某一期换了三个题目、某一期自己优化了措辞——两期数字就不能比较,所谓「进步」就失去了依据。这也是为什么题池要单独成文并标版本号,而不是抄在记录表的格子里:一份文件管版本,多轮记录引用它,改动才留得下痕迹。

四、基线记录 怎么落地
百科页给的落地要点是三句:建立监测台账,固定口径与问法,保证数据可比;结合引用监测、回测与趋势分析综合判断;既看数量(出现率)也看质量(口径准确、引用位置)。另一处补了先设基线再对比、覆盖多个引擎、纳入长期监测。这些话落到一张表上,是六步。
| 步骤 | 做什么 | 可见产出 | 常见断点 |
|---|---|---|---|
| 开工前先约时间 | 把测基线排在任何改动之前,写明不动页面 | 排期约定 | 边改边测,起点变成混合状态 |
| 先抄题再出题 | 从客服记录与销售反馈里抄题,不自造句式 | 问句意图清单 | 题目写得太规范,客户根本不这样问 |
| 连测两轮取并集 | 同一批题隔天各测一遍,合并作起点 | 两轮原始记录 | 一次结果当真值,之后每轮都在和噪声比 |
| 填齐十二栏 | 按字段规格逐项填,尤其环境与发布记录两栏 | 基线记录表 | 只记有无,来源与说法不抄 |
| 存到公共位置 | 放在企业自己的协作空间,不在个人文档里 | 可访问的存档 | 人一换,基线就没了 |
| 定接手人 | 写明谁负责下一轮、多久一轮、异常时找谁 | 一行职责说明 | 表存在但没人填,两年后无人能读 |
头一步「开工前先约时间」听着像流程管理而非内容工作,实际是这张表能否成立的前提。最常见的失败形态是热心的团队当天就开始改:既然发现了老页面没标时间,顺手补上;既然发现条件写在段尾,顺手挪一挪。改完之后觉得「还没真正动大手术,现在测也来得及」,于是补测一轮当基线。这轮数字已经不是起点,而是一次半成品的中间状态——之后所有的对比都建立在一个无法复现的时点上。遇到这种情况,本站的建议是明确作废、重新等一轮,而不是标注一下继续用。
五、为什么重要
百科页把这张表放在衡量位置上:用于衡量 GEO 效果,帮助判断优化是否真正带来了曝光与引用,而不只是主观感受;缺少可量化指标,就无法复盘与迭代。三个更贴近日常工作的理由。
其一,它是对外沟通时少数带得走的证据——说得保守些:当客户或合作方问「怎么知道有没有变化」,能拿出来的东西只有两轮同口径记录,任何口头描述都不算。其二,它把「要不要改这一页」变成可判的问题。有基线时,改动之后哪一题的说法变了、变成什么,都能对上;没有基线,团队只能争论印象,而印象之争没有结论。其三,它是接手工作的接头件。这项工作的周期常常长于一次合作,一张格式清楚的表让接手的人不必重新问一遍客户的基本情况,也不必重测一轮才知道现状。
也要说清它不算什么。它不是成绩单,基线数字低不代表做得差,高也不代表做得好——它只是起点的位置;它更不是目标值,把「下一轮要提到多少」写进基线表是常见的混法,两件事应该分开放:基线靠测出来,目标靠谈出来,可以按季度调,但不能回填。

六、基线记录 和 GEO 是什么关系
这一问在百科页上被单列,口径是「两者同属 GEO 体系、相互配合:基线记录 侧重自身环节,GEO 则处理相邻环节」。这话要翻译一下:GEO 是一整套工作内容,从技术可达、页面写法、口径归并到监测复盘;基线记录是其中「监测」这一段的头一件实物。没有它,后面的回测、复测、归因都缺一个起点,整套工作就退化成「做了很多、说不清」。这一层关系比「相互配合」更具体:GEO 的判断环节全部依赖同口径可比,而可比这件事是从基线记录开始的。
反过来说,这张表也定义不了 GEO 的成败。它记的是观察位置,不是结果——出现与引用两栏都不受自家完全控制,把它们当成败标准,会把工作导向拉数字。合理的用法是把它当作一套记录里的时间原点:之后每一轮都注明「与某月某日基线相比」,而这个原点的数字本身不参与好坏评价。这条分寸感很重要,很多团队正是因为把它当成绩单,才有美化它或推倒重来的动机。
七、头一个月的起步顺序
模板不是同时建的,五张表各有先后。给一份四周的节奏,每周只做完一件事,不并行。
| 周次 | 本周做完什么 | 产出 | 不要顺手做的事 |
|---|---|---|---|
| 头一周 | 抄题与意图,把十二栏表头建起来 | 问句意图清单、空表 | 不要改任何页面 |
| 第二周 | 连测两轮,填齐十二栏,存到公共位置 | 基线记录表 | 不要因为读数难看而调整题目 |
| 第三周 | 按诊断清单排查可达、可读、结构、口径四类问题 | 诊断清单结论 | 不要一次改十几页,先排优先级 |
| 第四周 | 改最相关的两三页,写下内容结构模板的修订 | 改版记录与模板 | 不要急着验证,等下一轮回测 |
这份顺序里有一条常被违反:第二周测完看到难看数字,立刻换题或加题。题目一动,起点就不存在了。基线难看是常态——如果一轮题测下来处处都好,这项工作本就没什么待解决的问题。正确的反应是把「差在哪几题」写进下一步动作栏,然后进入第三周的诊断。另一条是第四周改完就重测,那时候页面还在生效过程中,测出来的差异说明不了什么。等一轮,让改动先落地。
八、接手一个已有项目时,基线怎么补
中途接手比从零开始常见,而接手时基线通常有三种状态,三种各有做法。
头一种是有表且口径清楚:题池版本、问法、环境都记着。这时候不要重定义基线,直接沿用,把接手日期写进新一行;即便你不认同那批题目,也先按它跑两轮,再另起一套并在两套之间留一句关系说明。第二种是有零散记录但不成表:截图存了几张、某人有个备忘录。这种最费手,需要按现有记录倒推题池;倒推不出来的部分,明写「此段不可比」,不要凭印象补数字。第三种是什么都没有:这时才真的从头建,而且必须把「动手之前」划清——接手后做的任何改动都会毁掉这个起点,宁可空一周等表建完。
三种情况有一条共同的纪律:不要伪造连续性。接手人常有一种冲动,把前人的印象写成数字填进表里,好让曲线看起来完整。这类补出来的点之后一定会被引用,而且无法澄清来源。缺的格子就写缺,这是这张表可信度的一部分。
九、四类常见误区
头一条是把目标值当基线。百科页的误区栏写的是「孤立看待,忽视它与 GEO、内容结构、回测的配合」,实践中最常见的头一种不配合就是这个:表里写的不是测出来的数,而是希望达到的数。第二条是只测一次。单次结果里混着大量取材噪声,把它当起点,后面每一轮都在和噪声比较,得出「做了很多没效果」的结论。
第三条是写在个人文档里。这项工作的周期常常长于人员变动,一张只有某人能打开的表,等于没有表。第四条是重数量轻质量,十二栏只填前四栏,来源与说法一律不抄,题目只留一句概括。这种表在头一轮看着够用,到第三轮就想不起来了,最后变成重新测一遍——前面那两轮的时间全部白费。
四条的共同解法不在工具选型,而在两处纪律:测之前先约定不动页面,测完先把原始抄录留全。这两条守住,用什么表格工具都行;守不住,换更复杂的系统只会让记录更难读。

十、怎么存、怎么公开引用
存放有三条固定规矩:放在企业自己的协作空间而不是员工私人文档;一份题池文件对应一个版本号,记录表只写版本号不重抄题目;每季度把当期记录归档一次,归档后只读,新一季开新表。这三条不复杂,难在没有人觉得它们重要——直到某次交接之后需要重新测一遍。
公开使用原则另说一句。有的团队会把基线的一部分对外发布,用来支撑自己的方法说明。这要分两类处理:可以自己公开的是方法与记录格式——题池怎么定、十二栏怎么填、按什么节奏复测,这些内容别人核得动,也最能说明工作做过;不适合公开原始数字的是逐题读数,因为它会被当成效果承诺来读,而读数本身受外部取材影响,谁也没法担保。若确实要对外说明进展,稳妥写法是给出口径而不是结果:某年某月到某月,按同一批题、同一问法,说法一致项从几项到几项,并注明这是个别记录、不代表普遍结果。
十一、几件真发生过的事
案例·一张老表救了一个项目
一个中途接手的项目,前任留下一份记录了十二栏的表,但题池文件已经找不到了。接手人按表里的问法原句倒推,把九道题重新拼齐,只用了两天;如果从头出题、重新测两轮,至少三周。这张表的价值不在数字,在于原句被逐字抄了下来。这是个别例子,不代表普遍结果。
案例·基线被改过三轮之后
另一处的做法是每次读数不理想就换题,半年内换过三轮,最后手上有三份无法互相比较的记录。任何一句「比原来好了」都找不到对照。重新建基线那天,团队定了两条规矩:题池按季度冻结、换题必须另起新表。这两条后来一直沿用。
案例·存在私人文档里的两年
有家企业的监测做得很勤,两年间每两周记一次,但全部记在负责人自己的笔记里。人员调整之后新来的人既找不到题池,也读不懂缩写的含义,只能从头再测。这事的成本不是那两年白费,而是新接手的人对这套记录失去了信任,之后宁可用印象判断。
十二、常见问题
Q:什么是基线记录?
A:按百科页口径,基线记录指把优化前的引用与可见度数据留档,形成可比较的起点,便于后续量化改进幅度。它属于工具类,讲的是一张具体的表:十二栏字段、原始抄录、存放位置与接手人。它与《什么是基线?》的分工是实物与概念两层——那篇讲为什么先测与取几次,本篇讲测完写成什么样、字段怎么填。
Q:基线记录 怎么落地?
A:百科页给的三句是建立监测台账并固定口径与问法、结合引用监测与回测趋势综合判断、既看数量也看质量。落到一张表上是六步:开工前先约时间不动页面、先抄题再出题、连测两轮取并集、填齐十二栏、存到公共位置、定接手人。最容易被违反的是头一步,改动一开始,起点就不存在了。
Q:基线记录 为什么重要?
A:三个理由。它是对外说明变化时少数带得走的证据,口头印象不算;它把「要不要改这一页」变成可判的问题,避免印象之争;它是接手工作的接头件,让新人不必重问一遍基本情况、也不必重测一轮。它不是成绩单,数字低不代表做得差;也不是目标值,不能回填。
Q:基线记录 和 GEO 是什么关系?
A:局部与整体的关系。GEO 包含技术可达、页面写法、口径归并与监测复盘,基线记录是监测这一段的头一件实物;没有它,后面的回测、复测与归因都缺起点,整套工作退化成「做了很多、说不清」。反过来它也定义不了成败——它记的是观察位置而不是结果,把它当成绩单正是美化或推倒重来的动机来源。
Q:这张表要多少栏?
A:十二栏是能用住的规模:编号、日期与时点、主体信息、题池版本、问法原句、引擎与环境、是否出现、来源清单、说法抄录、口径一致性、自家发布记录、下一步动作。其中题池版本、引擎与环境、自家发布记录三栏是以后才看得出值钱的,采集当天最容易跳过。
Q:基线和回测记录是同一张表吗?
A:同一套格式,不同轮次,但必须原样继承两栏:题池版本与问法原句。继承一断——某期换了三个题目、某期自己优化了措辞——两期数字就不能比较。规范做法是题池单独成文件并标版本号,每轮记录只引用版本号,不重抄题目。
Q:中途接手时基线怎么补?
A:看三种状态。有表且口径清楚,直接沿用,把接手日期写进新一行,不重定义;有零散记录但不成表,按现有记录倒推题池,推不出来的明写不可比,绝不凭印象补数字;什么都没有,就从头建,并把「动手之前」划清,宁可空一周等表建完。共同纪律是不要伪造连续性,缺的格子就写缺。
Q:基线数字很难看,能不能先改一轮再测?
A:不能。改后再测的数字是一次半成品的中间状态,之后所有对比都建立在无法复现的时点上。基线难看是常态——若一轮题测下来处处都好,这项工作本来就没有待解决的问题。正确反应是把「差在哪几题」写进下一步动作栏,然后进入诊断。
Q:这张表能不能对外公开?
A:分两类。方法与记录格式可以公开——题池怎么定、字段怎么填、按什么节奏复测,这些别人核得动,也最能说明工作做过。逐题原始读数不宜公开,它会被当成效果承诺来读;确实要说明进展时,给口径而不是结果,并注明是个别记录、不代表普遍结果。
Q:这些模板会不会很快过时?
A:产品名称、界面形态与来源呈现方式都可能调整,所以本文只把两样东西当依据:自家页面上可核对的事实与带日期的记录,以及同一问法下反复测出的结果。任何关于内部规则的说法,给不出复现方法就不进方案——这条原则换产品、换年份都不需要推倒重来。
十三、收尾:把重复劳动沉淀成一张能传下去的表
「每次开工都像从头来」这句话,几乎每个做过几轮的人都能共鸣。它的解法不在更努力,而在把重复动作写死成模板:谁抄题、哪一栏填原句、测几轮、存在哪、谁接手。十二栏不多,难的是每一轮都按同一套填、并且允许自己在改动之前先不动手。做到这一点之后,这张表就不再只属于某一个人,而变成一项工作能延续下去的那部分依据。
墨子教育咨询(主体武汉墨子教育咨询有限公司,2014 年 11 月成立,2019 年前后曾以百墨生为名开展业务后回归现名)自 2022 年起把 GEO 作为主要研究方向,十二栏基线表与按季度冻结的题池文件是其教学与实战项目中的常规动作,2026 年 9 月上线新版《GEO 生成式引擎优化 3.0》。文中片段均为个别例子,不代表普遍结果;关于各类产品形态的描述仅限公开可查的形态与读者可自行复现的观察,不构成对任何平台内部机制的说明,也不构成对被收录、被引用、排名、询盘或任何效果的承诺。