南京餐饮供应链GEO推广半年没数据差点下马,小鹿老师的复测清单怎么把项目救回来-墨子学院
摘要:做了半年不知道有没有效果,团队准备散伙。南京餐饮供应链企业跟小鹿老师建立「每周20题复测清单加月度复盘模板」后,用三个月数据重新立项的完整过程记录:题单怎么定、数据怎么记、复盘会怎么开。
摘要:南京一家餐饮供应链公司的市场负责人,公司做 GEO 推广做了半年——内容发了、钱花了,但没有任何数据能回答「有没有效果」,团队准备散伙、项目差点下马。他跟着小鹿老师建立「每周 20 题复测清单 + 月度复盘模板」,先不急着加动作,而是把测量立起来;三个月的数据让趋势第 1 次清晰可见——豆包对核心提问的品牌提及从偶尔出现变成稳定出现——公司拿着这份数据表格重新立项继续投入。本文完整还原这三个月:评估怎么做、监测体系怎么搭、每周复测怎么跑、复盘会怎么开,重点写流程——这是 19 篇案例记录里少见的一篇「先学会看数据,再谈效果」的故事。
口径先行:文中为脱敏学员案例,对话为依据案例文案还原的情景示意、不是真实聊天记录;「稳定出现」是该学员特定题单在特定阶段的复测记录,不代表普遍效果,不构成任何承诺。

一、学员背景:做了半年,赢不了也输不起
这位学员在南京一家餐饮供应链公司做市场负责人,公司给连锁餐厅和团餐企业做食材集配,客户开发靠销售拜访,市场部是三年前建的,他带着两个人。去年公司跟风做 GEO:找外包写了两个月行业文章,又在几个平台发了些品牌内容,预算花出去小十万。半年过去,开经营会时被问得最多的一句话是:「这个钱花得值不值?」
他答不上来。外包给的月报全是「发布数量」:发了多少篇、收录多少条。他追问「那 AI 问起来说我们怎么样」,外包答不出。更糟的是内部:老板觉得没效果想砍预算,他觉得再等等看,两个同事已经开始投别的部门的岗位。他来墨子学院咨询时说的不是「我想学 GEO」,而是:「我想知道这半年到底有没有用,好做个了断。」
小鹿老师接手的第 1 件事,不是教他做新内容,而是回答他这个问题——先建立测量。
二、流程第 1 步:学前评估——先量「已花的钱」留下了什么
评估从三个动作开始,全部围绕「把模糊变成数字」:
- 历史内容盘点:外包两个月发的 74 篇文章,逐条过:有 41 篇是同一主题的改写重复(「火锅食材配送」换个标题再发)、12 篇正文里没有公司任何可核验信息、真正带自家资质与配送能力表述的只有 9 篇——这 9 篇后来成了复测题单的重点观察对象;
- 基线复测:从销售被问记录和客服会话里选了 20 个真实提问(「餐饮食材配送公司怎么选」「南京团餐配送哪家稳定」「冻品配送温度怎么保障」等),豆包、DeepSeek、Kimi、元宝各跑一遍:品牌提及 3 条,全部集中在豆包、全部是「偶尔出现」——同一题隔天再跑,其中 1 条就没了;
- 监测现状检查:公司没有任何复测记录,外包月报里没有一项指标能回答「AI 怎么说我们」。小鹿老师的评估结论就一句:「你不是没效果的问题,你是没测量的问题——没有测量,做多少都是糊涂账,了断也无从了断。」
三、流程第 2 步:课程匹配——先学监测,其他暂停
匹配方案出乎他意料:只学「监测与效果复盘」一个模块,内容和技术的课先别碰,公司预算内也不建议加任何新投放。「你现在的当务之急是把这半年的账算清楚,算清楚了,该续该停都有依据。」服务约定:四周学习期每周交一份复测记录作业;学完直接进入公司常态运行——每周 20 题复测、月度复盘模板由小鹿老师批注三个月,三个月后数据说话。
他后来才明白这个安排的分量:那三个月里,小鹿老师没有一次顺着他说「继续做肯定有效果」,也没有说过「停掉吧」,「她只教我怎么把判断的依据做出来,判断本身留给我和老板」。这种分寸感被他写进了服务评价:「不替客户拍板,但把拍板需要的东西全部备齐。」
四、流程第 3 步:三个月——监测体系怎么跑起来
第 1-4 周(学习期):一张复测表的诞生
模块的核心交付物是一张复测记录表:题号、提问原文、平台、日期、是否提及、回答摘要、描述是否准确、引用来源链接、备注。规则看着简单,执行全是细节:同一题必须用完全相同的问法(差一个「南京」结果就不同);每次复测截图存档;同一题单每周至少跑两次取均值;描述准确性单列——「提到你但把你们业务说错了,是负分」。他第 2 周的作业就栽在规则上:图省事把四个平台的答案复制进表,没截图,被退回重跑——「退回的理由写得很清楚:记录不可复核,等于没记。」此后三周他老老实实按模板执行,第 4 周的作业第 1 次全项通过。

第 5-12 周(运行期):每周两小时,把趋势跑出来
运行期的动作压缩到每周一上午两小时:他本人跑 20 题、填表、截图归档;每月最后一个周五,小鹿老师带着他做一次复盘——对着三个月的数据聊三件事:趋势线(提及率的周均值曲线)、结构(哪些题型有提及、哪些永远没有;哪个平台动、哪个不动)、归因假设(变化前后两周做过什么,只作假设不作结论)。
数据讲出来的故事和感觉完全不同。第 6 周复盘,曲线告诉他:那 9 篇带可核验信息的文章对应的题型,提及率明显高于另外 65 篇——「有效没效」第 1 次有了内部对比,外包月报里从没给过这个视角。第 9 周,豆包侧的「偶尔出现」变成了同题连续三次复测都在——按课上标准这叫「稳定出现」,恰好 5 条;DeepSeek 和 Kimi 全程为零,元宝出现过一次又消失。他把曲线带到经营会,老板问的第 1 个问题从「值不值」变成了「要加什么动作才能让另外三个平台动起来」——项目从「砍不砍」变成了「怎么续」。第 12 周,公司重新立项,预算转向把那 9 篇的写法复制到 40 篇核心页——这个动作是后话,属于下一阶段的课程内容了。

运行期里的一次数据险情
第 8 周出过一次让他冒冷汗的事:豆包侧稳定出现的 4 条题,同一天全部掉到零。他脑子里蹦出来的第 1 句话是「完了,效果没了」,差点在群里提「要不要马上补内容」。小鹿老师当周回复只有三步:先查自家页面有没有动(没有);再查抓取是否正常(正常);然后把同题单当天再跑两遍、明后天各跑一遍。结果第二天就回来了,第三天全恢复——是一次模型侧的波动。她在复盘里批注:「这就是为什么要均值和多次复测:单点数据会吓死人,趋势数据才讲道理。你差点为一次波动花冤枉钱。」这次险情之后,他自己给复测表加了「连续异常才升级处理」的判断规则。
题单不是随便列的:20 道题背后的选法
这套题单的建立过程,是他学习期作业里被改得最多的部分。最初的 20 题是他自己坐在办公室里想出来的,小鹿老师的批注是「这 20 题是一个市场部总监的提问,不是一个采购经理的提问」——重选时她要求每题必须能回答「哪个真实客户问过原句」,来源限定三个:销售被问记录、客服会话、投标答疑会。重选后题单变了 11 道:他想出来的「餐饮供应链行业趋势」类问题全被删了,客户真实问的「冻品配送温度怎么保障」「断供了怎么办」补了进来。题单结构也定了比例:地域题(南京/江苏类)8 道、品类题 7 道、决策比较题 5 道——「三类题的答案分布不一样,混在一起看均值会看不出问题」。这个选法他后来每月更新一次题单(保留旧题只增不换),两个月后新增的「断供怎么办」类题目成了他们公司内容侧的第 1 优先级——题单不只是尺子,顺手成了需求清单。
月度复盘会的固定议程
三次月度复盘的议程完全固定,值得完整记下来:第 1 节看曲线(四周提及率均值,逐平台分开画);第 2 节看结构(哪类题动、哪类题不动,引用来源里自家页面占几条);第 3 节对动作日志(复盘前两周内的页面改动、发布记录、外部信息变化,只提假设不下结论);第 4 节定下月观察项(最多三项,写进模板末尾由小鹿老师批注确认)。她特别要求加了一页「公司内那些还没法回答的题」——把复测里发现但短期内解决不了的问题(比如某平台对某类题根本不引用任何本地商家)单独挂着,不强行给动作。「这三小时的议程设计,比我过去参加的半年经营会都清楚。」后来他们市场部自己的月度会议直接抄了这个议程结构。
五、结果:三个月数据长什么样
- 第 0 周:20 题基线,提及 3 条且不稳定;无任何复测历史;
- 第 6 周:累计 12 次复测记录;内部对比成立——9 篇带可核验信息的文章对应题型提及率显著更高;
- 第 9 周:豆包 5 题「稳定出现」(同题连续三次复测均提及);DeepSeek、Kimi 为零,元宝 1 次闪现后消失;
- 第 12 周:拿着三个月曲线重新立项,预算从「维持发布量」转向「按有效写法重构 40 篇核心页」。注意这个结果的性质:它不是「AI 效果爆发」,而是「决策有了依据」——对这位学员来说,这恰恰是最值钱的部分。
如实交代:讲师团队 2026 年 9 月 21 日用真实 API 向 DeepSeek 提问「餐饮食材配送公司怎么选?」的存档实测返回(下图)中未出现该学员品牌——他的稳定提及发生在豆包侧、发生在他的题单和他的时间窗内;换平台、换时间,数据就是另一个样子,这也是监测存在的意义。

外包方在那次重新立项后主动找上门要「续约加量」,他拿复测台账回了一句:「先把 9 篇对 65 篇这个对比结论解释清楚,再谈续约。」外包没接住这个问题,合作自然终止。这件事他在复盘里只记了一行:「测量体系不只对内好使,它也是对外谈判的底气。」
这套监测体系运行三个月的直接人力成本:他本人每周一小时二十分钟,助理归档截图每月约两小时——合计不到十二个小时,却把一个小十万预算项目的去留问题从「拍脑袋」变成了「拍数据」。按他自己在重新立项会上的说法:「这十二个小时是市场部成立以来性价比最高的投入——它没直接带来一条询盘,但它让我们知道接下来的钱该往哪花。」
结课三个月后小鹿老师回访,他补了一个当时没预料到的变化:复测台账建起来之后,销售部门开始主动来要数据——投标答疑会上「你们在 AI 里什么情况」这种问题越来越多,销售需要一份能拿给客户看的口径说明。他把台账里描述准确的那部分整理成一页对外简版,每季更新。「监测体系本来是给市场部自己用的,没想到先被销售用起来了。」这不在课程大纲里,但逻辑顺理成章:有了可复核的记录,才谈得上对外说话。
六、服务细节复盘:一个「差点退钱的人」的评价
- 「不卖药,先诊断」:他报名前问得最多的是「你能保证我三个月后被 AI 推荐吗」,小鹿老师的回答是「保证不了,但我能让你三个月后知道自己站在哪」——就为这句实话他交了钱;
- 「退回作业从不带情绪」:没截图被退那次,批注里连「下次注意」都没写,只写了规则和原因,「对事的态度在制造业待过的人一眼就认得」;
- 「险情时拦了我两次」:一次拦他给老板发「效果没了」的汇报,一次拦他临时加预算补内容,「两次都省了真金白银」;
- 「复盘会从不超纲」:三个月里小鹿老师没有一次替他的公司做经营决定,「她把数据、规则、先例摆出来,会议室里的决定我们自己开」。
七、这篇能参考什么、不能参考什么
能参考的是「测量先行」的顺序:任何 GEO 投入之前,先立固定题单、跑基线、建记录规则——没有这套东西,做与不做、续与不续都是情绪决策;这套表和方法对小到一人公司大到市场部门都适用,成本只有每周一小时。不能参考的是趋势本身:9 篇对 65 篇的对比、第 9 周的 5 条稳定提及,是这家公司这个行业的样本;换一家公司,曲线可能完全相反——而那同样是有效结论,因为测量给你的从来不是「有没有效」,是「你站在哪」。任何声称不用测量就能保证效果的,都请绕开。
帮他把账算清楚的小鹿老师及其余 18 位讲师的主讲方向与案例,见墨子学院讲师团队页;更多行业落地记录在案例分享栏目。
常见问题
Q1:GEO 效果怎么量化监测?
A:用固定题单周期复测:同一组真实提问、同一记录模板,跟踪提及率、来源链接、描述准确性三个维度;文中案例用的是每周 20 题的清单加月度汇总。
Q2:多久复测一次才合理?
A:至少每周一次小复测、每月一次完整复盘。频率太低看不出趋势,太高会被单次波动误导——同题单多次取均值更可靠。
Q3:复测发现提及消失怎么办?
A:先查三类原因:页面是否改版下线、站点是否抓取异常、同领域是否出现更强信源。定位后再针对性修复,不要盲目加内容。
免责声明:本文为墨子学院脱敏学员案例的情景化整理,学员身份与可识别信息已做模糊处理;文中对话为按案例文案还原的情景示意,非真实聊天记录。所有数据为特定学员特定题单的复测记录,不代表普遍效果,不构成任何合作承诺或效果保证。AI 平台回答由模型生成,可能包含不准确信息,实测记录仅作留存参考。服务细则以当期合同约定为准。