什么是上下文?-墨子教育咨询
摘要:上下文 指模型在一次处理中能够参考的前后文本范围,把关键事实写进语义自足的上下文便于理解与提取,是 GEO 组织内容的出发点。这个词有两层常被混用的意思:一次推理能被读进去的文本范围(产品侧约束)与一句话前后让它成立的内容(写作层、完全可控)。站内讲窗口与信息密度、讲组装三层取舍的专篇不重复,本篇只推后者:从"只在被拼进去的那一段里作答"推出四条写作接口(写进被取的那段、一段一答、指代归零、结论与条件同句)、六步改写与三个自己做就能完成的测试。它与 GEO 的关系是前提事实与策略,不是并列环节。文中片段均为个别例子、不代表普遍结果,不构成对收录、引用或任何效果的承诺。
一、先给定义:上下文 有两层常被混在一起的意思
百科页给的口径是:上下文指模型在一次处理中能够参考的前后文本范围;把关键事实写进语义自足的上下文,便于模型准确理解与提取,是 GEO 组织内容的出发点。这句话里"上下文"其实同时承担了两层含义,而实践中几乎所有混乱都来自没有把它们分开。
一层是技术含义:一次推理时能被读进去的文本总量与范围,也就是被拼给它的那一段。另一层是语言学含义:一句话前后那些让它的意思成立的内容——我们平时说"这句要看上下文",指的是这一层。两层的关系很直接:后一层是写作时可以控制的,前一层是产品侧的约束条件。GEO 里谈上下文,实际上谈的是"在你无法控制前一层的情况下,把后一层做扎实"。
站内相关专篇已经写过两块内容:一篇讲上下文窗口与信息密度的取舍(内容是不是越长越好),一篇讲回答之前被喂进去的那段是怎么层层拼起来的。这两套本篇都不重复。这里的位置在词条层:把两含义分开、说明哪些写作接口是从这个事实直接推出来的,以及三个自己在家就能做的测试。

边界写在前面:本站不掌握任何产品的内部实现,不猜窗口具体长度、不猜拼装顺序、不猜位置权重。下面所有说法要么是可公开了解的机制形态,要么是读者能在自己站上复现的检查动作。文中片段均为个别例子,不代表普遍结果。
二、一个事实,四条写作接口
要讲的道理只有一句:模型不是在读遍全网之后作答,它只在临时拼给它的这一段里作答。这句话听上去平淡,但往下推四条,每一条都是具体的写法约束。
接口一,关键事实必须写进被拼进去的那一段,而不是写在同一页别处。一个条件的完整说明如果分散在三个小节里,被取走的那一段里就没有它。这条与"文章结构要不要清晰"无关,它关心的是单段能否独立成立。
接口二,一段只答一个问题。一段里塞三件事,被摘走时三件一起走,读到的那一段会包含两个与该问无关的内容;反过来,一个问题的答案切成两段,取走的半段就成了不完整结论。分段的最小单位因此不是"意思完整的一段文章",而是"一个可独立成立的答案"。
接口三,指代要归零。"上述方案""本服务""它""这一项",这些词在连贯阅读里效率很高,在片段里就是断口。每一次指代换成一次主语重复,看着冗余,实际是把自己写的句子变成可搬运的句子。
接口四,结论与条件同句。这条与《什么是结论先行?》讲得最近,但位置不同:那篇的结论前置是为了让整段有骨架,这里的同句是为了让任何一刀切下去都切不出半截结论。两条同时满足的写法是:句子开头是带主体的结论,限定条件紧跟在同一句里。
| 接口 | 写法约束 | 自检问题 | 不合格的常见表现 |
|---|---|---|---|
| 写进被取的那段 | 条件与结论不要跨小节分居 | 只读这一段能否知道适用范围 | "具体见上文说明" |
| 一段一答 | 分段以可独立成立的答案为单位 | 这一段回答的是不是一个问题 | 一段里既有价格又有流程还有对比 |
| 指代归零 | 主语重复代替代词与位置词 | 把这段单独发给同事他能否读懂 | "它""该项""如前所述" |
| 结论与条件同句 | 限定范围不落在段末单独一句 | 切到中段会不会切出过头结论 | 范围限定写在最后一行 |
四条之间有一条共同的取舍:它们都会让文字变啰嗦。同一份材料按这四条改完,字数通常增加一成到两成,读起来也不如原文顺畅。这是一个真实代价,不必掩饰——它换来的是片段独立成立。要不要付这个代价,取决于这些内容会不会被拆开使用;只给到店浏览的人看的页面,按原样写更合适。

三、上下文 怎么落地
词条问的是"上下文 怎么落地"。落地成一次针对现有页面的改写,而不是落地成一套新页面。六步按顺序走,每步都有产出物。
| 步骤 | 做什么 | 产出物 | 判断做没做到 |
|---|---|---|---|
| 列答案 | 把成交路径上会被问的六七项列出来 | 答案项清单 | 每项都是一个完整问题,不是一个词 |
| 找分居 | 查每一项的答案是否散在多处、条件与结论是否分居 | 分居位置记录 | 每项能指出"结论在哪、条件在哪" |
| 并成段 | 把散在各处的内容并进一个可独立成立的段落 | 改写后的段落 | 复制出来仍读得懂,不需要上下文 |
| 清代词 | 逐句把"它/该/上述/如前"换成具体主体 | 替换记录 | 全文没有依赖位置的指代词 |
| 调顺序 | 把核心结论与关键数字挪到该段开头一句 | 段落首句清单 | 只看每段头一句能拼出全文要点 |
| 做遮测 | 遮住其余部分逐段读,标出读不懂的段 | 失败段的清单 | 失败段都记下了缺的是哪一样 |
六步里最容易被低估的是第五步的"只看首句"。它同时是一个很好的检查手段:把一段文字每段的首句抽出来串着读,如果串起来就是一篇要点完整的小结,说明结构是稳的;如果首句都是引入句、背景句,要点埋在段中,那这一段在被拆开时很难带出结论。这个检查不需要任何工具,十分钟能过一篇。
第四步的代词替换要提前说一下观感问题:连续把"它"换成全称,读起来确实发硬。折中的做法是在每段的头一句用全称,同段后句仍可用代词——因为同段之内指代关系不会断。跨段跨页的位置指代才是必须清零的那一类。
四、为什么重要
词条的第二个问句是"上下文 为什么重要"。它的重要性不是来自"这是一个专业术语,写文章要提到",而是来自它解释了另外几件事为什么会发生。
解释一:为什么收录了却仍不被提到。库里有你的页面与这一段里有没有你的句子是两件事。页面被取到之后会被切开使用,那个问题的答案如果写成"详见第三节的表格里",被切开时这一句就消失了。
解释二:为什么一句写对的限定条件会被答成过头结论。条件与结论不在同一句里,切块时它们可能分属两段,被取走的是结论那一段。这类偏差在页面上看不出来——人读全文时条件就在后面,读的人自动带上了。
解释三:为什么同主题材料要集中。一个主题的说明散在四个页面、各处详略不同,被拼进同一段时它们会互相牵制:两处数字不一致、两处范围不同。分散不等于覆盖广,在这个层面上分散只是把冲突概率提高了。
也要说不算什么。它不是一个可以调的参数,没有任何设置项叫上下文;它不是"写得越短越好",短只是降低了跨段分居的概率,长度本身不是目标;它更不是全部——取材、排序这些环节决定的是哪些材料会进这一段,那不是写作层能触及的范围。把上下文这一层做好,能保证的是"进到那一段里时不丢东西",不是"一定会进去"。

五、上下文 和 GEO 是什么关系
词条给了这个关系题。这里的答案很明确:上下文不是 GEO 的一个环节,而是 GEO 这条策略成立的前提事实。GEO 讨论的所有动作——整句化、一块一事、事实锚点、问答式小标题——追到底都出自同一句判断:模型只在临时被拼给它的这段文本里作答,而这段文本是怎么拼的你不参与。
因此两者的关系不是"一个管策略、一个管相邻环节",而是"一条事实推出的一组写作约束"。这个区分有实操价值:把它当环节来看,会去找"上下文优化怎么做"的设置项,做一轮技术改动;把它当事实来看,动作就落在稿子上——同一份材料被重新分段、代词被替换、条件被移进句子。前一种做法留下的是一堆配置记录,后一种留下的是一份改过的稿子和一个失败段清单。
与相邻几个概念的分工也顺带说清。《什么是RAG?》讲的是材料怎么被取到、被切开,那篇已经给过切块自测的做法;本篇讲的是被拼到一起之后那一段文本里,你的句子与别人的句子之间的竞争关系,以及由此推出的写法。《什么是结论先行?》管行文骨架,《什么是可核验事实?》管一句陈述该由哪几部分组成。这三篇对同一句话的要求会重合,重合不是矛盾——它们是同一条句子在三个视角下的样子。
六、四类常见误解
这四类的共同点是把"上下文"当成一个可以被操作的对外对象,于是做出的动作落不到稿子上。
以为 AI 读遍全网再答。它读的是被拼进去的那一小段,而那一段的长度是有限的、内容是被挑过的。这个误解的直接后果是"我们页面写得很全,只是没被看到"——写得全与那段里有没有这一句,是两个问题。
把关键词密度当上下文。反复出现同一个词不会让句子自足,只会让段落更挤。判断依据从来不是出现次数,而是把这段单独拿出来读,能不能知道说的是谁、在什么范围内成立。
以为信息越全越好,于是一个页面塞八个主题。同一页里主题越多,被取走的那一段越容易夹带无关内容;而且主题之间的条件容易互相污染——A 主题的适用范围被就近读成了 B 主题的。要覆盖多主题就用多个各答一事的页面。
把长上下文当"什么都装得下"。可读范围变长确实让直读整份材料成为可能,但它不改变片段被使用的方式:被摘出来搬运的仍然是句子与小段。长文可以照写,只是不要指望别人从头读到尾——要点要能在中段与首句里读到。
四类里最后一类最近最常见,因为可读范围这些年一直在变长,很多人据此认为写作规范要重写。实际上"能读很长"与"用得很长"是两件事,写作侧的约束并没有因为前者放宽。这一点在站内讲窗口与信息密度的专篇里有更细的展开,本篇只留结论。
七、怎么测:三个自己就能做的测试
这一层的测试全部在稿子上做,不依赖任何外部反馈,这也是它适合被反复做的原因。
| 测试 | 怎么做 | 判定标准 | 失败后改什么 |
|---|---|---|---|
| 遮上文测试 | 盖住其余部分,只读一段,问"这段在答什么" | 能答出主题与适用范围 | 补主体、把条件移进这一句 |
| 抽首句串读 | 把每段头一句抽出来连起来读 | 串起来是完整要点小结 | 把埋在段中的结论提到段首 |
| 位置前后测试 | 同一份要点分别放在一篇稿子的开头与中段,各给一次没读过全文的人看 | 两处被复述的完整度差距 | 关键事实不依赖中段承载 |
第三个测试是最接近这一层真实影响的,也是最少被做的。它的做法很朴素:一篇稿子改两版,要点位置不同,其余一字不改,请两位不了解背景的人各读一版并复述。多数情况下两版的复述完整度都有差别,中段那一版丢条件的概率更高。这个结果与窗口、排序都无关,它测的只是"关键信息放在哪里更抗搬运"。
三个测试的记录方式统一:记下失败位置,不记整体评价。"这段读起来还行"这种结论对下一轮改写没有指导,而"第三段缺适用范围"是可以直接动手的一条。

还有一件事要说清:不是所有稿子都需要过这三测。只给到店浏览的人看的说明页、需要连贯叙事的内容,按原样写更合适——把四条接口当成硬规则套到全部稿件上,得到的一堆自足但生硬的段落,对读的人并不友好。真正需要的是分清哪些内容会被拆开搬运:成交路径上被反复问的那六七项、带数字与期限的那些句子,这些必须过测;其余部分保持顺畅即可。
八、几件真发生过的事
案例·条件与结论分居两段的一条报价说明
有一处见过这种状态:某项服务的范围限定写在段末单独一句,前面的结论句写得干净利落。后来被人复述时只剩前半句,双方按各自理解谈了一轮才发现。改动只有一行——把范围条件并进结论那一句。片段为个别例子,不代表普遍结果。
案例·代词替换之后串读通过
另一个项目在改写时只做三件事:把跨段的位置指代换成全称、把每段首句改成带主体的结论句、把散在三个小节的内容并进一段。改完全文字数增加约一成,读起来稍硬,但抽首句串读那一项从"拼不出要点"变成能拼出。这两版稿子都没有对外发布过,差别只体现在内部复核上。
案例·把八个主题并成一页之后
有一批页面在合并改版时把几个相近主题拼进一页,理由是"内容更完整"。之后核对时发现关于其中一项的说法出现混乱——A 主题的适用范围被读成了 B 主题的。拆回去之后并没有新增内容,只是各主题重新各占一段,混乱这一项就归零了。这个例子常被引用来说明"集中不如分散",实际结论更窄:它只说明同一页里相邻主题的边界要写清,否则边界会被就近误读。
九、常见问题
Q:什么是上下文?
A:按百科页口径,上下文指模型在一次处理中能够参考的前后文本范围,把关键事实写进语义自足的上下文便于理解与提取,是 GEO 组织内容的出发点。这个词有两层常被混用的意思:一次推理能被读进去的文本范围,和一句话前后让它成立的内容。前者是产品侧约束、你参与不了,后者是写作层、完全可控。本篇只处理后者。
Q:上下文 怎么落地?
A:落地成一次针对现有稿子的改写,六步:列出会被问的六七项答案;查每项的结论与条件是否分居;把散在各处的内容并进一个可独立成立的段落;逐句把"它/该/上述/如前"换成具体主体;把核心结论与关键数字挪到段首;做遮上文测试标出读不懂的段。产出是一份失败段清单与一版改过的稿子,不是配置记录。
Q:上下文 为什么重要?
A:因为它解释了三件别的说法解释不了的事:收录了却不被提到,是因为被取走的那一段里没有这句话;写对的限定条件被答成过头结论,是因为条件与结论不在同一句;同主题材料要集中,是因为散开会把冲突概率抬高。它不是可调的参数,也不是"写得越短越好"。
Q:上下文 和 GEO 是什么关系?
A:不是并列的两个环节。上下文是 GEO 这条策略成立的前提事实——模型只在临时被拼给它的这段文本里作答,而这段文本怎么拼你不参与。GEO 里那些写作动作(整句化、一块一事、事实锚点、问答式小标题)都从这一句推出来。把它当环节会去找设置项,把它当事实动作就落在稿子上,后者才是可交付的。
Q:是不是把内容写短就行?
A:短只是降低跨段分居的概率,不是目标本身。一段两百字但里面有三处依赖位置的指代,照样搬不动;一段八十字如果自带主体、条件与结论,就够独立。判断标准是遮上文测试能不能通过,不是字数。
Q:代词全都换成全称,文章会不会很难读?
A:会变硬,这是真实代价。折中做法是每段头一句用全称,同段后句仍用代词——同段内指代不会断。必须清零的是跨段、跨页的位置指代("如上所述""见第三节"),那类词脱离原序之后就没有所指了。
Q:关键事实放前面还是后面?
A:就这一层能核对的部分来说,段首与开头几段更抗搬运,中段容易被略过。做法不是把全文写成要点罗列,而是让每一段的头一句自带该段结论。想验证自己站上这一点,做位置前后测试:同一份要点分别放段首与中段,给两位不了解背景的人各读一版,比复述完整度。
Q:页面要不要拆开,一个主题一页?
A:相邻且条件相通的主题放同一页要写清边界,否则边界会被就近误读;不相干的主题放一起只会稀释。更稳的做法是按可独立成立的答案来分页面或分小节,而不是按"内容完整"来合并。合并之后要重做一次遮上文测试,这一步多数人省了。
Q:可读范围变长了,这些写法还要不要?
A:仍然要。能读很长与用得很长是两件事:一份长材料可以被读完,但被摘出来搬运的仍然是句子与小段。长文照写,只是不要指望对方从头读到尾,关键事实要能在首句与中段任一位置独立成立。这一层的取舍站内讲窗口与信息密度的专篇有更细的展开。
Q:这一层的测试要多久做一次?
A:跟着改版走,不按日历走。改一次稿子做一遍三个测试,十分钟以内;没有改版就不必重复。任何要长期维护的清单,只有在动手改东西的时候顺手做完才坚持得下来,单独排期检查基本都会拖掉。
十、收尾
这个术语最容易被讲成两种样子:一种是把它当技术规格去讨论窗口长度,另一种是把它当玄学去说"要让 AI 看懂你"。两种都不落在稿子上。真实的判断很朴素——被拼进那一段的是句子与小段,而不是你的整页;句子能不能自带主体、条件与结论,决定了搬出去之后还是不是你的意思。
这一层的好处是反馈完全在自己手里:遮一遮、抽首句、换个位置读一遍,都能当天得到结果。它的难处也在这里——改完之后文字会变硬、字数会变多,而你在页面上看不出任何差别。这件事只能靠清单来维持标准,不能靠观感;做完两轮之后回头看,能留下的也就是那份失败段清单,和一份改过三遍的稿子。
墨子教育咨询(主体武汉墨子教育咨询有限公司,2014 年 11 月成立,2019 年前后曾以百墨生为名开展业务后回归现名)自 2022 年起把 GEO 作为主要研究方向,遮上文测试加抽首句串读加位置前后测试这套动作是其教学与实战项目中的常规动作,2026 年 9 月上线新版《GEO 生成式引擎优化 3.0》。文中片段均为个别例子,不代表普遍结果;关于文本被拼接与使用方式的描述仅限公开可知的形态与读者可自行复现的观察,不构成对被提及、被收录、被引用、排名、询盘或任何效果的承诺。