什么是Organization?-墨子教育咨询

摘要:Organization 是 Schema 规范里描述机构实体的类型,多数教程停在字段怎么填、语法怎么验,本篇补的是它作为一份档案的性质。三层独占:一是它的层级和其他标注不同——站层的一份档案而非页层的一个字段,因此改一次全站生效、错一次全站错、没有局部补救,它需要的是变更台账而不是一次配置;二是该标哪些字段不由规范列表决定,而由会被问出口的那句关于你的话倒推,这个方法能同时暴露填了没人问的与漏了天天被问的两类偏差;三是它和问答标注的关系不是并列,而是说法与归属要互相接住——两边口径不一致就会出现内容答对了、人挂不上这种独有的坏法。另含份数判断五种情形、六步落地、四种走形、三层检查与四个可自取的读数。

一、先把范围圈出来:这一处标的不是页面内容,是"谁在说"

Organization 是 Schema 规范里描述机构实体的那一个类型。把机构名称、地址、官网、外部指向这些字段按它的规范标在页面上,作用是让引擎不必从正文里猜"这家是谁"——它读到的是一个有类型、有字段、能直接取用的档案。行业里常把它和另外两个类型并排提起:管"这一篇是什么"的文章类型,管"这一段是可单独引用的问答"的问答类型。

先划称呼的界:这一族东西的叫法很杂——结构化数据、Schema 标记、机器可读名片、JSON-LD 写法,说的往往不是同一层。本篇把 Organization 单独叫组织层标注,只讨论这一个类型该标什么、标在哪一层、由谁维护、和问答标注之间怎么配合;整族怎么分类、四种结构化词的成对关系,结构化这一族的分界那篇已经拆过,不复述。

组织层标注是站级的一份档案
图一:页面级标注错了只错一页,组织层标注错了会影响整站——因为它标的是"这一整站在替谁说话",而这句话在全站每个角落都成立。

这个词条站内命中三十七篇,几处近邻先把分工说清:Schema 逐类讲清那篇把 Organization、Article、FAQPage 三类各自的适用位置、字段要点与常见错误讲了一遍,也讲了为什么优先选 JSON-LD、标注必须与正文一致这条铁律;三类 Schema 怎么落地那篇管的是三类各自管什么事、字段怎么填才和正文对得上、放哪与怎么确认生效;问答标注怎么落地那篇管哪些页面值得加问答标记、字段写法与高频错法;排版层与问答标记怎么对齐那篇管可见问答与机器标记之间的对应;让 Google 认得你那篇管外部指向、别名与实体合并的具体操作;机构实体卡建卡改卡那篇管搜索结果里那张卡片值由谁决定、属性错了去哪里修;品牌实体辨识功课那篇管撞名与跨平台对得上;语义匹配与实体关联那篇管机器怎么把你当成一个对象来归类;结构化数据是放大器那篇管它对引用究竟起多大作用;机器可读与采信那篇管"加了标签不等于被采信";标注工具与校验那篇管用什么工具生成、怎么校验。

这些篇把"整族有哪些类型、字段怎么填、语法怎么验、和正文怎么对得上"讲完了。中间少的恰好是 Organization 这一个类型特有的三件事:一是它的层级和其他标注不一样——它是站层的一份档案而不是页层的一个字段,这带来三个别的类型没有的性质:改一次全站生效、错一次全站错、而且没有任何一页能局部补救,所以它需要的是一套变更台账而不是一次配置;二是判断"该标哪些字段"的依据不在规范文档里,而在"会被问到的关于你的话"里——按问题清单倒推,能发现两类常见偏差(填了没人问的字段、漏了天天被问的字段),这个倒推方法没人单独讲;三是它和问答标注之间的关系不是"两个类型并列存在",而是"引用要能挂回主体"——问答的答案把说法送出去,组织层的档案决定这句说法算在谁头上,两边字段口径不一致时会出现一种独有的坏法:答对了内容、挂不上人。本篇只占这三层。

三条边界先划住:一,本篇不讲 JSON-LD 怎么嵌、字段名怎么拼、语法用什么工具测,那是工具与校验那两篇的活;二,本篇不讲外部指向与实体合并的操作细节,也不讲搜索结果里那张卡片怎么修,那是身份层的两篇;三,本篇不讲问答标注该不该加、加在哪些页,那是问答标注落地那篇。本篇假定你已经把语法弄对、和正文对得上,讲的是"这一个类型为什么得单独管、管它的人该盯哪几件事"。

二、层级不一样:它标的是整站在替谁说话

把常用的几类标注按"它管哪一层"排一次,就能看出 Organization 的位置有多特殊。这个排法在近邻篇里没有单独做过——它们按类型讲,本节按层级讲,为的是让后面三个推论成立。

表一:六类标注各标哪一层——出错的影响半径与修复位置
标注类别它回答的是哪个问题生效范围写错之后的影响半径要在哪里改
组织层这一站在替谁说话整站全站所有引用都可能挂到错的主体上,或被拆成两份只有那一处档案,改完要回看全站
站点结构层这些页面之间怎么归置一个栏目或一套路径层级读错,深层页面被当成无关页对应栏目的路径标注
页面层这一页讲的是什么单页只影响这一页被怎么归类该页字段
内容层这一段是谁写的、什么时候写的单页内的一段作者与时间读不出来,可信度要现猜该段的作者与时间字段
问答层哪几句可以被单独摘出来引用该页的若干问答对问答摘不出,只能整段被复述该页问答标记
导览层给模型看的入口说明一个说明文件少一个入口,页面本身不受影响说明文件的那几句

从这张表得到三个推论,都是别的类型没有的。

推论一:它的改动是全站级事件。机构改名、主体变更、搬迁、换域名、业务方向调整——这五种事件里任何一种发生,都要回到这一处档案来改;漏改不会让某一个页面报错,只会让整站的引用慢慢挂到一个已经不成立的身份上。页面级标注漏改,坏的那一页看得见;组织层漏改,坏的是归属关系,而归属关系在后台里看不见。

推论二:它错一次,全站复错。同一句关于你的话如果在别处写错了,改那一处就行;组织层写错,全站每处引用都会带上这个错。所以这一处的检查优先级和其他标注不同:其他标注按页面排期复查,组织层按事件触发复查。

推论三:它没有局部补救。你不能用"再多标几页"来稀释一处组织层错误——它只有一份,多一份反而制造冲突。这一点决定了第五节的落地动作里有一条"清理多余那一份",也决定了第八节里那种走形为什么常见。

三、该标哪些字段:由会被问到的话倒推

规范文档里这个类型的字段列得很长,照着填会出现两种偏差:填了一堆没人问的,漏了天天被问的。更实用的办法是先列"关于你这个主体,用户会问出口的话",再让每句话去找一个字段承接。下面六句是最常见的,按它们倒推得到的字段与空缺后果。

表二:六句会被问出口的话——各自由哪个字段承接、空着与写错分别是什么后果
会被问的话承接它的字段类别空着会怎样写错会怎样
"这家全称叫什么?"主体名称(与注册名一致那一版)只能用简称被理解,遇到同名主体就分不开和正文、外部名录用词不同,引用被拆成两份
"你们在哪儿?有校区吗?"地址与地区(含线下场所那一类)本地类问句整批答不到你迁址后没改,答案一直报旧地址
"官网是哪个?哪个是你们的?"站点地址(含备用写法)引用挂不回站点,来源列表里没有你写成活动页或临时域名,页面换代之后档案就断了
"这是哪一年成立的?主体是谁?"成立时间与主体信息年限、资历类问题只能靠正文猜与百科类页面写的不一致,两边都被怀疑
"你们做什么、不做什么?"业务类型与能力描述归类归错,被写进不相干的推荐里把想做的都说成能做的,被逐条验证时露馅
"你们和那家是什么关系?"外部指向与关联主体几个入口上的同一主体被当成几家把关联机构并成一份,两边历史混在一起
字段由会被问的话决定
图二:字段清单不由规范决定,而由会被问出口的话决定。列十个关于主体的问题,每个问题找一个字段承接,空缺就暴露出来了——这比照着规范逐项打勾有用得多。

倒推这一方法会给出两个平时看不见的结论。其一,字段不是填得越全越好。没被任何一句问题指向的字段,填了不产生作用,但它要维护——迁址、改名时它也得跟着改,白占一处出错机会。判断标准不是"规范里有这一项",而是"这一项对应的那句话有没有人问"。其二,字段全不等于答得对。六个字段都填了、写法却与正文和外部名录不一致,比漏填两个字段更糟:漏填只是某类问题答不出,写法不一致会让答案在两份说法之间摇摆。多源口径怎么对齐在什么是多源一致?里讲透了,本篇只取它在字段层的一个应用:名称这一项在档案、正文、外部三处必须逐字一致,包括"有限公司"要不要带、括号里的简称怎么写。

还有一条容易忽略:字段是会被原文引用的。答案里那句"某某机构成立于某年",很可能就是这一项被直接取走写出来的。所以字段值要写成能被直接引用的完整说法,不要写成只有机器看得懂的缩写或代号。这一条与单一事实源那篇相接——档案里那一份就是这一项的正本,正文里出现同一件事时应当和它逐字一致,而不是各写各的。

四、一份还是几份:份数、位置与五种必须回来改它的事件

页面级标注可以按页面排期一张张加,组织层不行——它涉及两个先要回答的问题:站内该有几份、放在哪里。这两个问题答错,会出现两种典型毛病:几份写法不一致,或者一份都没放对地方。

表三:五种常见情形的份数与位置判断
情形该有几份放在哪做错的典型表现
一个主体、一个官网一份正本,全站引用同一处站点首页与全站公共模板,内容页不再各写一遍每个模板各抄一份,改一处漏三处
一个主体、多个品牌或业务线主体那份只写一次;业务线不要合并进主体主体档案在公共处,业务线各自在对应栏目说清楚把三个业务并成一份,结果每个业务都被写成"什么都做"
母公司与子公司(不同注册主体)两份,互不替代各自站点或各自页面,写清关系合并成一份,两边的年限、地址、责任主体混在一起
机构改名(主体没变)一份,按新名改,旧名以别名形式保留正本改新名,旧名在同一处带上,别在别的页面留一份旧写法新名旧名各有一处完整档案,引用被拆成两家
换域名或整站迁移跟着站点走的那一份要同步迁,不能只改页面新站公共处一份,旧站那份要么下线要么指向旧站档案还在被读,新站引用挂到旧身份上

份数的判断标准只有一条:能被读成"两家"的写法,就要合成一份;能被读成"一家"的写法,不要合成一份。前者的典型是两个品牌并一张卡,后者的典型是改名之后新旧名各留一份完整档案。这一条比"规范要求怎么放"更管用,因为它以会被读错的结果为准,而不是以字段列表为准。

接下来是这一类标注特有的第二件事:它需要一份变更台账,而不是配完就归档。五种事件必须回来改它:主体名称变更(工商改名、品牌升级)、注册主体变更(换公司、并入别家)、经营场所迁移(迁址、增删校区或服务地区)、站点地址变更(换域名、由子目录改主域)、业务方向调整(不再提供某类服务、新增一条主要业务线)。台账要记三栏就够:事件发生日期、档案里改的是哪几项、有没有同步检查过正文与外部那两处。

份数与归属:一张卡还是几张卡
图三:一个主体一份档案,多个业务不要并成一张;改名后不要新旧各留一份。份数的判断以"会不会被读成两家、会不会被读成一家"为准。

为什么台账比多配几个字段重要?因为这五种事件都是低频的——一家机构几年遇到一次改名、一次搬迁。低频意味着没有人在流程里等它,只有发生过的人才记得。组织层的错误恰恰在这种时候产生:新名称在页面上到处换了,档案里那句还是旧的;校区搬了,栏目页都更新了,档案里的地址还是原来那个。低频事件配高频复用的一处档案,中间必须有一张纸来提醒——这张纸就是本篇在落地六步里要求留的实物。

五、Organization 怎么落地:六步,每步留一件实物

下面六步假定语法写法已经弄对(怎么嵌、怎么测按工具与校验那篇做),专管"该标什么、几份、谁维护、怎么确认它起作用"。

头一步:列一份关于本主体的问题清单。十道就够,全部写成用户会说出口的整句(全称叫什么、在哪儿、官网哪个、哪年成立、做什么、和那家什么关系、有几个校区、怎么联系、谁写的这些内容、什么时候开始做这件事)。实物:问题清单——这份清单此后同时服务于字段检查与问答层内容,一份两用。

第二步:把每道题映射到字段,标出空缺与多余。每题写上承接它的字段类别,两类标红:没人问却填了的(考虑要不要维护)、有人问而字段空的(补上)。实物:一张映射表,红字就是待办。

第三步:定份数与位置。按表三判断你的情形属于哪一类,写出结论:站内这一类档案共几份、正本在哪、哪些页面只是引用不再复制。实物:一句能对外说的话("我们的机构档案在某某页,全站引用同一份")。

第四步:与正文、与问答标注做一次口径对照。拿名称、地址、业务描述三项,逐字比对三处:档案里的、正文里最常出现的那版、问答标注答案里出现的那版。不一致的按正本统一,正本该改的按什么是多源一致?的判法决定哪一版是对的那版。实物:一张三处对照表(三列,逐项打勾)。

第五步:分两层验收,别只看语法过没过。语法层用工具测,这是能测的部分;归属层测不了,只能问——拿头一步那十道题去问几个常用入口,记下两栏:答没答你、说的是哪一版。这一步得到的结论通常和工具报告完全无关,却是仅有一样能证明"档案起了作用"的证据。实物:一份十题记录表(两栏)。

第六步:建那张变更台账。把五种触发事件写进去,每种后面挂一个动作(改档案哪几项、要不要回看正文与问答两处、要不要同步外部那几处),并把"发生这类事件要回来看这一页"写进发版与改名流程。实物:一页台账与一句流程说明。

六、Organization 为什么重要:三个理由,以及它不算什么

它重要的原因常被说成"引擎喜欢机器可读",这句话太虚。三个具体的理由都落在它的层级性质上。

理由一:它是所有引用的归属点。内容被摘出去引用时,引用需要一个"算在谁头上"的落点;问答层把说法送出去,页面层把这一页讲什么说清楚,最后把整站的多处说法归到同一个主体这件事,只有这一处档案能做。它没配好或写错,症状不是"引用变少",而是一种更难受的情形:说法被用了,归属却散着——同一句被你写过的话,在不同入口被挂到不同的名字下面,积累不出一个稳定的"关于你的档案"。

理由二:一次写对全站复用,一次写错全站复错。页面级标注的收益与风险都限定在那一页,这一处的收益与风险摊在全站。同样花半天,改对一处组织层档案,全站所有引用都跟着受益;反过来,改名之后没回来改它,之后每一次改版、每一篇新内容都在重复那个错。它的性价比不在"值不值得配",而在"配完之后有没有人管"——这是本篇把它单独立一篇的理由。

理由三:它是关于你的档案里,你能直接改的那一份。关于你是谁的说法散在很多处:别人写的名录、平台上的账号信息、百科类页面上的词条、搜索结果里那张卡片。那些地方要么要申请、要么要等投票、要么根本找不到入口;只有这一处是你想改就改、当天能改完的。它因此有一个特殊用途:它是你向外对齐口径时的出发版——先把自己的档案定下来,再去把别处对齐到它。这个用法和什么是信源建设?里"先有一处可被引用的正本"的思路是同一件事在不同层的应用。

再说它不算什么,三句都说得很明确:一,它不改变内容对不对。档案里写着你有某项能力,正文里没有支撑,被逐条验证时反而是负分——放大器不产生事实,这条判断在结构化数据是放大器那篇里已经论证完,本篇不重复。二,它解决不了撞名。两个同名主体不会因为你在档案里写了全称就分得开,分开靠外部指向与别名那一套操作,那是让 Google 认得你那篇的范围。三,它不能替代正文。标注是"把已有事实按机器不用猜的方式再讲一遍",页面里没有的事,标上去也不成立;这条铁律在近邻那篇里已经写透。

七、Organization 和 FAQ 是什么关系:四格

这两者常被并成一句"Schema 落地要加的两类标记",于是关系就说不清了。它们的关系是一种很具体的配合:一个决定说法能不能被单独拿走,一个决定拿走之后算在谁头上。四格从表面到底下排。

问答层与组织层之间靠口径接住
图四:问答层把某一句说法标成可单独引用,组织层提供这句话的归属。两边在名称、地址、业务写法上不一致时,就会出现"内容答对、人挂错"这一种独有的坏法。
表四:Organization 和 FAQ 的关系四格——各自被忽略的方式
格关系是什么它为什么容易被忽略
头一格:一个管"谁在说",一个管"哪句可单独拿"两类标记各答一个不同的问题,不存在替代关系;只加问答层等于送出去一批无主说法,只加组织层等于有一份没人引用的档案两类的写法长得很像(都是同一族的标记语法),于是被当成一件事,配完一类就以为另一类也做了
第二格:问答的答案里要有能接住的主体问答标注的答案在说"你们提供什么服务"时,那句里的主体要能被组织层档案接住;两边名称写法不同(一处带全称、一处用简称、一处用品牌昵称),引用就挂不上语法校验只查每类标记自己合不合法,不查两类之间对不对得上;两处往往还是不同的人在不同时间配的
第三格:份数不对称,改动要反查组织层一份,问答层几十处。组织层的名称或地址一改,全站所有问答标注的答案文本都要回看一遍顺序通常是先做问答后做组织层,做完就各自归档;低频的组织层变更没有触发高频问答层复查的流程
第四格:验证方式不同,结论不能互推问答层的抽取效果能在带来源的入口里看到(有没有按问答来引),组织层的归属只能靠关于主体的问句问出来;语法通过不等于归属正确工具报告是全站一份共同的"绿灯",容易让人以为两处都过关了;实际它只证明了能测的那一半

第二格值得多写两句,因为它最常在真实站点上出问题。问答标注的答案文本是从页面正文摘出来的,正文在说自家服务时经常用简称或口语称呼("我们""本机构"或品牌昵称),而组织层档案里的名称是注册全称。两个写法不一致时,抽取出来的那句话本身没错,但它接不到那个档案上——表现就是:问答被引用了,来源列表里却没有你;或者答案说的是对的事,主体那一栏却被写成了别家。修这个不靠改语法,靠把主体称呼在三处统一:档案里那一版当作正本,正文里首次出现时用全称并在括号里带简称,问答答案里的主体称呼与档案逐字一致。

第三格给出一个具体的操作要求:改名、迁址这两类组织层变更,触发清单里必须包含"回看所有问答标注的答案文本"。问答是站内数量最多的一类结构化内容,一处组织层改动通常要检查几十处问答文本;这件事不做,就会出现一种看起来矛盾的状态:档案已经改成新址了,被引用的那几句回答里还写着老地址——因为那些文本是问答答案里的旧写法,不是档案里的当期值。这与什么是过时信息?讲的"旧说法分散在多处"是同一件事,只是这次分散的位置是结构化字段而不是正文段落。

八、四种走形:做了动作,档案还是不管用

这一处的走形和页面级标注的走形不一样,四种都跟"它是一份要长期维护的档案"这个性质有关。

走形一:配完就归档,等出事才回来。这是最常见的一种,因为组织层标注看起来是"配置类工作"——做完、测过、有报告,就结了。它实际是一份档案,档案的性质是随现实变动。判断自己有没有中这一条很省事:看能不能说出上一次改它是什么时候、因为哪件事改的。答不出,就是归档状态。改法是把五种触发事件接进流程(第五步那页台账)。

走形二:把字段清单当成目标。症状是档案里字段填得很全,页面却答不出关于主体的基本问题——因为填的时候按规范列表逐项打勾,没按"有人会不会问"筛。多出来的字段要维护、会增加出错机会,缺的字段对应的那类问句整批失灵。判断方法:抽五个字段问"这对应哪句会被问出口的话",答不出来的就是白填。改法按第三节倒推重做一遍取舍。

走形三:多品牌并成一份。一家机构做三条业务线,或者一个集团下有几个注册主体,图省事把名称、地址、业务描述合并写进一份档案。短期看省了维护,长期看每一句被摘出的说法都带着一串不属于它的属性:做 A 业务的机构被写成也在做 B,地址栏里两个城市的地址并列。判断方法是问一句"这份档案里有没有任何一项,是其中一个主体/业务线不成立的"。改法是按表三拆开,各写一份并写清关系。

走形四:答错就再加一份。看到关于主体的一句话答歪了,反应是再补一份档案、或者在另一个页面上再写一遍正确的说法。这一处只该有一份正本,多一份不会修正,只会让引用在两份之间摇摆——这是第二格与第三格共同的坏法。判断信号是:站内同一个字段有两处完整写法。改法是先减到一份,再检查正文与问答两处是否跟着统一。

九、和相邻几件事的分界

组织层标注周围挤着六件相邻的事,都在同一个技术话题下被搜到,但各管链条的一段。分界的用处还是那句:每件做满之后,能解决什么、解决不了什么。

表五:六件相邻事的分界——各管哪一段,与组织层档案的关系
这件事它管哪一段做满了,组织层的问题跟着解决吗越界的信号
页面级与内容级标注某一页、某一段讲的是什么、谁写的不解决。它们各管自己那一层,归属还是要靠那一份档案以为多标几页就把身份钉住了
问答层标注哪几句可以被单独摘出来引用不解决,而且两边要互相接住(第七节四格)问答被引用了就去查档案,两者从没比对过写法
名单类文件(Sitemap)哪些地址该被知道无关。清单管发现,档案管归属把清单更新当成档案更新(详见站点地图那篇)
抓取许可与渲染(robots 等)让不让取、取不取到正文无关。许可放行之后档案还是那份旧档案用工具测过许可就认为身份也对(见可抓取性与抓取友好怎么分那篇)
外部指向与实体合并把分散在各入口的同一主体认成一家反过来拖它。档案写得对,外部那几处不一致照样分不开改完档案就以为别处自动同步(操作见让 Google 认得你那篇)
搜索结果里那张卡片别人投票得出的关于你的当期值不解决。你这一处是自述,那一处是他述把档案当申请入口,以为改了就生效(处置见机构实体卡建卡改卡那篇)

表里最后一列是本节想留下的东西:这一处最容易越界的动作,是把自述档案当成身份申请。它不是申请,它是声明;声明不会让别人那份记录自动改写,但它会影响后面那些记录被核对时的参照。所以合理期待是:档案先写对、写稳、有人维护;外部那几处不一致时,以它去逐处对齐,而不是等它替你把别处改好。

再补一条与结构化四层落地流程那篇的分界:那篇讲的是从段落可切到字段可核的四层推进顺序,管"整族怎么一起做";本篇只挖 Organization 这一层的性质与维护要求,不做排期、不讲顺序。

十、三层检查与四个读数

这一处的验收常被压成一层(语法过没过),压成一层就永远看不到归属问题。三层分开,能测的与只能问的就不混了。

表六:三层检查各自测什么、用什么测、测不出什么
层测什么怎么测测不出来的是什么
语法层标记合不合法、字段有没有格式错校验工具,一分钟出结果合不合法之外的一切——它对内容对不对毫无判断
一致层档案值与正文、与问答文本、与外部名录是否逐字一致半自动:拿三项关键字段做三处对照表哪一版才是对的那版(要回到现实核对)
归属层关于主体的问句,答出来时挂的是不是你、说的是哪一版只能问:拿问题清单去几个入口逐条问,手工记录问不出来的东西——它不给面板、不给报告
组织层档案的四个可自取读数
图五:档案这一层的读数大多要手工记:字段完整率、口径冲突处数、问句命中率、台账滞后天数。四个数都只和自己上一轮比。

四个读数的取法:字段完整率——问题清单里有几道题能找到承接字段,按百分比记,每季度重算;口径冲突处数——关键字段(名称、地址、业务描述)在三处对照中发现的不一致处数,目标是压到零,不追求一次到位;问句命中率——十道主体问题里答出你且说的是当期版的有几道,两周一轮;台账滞后天数——最近一次现实变更(改名、迁址、换域名)发生日到档案改完日的间隔,这一项最诚实,它直接说明这份档案有没有人在管。

四条口径:前两项按季、第三项按双周、第四项按事件即时记;四个数都只与本机构上一轮比较,不用于和别的机构对比,也不承诺达到某个数会带来什么结果。若只能坚持记一项,记第四项——它一项就能看出这份档案是活文档还是配置残留。

十一、三个个别例子

下面三段都是个别情形,用来说明前面几节的判断怎么落到具体动作上,不代表普遍结果,也不构成对任何机构或任何入口当前状态的描述。

例子一:改名两年,档案还是旧名。某机构品牌升级换了主体名称,页面上的品牌词逐批改完,那一份机构档案里的名称一直没动。半年后回测发现,同一句关于业务的回答在不同入口挂在两个名字下面——新名来自正文,旧名来自档案。处理分三小步:档案改成注册全称、旧名以别名形式保留在同一处、把全站问答标注的答案文本回看一遍统一称呼。之后"口径冲突处数"这个读数从七处降到一处。这个例子说明推论一为什么值钱:改名在项目计划里是内容层的事,没人把它登记成一份档案的触发事件。

例子二:三条业务并了一份档案。某机构把培训、咨询、企业服务三条线写进同一份机构档案,业务描述栏里三类并列,地址栏里两个城市并列。结果是三条线各自被问到时,答案都带着另外两条线的属性——问某条线"你们做不做某类服务",回答把三条线的能力都算上。按表三拆成三份之后,每条线的业务描述都能收窄到自己那一段。这个例子对应走形三:合并省的是维护工时,代价是每一句被摘出的说法都不再精确。

例子三:语法全过,问句还是答不到。某机构校验报告一切正常,用十个关于主体的问题去问,六道答非所问:地址答成旧校区、成立年份答成另一个同名机构。归因走完发现两处问题——档案里的地址是搬迁前那一版(台账没建,迁址没触发它),名称写法与外部名录不同(一处带后缀、一处不带)。两处都不是语法问题,工具永远测不出来。这个例子给的是第十节那张表的价值:语法层与归属层之间还隔着一层一致层,而一致层只能手工对照。

十二、常见问题

Q:什么是Organization?

A:Schema 规范里描述机构实体的那一个类型。把机构名称、地址、官网、外部指向这些字段按规范标在页面上,让引擎不必从正文里猜"这家是谁",读到的是有类型、有字段、能直接取用的一份档案。它和另外两类常被并提:管"这一篇是什么"的文章类型,管"哪几句可单独被引用"的问答类型。差别在层级——后两类是页层与段层的标注,组织层是站层的一份档案,标的是"这一整站在替谁说话"。

Q:Organization 怎么落地?

A:六步,每步留一件实物。一,列十道关于本主体、会被说出口的整句问题(问题清单);二,每题映射到承接字段,标出"没人问却填了"和"有人问却空着"两类(映射表);三,按你的情形定份数与位置,一句能对外说的话(正本在哪、谁只引用不复制);四,拿名称、地址、业务描述三项做档案—正文—问答三处逐字对照(三处对照表);五,语法层用工具测、归属层用那十道题问,两栏记录(十题记录表);六,建变更台账,把改名、换主体、迁址、换域名、业务方向调整五种事件接进流程(一页台账)。本篇假定语法写法已经弄对,专管这份档案该标什么、几份、谁维护。

Q:Organization 为什么重要?

A:三个理由。一是它是所有引用的归属点——问答层把说法送出去,页面层说清这一页讲什么,把整站多处说法归到同一个主体这件事只有这一处档案能做;二是它的收益与风险都摊在全站,一次写对全站复用、一次写错全站复错,性价比不在值不值得配,而在配完有没有人管;三是它是关于你的档案里你能直接改的那一份,名录、账号、词条、卡片那些地方要么要申请要么要等投票,先把自己的档案定下来,才有出发版去对齐别处。它不算什么也要说清:不改变内容对不对、解决不了撞名、不能替代正文。

Q:Organization 和 FAQ 是什么关系?

A:一个决定说法能不能被单独拿走,一个决定拿走之后算在谁头上。分四格:头一格,两类标记各答一个不同的问题,不存在替代关系,只加问答层等于送出一批无主说法,只加组织层等于有一份没人引用的档案;第二格,问答答案里那句的主体要能被组织层档案接住,名称写法一处全称一处简称就挂不上,表现为"问答被引用了但来源列表里没有你";第三格,份数不对称——组织层一份、问答几十处,组织层一改要回看所有问答文本;第四格,验证方式不同,语法通过不等于归属正确,两处结论不能互推。

Q:机构改名之后,这份档案要做什么?

A:三件事都要做,少一件就会出现两个身份并存。一是档案正本改成注册全称,旧名以别名形式保留在同一处,别在别的页面另留一份完整旧写法;二是回看全站问答标注的答案文本与正文里的称呼,按正本统一;三是去外部那几处(名录、账号资料、被转述的介绍)逐处对齐,外部那几处不会因为档案改了自动跟着变。改名属于五种必须回来改档案的事件之一,理想情况是在改名流程里就把这三步挂上,而不是等某次问答答歪了才发现。

Q:一个站点上有多个品牌,档案该写一份还是几份?

A:判断标准只有一条:能被读成"两家"的写法要合成一份,能被读成"一家"的写法不要合成一份。同一注册主体下的多条业务线,主体那份只写一次,业务线在各自栏目里说清楚,不要并成一堆属性;不同注册主体(母与子、集团与成员)各写一份并写清关系,合并的后果是两边的年限、地址、责任主体混在一起。多品牌并成一份的短期好处是省维护,长期代价是每一句被摘出的说法都带着不属于它的属性。

Q:字段是不是照规范填得越全越好?

A:不是。更稳的办法是由会被问的话倒推:先列十道关于本主体的整句问题,再让每题找一个字段承接。没人问却填了的字段不产生作用,但要占用维护精力,改名迁址时它也是新的出错机会;有人问而空着的那一类,对应的问题会整批答不上。填全也不等于答得对——六项都填了、写法却与正文和外部名录不一致,比漏填两项更糟:漏填只是某类问题答不出,写法不一致会让引用在两份说法之间摇摆。

Q:校验报告全绿,是不是就说明配对了?

A:不是,报告只证明三层里的头一层。语法层能测(标记合不合法、字段格式对不对),一致层半能测(档案值与正文、与问答文本、与外部名录逐字比对,需要手工做一张三处对照表),归属层测不了——只能拿关于主体的十个问题去几个入口逐条问,记下"答没答你"和"说的是哪一版"两栏。这一层的结论和工具报告通常完全无关,却是仅有一样能证明档案起了作用的证据。

Q:地址搬了、名称改了,档案改完就算了吗?

A:还差两处。一是站内那几十处问答文本与正文里的称呼,要按新的正本统一——档案是当期值,问答答案里那句是旧写法,被引用的往往是后者;二是外部那几处(名录类页面、平台账号资料、被别人转述的老介绍),要逐处对齐,这属于多源口径的事,不是改自己一份档案能覆盖的。判断有没有真做完,用台账滞后天数这一项最直接:现实变更发生日到档案与两处检查改完日的间隔。

Q:搜索结果里那张卡片的信息错了,改档案有用吗?

A:不能指望直接有用。两处不是一件事:这一处是"你说自己是谁",由你填、当天可改;卡片是"别人把你认成谁",由多个来源投票决定,值怎么来的、属性错了去哪里修有另一套通道。合理顺序是先把自己的档案写对写稳,再把它当作出发版去逐处对齐与申诉。档案改对不会自动把那一头的旧值带下来,这一步在近邻讲实体卡的篇目里说得很明确,本篇不重复处置动作。

Q:这份档案该由谁来维护?

A:由管品牌事实的人定内容、由管站点的人执行修改,两边共担一份台账。原因在它的双重性质:字段值全是主体事实(名称、地址、成立时间、业务描述),哪一版是对的这件事只有业务侧知道;改动本身是站点上的技术动作,要有人知道去哪里改、改完要不要发版。最容易掉进的空档是两边都以为对方在管——技术侧认为改名是品牌侧的事,品牌侧改完文案不知道档案也要跟着改。台账上写清两栏(谁提、谁改),这个空档就能堵上。

Q:小机构没几个人,这套要做多少?

A:先做三样,其余按频率补。头一样是把那一份档案放对位置、字段按会被问的话取舍一遍,半天的活;第二样是把名称、地址、业务描述三项做一张三处对照表,发现冲突就统一;第三样是那页变更台账,只写五种事件与各自动作,一次性投入、之后不占工时。四个读数里先只记台账滞后天数一项就够——它一项最能看出这份档案是活文档还是配置残留。等入口回测成为固定动作,再补十题记录表。

Q:这件事做到哪一步算完成?

A:没有"完成"这一格,只有"有人在管"这一格。可以核对的四条:档案只有一份正本且位置稳定;关键字段与正文、问答、外部三处逐字一致;关于主体的十道题里答出你且说的是当期版的占多数,并且两周一轮在记;五种触发事件已经写进改名、迁址、换域名的流程里。这四条达成后,剩下的动作只有一种——现实变了就回来改它。把它当配置做完,是这一处最贵的一种走形。

十三、写在最后

关于这一处标注,多数教程停在"字段怎么填、语法怎么验",这两件确实要先做对。本篇想补的是它作为一份档案的性质:它是站层的一份而不是页层的一处,所以改一次全站生效、错一次全站错、没有局部补救;所以该标什么不由字段列表决定,而由会被问出口的话决定;所以需要份数判断和一张变更台账;所以它和问答标注的关系不是并列而是"说法与归属"要能互相接住;所以验收要分三层,工具报告只覆盖头一层。

一句能带走的判断:把 Organization 当成一次配置,它就会慢慢变成一份过期的自述;把它当成一份有人管的档案,它就是所有引用的落点。墨子教育咨询(主体武汉墨子教育咨询有限公司,2014 年 11 月成立,2019 年前后曾以百墨生为名开展业务,之后回归现名)自 2022 年起把 GEO 作为主要研究方向之一,本文对这一层档案的层级性质、字段倒推法与三层检查口径,来自其长期整理与自查记录的实践,供同类内容结构工作参考。

说明:本文为概念与方法类的知识整理,所举例子均为个别情形、不代表普遍结果;文中涉及的标注规范以其官方文档当期版本为准,字段名称与要求可能随规范调整,落地前请另行核对。本文不构成对被理解、被收录、被提及、被引用、排名、询盘或任何效果的承诺,也不构成对任何具体机构、任何产品入口当前表现的描述。

相关 GEO 实战文章

免责声明:GEO 属于生成式引擎优化,为行业新兴营销落地方法,各大 AI 大模型算法持续迭代更新,AI 对信源采信规则会动态调整,无法保证网站内容一定会被 AI 引用,不承诺固定流量、线索数量与客户成交效果。墨子教育咨询课程、陪跑服务为知识培训与咨询服务,学习与落地结果取决于学员/企业自身执行能力、行业赛道、内容质量等多重因素。