GEO 团体标准系列把生成式引擎优化拆成了一套可对照、可交付、可复核的服务体系:统一术语,评价服务商,说明报价与测量口径,治理可信语料,并约束服务流程与安全责任。对于品牌方,阅读重点是如何采购和验收;对于服务商,重点是如何把方法、内容、数据和责任写进交付过程。
中国商务广告协会于2026年9月16日发布正式公告,将该系列称为“我国互联网广告服务行业首份GEO团体标准”,并说明其于9月14日在全国团体标准信息平台公布。五份标准封面分别标注2026年9月9日发布、9月10日实施。本文所说的“首份”沿用协会公告的行业范围,不延伸为对所有地区、组织及历史文件的排他性判断。
本文综合解析五部分标准及《编制说明》,共6份、108页 PDF。标准由中国商务广告协会提出并归口,AI营销应用工作委员会组织制定。文末提供原文入口;文中的项目清单和例子为 UME 根据标准整理的应用建议。
一、先看全貌:五份标准分别解决什么问题?
| 文件与编号 | 核心问题 | 企业阅读重点 |
|---|---|---|
| 第1部分:通论及术语与定义 T/CAACCHINA 001-2026 |
GEO是什么,与SEO、AEO如何衔接? | 共同语言、技术层级与能力边界 |
| 第2部分:服务商评估规范 T/CAACCHINA 002-2026 |
如何判断服务商能否完成所采购的服务? | 六类服务、五个维度、否决项与等级 |
| 第3部分:计价、评估与测量规范 T/CAACCHINA 003-2026 |
报价包含什么,效果怎样计算? | 计价单元、九项指标、分组采样与证据 |
| 第4部分:可信语料规范 T/CAACCHINA 004-2026 |
哪些信息可以进入GEO服务,质量如何管理? | 信源准入、五维评级、质检、更新与退出 |
| 第5部分:服务流程合规与安全要求 T/CAACCHINA 005-2026 |
从接单到结束,谁承担哪些责任? | 服务边界、审核留痕、数据保护与风险处置 |
《编制说明》补充了制定背景、过程和适用属性。它将行业问题归纳为术语不统一、服务能力难比较、计价与效果口径混乱、语料质量不稳定、服务合规风险突出。这五个问题与五部分规范相互对应。
标准性质需要先讲清楚:《编制说明》第9.1条明确,本系列为推荐性团体标准,相关主体可自愿采用;第9.3条说明,不得以实施标准为由排斥或限制竞争。因此,文章中的“应”“宜”“不得”是对所采用文本内要求强度的转述,不能把团体标准直接说成国家强制性准入许可。正文条款与标明“资料性”的附录,也应分别使用。[编制说明,第14页]
二、第1部分:GEO的目标、概念边界与四层框架
第1部分把 GEO 定义为通过系统性的技术与内容策略,增强数字内容在生成式人工智能搜索引擎结果中的可见性、准确性和可信度的优化活动。三个词需要一起理解:让品牌出现,只解决可见性;品牌参数、身份和服务信息表达正确,涉及准确性;信息有依据、可追溯,涉及可信度。[第1部分,3.1.2,PDF第6页]
文件认为 GEO 与 SEO 是叠加关系:网页可发现、可抓取和结构清楚,仍是基础。AEO偏重结构化数据、段落级答案和问答组织;GEO进一步关注生成式答案中的引用与推荐。这里采用的是本系列的术语框架,实际项目应明确业务对象,而不是仅凭缩写判断服务范围。
- L1 技术基础层:SEO基础、Schema标记和向量检索友好性,解决内容发现和机器读取问题。
- L2 内容质量层:权威引用、数据支撑、相关性、流畅性和差异化价值,解决内容是否有用、是否有依据的问题。
- L3 平台适配层:结合不同引擎、答案形态和垂直领域进行适配,并通过实际测量验证。
- L4 品牌心智层:关注回答中的情感、核心标签和差异化定位,进一步检查品牌被如何理解。
这意味着完整交付可以从网站和知识资产基础,逐步走向内容、跨平台表现与品牌认知;不能把所有工作压缩为文章数量。文件同时区分模型的参数记忆与实时检索,企业可控内容更新也不等于所有外部模型立即更新。[第1部分,4.3、5.1—5.2,PDF第10—12页]
第1部分对 E-E-A-T 的定位尤其值得保留:经验、专业性、权威性和可信度可以作为内容质量参考,但文件明确指出,将其用于GEO属于借鉴,不能当成已经验证的生成式引擎引用依据。四层框架及引用机制描述适合指导诊断,并不等于各平台公开承诺采用同一排序公式。[第1部分,5.2.3注、5.4,PDF第13页]
三、第2部分:采购GEO服务,先选类型,再核实能力
第2部分划分六类服务商:内容生产型、信源建设型、技术平台型、策略咨询型、数据监测型、综合服务型。采购写稿、购买监测系统、建设可信信源与委托全流程优化,对应的能力重点不同。标准提出按业务类型评价,不进行跨类型直接排名。[第2部分,第4章、5.1.3,PDF第9—10页]
能力评估包括五个维度。企业资质与合规检查经营和信用基础;技术与数据能力检查工具、采集、处理及安全;服务交付能力检查人员、流程、沟通及追溯;质量保障体系检查验收、纠错和持续改进;行业实践与声誉检查真实项目与客户反馈。UME建议每项能力都对应一份可核验材料,例如脱敏原始样本、审核记录、系统演示或项目复盘。[第2部分,5.2—5.6,PDF第10—12页]
标准设置一票否决情形,包括黑帽GEO、语料投毒及其他恶意操纵AI结果,近三年因违反文件列举的相关法律受到行政处罚,被列入严重违法失信名单,以及尚未解决的重大知识产权侵权纠纷。依照该框架评价时,触及否决项不能用其他能力得分抵消。ISO 9001、ISO 27001属于优先考察项,不能改写成所有服务商必须同时取得的证书。资料性附录中的经营年限参考,也不能升级为全行业法定门槛。
评价等级为A(卓越)、B(优秀)、C(合格)、D(待改进),但文本没有给出全国统一数值分数线,也不预设固定权重。5.1.4提及维度权重10%的下限时,交叉引用与章节结构存在不一致;UME建议评估方说明具体方法并核对适用口径,不能自行补成一套“官方百分制”。评估有效期为两年,重大变化可能触发提前复审。[第2部分,等级划分及6.4,PDF第13—14页]
四、第3部分:把报价、效果指标和样本放在同一套口径里
1. 七类单元、五种计价方式,并非统一行业价目表
标准列出内容、引擎、时间、数据、交付、信源、语料七类计价单元,并介绍按项目、按服务内容和数量、按效果、按系统交付以及混合计价五种模式。按“意图词”报价时,还需列出具体自然语言问题及数量;同一个意图词可能对应不同场景和多个问法。[第3部分,4.2—4.4,PDF第11—16页]
例如,文件提供“服务单价×问题数量×模型数量×服务周期”等计算基准;数据、报告和语料也有相应计量方式。实际报价仍要说明单位、引擎模式难度和包含项目。对于“固定服务内容+效果绩效”的混合模式,覆盖固定成本的费用占合同总额宜不低于30%,这是特定组合中的建议,不是所有GEO合同统一适用的强制比例。
UME建议将“覆盖哪些问题、在哪些模型与模式执行、持续多久、交付什么、以什么数据结算”写在同一张报价附件中。仅写“优化100个关键词”不足以形成可比较的采购范围。
2. 九项指标各回答一个问题
下表压缩呈现第5.2条的计算口径,比例指标均需乘以100%。计算前应明确有效样本、对象识别、问题集、去重方式和统计周期;分母为零时不能把结果直接报告为0%或100%。最后一项为可采用的语料一致性计算方式。[第3部分,5.2,PDF第16—20页]
| 指标 | 计算口径 |
|---|---|
| 可见率/提及率 | 命中指定品牌或产品的提问次数÷提问总次数;可另约定TOP1、TOP3口径。 |
| AI情感中正率 | 对该对象评价为正面或中性的提问次数÷出现该对象的提问次数。 |
| 可见份额 | 指定对象提及次数÷同一统计范围内全部品牌或产品提及总次数。 |
| 平均排名 | 指定对象首次出现的位序之和÷该对象出现的提问次数。 |
| 指定信息正确率 | 指定信息被正确表达的提问次数÷被评估且涉及该信息的有效提问次数。 |
| 指定信息覆盖率 | 按5.2.6公式:出现指定信息的提问次数÷包含评估品牌或产品的有效提问次数。 |
| 信源数量引用率 | 指定信源引用次数÷全部信源引用次数;事先明确引用条数及去重规则。 |
| 信源问题引用率 | 引用指定信源的有效提问次数÷有效提问总次数;同一回答内多次引用只记一次命中。 |
| 语义一致性 | 通过一致性校验的内容条数÷参与校验的内容总条数,以客户确认的事实库等为依据。 |
可见率、可见份额和平均排名应在行业或品类问题中计算,不混入直接询问某品牌的问题。同一回答重复提到同一对象,不应借此放大相应提及计数。可见份额不宜直接作为项目考核KPI,平均排名不宜单独作为KPI;品牌很少出现、偶尔出现时排第一,与稳定进入推荐范围并不是同一种表现。
另有两处口径尤其容易混淆。第一,中正率把中性评价算入分子,并不等于正面率。第二,10次有效提问只有1次引用某信源,即使这一次回答引用了5处,其信源问题引用率仍为10%;数量引用率则要除以全部信源引用次数,不能拿问题数替代。
信息覆盖率存在原文内部差异:3.19定义使用总回答数量,5.2.6操作公式使用包含评估品牌或产品的有效提问次数。本文按后者列示公式,并保留差异。实际合同和报告应明确采用的分母,必要时向发布方核对。覆盖率表示有没有出现,正确率表示表达是否正确,两者也不能相互替代。
3. “30次样本”要落到最小分析粒度
采集组由问题或意图、引擎、模式、端口、地域、语言和统计周期等共同限定。跨组汇总须说明权重、合并规则及限制。标准建议按客户要求的最小分析粒度配置不低于30次有效样本,举例为每个“意图词—模型—周”;不能理解为整个项目累计30次即可,也不能视为所有场景下充分可靠的统计保证。[第3部分,5.1、5.3.5及附录A]
中国市场测量建议覆盖不少于3个城市、5个主流引擎产品;当约定引擎数量不少于2个时,单个引擎样本占比不应超过全样本80%。前两项为建议,后一项为条件要求。引擎版本、API或PC/App方式、联网与深度思考设置、语言、地域和日期都要记录,才能解释两期结果是否可比。
第3部分还要求原始采集数据至少保存至项目结案后三年;核心指标连续异常且无对应业务归因时,应启动复核并在3个工作日内出具结论。模型和平台变化、市场事件、竞品活动也可能影响结果,不能把全部变化自动归因于优化动作。[第3部分,5.3.8—5.3.9,PDF第21—22页]
五、第4部分:可信语料,从来源到更新都要可追溯
可信语料不等于已经发布的文章。第4部分从真实性、权威性、专业性、可追溯、动态更新和中立性六项原则出发,覆盖输入素材、生产内容、检索内容、知识库内容及提示语料。一般行业应核实内容审核、身份背书、责任追溯、来源和授权链;高合规要求行业还需核查相应资质。网站公开可访问,本身不能替代使用授权。[第4部分,第4章及5.1—5.2,PDF第8—10页]
文件以权威性、专业性、真实性、时效性、内容质量五个维度设置1至5星;其中5星要求五维均高。第7章另设针对样本整体的1至5级综合可信等级,两者不是同一标签。例如,5级一栏列有样本量至少1000、星级样本占比至少85%和第三方检测机构等要求,但表2没有明确“星级样本占比”统计哪些星级,不能自行改写为“85%的五星文章就获得五级认证”。采用评级前,需先明确样本范围和判定方法。[第4部分,表1、表2,PDF第10、13页]
语料生产流程包含采集、清洗、标注、质检和入库。正文6.1.4规定:每批不超过500条时全检;超过500条时先抽检10%,问题率大于3%扩大至50%,大于5%执行全检;高合规要求行业100%全检。文本重合度大于80%的高度相似内容需按规则去重,而不是用大量重复文本充当资产增长。[第4部分,6.1.2—6.1.4,PDF第12页]
资料性附录C另有抽样评估参考,不能用它替代正文的高合规行业生产质检全检要求。生产质检、抽样评估和综合等级标识,应分别说明用途。若项目需要对置信度或误差作承诺,还应核对抽样设计与适用假设,不能只复制附录中的固定样本数字。
上线后的内容仍需更新和召回。资料性附录B提出,发现已投放语料存在事实错误或被AI错误引用时,应在72小时内启动修正程序,更新服务商可控制的语料和渠道,并建议或协助客户立即同步更新,双方记录变更日志。这是纠错启动要求,不是所有外部模型在72小时内完成修正的承诺。附录的分级归档安排也具有资料性属性,应用时需核对授权、合同和相关适用要求。[第4部分,附录B,PDF第16—17页]
UME建议建立事实台账,将每条关键事实关联原始证据、使用权利、责任人、有效期、适用范围、生产版本和发布地址。这样,产品参数变更时可以定位受影响内容,撤回授权时可以知道哪些渠道需要处理。
六、第5部分:服务流程、安全责任和违规处置
第5部分把责任串联为七个节点:客户准入与需求洽谈、合同和服务边界、业务材料审核、内容生产、可信传播、评估测量、风险处置。每一环节都应留下相应记录,使素材、审核、发布、监测和整改能够相互核对。[第5部分,第4—5章,PDF第9—12页]
合同需明确交付、验收、数据用途、知识产权、分包和责任安排,并附不可承诺事项清单。文件不允许把“绝对控制模型”“百分之百霸屏”等超出事实和技术边界的承诺用于服务。人工智能辅助生成的内容须经事实、逻辑和安全复核,保留版本及审核记录;未经审核不得直接发布。
对黑帽GEO的判断也有清晰边界:真实、合法且无欺骗性操纵的广告、公关、媒体发布和KOL/KOC合作,不因具有商业目的就自动属于黑帽。需要治理的是伪造信源、数据造假、语料投毒、恶意刷量和攻击等行为;涉及商业推广、付费合作或广告的内容,还须按适用要求处理标识责任。[第5部分,3.5、5.5、6.4]
数据方面,客户非公开策略和内部资料应按保密信息管理,不得超出约定服务目的使用,不得用于其他客户知识库训练或跨项目复用;未经授权的模型训练、第三方共享同样被禁止。合同到期终止后的业务语料删除,与合规证据保存属于不同管理对象:第6.2条要求删除相关语料并出具销毁确认单;第7.3条对服务日志、审核发布记录及监测报告提出,自服务终止之日起宜保存不少于三年。这里的“宜”和起算点,都不同于第3部分原始采集数据的留存表述。[第5部分,6.2、7.3,PDF第13、15页]
| 违规等级 | 原文处置要求 |
|---|---|
| 一般违规 | 7个工作日内整改并补充凭证,复核通过后继续相关服务。 |
| 严重违规 | 立即暂停相关服务、下架相关内容并启动内部问责;整改复核通过后恢复。 |
| 重大违规 | 立即终止相关服务、固定证据并启动应急处置;涉嫌违法犯罪时按要求移交。 |
同类严重违规在整改完成后12个月内再次发生,升级为重大违规。一般违规的7个工作日整改期,不能套用为重大风险的等待期;效果异常通知则遵循双方约定时限,文件没有统一规定所有异常都在72小时内处理。[第5部分,5.6—5.7及第8章]
七、如何落地:把标准转成六份项目文件
以下为UME的应用建议,不是新增标准条款。与其在方案里仅写“遵循GEO团标”,不如在项目启动时形成六份可检查的文件。
- 范围与报价表:写明目标对象、意图和问题清单、引擎及模式、地域、周期、服务数量、价格和交付物。
- 服务商证据表:按所采购类型列出团队、工具、流程、合规和真实项目证据,标明核验人及时间。
- 事实与信源台账:记录来源、授权、有效期、资质、版本和客户确认结果,区分可公开与限制使用资料。
- 内容审核与发布记录:关联原稿、AI辅助过程、人工修改、审核、最终版本、渠道和发布地址。
- 测量与验收方案:固定基线、问题集、采样粒度、指标分母、去重与汇总规则、异常复核和结算条件。
- 纠错与退出方案:明确暂停、下架、更新、客户通知、数据删除、证据留存和责任人。
六份文件之间应能相互引用:一项报价能找到对应交付,一条内容能找到事实依据,一项指标能回到原始样本,一个错误能定位修改对象和处理记录。这也是五部分标准对企业最直接的价值:让服务承诺具备核验路径。
原文与阅读依据:6份PDF入口
以下链接指向中国商务广告协会发布的原始文件。本文引注页码均为PDF物理页序,包含封面和目录;如正文与编制说明存在措辞差异,应核对相应正式条款及发布机构后续说明。
《生成式引擎优化(GEO)第1部分:通论及术语与定义》,T/CAACCHINA 001-2026,15页。
《生成式引擎优化(GEO)第2部分:服务商评估规范》,T/CAACCHINA 002-2026,18页。
《生成式引擎优化(GEO)第3部分:计价、评估与测量规范》,T/CAACCHINA 003-2026,24页。
《生成式引擎优化(GEO)第4部分:可信语料规范》,T/CAACCHINA 004-2026,20页。
《生成式引擎优化(GEO)第5部分:服务流程合规与安全要求》,T/CAACCHINA 005-2026,17页。
《生成式引擎优化(GEO)团体标准》编制说明,14页。
整理:UME。依据2026年9月发布的系列文件及协会公告。本文为资料解析与应用建议,非发布机构的官方解释;标准解释权归中国商务广告协会。
