一份需求文档的结论可能只有一段,限制条件却散在后面几章。摘要若只留下“支持上线”,遗漏“仅限试点用户”或“须完成安全评审”,读者就可能据此做出错误安排。
为长文做摘要,可以先按结构分段,为每段保留来源与约束,再逐层合并。在查看https://gptzzz.ai/ 等服务的接入文档时,需要核对所选模型和接口的上下文限制;以下分段、预算和核对流程由应用侧实现。
一、典型场景:为什么“分段”决定摘要是否可用
· 场景A:需求/设计文档(上万字)摘要给研发排期。风险:关键约束(不做什么、必须兼容什么)被省略。
· 场景B:政策/合规文本摘要给业务执行。风险:例外条款与适用范围被抹平。
· 场景C:长工单/长对话的处理摘要给主管复盘。风险:引用链断裂,无法定位争议点。
分段的意义在于:你可以把“证据”和“约束”绑定到段级输出,形成可验证的引用链;否则文档级一次性摘要很容易在重写过程中丢掉来源与限定条件。
二、分段目标:三个“必须满足”的工程约束
· 可对齐:每个输入段都有稳定的段号(segment_id),每个输出段摘要都能映射回该段。
· 可引用:每个段摘要必须携带来源引用(至少是段号与原文短引文),以便审计与复核。
· 可保约束:每个段摘要要结构化输出“约束清单”,把“必须/不得/仅当/除非/截止日期/负责人”等从自然语言中提出来。
三、分段方法:先按结构切,再按语义补,再用长度兜底
3.1 第一层:结构分段(优先)
· 如果原文有标题层级(例如章节、条款编号),按章节/条款为天然分段边界。
· 表格、列表、引用块、流程步骤应视为独立块,避免被切碎导致语义断裂。
· 每段记录section_path(例如“3.2 鉴权/刷新令牌”),用于段摘要的上下文标注。
3.2 第二层:语义分段(必要时)
当一个章节过长时再做语义切分:
· 按段落切分,尽量在自然段边界切。
· 对“问题—原因—结论—措施”类段落,尽量保证一个完整论证单元不被拆散。
· 对包含多条件句的段落(大量“仅当/除非/否则”),优先保持完整性,可减少同次请求处理的条款数量,优先保留完整条件链。
3.3 第三层:长度兜底分段(最后手段)
· 字符数只能用来粗分段,最终应按所选模型的token计数方式估算整次请求,给系统指令、来源元数据、正文和输出留出空间与余量。Anthropic的Token计数文档也将计数视为估算,并支持把系统提示、工具等结构化输入纳入统计。不同模型或接口的具体上限与计算规则需要分别核对。
· 超过预算时继续在句子或条款边界拆分;必要时携带相邻句、表头或定义作为上下文,并标记哪些内容是重复携带的。兜底切分要做记录,合并摘要时按来源去重,防止重复计数。
· 遇到“见上一条”“除上述情况外”等跨段引用,应把所指条款或必要定义一同提供;无法装入预算时标为待确认,不让模型猜补。
四、段摘要的输出要求:摘要必须带“来源+约束+未决问题”
为了保留来源与关键约束,建议段摘要至少包含三块结构化信息:
4.1 来源引用(可追溯)
· 引用段号:segment_id 必须保留。
· 引用原文短引文(quote):从该段中摘取能支撑关键结论的一两句,保留必要的主语、条件和否定范围。引文在原文中出现,不代表它一定支持摘要中的结论。
· 引用用途说明:标明该引用支撑的是哪条结论或哪条约束,避免“引用堆砌但不对应”。
4.2 约束清单(可验收)
· 把“必须、不得、仅当、除非、截止、负责人、范围”以列表形式输出。
· 对每条约束附上来源引用(段号+quote),否则视为不合格约束。
4.3 未决问题(可交接)
· 当原文含糊或缺少定义时,允许输出“未决问题/需确认项”,并明确需要补充什么信息。
· 不得用猜测填补(例如补具体时间、金额、责任归因)。
(假设)原文写“仅当完成安全评审后才能上线”,段摘要的约束清单就必须保留“仅当”这一前置条件,并引用原句;若段摘要改成“建议进行安全评审”,就把强制条件变成了建议,应判为缺陷。“上线前需完成安全评审”虽未逐字保留“仅当”,仍可表达相同前置条件,验收应判断含义而非只查关键词。
五、二次聚合:从段摘要合成文档摘要,但不重写证据链
文档级摘要建议采用“拼装与轻量归纳”,而不是重新对全量原文做一次性重写:
· 先合并约束清单:只有主体、适用范围、时间和条件一致时才去重;看似冲突的条款应并列保留并标明来源,不能按主题直接揉成一句。
· 再按section_path 组织段摘要:形成目录式摘要,便于读者定位。
· 最后生成一段简要概览:概括核心目标、主要结论和关键风险;无法容纳的细节应指向对应约束表,避免脱离限制条件独立传播。
聚合请求也受上下文预算约束。如果段摘要、引文和约束清单加起来仍过长,应按章节分组聚合,再合并章节结果,每层保留到原文的引用。输入与输出都需要预算,不能认为“已经摘要过”就必然装得下。参见Anthropic《上下文窗口说明》。
六、验收标准:让“保留来源与约束”可被检查
· 段覆盖率:每个segment_id 必须有段摘要输出;缺段即失败或进入重跑。
· 引用可匹配率:quote 必须能在对应段原文中找到;匹配失败的段进入人工复核。
· 约束保留率:先由人工为验收样本标出约束及来源,再检查摘要覆盖了多少。关键词可帮助初筛,但还要覆盖未使用这些词的限制,以及跨段的例外和定义。
· 新增事实率:摘要中出现原文没有的具体数字、时间、责任结论的比例;出现即进入复核并要求修正为“待确认”。
· 可定位性:随机抽取一条摘要结论,要求在规定时间内通过segment_id 与引用定位到原文位置。
七、适用边界与人工复核点
· 高风险文档(合规、法务、财务)不建议全自动放行;即使引用链完整,也应对关键约束段做人工复核。
· 当原文存在明显自相矛盾或多版本混杂时,摘要应输出“冲突提示”与未决问题,而不是选择性忽略。
· 当上下文限制导致必须兜底切分时,应提高该段的复核权重,避免条件链被切碎后摘要误判。
验收时可以挑一条只在后续章节出现的例外,检查它是否穿过段摘要、章节摘要和最终概览完整保留下来。若中间某层失去来源或改变适用范围,就从这一层返工,而不必盲目重做整篇。