过去几年,数传一直围绕出版机构“三审三校”的标准工作流建设智能审校能力。书翼—AI编辑工作室原有的L2级别审校能力(下文简称“L2”)以规则和文本校验为基础,负责文字差错、标点符号差错、词语误用、政治性差错,以及部分知识性、导向性问题的检查。它让大量分散在编校规范和日常经验中的标准进入系统,也为数传积累了审校规则、真实书稿和出版社反馈。
随着AI编辑工作室在出版社中的应用日益深入,数传所面对的需求也在不断变化。教材教辅、少儿、社科等不同类别图书的审校尺度各不相同,一套固定规则很难适配所有书稿;编辑希望系统能记住反复纠正过的问题;长篇幅书稿开始审校后,编辑希望能随时了解整体进度和每一页的处理情况;审校任务结束后,出版社还需要勘误登记表和正式审校报告,以便衔接后续流程。
墨宝L3级别的审校能力(下文简称“L3”)正是在这些实际需求中形成的。数传以L2已趋成熟的文本校验能力为基础,采用新的Agent架构重新组织规则、模型和知识库。现在数传将要把在墨宝中实践成熟的L3引入书翼—AI编辑工作室。L3级审校能力增加了智能决策与持续学习能力,也重新设计了结果预览、逐页查看和报告输出。技术路线的调整既来自于模型能力的进步,也来自于出版社在长期使用中的具体反馈。

今年6月介绍L3时,数传仍然认为L2与L3可以并行使用:L2完成标准化检查;L3处理更复杂的书稿。但在产品进入实际应用后,L3在出版社反馈与内部测试中的表现均优于L2。经过重新评估,数传决定调整原有安排,将L2逐渐全面切换至L3,让新一代审校能力直接服务于原有用户。
L2是数传长期建设并已经投入使用的产品。逐步停用它,等于主动结束了一条熟悉的技术路线。数传把后续研发、出版社反馈和产品迭代集中到L3,这一决定的考虑十分明确:出版社提出的问题已经发生了变化,技术也有了新的解法,产品也应随之迭代。
为何切换
L2迈出了审校规则数字化的重要一步。文字差错、标点符号差错、词语误用、政治性差错,以及部分知识性、导向性问题,都能被整理成词表和判断条件,由机器完成初步筛查。经过多年积累,L2已经覆盖233个细分类别。很多过去需要编辑逐字检查的问题,现在可以批量处理;一些分散在各类编校规范中的要求,也被整理成可以反复调用的系统能力。
出版社在使用中逐渐提出了更具体的问题。一部文学作品和一本教材,对语言的要求并不相同;少儿读物还会涉及拼音、适读年龄和图文关系;专业图书中的知识判断,也很难依靠通用词表完成。部分问题要联系前后章节才能发现,而固定规则只能处理其中边界比较清楚的内容。规则处理不了的部分,编辑仍要逐条查看机器给出的意见。提示准确时,可以减少重复检查;无效提示过多时,编辑仍要回到原文重新判断。因此,出版社对审校产品的期待不再停留在“能够发现问题”,而是希望系统能够识别书稿类型,采用合适的审校尺度,并在多次使用后逐渐熟悉本社的要求。
出版社没有用技术概念描述需求,他们谈得更多的是实际工作,这些意见也持续反馈到数传的产品团队:这条提示已经修改多次,系统能否记住;这部书稿和上一部不是同一种类型,为什么采用同样的检查方式;一部长篇书稿何时能够给出部分结果;审校结束后,勘误登记表能否直接生成。这些问题后来分别对应L3的智能决策、反馈学习、过程可视和流程适配四项核心能力。
L3级审校能力保留了L2的文本校验和规则积累。系统会先识别图书类别、内容特点和专业领域,再选择适用的规则、模型和知识库。数传对两套产品的判断也在实际使用中发生变化:L3能够覆盖原有基础能力,又提供了更好的扩展空间,继续让两套产品长期并行,反而会分散研发和服务资源。
L2逐渐切换至L3后,现有用户无需另行寻找产品入口,即可使用新一代审校能力。日常书稿中产生的反馈也会进入同一条迭代路径。数传希望缩短需求进入产品的距离,让真实使用推动审校专家不断完善。
因需而变
出版社反馈最集中的一类问题,是不同书稿需要不同的检查方式。L3接到任务后,会结合图书类别、内容特征和专业领域确定审校范围。文学、社科、少儿、教材教辅等类别各有其内容结构和编辑要求,审校专家会据此选择对应的规则、模型和知识库。
过去,部分检查条件需要编辑提前选择,更多内容则按照系统预设的规则执行。L3增加智能决策能力后,审校从书稿识别开始:系统先明确当前任务的处理对象,再调度相应能力。Agent架构在其中负责组织规则、模型和知识库,使它们共同完成一项审校任务。
L3级审校能力目前能够处理中文书稿,以及拼音、英语练习、习题解答和图文混排等特殊内容。教材教辅中的题目与答案、少儿读物中的拼音和插图、知识类图书中的专业术语,都需要不同的检查方法。出版社过去可能要把这些内容交给多个工具分别处理,而现在可以放进同一个审校任务中。

一些编校差错也潜藏在书稿的前后关系中:人物信息前后矛盾,时间线索无法对应,同一知识点在不同章节中表述不一,题目与答案不一致,图片内容与正文存在偏差……只有当模型具备更长的上下文处理能力,AI审校才有机会处理这类问题。相应地,L3对书稿的检查,也从局部文字扩展到页面、章节乃至整体内容。
出版社对处理过程同样有要求。一部篇幅较长的书稿上传后,如果只能等待最终结果,编辑很难判断系统采用的审校尺度是否合适。L3支持提前预览,错误明细随任务进度持续输出,每一页的处理情况都能查看。编辑可以先观察部分结果,发现审校方向需要调整时,再补充具体要求。
任务完成后的工作也来自出版社的反馈。机器找出问题后,编辑还要整理意见、填写勘误登记表,并为“三审三校”留下记录。L3把这些事务纳入产品功能,可以根据审校结果自动生成勘误登记表和正式审校报告。技术能力由问题检查继续向后延伸,结果可以直接进入下一个工作环节。
L3级审校的四项能力分别对应出版社的四类实际需求:第一,面对不同书稿,系统要知道该如何审校;第二,编辑纠正过的问题,下一次应当有所改进;第三,长篇书稿的处理进度,应当随时可见;第四,审校结束后,编辑还要获得可以继续使用的成果。数传没有把这些需求拆成彼此孤立的功能,而是放进一套完整的审校流程中。
经验沉淀
编辑可以在L3中标记误报,添加人工批注,也可以直接输入本社或者当前项目的审校要求。书稿经过审校,编辑修正结果,新的反馈再回到系统,审校专家在这一过程中逐渐熟悉各家出版社的审校习惯。
这一设计同样来自出版社的长期实践。传统规则系统根据出版社意见更新,通常要经过需求整理、规则编写、技术测试和版本发布。许多在具体项目中产生的判断,无法及时进入产品:编辑已经说明某种表达可以保留,下一次仍有可能收到相同提示;某部书稿有自己的特殊要求,更换项目后又要重新设置。
L3把反馈入口放在编辑的日常操作中。一次误报被确认,系统便多获得一个具体案例;编辑补充一项审校要求,后续处理同类书稿时就有机会继续使用。数传希望减少编辑反复说明同一问题的次数,让每一次使用都能为下一次审校积累经验。
出版社有大量专业判断保存在编辑个人经验中。审校手册只能规定基本要求,具体书稿采用什么尺度,还要依靠长期实践。某种表达应当保留还是修改,一个知识点需要核查到什么程度,一类图书容易出现哪些问题,资深编辑通常有自己的判断。这些经验的积累周期很长,也很难依靠一份制度文件完整传递。
审校专家与私有知识库结合,为这些经验提供了新的保存方式。系统使用得越深入,就越能了解一家机构的产品结构和编辑习惯。原本依附于个人的部分判断,可以逐渐成为团队能够调用的知识。
不同出版机构在编辑力量、专业积累和技术投入上存在差异。自行建设模型、维护大型规则库,对多数机构来说并不容易。数传持续建设通用能力,出版社再用自己的知识库和编辑反馈完成个性化调整,一套产品便可以适应更多机构和图书类别。
L2的原有用户切换至L3后,新产品也将覆盖更丰富的书稿场景。出版社提出的需求可以更快得到验证,产品团队也能看到不同类型书稿中的实际问题。数传希望保持这样的节奏:出版社需求出现变化——产品及时调整——新的技术能力成熟——尽快进入出版社的工作流程。
进入流程
出版社能否长期使用一项技术,最终取决于它能否融入既有的工作流程。产品功能再多,如果需要编辑反复搬运文件、重新整理结果,使用深度仍会受到限制。L3级审校能力把任务判断、内容检查、反馈学习和报告生成放进同一项审校任务,重点解决了技术能力与出版流程之间的衔接问题。
“三审三校”涉及多个角色和环节,不同出版社还有自己的内部规范。编辑既要能够看到处理过程,也要获得可以继续使用的结果。提前预览和逐页查看便于掌握进度,勘误登记表与审校报告减少重复整理,私有知识库用来适应不同机构的标准。这些安排都来自出版社在实际使用中提出的具体要求。
AI审校产品的竞争维度也在变化。早期产品主要比较规则数量、检出范围和处理速度。出版社开始长期使用后,还会关心系统是否理解不同类型的书稿,已经纠正的问题会不会再次出现,输出结果能否直接交给后续环节。单点功能难以支撑一项完整的审校工作,产品需要同时处理内容、经验和流程。
数传决定逐步停用L2,表明公司对下一阶段的技术路线已经形成了较为明确的判断。保留原有产品可以降低短期切换压力,全面升级则能让现有用户更快使用新能力,也让研发和反馈集中到同一套系统中。以新产品替代已经成熟的原有产品,是数传根据出版社需求和实际使用结果作出的选择。
L3接下来仍需在真实使用中持续完善。L3在不同图书类别中的表现是否稳定,编辑反馈能否被准确记住,私有知识库能否持续发挥作用,自动生成的报告能否真正减少工作量,都要在一部部书稿中接受验证。数传将继续听取出版社反馈,也会根据各出版社工作方式的变化调整产品。
停用L2并不意味着否定过去的积累。它让编校规则得以数字化,也让数传深入了解到编辑的工作实际。L3在这些基础上,开始处理更复杂的书稿,学习不同机构的审校习惯,并把结果送进出版流程。
这次切换不仅是一次产品升级,也延续了数传长期以来的产品逻辑:从出版社的实际工作中发现问题,再用新的技术能力解决问题。出版社的需求在持续变化,数传的产品同样需要不断迭代。让现有用户尽快用上更好的能力,让智能审校在真实使用中继续成长,是数传决定以L3替代L2的原因。
价值归位
产品如何更替,最终都要回答同一个问题:编辑的时间,应当花在哪里。
出版业的质量防线,是一代代编辑在字里行间筑起的。正因如此,智能审校的迭代,价值不在于替代编辑的判断,而在于把编辑从重复性的文字核验中更彻底地解放出来,让他们回归更考验专业判断的地方:内容的把握、结构的推敲、思想的分量。
书稿在变,读者在变,技术在变,但出版人对内容负责的自觉不会变。数传愿做这条长路上的同行者:以出版社的真问题为起点,以编辑真实的使用为检验,最终,让每一部书稿的质量成为最沉静、也最有力的答案。