#05 · 项目
公文、汇报、论文都有严格的排版规范,但排版至今是纯体力活:
字体字号、行距缩进、标题层级、编号体例,一份几十页的文档要逐段手调,
而且"规范"往往只存在于老师傅的经验或一份没人细看的 Word 模板里。
用户只给两样东西——格式来源(一段自然语言规范,或一份排好版的 Word 模板)
和待排版的目标文档,Agent 自主完成理解、判断与执行,
输出排版好的 docx、一份修改对照报告,以及一份修订模式文档。
LLM 在整个系统里只被允许产出两个结构化结果,永远不直接生成或修改 docx:
真正的文档改写全部由确定性代码完成:把规则写成 Word 命名样式,
输出文档在 Word 里可以继续正常编辑,而不是一堆刷死的直接格式。
| 格式来源 \ 目标文档 | 纯文本无结构 | 有序号/自动编号 |
|---|---|---|
| 自然语言规范 | LLM 语义理解段落角色 | 编号惯例确定性判级,省模型调用 |
| Word 模板 | 脚本直读模板样式 + LLM 标注 | 自动编号 XML 识别,零幻觉 |
四个真实案例覆盖能力矩阵全象限:从无序号的体检通知,到带三级序号的
工作方案,到用真实党委会议题模板重排投资议案——包括 Word 自动编号
(文字里根本没有序号)这类真实世界的硬骨头。