| name | lieflat-gongwen |
|---|---|
| description | 基于真实公文全量统计的公文写作 skill。分公文族与党建族两族,覆盖调研报告/领导讲话/工作意见/经验材料/工作方案/经验总结六类公文族文体,加千字级党建/基层经验材料一类,提供可验收的数值参数、骨架公式、标题技法和自动化自检脚本。触发场景:"写一篇调研报告""起草领导讲话""写份工作意见""写篇党建经验材料""把材料写成经验总结""让这篇稿子更有公文味""检查这篇公文的参数对不对"。 |
公文写作 DNA
不给通用模板,给从真实公文语料全量统计出的数值参数。
核心主张:公文的"像不像"是可测量的——句长、顿号密度、层级配比、力度词配额都有各文种的特征区间,写完可用脚本验收。
一、开工前先判文体族(判错此步,后续全错)
两个文体族的参数互斥:
| 文体族 | 篇幅 | 句长 | 一级标题 | "一是二是" | 长引语‰ |
|---|---|---|---|---|---|
| 党建族 | ~1,120 | 51 | 0 | 0-1 | 2.9 |
| 公文族 | 2,500-3,700 | 53-64 | 2-5 | 1-9 | — |
1,000 字左右的党建/基层经验、信息、简报 → 党建族
正式发文,或 2,500 字以上的材料 → 公文族 → 再判文种
千字材料加多个一级标题就变成了压缩版公文。两族在篇幅和一级标题上不重叠,判族只看这两项。
党建族按篇幅和话语体系划,不按题材划。 要写 3,000 字以上的党建调研报告、党建工作方案,参数走公文族对应文种,只把话语和挂接逻辑从 党建语料/ 取。
二、公文族文种速判
| 用户意图 | 文种 |
|---|---|
| 摸清情况、发现问题、向上提建议 | 调研报告 |
| 会上部署、动员、提要求 | 领导讲话 |
| 出台规范性要求、给下级立规矩 | 工作意见 |
| 报送做法成效、供他人借鉴 | 经验材料 |
| 定目标、分任务、排步骤、明责任 | 工作方案 |
| 交流会上陈列本单位做法 | 经验总结 |
法定公文(通知/请示/报告/批复/函)没有统计参数——公文语料全为事务性材料,不含法定公文。但 参考/法定公文样例/ 有 7 篇真实政策文件可作版式参照(含发文字号、主送机关、成文日期、公开标识,这些要素在公文语料中已不存在)。
二·补 党建族
上表六个文种都在公文族。如果要写的是千字级党建/基层经验材料、简报、信息,走的是党建族,不在上表里,参数和写法另有一套:
- 参数看
参数卡.md第三步(自检器里的文种键名是短经验材料,n=77,全部来自党建语料):篇幅 ~1,120 字、句长 51、零一级标题、几乎不用"一是二是"、要求词密度只有公文的 1/3(陈述做法,不下指令)、长引语 2.9‰(引群众原话,这一族的正向指纹)。 - 骨架和写法看
党建语料/三份 DNA:文章结构模板.md(把一级标题降级成段首提领句、6 段功能分工)、写作视角与认知框架.md(党建业务七种挂接模式、当代话语五类词表、"问题只写已解决的"等硬规则)、党建DNA.md(L1 语言参数、当代党建口径)。 - 范文看
示例/党建经验材料_*.md三篇(组织部/国企/社区三种主体)和示例/短经验材料_*.md三篇(基层便民)。 - 党建材料的挂接逻辑、归因、合法性建构与公文族差别很大,写前务必读
写作视角与认知框架.md,别拿公文族的路子套。
写法定公文时的三条要点(从样例观察):
- 承启句是文种指纹,用错等于文种错:批复/复函用"…收悉。现批复如下:",通知用"现将…通知如下:"
- 表态在最前。批复第一条就是"同意/不同意",理由跟在表态之后——与调研报告"先铺垫后结论"完全相反
- 法定公文无标准篇幅。样例从 508 字(复函)到 6,927 字(印发规划的通知),事项说完即止;短件(500字级)不分条
行文规则与版式细节(发文字号编排、主送机关排序、抄送规则)须另行核对《党政机关公文处理工作条例》与 GB/T 9704,本 skill 不覆盖。
三、六步工作流
1|定位参数行
读 参数卡.md,定位到你的文体那一行。记下:字数、句长、层级配比、"一是二是"次数、顿号密度、力度词配额、百分比上限。
2|取骨架
读 公文语料/文章结构模板.md 中对应文种那一节(勿全量加载),拿到骨架公式、重心段占比、过渡手法。
关键区分——重心分布分两族:
- 单段独大型(工作方案 38-67%、工作意见 44-53%、经验材料 47-59%)把重量压在"做什么"
- 均衡型(调研报告 23-38%、经验总结 23-43%、领导讲话 18-45%)各功能段近乎等重
把调研报告写成单段独大,等于写成了经验材料。
3|读样本,读完整篇
两族的真样本原文都不随 skill 分发(版权)。 _meta/ 下只有剥去标题与原文字段的逐篇数值统计,读不出文本。
改读三样替代物,都要读完整篇:
- 公文族:
公文语料/四份 DNA 文档。文章结构模板.md取对应文种的骨架与重心,写作视角与认知框架.md取站位与归因,语言DNA.md取词汇层,结构全量统计.md取开头与收尾分布。 - 党建族:
党建语料/三份 DNA 文档(党建DNA.md的 L1 参数、文章结构模板.md的 6 段功能分工、写作视角与认知框架.md的挂接模式与话语词表,均从 77 篇原文提炼)。 - 两族共用:
示例/22 篇合成范文,按文种命名,顶部有披露块写清手法出处与初稿教训。
合成范文不是真件,只借结构和节奏,不借内容。提炼物加范文能顶上真样本的大部分作用,但顶不上全部,这是移除原文之后一次真实的能力下降。
这一步不可跳过,而且不能只读开头。 写 示例/ 第一批十篇范文时,最多的一篇也只取了每篇的前 1200 字,有两个文种一篇原文都没开。只读开头拿到的正好只有骨架:开场怎么起、有几个一级标题、标题什么句式。而场面通常在中段,结尾永远在末尾,这两样恰恰是"像不像真人写的"的来源。结果是六篇范文事后必须重写,详见 示例/README.md。第二批八篇每篇读了 2 至 3 篇完整原文,没有重犯这个问题。原文移除后这个坑更难避开,DNA 文档和范文都要读完,别只扫标题。
读的时候盯这五样,它们在参数表上一项都看不到:
- 具体场面。不是概括,是你能在脑子里画出画面的那种细节。
- 人有名字、有原话。人物不是「一位群众」,而是有姓有名的;引语不是转述,而是原话带引号。
- 比喻。好的公文里会用比喻把抽象的工作说法落地,读到了记下来。
- 敢写难听的。直接摆问题、摆干部的原话、摆带数字的具体案例,不回避。
- 留一个没解决的。不是每篇都要收得圆满,有的结尾就是一句没答案的问题。
已克服的阻力可以写,当下未解决的不写。 77 篇党建经验材料 0 篇提及本单位尚未解决的不足,但有语料明确写了改革遇到的思想阻力(「少数员工起初意见很大」之类)。写做法时带上起初遇到的困难,比只写成效更可信。
4|出骨架,停下等确认
只给「标题 + 分层骨架(每段一句话点明写什么)」,等用户确认后再展开,不要一口气写到底。
标题按 标题技法库.md 决策表选技法。要点:
- 法定公文篇名守"发文机关+事由+文种",不玩技法(语料中 69% 无技法)
- 一级标题字数分两类:业务类(方案/意见)4-12 字,分析类(调研/讲话/心得)14-24 字
- 一组一级标题不可混用技法,要么全数字式,要么全设问式,要么全动宾式
- 喻体(压舱石/组合拳/生命线)用在篇名或讲话稿标题,别用在一级标题(语料使用率仅 1%)
篇名不加修辞前缀。 经验材料 22 篇语料,破折号标题 1 篇、冒号标题 2 篇,其余全是直入主题。不要写「从X说起:做法和启示」「把X办成Y——做法和启示」这类在正式标题前加一句叙事钩子或比喻短语的格式,那是新媒体和自媒体的写法,不是公文的写法。篇名直接说事:「XX的做法和启示」「关于XX情况的调研报告」「在XX会议上的讲话」。领导讲话可以在一级标题里用口语疑问句,但篇名同样直入。
5|按参数写正文
盯住这几项,它们是"公文味"的技术来源:
句长与并列。公文平均句长 53 字,是自媒体的 2 倍;顿号密度每千字 14-31 个,按文种分档(工作方案、经验材料最疏 14-23,工作意见、经验总结最密 23-31,查参数卡对应行)。实现方式是并列成分堆叠:
写"A 是 B"就停 → 句长 42、顿号疏 → 读起来像自媒体 写"A 是 B,三者在 X、Y、Z 上高度重叠" → 句长 51、顿号密 → 有公文质感
并列过度和并列不足按文种分两侧,别一律往上堆。 写 示例/ 第二批八篇时,六篇初稿是句长偏短、顿号偏疏、要求词偏少同时出现(调研报告 40.2/13.5‰/9,经验材料 38.4/12.4‰/7,领导讲话句长 32.0),另外两篇恰好相反,且都是规范性文件(工作意见顿号 38.5‰ 对区间 25–31,工作方案顿号 32.4‰ 对区间 14–22):
分析类、叙事类(调研报告/领导讲话/经验材料/经验总结/党建族) → 容易并列不足,要补
规范性文件(工作意见/工作方案) → 容易并列过度,要砍
工作方案是八个文种里顿号最疏的一档(18‰),把任务写成四五项器材清单就会顶破。经验总结相反,是句长最长的一档(中位 64,区间 58–71),而且它的要求词多半来自**"确保"而不是"要"**,盯错词就补不上去。
不知道并列具体怎么堆、怎么砍,读 句子对照库.md。 八个文种各 2–4 组句子对照,一侧是拆回短句的写法,一侧是 示例/ 范文里的原句,另有经验总结的整节对照(跑脚本实测:句长 27.2→46.8、顿号 12.6→26.4‰、要求词 0→3,同样的内容短句版少 93 个字)。里面有两条只有看对照才看得出来:砍顿号会让句长上升(拆并列用的是分句不是句号,工作方案 41.0→45.0 而顿号 32.4→21.9‰);要求词偏少不是漏写了"要",是没有动作可以挂在"要"上。
力度配额(按篇计的实际个数,比千分比好用):
| 文种 | 强制词(必须/应当) | 要求词(要/切实/确保) | 建议词 |
|---|---|---|---|
| 调研报告 | 1-2 | 26 | 6 |
| 领导讲话 | 2-3 | 47 | 3 |
| 工作意见 | 2 | 40 | 1-2 |
| 经验材料 | 1-2 | 20 | 3-4 |
| 工作方案 | 2 | 22 | 6 |
| 经验总结 | 0 | 14 | 0-1 |
| 短经验材料 | 0 | 2-3 | 0 |
强制词是稀缺资源,多数文种一篇只该有 0-2 个,用多了失效。注意"不得""严禁"与"必须""应当"共用同一个配额——写规范性文件时每提一条约束就顺手写"不得",很容易一路堆到七八个,改成"不能""一律取消""一并纠正"语气不弱,配额也不破。
标点不做修辞。 公文的标点是语法功能件,不是节奏工具。语料实测:经验材料 22 篇正文破折号总共 5 个(平均 0.2 个/篇),党建短材料 77 篇平均 0.3 个/篇。AI 写的初稿天然偏好用破折号做停顿(「十件里九件不是什么大事——一堵墙、一次装修」)、用冒号做揭晓(「后来我们改了两处:」),这两样在公文里几乎不出现。规则:
- 破折号:一篇正文不超过 1 个,0 个最好。需要停顿用逗号,需要转折用句号断开
- 冒号:只出现在三种位置——引语引入(「XX说:」)、主送机关(「各县(市、区):」)、法定公文层次标题。不要用冒号列举(「主要有三个:」改成「主要有三个。」)、不要用冒号揭晓(「办法是:」改成「办法是,」或直接写做法)
- 「其实是」「说到底」「归根到底」:公文不做元评论,直接说结论
写完检查一遍:数破折号,超过 1 个就砍;搜「:」,不是引语、主送机关或层次标题的就改掉。check_params.py 会报破折号密度。
站位铁律(认知层口径 226 篇):以制度缺陷作为开篇切入点的仅 2 篇。要批评体制,前面必须先垫战略高度和已有成效——想批评,先把资格挣到手。详见 公文语料/写作视角与认知框架.md。
不编数据。51%-100% 的语料公文完全不用百分比(经验总结 100%、工作方案 80%、领导讲话 75%、调研报告 51%)。不掌握真实数据时靠逻辑深度撑起文章,这是语料证明可行的路径。缺失事实按占位符处理:
【待补:xx】 缺失的数字/文号/人名/日期,须由用户补齐后方可定稿
【示意·待核】 为帮助体感给出的参考量级,使用前必须核实替换
【待核对原文】 引用重要论述、上级文件表述拿不准时
除此三种不用其他占位写法;宁可占位,绝不杜撰。
引用密度按论证需求定,不按"政治正确"定。基层党建经验材料 77 篇中仅 2 次引用(其中 1 次是真引用),经验材料讲自己做的事,不需要借权威背书。不必为显得政治正确强行引用。
经验材料不写本单位的问题。77 篇党建经验材料中,0 篇提及本单位尚未解决的不足(原统计的 5 篇经逐条核查全为误判)。唯一承认缺陷的是一篇讨论国家层面差距的理论文章——这反而说明规则的边界:只有当文章在论证某个观点时才会承认缺陷。写经验材料时不要主动加"存在的不足"一节,那是调研报告和工作总结的成分。
收尾。75-87% 的语料作品是自然收束,调研报告/经验材料不要加程式化结语。法定公文按行文方向选:
上行请示 → 妥否,请批示 / 以上请示,请予批准
上行报告 → 特此报告 / 以上报告,请审阅
下行通知 → 请遵照执行 / 特此通知
平行函 → 专此函达,请予复函 / 特此函复
讲话稿 → 号召+表决心(语料 11% 用此式)
6|跑自检
python3 scripts/check_params.py draft.md --genre 调研报告
python3 scripts/check_params.py draft.md --match # 不确定文体时先猜
python3 scripts/check_params.py --list # 列出支持的文体
读报告的方式:
| 项 | 含义 |
|---|---|
| ✗ 硬冲突 | 文种识别错误,必须改。旧版含九文体时 222 篇语料 100% 通过此项(原文已移除,无法重跑),报错基本说明真错了 |
| ⚠ 软提示 | 存在合法变体,斟酌即可 |
| 参数对照表 | 单项偏离不等于错误;但连续多项偏同一方向(句长短+顿号疏+要求词少)说明整体节奏不对 |
| 文体族检查 | 跨族误配信号强(两族在篇幅和一级标题上不重叠);同族文种参数重叠大(Top1 仅 33-55%),仅供参考 |
三点五、不覆盖的文种
网评和心得体会已从本 skill 移除,参数行、自检器条目、范文都不再保留,--genre 网评、--genre 心得体会 会直接报未知文体。
原因是覆盖的七类文体有一个共同点:格式约束强,输出物是工作安排、做法陈述、情况分析或政策建议,AI 能靠参数和骨架写出像样的稿子。网评的输出物是作者的观点,心得体会的输出物是个人经历,这两样 AI 都没有,参数再准也写不出来。
移除网评没有削弱判族能力,反而加强了。网评族和党建族原先在参数上几乎并列,示例/README.md 记着一次实测是网评 0.27、短经验材料 0.28,要靠长引语密度才勉强分开。现在剩下的两族在篇幅和一级标题上根本不重叠:拿 示例/短经验材料_流动服务队便民做法.md 跑 --match,Top1 距离 0.24,次位的经验材料 0.76,中间是一道清楚的沟。
法定公文(通知/请示/报告/批复/函)也没有统计参数,但有 7 篇真件可作版式参照,见第二节。
四、改稿分支
用户拿已有稿来改时,不走上述流程:
- 先跑自检拿到客观偏差
- 按 P0/P1/P2 分级诊断,停下等用户确认改哪些:
| 级别 | 内容 | 要求 |
|---|---|---|
| P0 | 文种/文体族误配、事实与数据、政策表述 | 必须准确,先改 |
| P1 | 结构逻辑、观点结论、层级配比 | 经得起推敲 |
| P2 | 句长节奏、顿号密度、力度词、标题字数 | 靠参数校准,具体改法见 句子对照库.md |
- 按 P0→P1→P2 逐级改,改完复跑自检
五、参考索引(按需读,勿全量加载)
| 文件 | 何时读 |
|---|---|
参数卡.md | 每次必读,一页表含全部文体参数 |
公文语料/文章结构模板.md | 取骨架时读对应文种一节 |
标题技法库.md | 拟标题时读决策表 |
句子对照库.md | 第 5 步读;自检报告出现句长/顿号/要求词偏离时也读。八文种句子级对照+整节对照,四种堆法,四处不该堆的地方 |
公文语料/写作视角与认知框架.md | 写上行文时读(站位/引用/分寸/归因) |
公文语料/语言DNA.md | 需要词汇层细节时读(高频动词/副词/避坑词) |
公文语料/结构全量统计.md | 需要开头/收尾策略分布时读 |
党建语料/党建DNA.md | 写党建族材料时读(L1 参数) |
党建语料/文章结构模板.md | 写党建族材料时读(6 段功能分工、与 3500 字级的分野) |
党建语料/写作视角与认知框架.md | 写党建族材料时读(当代党建话语五类词表、党建业务挂接模式);写党建题材的公文族长文时也读这一份 |
参考/法定公文样例/ | 写通知/批复/复函/决定时读(7 篇真件,含完整版式要素) |
_meta/*.json | 写作时不必读。 只是参数的数值溯源(逐篇字数、层级个数、力度词计数),无逐字原文。真样本原文不随包分发,第 3 步改读各族 DNA 文档 + 示例/ 范文 + 参考/法定公文样例/ |
示例/党建经验材料_*.md | 写党建/千字级经验材料时读三篇合成范文:县委组织部(数字命名法)、国企(优势转化式 + 末段"党建即生产力")、社区(引语开篇 + 零数据)。每篇顶部披露块写清手法出处与初稿教训 |
示例/README.md | 想知道范文哪些能借、哪些只能看结构时读;含 22 篇范文清单、各批语料读取审计、"参数中位数不能当合格线"的实测记录,以及"同一文种多篇怎么分工"的选篇逻辑(含党建三篇的选篇逻辑) |
六、方法论声明
参数来自公文语料的全量统计,不是经验总结。但两点必须说明:
参数区间是描述性的,不是规范性的。 语料个体差异极大——调研报告的"一是二是"从 0 到 20 次都有,四分之一的作品完全不用。因此自检器只判硬冲突,不拿均值当合格线。好文章不整齐,整齐的往往是平庸作品。
这一条最容易在实操中被推翻,所以给一组实测数字。语料中场面写得最好的几篇,逐篇跑自检,句长从 26.0 到 56.8、顿号从 6.3‰ 到 42.8‰,没有一篇全项落在常见区间内。领导讲话同样如此,同文种内部的离散度远大于文种之间的差异。
⚠ 不是待办事项。 迭代时若发现自己在做"补字数、拉句长、调顿号密度"这类动作,停下来——那是在把稿子往中位数上拽,代价是把场面和短句挤出去。写 示例/ 第一批范文时正是这样连改五到七轮,参数全部达标,读起来仍然是论文摘要。只有硬冲突(✗)必须改;⚠ 要先问一句"我这一项偏离是因为写进了什么东西",答得出来就留着,并在稿件说明里写清是有意偏离。
参数解决"像不像",不解决"对不对"。 内容是否站得住、判断是否准确、政治表述是否得体,参数管不了。涉密、重大决策、对外口径一律须经本单位核稿人终审,本 skill 不代替把关。
样本量差异:调研报告 75 篇、领导讲话 44 篇的参数可信;工作意见 25 篇、经验材料 22 篇、党建千字材料 77 篇尚可;工作方案 10 篇、经验总结 8 篇样本偏薄,参数仅供参考。
统计口径:三套并存,查数时注意分辨。
| 口径 | 篇数 | 用在哪 | 能否复算 |
|---|---|---|---|
| 按文种参数(验收基准) | 六文种合计 184 | 参数卡.md、scripts/check_params.py | 可,见 _meta/by_genre.json |
| 篇章层面全量(收尾模式、开头策略、层级深度) | 229 | 公文语料/结构全量统计.md | 部分,见 _meta/all_pieces.json |
| 认知层统计(站位、引用、分寸) | 226 | 公文语料/写作视角与认知框架.md | 否,原文已移除 |
验收一律用第一套。 229 与 226 是切分复核前后的两份集合(后者成文更早,少 3 篇),各自的百分比都在各自集合上算出,未按比例互相折算——原文已移除、无法重算,硬折算只会得到查无实据的数字。
229/226 两套里都含 38 篇已移除的心得体会:按文种分列的参数不含它(删的是整行),聚合数字里仍有它的贡献。
七、输出契约
- 走骨架流程时:先只给标题 + 分层骨架,明确请用户确认后再展开
- 出成稿时:给 ①完整正文 ②自检报告(实际跑脚本)③占位符汇总(三类分别列出)
- 参数偏离时:说明是"有意偏离"还是"疏漏",不默默放过
- 涉密、重大决策、对外表述:提示须经核稿人终审
