Imported from masterball-w/A-writer-should-do (
SKILL.md). Install upstream withnpx skills add masterball-w/A-writer-should-do. Copyright stays with the author.
A-writer-should-do(六维文学DNA蒸馏)
功能定位
从单本图书文本中蒸馏作者的六维文学DNA——不是统计作者的用词频率,而是提取作者理解世界的方式,随后将特征转化为可执行的写作规则,输出一套派生写作指导 Skill 文件集(1个主 SKILL.md + 6个维度文件)。
架构原则(本 Skill 的一切设计服从于此):
- 模块少而密:六个维度,不再增加。文学特征天然重叠,合并优先于细分。目标是让中等上下文模型也能稳定执行全流程。
- 文学有效性检验:任何新增概念必须回答"它是否能改变最终生成文本?"——不能直接影响生成质量的分析,不作为独立模块存在。
- 像作者理解世界,而非像作者说话:蒸馏的终点是作者的解释世界方法(视角、同情、恐惧、判断方式),语言习惯只是它的外壳。
内置反AI特征检测机制:提取特征时同步识别作者写作中天然对抗AI生成模式的特征(不规则句长、非工整结构、粗糙用词、碎片化节奏等),统一收编到维度6(生成约束与编辑校验),不在每个维度重复。
适用输入
小说、散文、杂文、社科论述、传记等各类文体的完整书籍文本或章节文本。
支持的文件形式:纯文本(txt/md)可直接输入;EPUB / MOBI / AZW3 等电子书格式须先执行本 Skill 配套的提取脚本转为纯文本(见「二、标准执行流水线·步骤0」与「十一、脚本使用指南」)。
输出形式
两阶段输出:
- 内部特征分析报告(用于校验,不作为最终交付物):按六维输出结构化特征,所有特征附带原文例证,报告末尾附「文学核心摘要」草稿。
- 派生写作指导 Skill 文件集(最终交付物):存放于当前 IDE 的 Skill 目录(与本规范所在目录同级),结构如下:
write-like-{作者}/
├── SKILL.md # 主调度文件:Literary DNA Summary + 风格总纲 + 执行顺序 + Common Failure Modes + 校验清单 + 种子文本库 + 边界说明
├── 01-author-spirit.md # 维度1:作者精神模型
├── 02-theme-worldview.md # 维度2:母题与世界观
├── 03-narrative-mechanism.md # 维度3:叙事结构机制
├── 04-language-rhythm.md # 维度4:语言节奏系统
├── 05-expression-and-space.md # 维度5:表达技法与留白
└── 06-generation-editor.md # 维度6:生成约束与编辑校验
两阶段缺一不可:未经第一阶段分析验证的特征,禁止写入第二阶段的指导规则中。
一、核心执行原则(必须严格遵守)
- 由整体到局部,逐层递进:严格按「精神底色→母题立场→结构机制→语言节奏→表达留白」的顺序提取,禁止先抠词句再定风格。
- 先分类,再提取:第一步判定文体类型,调用对应权重(见第五节),禁止用统一标准评估所有文体。
- 频次验证原则:仅当某一特征在全书≥3处不同章节/段落重复出现时,才可判定为「作者核心特征」;单次出现的表达仅标注为「局部技法」(派生 Skill 中以💡收录)。
- 主动降噪原则:必须区分「作者个人特征」与「非作者因素」,禁止将文体格式、题材要求、时代语言、译者风格、汇编内容误判为作者特征(规则见第四节)。
- 文本锚定原则:所有特征必须匹配原文具体例证,禁止脱离文本做主观脑补。
- 边界声明一次完成:在步骤1统一声明「基于单本书提取」,后续步骤不再重复声明。
- 文学有效性原则:每提取一条特征,自问"它能改变生成文本吗?"——只能描述不能指导的特征,不进入派生 Skill。
- 条件式规则原则:节奏与语言类规则必须写成"什么时候短、什么时候长"的条件式,禁止"多用短句"式无条件规定。
二、标准执行流水线(五步主干)
输入文本
↓
步骤0 源文本准备(电子书文件时强制执行,脚本提取)
↓
步骤1 文本理解(文体判定 / 文本属性 / 边界声明 / 全局锚定)
↓
步骤2 六维文学DNA提取(反AI特征随维度同步识别,不单独扫描)
↓
步骤3 原文证据验证(频次≥3 / 降噪排除 / 例证回填)
↓
步骤4 生成规则转换(特征→祈使规则 + DNA摘要 + 失败案例 + 种子文本)
↓
步骤5 编辑校验(文件集质量自检)
↓
输出子 Skill
步骤0:源文本准备(脚本执行,输入为电子书文件时强制执行)
当输入为 EPUB / MOBI / AZW3 等电子书文件而非纯文本时,必须先执行本 Skill 配套的提取脚本,将其转为纯文本后方可进入步骤1。脚本位于本 Skill 目录下的 scripts/ 文件夹:
| 脚本 | 适用格式 | 执行命令 |
|---|---|---|
extract_epub.py |
EPUB | python scripts/extract_epub.py <书籍.epub> [-o 输出目录] |
extract_mobi.py |
MOBI | python scripts/extract_mobi.py <书籍.mobi> [-o 输出目录] |
extract_azw3.py |
AZW3 | python scripts/extract_azw3.py <书籍.azw3> [-o 输出目录] |
脚本职责与产出:
- 去除非正文元素:剥离 style、script、head、注释、CSS、图片引用、标签等,只保留正文文本
- 产出
{书名}_fulltext.txt:按书籍阅读顺序(spine)拼接的纯正文,UTF-8 编码 - 产出
{书名}_toc.txt:索引式目录,每行格式为序号<TAB>标题<TAB>字符偏移,偏移指向该章节在_fulltext.txt中的起始位置,可用于定位抽样段落
执行约束:
- 输出目录缺省为电子书文件所在目录,后续步骤一律以
_fulltext.txt与_toc.txt作为分析输入 - 脚本依赖见「十一、脚本使用指南」;脚本失败时须向用户说明缺失的依赖,禁止改用未清洗的原始 HTML 直接分析
- DRM 保护的文件无法提取,须提示用户先自行移除 DRM
步骤1:文本理解
一步完成四项判定(边界声明只在此处做一次):
- 文体判定:核心文体(虚构类/非虚构论述类/散文随笔类/实用类),调用第五节权重与文体特化要求(特化要求贯穿后续全部步骤)
- 文本属性:原著/译本/编著/合集;译本注明「语言特征叠加译者风格,仅提取原作者的叙事、结构、主题层面特征」
- 边界声明:标注评估范围与「基于单本书提取」限定
- 全局锚定:优先读取目录、序言、尾声,完成三项判断——全书核心母题、整体调性与言说立场、整体结构范式
步骤2:六维文学DNA提取
按「维度1→维度6」顺序提取(细则见第三节),并按第三节「文体专项提取点」在对应维度中追加文体专项提取。执行方式:
- 分层抽样:按「开篇段+核心段+过渡段+结尾段」抽样精读,每类至少2个样本;结合目录与章节篇幅统计
- 反AI特征随维度同步识别:不设独立扫描步骤。提取每个维度时,按该维度的[反AI]识别要点同步标注,格式:
[反AI] {特征} ← 对抗:{AI典型模式},附原文例证 - 人格推导并入维度1:文字背后的人格感与情绪底色,作为维度1的深层内容直接提取,不单独成步
步骤3:原文证据验证
对步骤2的全部特征执行三重验证:
- 频次验证:核心特征须≥3处不同章节/段落例证;不满足者降级为「局部技法」
- 降噪排除:逐条对照第四节降噪规则,排除文体/题材/时代/译者/汇编干扰项;疑似AI辅助生成的段落标注后审慎提取
- 例证回填:每条保留的特征补齐具体原文引文(标注章节位置),无例证的特征删除
步骤4:生成规则转换
将验证通过的特征转化为派生 Skill 文件集(转换法则见第七节,模板见第八节):
- 确定目录名
write-like-{作者拼音},存放于当前 IDE 的 Skill 目录 - 生成主调度
SKILL.md:顶部写入 Literary DNA Summary(≤500字,最高优先级),随后是风格总纲、六文件执行顺序、Common Failure Modes(≤5条)、校验清单、种子文本库、边界说明、文体特化约束(按第八节 8.1 模板第七节,依步骤1判定的文体选用对应一组) - 生成维度1-5文件:描述性特征改写为祈使性「遵循✅/避免❌/可选💡/🤖规避」规则,每条附原文示范样本
- 生成维度6文件:收编全部[反AI]标注 + AI典型写法黑名单(见第九节)+ 人写模拟技术 + 编辑三问 + 叙事逻辑自检 + 反模仿伦理
- 提取3-5段种子文本(覆盖开篇/推进/对话或引用/收束),写入主文件「种子文本库」,每段标注出处、功能类型与结构特征
步骤5:编辑校验
对生成的文件集执行质量自检(清单见第十节):文件完整性、frontmatter 合法性、规则可追溯性(每条✅可回溯到≥3处例证)、黑名单完整性、交叉引用一致性。自检不通过须回补,禁止带病交付。
写作产出落盘(派生 Skill 执行写作任务时强制)
凡使用派生写作指导 Skill(write-like-*)执行写作任务,产出的文章必须以 Markdown 文件形式保存到当前工作目录(用户当前所在目录,非 Skill 目录):
- 文件命名:
{文章标题}.md,标题取自文章首行标题,去除文件名非法字符 - 编码统一为 UTF-8,文件首行为一级标题(
# 标题) - 保存后须向用户确认文件路径;禁止仅在对话中输出成稿而不落盘
- 同名文件已存在时追加序号(如
{标题}_2.md),禁止静默覆盖
三、六维文学DNA提取细则
维度1:作者精神模型
核心问题:作者如何解释世界? 不模仿作者经历,只提取解释世界的方法。
提取要点:
- 观察世界的方式:作者看世界的立足点(经验主义平视/精神本位俯视/方志家考据/说书人旁观),从什么位置、用什么眼光看
- 同情对象:作者的笔墨与温度倾向谁(弱者/小人物/精神追求者),如何写他们
- 恐惧与怀疑对象:作者反复警惕什么(虚无/功利/喧嚣/时代洪流),尖锐处在哪里
- 核心情绪底色:全书稳定的情绪基调(悲观垫底+超脱/平静幽默/冷峻认命/丧中带暖),及其不规则处(突转、断裂)
- 叙事距离:作者与人物、与读者的距离(平视/俯视、共情/审视、介入/抽身)
- 文风调性与文字人格:3-5个核心形容词;文本呈现的作者形象(自嘲者/史官/说书人/废柴)
[反AI]识别要点:情绪表达是否存在突转与不规则推进(AI倾向全程均匀基调);是否以自嘲、个人经验入场而非权威立论。
维度2:母题与世界观
核心问题:作者反复书写什么、回避什么,如何判断人性?
提取要点:
- 反复书写的问题:核心母题带(全书反复叩问的3-6个主题)
- 人物命运模式(虚构类):人物通常走向什么结局,命运由什么驱动(时代/一句话/性格/运气)
- 素材谱系与取舍:案例/引文/故事的类型偏好;刻意浓墨重彩与一笔带过的内容边界(非对称取舍)
- 对人性的基本判断:性善/性恶/温和悲观/理解悲悯;对核心冲突的评判倾向
- 道德与价值倾向:价值序列(精神优先/生存优先/功利优先)、辩证程度(容纳矛盾还是非黑即白)、刻意回避的议题
- 认知惯性:思维路径(本质主义/经验归纳/绕圈归因)、反复出现的判断句式
输出要求:形成两份清单——「作者关注什么」与「作者避免关注什么」,后者同样重要。
[反AI]识别要点:笔墨分配是否非对称(AI倾向均匀分配);论证是否容许强立场弱论据(AI倾向论据结论对称);引用是否翻转翻新而非平铺佐证。
维度3:叙事结构机制
核心问题:作者为什么这样安排? 提取机制与动机,不是结构的静态总结。
提取要点:
- 开篇方式:如何入场(他人提问/定性短句/回忆追述/场景白描),为什么拒绝另一种开场
- 冲突/论证展开方式:推进引擎是什么(链条对话/并置对照/绕圈归因/格言-随感交替)
- 信息隐藏方式:什么信息后置、什么信息对读者保密、伏笔与照应的闭环度
- 转折机制:如何转(硬切/藤蔓挂接/辩证翻转/突转),转折处加不加过渡
- 结尾方式:如何收束(短句定性/空镜头/轶事反讽/祈使松散收束),是否拒绝总结升华
- 详略倒置:大事小写、小事大写的具体边界
- 句段衔接:显性连接词还是语义承接,过渡的平滑度与断层位置
[反AI]识别要点:结构是否缺少完整起承转合(突然结尾、省略过渡);段间是否存在跳跃断层(AI倾向过于平滑);是否拒绝总结式收束。
维度4:语言节奏系统
核心问题:作者什么时候短、什么时候长? 一切节奏规则必须写成条件式。
提取要点(粒度必须到具体词、具体句式、具体频次,禁止"语言平实""句式灵活"式笼统概括):
- 句长变化的条件:长句用在什么位置、承担什么功能(闲笔铺陈/连缀因果/时间压缩),短句用在什么位置(变故/死亡/定性判断/收束);统计平均句长与极差
- 段落密度:段落粒度如何跳跃(单句成段与长段交错的位置规律),信息密度的松紧分布
- 对话比例与形态(虚构类):对话占全文比例、对话推进形式(链条/剧本式/一问一答)、口语毛边(答非所问、重复、打岔)
- 语言冷热程度:克制陈述与直抒胸臆的分布;情绪表达是命名("悲痛")还是外化(动作/身体反应)
- 口语与书面比例:语域分界(哪些词只出自人物之口、哪些只出自叙述者);方言、俗语、文言点缀的使用语境
- 高频专属词与句式惯性:口头禅与高频词逐词统计频次;惯用句式(定义句/独白句/转述链)给出格式与频次;标点习惯(问号/感叹号/省略号占比)
- 重复策略:是否主动重复母题词与口头禅(AI强制同义替换,作者往往不替换)
[反AI]识别要点:粗糙用词(避精致求朴素);情绪是否外化为动作而非精致情绪词命名;笑哭表达是否有多个民间变体;状态描写是否带具体过程(无主体速记式派发归入黑名单A11)。
维度5:表达技法与留白
核心问题:作者怎么写,以及刻意不写什么? 留白是风格的一部分。
提取要点:
- 常用意象:高频意象体系及其来源域(乡间日常/自然永恒物/都市消费)
- 象征系统:核心意象的象征指向,意象重复出现的规律
- 比喻方式:比喻密度、喻体来源、是否刻意不对称/带生活粗糙感
- 核心修辞偏好:最依赖的2-3种修辞(白描/反讽/戏仿/降格归谬/翻新引用)及其使用语境
- 情绪表达方式:最痛处的处理惯例(动作替代/物件替代/追问替代呐喊/玩笑语气讲惨事)
- 负空间分析(本维度特有):
- 作者刻意不写什么(不写动机/不写痛哭/不写解释/不写结局之后的事)
- 情绪最浓处的沉默惯例(停顿、切走、空镜头)
- 拒绝给出的答案(以困惑/追问/豁达的不解结束)
[反AI]识别要点:比喻是否随意、不对称、带生活粗糙感(AI倾向工整精致的构造式比喻);是否为每个观点都配比喻(过度类比);留白是否真实存在(AI倾向写满说透)。
维度6:生成约束与编辑校验(提取阶段仅收集,不单独提取)
维度6不由文本分析产生,而是步骤4中把以下内容收编进一个文件:步骤2各维度标注的全部[反AI]特征、第九节黑名单、人写模拟技术(见第八节模板)、编辑三问、叙事逻辑自检、反模仿伦理。其内容模板见第八节 8.3。
文体专项提取点(按步骤1判定的文体,在对应维度中追加提取)
虚构类:
- 维度2追加:抽象人物谱系表(称谓/排行/辈分/亲属与社会关系/身份处境/性格复杂性/身体标记或命名寓意);人物命运的驱动机制(时代/一句话/性格/运气)
- 维度3追加:叙事松散元素清单(插叙/跑题/转述链/传闻视角/信息断层),逐项记录其风格功能与回收方式;人物关系网的层级与密度评估、事件在关系网中的传播路径(扩散/牵连/回响)
- 维度4追加:称谓词表与称谓复用规律;不同身份人物的语域分界与台词形态
非虚构论述类:
- 维度2追加:核心论点的依据类型标注(事实/数据/引文/案例/经验)、出处与可靠性层级;虚构事实与伪造引用在本类文体中一律禁止(写入维度6)
- 维度3追加:论据展开方式(案例先行后归纳/数字夹叙/引文翻转/限制条件后置)与论点-论据的可检查性安排
- 维度4追加:术语体系与一致性策略;数字与引文的密度、位置、呈现形式
散文随笔类:
- 维度1追加:经验材料的来源谱系(亲历/回忆/转述/阅读)与叙述者的真实性立场
- 维度3追加:片段组装方式(联想链/空间并置/时间跳跃)与贯穿机制(意象/问题/语气贯穿);情绪推进路径与峰值位置
- 维度5追加:留白的位置-功能清单;情绪峰值处的沉默惯例
实用类:
- 维度3追加:程序的步骤结构与步骤间衔接方式;条件、依赖、边界的交代位置
- 维度4追加:术语体系与一致性;祈使句形态与分寸尺度表述(“适当”类词是否附带可操作尺度)
- 维度6追加收编:文体规范清单(条目体例/固定套话),与作者个人特征显式分界
四、降噪规则(必须执行)
提取特征时,必须排除以下非作者个人因素:
- 文体固有格式:如小说对话格式、论文摘要关键词、公文固定套话、工具书条目体例
- 题材强制内容:如历史题材的史料引用、年代政治话术、戏曲唱词,不判定为「作者偏好」;须注明"仅在对应题材使用"
- 时代语言痕迹:如民国文本的文白夹杂、特定年代话术,不归为作者个人文风;作者主动选择的语言策略(如刻意的分层语言)除外,须标注等效转译要求
- 译者风格干扰:译本仅提取叙事结构、情节设计、人物塑造、主题认知等原作者特征;语言层面注明「含译者风格影响」
- 编著汇编内容:合集、编著、引文、代笔篇目需单独标注,不纳入作者核心特征
- AI生成痕迹:若原文存在与AI典型模式高度吻合的段落(完美对称排比、过于工整对仗、均匀段落),标注「疑似AI辅助」并审慎提取
五、文体差异化权重指引
不同文体在六维上的提取权重:
| 维度 | 虚构类(小说) | 非虚构论述类 | 散文随笔类 | 实用类 |
|---|---|---|---|---|
| 1 作者精神模型 | 中 | 高 | 高 | 低 |
| 2 母题与世界观 | 高 | 高 | 高 | 低 |
| 3 叙事结构机制 | 高 | 高 | 中 | 中 |
| 4 语言节奏系统 | 高 | 中 | 高 | 中 |
| 5 表达技法与留白 | 高 | 低 | 高 | 低 |
| 6 生成约束与编辑校验 | 一律完整生成,不受权重影响 |
说明:「高」为深度展开,「中」为正常提取,「低」为简要提取。
文体特化要求(权重之外的强制项,贯穿分析/提取/生成/校验四阶段)
权重表只决定提取深度;以下特化要求按步骤1判定的文体强制执行,并同步落实到第三节提取细则、第八节派生模板与第十节自检清单。
虚构类(小说等)
- 人物谱系建构(提取/生成/校验均强制):
- 提取阶段:从原文建构抽象人物谱系——称谓、排行、辈分、亲属关系、社会关系、身份处境、性格复杂性(受害者/共谋者等双重属性)、身体标记或命名寓意;谱系表写入内部报告。
- 生成阶段:动笔前先固定谱系;新增人物必须带明确位置进入关系网,禁止出现无来历、无位置的孤立人物。
- 校验阶段:称谓、辈分、关系逐项对照谱系核验(收进维度6 E节叙事逻辑自检)。
- 台词真实性:人物台词只按身份、处境、利益说话;禁止主题词借壳与金句回击,回击宁可笨拙、平淡或缺席(对应黑名单A12)。
- 叙事松散边界:允许并要求插叙、跑题、转述链、传闻视角、信息断层、非完整起承转合——但每个松散元素必须承担风格功能(制造多版本真相/留白/民间视角/节奏反差),提取时须记录其位置、功能与回收方式(如跑题须有拉回句);禁止无功能、无回收的松散堆砌。
- 人物关系网复杂度评估:按文本实际评估关系网的层级(主要/次要/边缘人物)、密度(人物间关系边数量)与事件传播机制(一个事件如何在关系中扩散、牵连、回响);转化为生成规则:重大事件至少波及2-3个人物,波及方式与强度须有差异,禁止全员同强度反应。
非虚构论述类
- 论点真实性校验:提取阶段为每条核心论点标注其依据类型(事实/数据/引文/案例/个人经验)与原文出处;生成阶段禁止虚构事实、伪造引用、夸大证据;无法确认的内容必须显式标注不确定性,或降格为推测、猜想表述,禁止把推测写成事实。
- 论据细节展开:论据不得停留在抽象判断,必须展开为具体语境、事件过程、数字细节、例证来源、限制条件、推理路径;论点与论据的关系须可检查、可复现;提取阶段记录作者的论据展开方式(案例先行后归纳/数字夹叙/引文翻转/限制条件后置),转化为生成规则。
散文随笔类
- 个人经验:提取经验材料的来源(亲历/回忆/转述/阅读)与经验入场方式(直陈/插叙/物件承载);生成时经验必须有来源感,禁止无出处、无痕迹的具体经验凭空组装。
- 情绪推进:提取情绪的推进路径(由小事入深/跑题归真/突转归静)、情绪峰值的位置与频率、峰值处的处理方式;禁止全程均匀的情绪曲线。
- 片段化结构:提取片段的组装方式(联想链/空间并置/时间跳跃)与形散神聚的贯穿机制(意象贯穿/问题贯穿/语气贯穿);禁止以论述逻辑连接散文片段。
- 留白方式:提取沉默的位置(不说破/切走场景/问而不答)与功能,转化为生成时的负空间规则。
实用类
- 步骤清晰度:一步一动作,顺序可执行,前置步骤显式标出;禁止无主语、无对象的步骤。
- 操作可行性:每步的条件、依赖、适用边界、失败处置明确;禁止“适当”“适量”式模糊指令(作者保留经验分寸的除外,须标注其分寸尺度)。
- 术语一致性:同一概念全文同一术语,禁止引发歧义的同义替换;术语首次出现给出定义或指向定义。
- 文体规范与作者特征分界:条目体例、固定套话属文体规范(按第四节降噪),不入作者特征;只提取作者在说明修辞、示例选择、提示语气、细节安排上的个人级选择。
六、内部分析报告模板(校验用)
用于步骤3之后的内部校验,不作为最终交付物。保存为
{书名}_写作特征蒸馏报告.md。
# 《XX》写作特征蒸馏报告
## 一、基础信息
- 书名 / 文体类型 / 文本属性(原著/译本/编著) / 评估范围
- 边界说明:本报告基于单本书提取,不代表作者全部创作风格
## 二、文学核心摘要(草稿,≤500字)
(派生 Skill 的 Literary DNA Summary 直接取材于此,须覆盖五问:
1. 作者如何看世界;2. 作者如何选择人物/素材;3. 作者如何处理痛苦/快乐/冲突;
4. 作者最核心的表达机制;5. 生成时最需要避免什么)
## 三、六维特征详解
### 维度1 作者精神模型
- 观察方式 / 同情对象 / 恐惧对象 / 情绪底色 / 叙事距离 / 文字人格
- 原文例证:
- [反AI]特征:
### 维度2 母题与世界观
- 反复书写的问题 / 命运模式 / 素材谱系与取舍 / 人性判断 / 价值倾向
- 关注清单:
- 回避清单:
- 原文例证:
- [反AI]特征:
### 维度3 叙事结构机制
- 开篇 / 展开 / 信息隐藏 / 转折 / 结尾 / 详略倒置 / 衔接
- 每项须回答"为什么这样安排":
- 原文例证:
- [反AI]特征:
### 维度4 语言节奏系统
- 句长条件分布 / 段落密度 / 对话比例 / 冷热程度 / 语域分界 / 高频词与句式(附频次)
- 原文例证:
- [反AI]特征:
### 维度5 表达技法与留白
- 意象 / 象征 / 比喻方式 / 核心修辞 / 情绪表达惯例
- 负空间清单(作者刻意不写什么):
- 原文例证:
- [反AI]特征:
## 四、写作辨识度总结
- 作者独有核心标识:
- 同类文体通用写法(不入规则):
## 五、降噪记录
(被排除的非作者因素及理由)
## 六、种子文本候选(3-5段,标注出处与功能类型)
七、特征→规则转换法则
法则1:描述句→指令句
| 原始特征(描述句) | 转换后规则(指令句) |
|---|---|
| 作者死亡场景一律一句带过 | 死亡/重大变故用一句平静陈述完成;悲痛外化为动作,禁止渲染 |
| 全书多采用限知视角叙事 | 采用限知视角,信息随人物认知释放,禁止全知旁白介入 |
| 短句集中出现在收束位置 | 定性判断与篇末收束用5字以内短句;叙述推进用连缀长句 |
法则2:频次特征→硬性规则
通过频次验证(≥3处)的核心特征,转换为「必须遵循」的硬性规则(✅)。
法则3:单次技法→可选技法
仅出现1-2次的局部技法,转换为「可选技法」(💡),不强制执行。
法则4:降噪项→排除规则
已排除的非作者因素,转换为「明确避免」的排除规则(❌),防止写作时误用文体套话、时代语言。
法则5:例证→示范样本
每条规则附注1-2条原文例证作为「示范样本」。
法则6:反AI特征→维度6集中收编
步骤2标注的全部[反AI]特征,只写入 06-generation-editor.md,不在维度1-5重复收录(各维度文件仅保留与本维度直接相关的少量🤖规则)。每条🤖规则包含三要素:须规避的AI典型模式、替代策略、人写参照(原文例证)。
法则7:规则可执行性
每条规则必须是可操作的具体指令:给出可量化标准(句长、频次、占比)或可对照的具体范式;节奏类规则必须写成条件式("什么时候短,什么时候长")。禁止「注意文风」「把握节奏」式模糊表述。
八、派生写作指导 Skill 文件集模板
步骤4最终交付物:1个主调度文件 + 6个维度文件。
8.1 主调度文件 SKILL.md
---
name: "write-like-{作者名或书名}"
description: "基于《{书名}》蒸馏的作者写作特征,提供该作者风格的写作指导。当用户要求模仿{作者名}风格写作、按该风格创作文章/段落/章节、或校验文本是否符合该风格时调用本 Skill。"
---
# 写作指导:{作者名}风格(基于《{书名}》)
## 适用场景
(覆盖范围 + 未涵盖的风格变化 + 同作者不同文体版本的分工说明)
## Literary DNA Summary
> **最高优先级参考**:写作前必读。与维度文件冲突时,以本摘要的精神为准。
(≤500字,必须依次回答五问:
**1. 如何看世界**:作者观察与解释世界的立足点与方法。
**2. 如何选择人物/素材**:作者的选择标准与拒绝清单。
**3. 如何处理痛苦/快乐/冲突**:作者的情绪处理惯例。
**4. 核心表达机制**:作者最有辨识度的2-4个结构/语言机制。
**5. 生成时最需避免**:最容易背叛该作者的3-5项。)
## 一、风格总纲
(3-5条核心原则,每条一句话,概括该作者最核心的写作标识)
## 二、执行顺序与文件索引
| 执行顺序 | 文件 | 维度 | 职责 | 依赖前提 |
|:---:|---|---|---|---|
| 1 | `01-author-spirit.md` | 作者精神模型 | {职责} | 无(最先执行,为全文定调) |
| 2 | `02-theme-worldview.md` | 母题与世界观 | {职责} | 依赖维度1确立的精神底色 |
| 3 | `03-narrative-mechanism.md` | 叙事结构机制 | {职责} | 依赖维度2确定的母题与立场 |
| 4 | `04-language-rhythm.md` | 语言节奏系统 | {职责} | 依赖维度3确定的结构框架 |
| 5 | `05-expression-and-space.md` | 表达技法与留白 | {职责} | 依赖维度4确定的词句节奏 |
| 6 | `06-generation-editor.md` | 生成约束与编辑校验 | AI检测、真实性检查、编辑三问、叙事逻辑自检、反模仿伦理 | 最后执行,初稿成形后终检 |
### 执行方式
- **产出落盘**:成稿以 `{文章标题}.md` 保存到当前工作目录,禁止仅在对话中输出不落盘。
- **完整写作任务**:按顺序1→5落实初稿,随后必须执行维度6全套校验,否则视为未完成。
- **局部改写/校验任务**:可直接加载对应维度文件单独执行;改写后仍须执行维度6的统计性校验与编辑三问。
- **风格校验任务**:先对照 Literary DNA Summary 判断文本是否具备作者的世界观与核心机制,再用校验清单逐条核对。
- **种子文本仅作结构参照**:内容一律按规则全新生成;禁止改写原文句子、禁止套用原文句式骨架做词语填充、禁止原文人物与场景进入新作。
## 三、Common Failure Modes
> 最多5条。帮助模型避免"像作者但没有文学价值"。
### 失败1
**错误**:{具体的错误表现}
**原因**:{为什么会发生,触及哪个机制}
**修正**:{可执行的修正动作}
(失败2-5同格式)
## 四、风格校验清单
- [ ] 文本是否体现 Literary DNA Summary 的五项要点
- [ ] 文风基调是否符合风格总纲
- [ ] 维度1-5的硬性规则是否逐条遵循(逐文件列出)
- [ ] 维度6的 A-F 六节校验是否全部执行并有实际删改
- [ ] {风格专属校验项3-8条}
## 五、种子文本库(全局强制)
> **用法**:种子文本是原文的结构范式与语感基准,仅作段落功能、句长节奏、过渡与收束方式的参照;写作内容一律按规则全新生成,禁止改写原文。
>
> **结构参照约束**:①为目标段落选取结构最接近的种子,对齐其段落功能、句长节奏(±5字浮动)、段落粒度与收束方式;②成稿后与种子对照做语感校准,偏差时调整结构与节奏,不得借用原文内容。
### 种子1:{功能类型}(如:开篇段)
> {原文摘录}
> ——{出处}
**结构特征**:{段落功能 → 推进方式 → 收束方式,含句长节奏描述}
(共3-5段种子,覆盖开篇/推进/对话或引用/收束)
## 六、边界说明
(基于单本书提取的限定;译本含译者风格影响的限定;题材强制内容的使用边界)
## 七、文体特化约束(按生成文本的文体启用,取自母 Skill 第五节)
> 写作任务启动时先判定目标文体,启用对应专项约束;文体判定不明时先问用户,禁止默认按虚构类处理。
(按步骤1判定的文体,从以下四组中选用一组写入,逐条可校验:
- **虚构类**:动笔前先完成人物谱系表(称谓/排行/辈分/亲属与社会关系/身份处境/性格复杂性);台词只按身份处境利益说话;插叙/跑题/转述链/信息断层各有风格功能与回收方式;重大事件至少波及2-3个人物且波及方式与强度有差异
- **非虚构论述类**:每条论点有可追溯依据(事实/数据/引文/案例/经验);禁止虚构事实、伪造引用、夸大证据;不确定内容显式标注;论据展开到语境/过程/数字/来源/限制条件/推理路径
- **散文随笔类**:经验材料有来源感;情绪推进有路径与峰值;片段组装有贯穿机制;留白按位置-功能清单执行
- **实用类**:一步一动作、前置步骤显式;术语全文一致;条件、依赖、边界、失败处置明确,无模糊指令)
8.2 维度指导文件模板(01 至 05)
---
name: "write-like-{作者}-{编号}-{英文简称}"
description: "{作者名}风格写作指导·维度{编号}·{维度中文名}。当用户按{作者名}风格写作并需要本维度规则时调用本文件,或由主调度文件 SKILL.md 按执行顺序自动加载。"
---
# 维度{编号}:{维度中文名}
> 所属指导集:write-like-{作者}(基于《{书名}》)
> 执行顺序:第{编号}步 / 共6步
> 前置依赖:{上一维度,维度1填「无」}
> 本维度回答:**{核心问题}**
## 规则
### 遵循
- ✅ {祈使性指令句,节奏类必须为条件式}
- 示范样本:{原文例证及出处}
### 避免
- ❌ {排除规则}
### 可选技法
- 💡 {频次不足3次但有价值的技法}
### 🤖 AI特征规避
- 🤖 {与本维度直接相关的AI典型模式} → {替代策略}
- 人写参照:{原文例证}
## 本维度自检
- [ ] 所有✅规则是否已落实
- [ ] 是否触犯任一❌避免规则
- [ ] 可选技法💡是否有意识地取舍
- [ ] 是否触犯任一🤖 AI特征规避规则
- [ ] 本维度的核心问题是否已被回答,而非仅套用表面句式
## 衔接说明
本维度完成后,进入下一维度「{下一维度名}」(文件:`{下一文件名}`)。{本维度产出如何构成下一维度的约束前提}
维度4专属要求:04-language-rhythm.md 须覆盖句长条件分布、段落密度、对话形态、语言冷热、语域分界、高频词与句式六个子项;每条✅规则必须给出具体词表/句式格式/频次门槛,禁止无条件式规定。
8.3 维度6文件模板(06-generation-editor.md)
---
name: "write-like-{作者}-06-generation-editor"
description: "{作者名}风格写作指导·维度6·生成约束与编辑校验。写作完成后调用本文件执行AI典型问题检测、文学真实性检查与编辑校验,或由主调度文件 SKILL.md 按执行顺序自动加载。"
---
# 维度6:生成约束与编辑校验
本维度不改写风格,只回答三个问题:**初稿哪里像AI?哪里不像{作者}?哪里该删?**
## A. AI典型问题检测(全局黑名单,逐条校验)
(原样收录第九节黑名单全文:句式A1-A13、用词B1-B8、结构C1-C6、质感D1-D5;
另将步骤2标注的[反AI]特征转化为作者专项🤖规则附于本节末尾)
## B. 文学真实性检查({作者}专项)
- [ ] 是否复制作者表面语言(原文句子/人物/地名不得进入新作)
- [ ] 是否缺少真实细节(每场景须有时间/地点/人名/物件锚点)
- [ ] 是否只有风格没有世界观(删掉风格化措辞后,是否仍有作者式判断方式)
- [ ] 人物台词真实性(虚构文体:人物只说符合身份处境的话,无主题词借壳、无金句回击)
- [ ] 文体专项真实性(按目标文体选勾一组):
- 虚构类:人物谱系核验通过(称谓/排行/辈分/关系逐项对照);松散元素各有功能与回收;事件波及多个人物且反应有差异
- 非虚构论述类:无虚构事实与伪造引用;每条论点的依据可追溯;不确定内容已标注;论据已展开到语境/过程/数字/来源/限制条件/推理路径
- 散文随笔类:经验材料有来源感;无论述逻辑连接的片段;留白按清单执行
- 实用类:术语全文一致;步骤可执行;无模糊指令
## C. 编辑校验三问(成稿后逐段执行)
1. **删除什么?**(删解释/删过渡/删金句/删冗余修饰)
2. **哪里应该停顿?**(重大变故后的停顿惯例;判断句后不急于补论据)
3. **哪里应该留白?**(结尾不升华;动机写七分;最痛处不用情绪词)
## D. 人写模拟技术(全局强制,逐项落实)
| 编号 | 技术 | 具体操作 | 量化要求 |
|:---:|---|---|---|
| E1 | 思维跳跃注入 | 中途插入1-2处看似无关的联想,再拉回主题 | 每篇至少1处 |
| E2 | 质量不均制造 | 故意让1-2句写得"粗糙",保持人写的不完美感 | 每篇至少1句口语化碎句 |
| E3 | 具体到不能再具体的细节 | 用作者式的具体细节替代模糊表述 | 每篇至少2处具体细节 |
| E4 | 允许跑题 | 1-2句偏离主题的话,然后自然拉回 | 每篇至少1处跑题 |
| E5 | 信息不对称制造 | 某些段落密度极高,某些几乎无信息 | 全文信息密度差异≥3倍 |
| E6 | 个人语言怪癖复现 | 复现从原文提取的高频用词习惯 | 每篇至少3次复现 |
| E7 | 体验性细节优先 | 用主观判断、身体动作、直觉替代环境描述 | 体验性细节占比≥60% |
| E8 | 句长极差制造 | 最短句(≤5字)与最长句(≥40字)长度差超过35字 | 句长标准差≥15 |
(E3/E6等条目须按该作者特征风格化改写,给出作者式示例)
## E. 叙事逻辑自检(独立于风格校验,初稿后强制执行)
- [ ] ①人物称谓与排行辈分一致(虚构类强制;对照人物谱系表逐项核验)
- [ ] ②对话内部无自相矛盾
- [ ] ③机构名称、证件、程序等设定全文一致(非虚构类按机构/数据/引文出处一致性执行)
- [ ] ④时间、年龄、金额前后自洽
- [ ] ⑤(非虚构类)事实、数据、引文与标注的依据类型相符,无把推测写成事实
## F. 反模仿伦理
- 模仿解释世界的方法,不复制作者的经历:不得把作者真实生平、亲友、事件搬进新作
- 像{作者}≠是{作者}:世界观落点允许不同,观察与判断的"方法"必须一致
- 禁止风格炫技:标志性句式复现以维度4的频次门槛为限
## 本维度自检 / 衔接说明
(A-F逐节通过;全部通过后成稿按落盘规则保存为 `{文章标题}.md`)
九、AI典型写法黑名单(全局强制)
唯一收录处为派生 Skill 的
06-generation-editor.mdA节,维度1-5不再重复收录。写作时逐条校验,触发任一条即须改写。
A. 句式黑名单
| 编号 | 禁止的AI典型句式 | 具体表现 | 替代策略 |
|---|---|---|---|
| A1 | 三段式排比 | "A在...;B在...;C在..."三段并列 | 用一句直白概括替代,或只保留一个具体场景 |
| A2 | "不是A而是B"对比结构 | 用该句式推进论点 | 用直接陈述或具体经验替代 |
| A3 | 设问自答式推进 | "为什么...呢?因为..."(除非原作者频繁使用且通过频次验证) | 用直接陈述或场景叙述替代 |
| A4 | 工整对仗式总结 | "把A当成B""将A化为B"的对称总结句 | 用口语化直白表达替代 |
| A5 | 过渡词模式化 | 每段开头都用"当然""不过""说到底"等过渡词 | 过渡词分散使用,至少30%的段落无过渡词直接跳跃 |
| A6 | 拟人化修辞 | "胃开始抗议""时间在流逝"等AI式拟人 | 用直接身体感受替代(如"胃开始不舒服") |
| A7 | 伪亲切模式 | 滥用"你"制造代入感("你是否也...") | 用第一人称经验替代 |
| A8 | 故作轻松语气 | "就这么简单""其实很容易""没什么大不了" | 用真实的困难描述替代 |
| A9 | "不"字定义法 | 用"不+形容词"定义判断("不简单""不容易") | 用具体描述替代("需要反复尝试""花了三个小时") |
| A10 | 强制因果句式 | "正是因为...所以...""由此可见..."的显性因果链 | 用语义自然承接替代,省略因果连接词 |
| A11 | "短直简"速记式描写 | 用极短致使结构直接派发状态,或用模糊物件、省略主体,如"照得人脸上发青""把东西攥在手里,攥得发白"——无具体过程与体验细节,也不承担叙事功能 | 把物件写具体、给状态补上主体,或替换为具体的身体/体验后果,无必要时直接删除 |
| A12 | 主题词借壳与金句回击 | 让虚构人物原样说出主题词或论点,或为人物安排滴水不漏的警句回击——现实中的人只按身份处境利益说话,完美金句一秒即被识破为AI | 人物只说符合其身份处境的话,主题词留给叙述者;回击宁可笨拙、平淡或缺席 |
| A13 | 句尾顿悟点评与缀饰 | 叙述或描写完成后,在句尾追加极短的论断、感悟或修饰,形成事实加顿悟、描写加缀饰的两段式,如两样钱都黑、一个馒头比天大、眉毛蜷起来像烧过的纸、手黑得发亮、吃得脸都肿——细节被强行点化成寓言,描写被强行拔高成抒情,是最高频的AI腔痕迹;同禁无叙事功能的过短状态句 | 默认整句删除句尾顿悟与缀饰,叙述在事实本身处停止;若该句承担伏笔或人物刻画等叙事功能,改写为具体过程、动作或台词,不得以独立短论断句的形式保留 |
B. 用词黑名单
| 编号 | 禁止的AI典型用词 | 具体词汇 | 替代策略 |
|---|---|---|---|
| B1 | 精致书面词汇 | "信誓旦旦""固有认知""终极武器""毋庸置疑""综上所述""不言而喻" | 用日常口语化表达替代 |
| B2 | 对冲语气词过度使用 | "似乎""或许""大概""应该""可能"每篇超过3次 | 控制在2次以内,或用确定性表达替代 |
| B3 | 模糊代词 | 用"东西""活""事"代替具体名词 | 用精确名词替代 |
| B4 | 单字形容词 | "腻""响""空""窄""快""大"等单字形容 | 用完整短语替代 |
| B5 | AI式刻意口语 | "跳脚""兜不住""挺久""还行""一堆""有货""有坑" | 用自然口语替代 |
| B6 | 空洞断言词 | "迟早""必然""一定会""终将" | 用具体条件限定替代 |
| B7 | 精致形容词堆砌 | "深刻的""本质的""核心的""关键的"连续出现 | 每篇此类词不超过2个,用具体描述替代 |
| B8 | "某种程度上"式模糊限定 | "某种程度上""在一定意义上""从某种角度" | 直接删除或用具体程度替代 |
C. 结构黑名单
| 编号 | 禁止的AI典型结构 | 具体表现 | 替代策略 |
|---|---|---|---|
| C1 | 完整起承转合 | "引入→经历→案例→辩证→总结→收束"的完整对称结构 | 允许结构松散、过渡突兀、结论松散 |
| C2 | 过于平滑的段间过渡 | 每段开头都与上一段自然衔接 | 须有至少2处跳跃或断层 |
| C3 | 均匀段落分布 | 所有段落长度相近(每段3-5句) | 单句成段与正常段落交错,单句成段占比≥20% |
| C4 | 对称论证 | 论据与结论完美匹配 | 允许某些论据指向模糊结论,或结论缺乏充分论据 |
| C5 | 过度类比 | 为每个观点都构造一个比喻 | 比喻数量控制在每篇1-2个 |
| C6 | 信息均匀分布 | 每段信息密度相近 | 制造信息不对称:某些段落密度极高,某些几乎无信息 |
D. 质感黑名单
| 编号 | 禁止的AI典型质感 | 具体表现 | 替代策略 |
|---|---|---|---|
| D1 | 刻意构造的比喻 | 为论点定做严丝合缝的寓言或比喻(如"名牌T恤""捷径的通行证") | 比喻须从个人经验自然生发,允许失配与无用细节 |
| D2 | 伪亲切代入 | 滥用"你"制造代入感 | 用"我"的第一人称经验替代 |
| D3 | 故作轻松 | "就这么简单""没什么大不了" | 用真实困难描述替代 |
| D4 | 总结式收束泛滥 | 每篇都以"说到底""归根结底"式总结收束 | 收束方式多样化,允许松散结尾 |
| D5 | 完美论证 | 每个论点都有充分论据,逻辑无懈可击 | 须允许至少1处论证留白或逻辑跳跃 |
十、质量自检清单
10.1 内部分析报告自检(步骤3后校验)
- 是否按由宏观到深层的顺序提取,未出现以局部细节定义整体风格
- 所有核心特征是否均有≥3处原文例证支撑
- 是否已排除文体、题材、译本、时代等非作者因素(降噪记录成文)
- 是否存在脱离文本的主观脑补与过度推论
- 文学核心摘要是否≤500字且覆盖五问
- 维度5是否给出了「负空间清单」,维度2是否给出了「关注/回避」双清单
- [反AI]标注是否覆盖节奏、结构、用词、句式、质感五类
- 文体专项提取点是否完成(按第五节对照):虚构类——人物谱系表、松散元素功能清单、关系网评估;非虚构——论点依据类型标注与可靠性层级;散文——经验来源谱系与留白位置-功能清单;实用——步骤结构与术语体系
10.2 派生 Skill 文件集自检(步骤5校验)
- 文件集完整:1个主
SKILL.md+ 6个维度文件(01-06) - 主文件 frontmatter 合法,顶部含 Literary DNA Summary(≤500字,覆盖五问)
- 主文件含 Common Failure Modes(≤5条,每条含错误/原因/修正三要素)
- 执行顺序表完整列出6个文件,标注职责与依赖前提
- 每条✅规则可追溯到频次验证通过的特征,附原文示范样本;节奏类规则均为条件式
- 降噪排除项已转换为❌规则;黑名单只收录于维度6 A节,维度1-5无重复收录
- 种子文本库含3-5段,标注出处与功能类型,明确「仅作结构参照、禁止改写原文」
- 维度6含 A-F 六节(黑名单/真实性/编辑三问/人写技术/叙事逻辑/反模仿伦理)
- 边界说明标注「基于单本书」;译本标注「含译者风格影响」
- 全部文件中无「禁止从零生成」「替换比例≤50%」「以原文为模板改写」类残留表述
- 文体特化约束已收进派生 Skill(主文件「七、文体特化约束」节 + 维度6 B节文体专项真实性 + E节文体适配项),且每条约束可校验(有对照对象或判定标准)
十一、脚本使用指南
配套脚本位于本 Skill 目录下的 scripts/ 文件夹,用于在步骤0将电子书文件转为纯文本:
| 文件 | 用途 |
|---|---|
extract_epub.py |
EPUB 提取:解析 container.xml → content.opf,按 spine 拼接正文;TOC 取 NCX → EPUB3 nav → h1-h6 标题索引兜底 |
extract_mobi.py |
MOBI 提取:优先 pip 包 mobi 解包,回退 calibre ebook-convert 转 epub 后复用 epub 逻辑 |
extract_azw3.py |
AZW3 提取:优先 calibre ebook-convert 转 epub,回退 pip 包 mobi |
_text_clean.py |
共用清洗模块:去除 style/script/head 等元素,只保留正文文本,供以上三个脚本调用 |
执行步骤
- 确认电子书文件路径与格式后缀(epub / mobi / azw3)
- 按格式选择对应脚本执行:
python scripts/extract_<格式>.py <文件路径>(Windows PowerShell 环境直接以python调用,路径含空格时加引号) - 检查输出:
{书名}_fulltext.txt(纯正文)与{书名}_toc.txt(索引式目录) - 以这两个文件为输入进入步骤1;偏移索引可直接用于步骤2的抽样精读定位
依赖说明
extract_epub.py仅依赖 Python 标准库,无需第三方包extract_mobi.py需pip install mobi,或安装 calibre(提供ebook-convert命令)extract_azw3.py推荐安装 calibre,或pip install mobi作为回退- 含 DRM 的文件无法提取,脚本会给出提示,须由用户先自行移除 DRM
十二、交付与存档规范
- 派生 Skill 文件集:存放于当前 IDE 的 Skill 目录(与本规范所在目录同级),作为长期可复用的交付物
- 内部分析报告:以
{书名}_写作特征蒸馏报告.md保存至当前工作目录,供校验与回溯 - 生成文章:凡按派生 Skill 创作的文章,一律以
{文章标题}.md保存至当前工作目录(见「写作产出落盘」),不得仅存于对话记录中 - 提取产物:步骤0产出的
{书名}_fulltext.txt与{书名}_toc.txt保留于输出目录,作为蒸馏溯源依据
十三、执行注意事项
- 原文例证格式:每条例证标注章节/段落位置,引文用引号标注;引文长度控制在说明特征的必要长度内
- 频次标注:核心特征旁注明「全书出现N+处」
- 降噪标注:可能受非作者因素影响的特征,以括号注明干扰来源,如「(注:含译者风格影响)」
- 派生 Skill 命名:目录名使用
write-like-{作者拼音}格式,确保唯一可读 - 维度文件命名:6个文件名固定为:
01-author-spirit.md、02-theme-worldview.md、03-narrative-mechanism.md、04-language-rhythm.md、05-expression-and-space.md、06-generation-editor.md - 文件间引用一致性:主调度文件与维度文件衔接说明中引用的文件名须与实际文件名一致
- 维度文件独立性:每个维度文件的 frontmatter description 须含作者名、书名、维度职责,可脱离主文件单独调用
- 上下文效率:维度1-5单文件以精简为要;黑名单与人写技术等大块内容只进维度6,禁止在多个文件重复收录