Skip to content

Latest commit

 

History

3 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 

Repository files navigation

humanizer-zh

humanizer-zh 是一套给 GPT、Claude 等大模型使用的中文编辑规则。它主要处理翻译腔、模板腔和聊天残留,但不会为了“更像真人”改掉原意、作者立场、文体或受保护内容。

它也不判断一段文字是否由 AI 生成,更不会把普通润色悄悄变成摘要、扩写、事实核查、来源验证或抄袭检测。

这份 README 也经过了本 Skill 的规则复核。 复核前为 111 行、5,783 字节,SHA-256 为 78100feb72829847bed6de85c665035f3ac8cd98dbc72a5f1e81c79027b7786c。复核后为 113 行,仍保留 8 个二级章节;新增的 2 行来自这段自用记录。本轮只调整叙事顺序、标题和措辞,保留原有数字、结论与验证边界。它能证明这套规则确实被用于自身文档,但不能单独证明 GPT、Claude 的长期效果。

它想解决什么

  1. 用户只说“自然一点”“去 AI 味”或“润色”时,默认做忠实改写,不自行扩大权限。
  2. 改写后仍保留原文的事实、主张、归因、立场、限制、不确定程度和规范词强度。
  3. 中文本土化落在信息顺序、主语、搭配、语域和渠道习惯上,不靠词语黑名单。
  4. 审阅、文件写回、摘要、创作和核查各有边界,模型不能自行跨任务。
  5. 删去 GPT、Claude 通常能直接推断的重复解释,只留下容易误判或造成语义损失的规则。

为什么只拆成两层

humanizer-zh/
├── SKILL.md
├── README.md
└── references/
    └── conditional-modes.md
  • SKILL.md 放常驻规则:任务边界、忠实改写契约和 5 步执行流程。
  • references/conditional-modes.md 只在摘要/压缩、扩写/创作、事实/来源核查或特定文体需要时读取。
  • README.md 记录设计和验证过程;在本次 Skill Forge 运行时投影中,它不会进入模型上下文。

继续按文体或表达模式细拆,会增加漏读、重复和规则漂移。全部合回一个文件也能运行,但普通润色任务会被迫加载所有条件模式。现在的结构只增加一次直接引用,默认任务则少加载约 39.9% 的运行时文本。

优化是怎么完成的

阶段 产出与数量 实际结果
需求冻结 1 份 requirements.md 固定目标、非目标、质量维度、成本和停止条件
用例冻结 13 例 9 个可见用例、4 个密封用例,全部经用户确认保留
不可变基线 2 个运行时文档 SKILL.mdpatterns.md 均有 SHA-256 绑定
隔离构建 1 个候选 构建者只看到需求和可见集,没有接触密封集
结构检查 0 errors、0 warnings 没有风险提示或未知项
标准主机矩阵 18 条观察 基线 9 条、候选 9 条,均遇到相同的基础设施错误
补充显式执行 9 个结果文件 执行者未参与候选构建,也未读取密封集和验证器
因果修订 1 次、1 条规则 只修复明确长度约束下的实际计数问题

这次优化没有增加脚本、资产、多层引用或额外规则系统,也没有改动冻结用例和验证器。

上下文负担减少了多少

下表只统计模型运行时会读取的 SKILL.md 和直接引用文件,不包含 README。

指标 优化前 优化后 变化
运行时文件数 2 2 不增加
总行数 324 60 -81.5%
总字节 16,342 4,713 -71.2%
常驻 SKILL.md 行数 79 32 -59.5%
常驻 SKILL.md 字节 5,897 2,833 -52.0%
条件参考行数 245 28 -88.6%
条件参考字节 10,445 1,880 -82.0%
直接引用层级 1 1 不增加

优化前的参考文件有 31 个三级模式标题,优化后收敛为 4 个条件模式。这里删掉的是重复模式、词表和模型可推断的说明,不是把内容转移到更多文件里。

一次可以复现的修订

补充执行中,有个压缩用例要求输出 80–100 个汉字:

指标 修订前 修订后
输出汉字数 56 95
是否进入目标范围
候选运行时字节 4,504 4,713

对应的改动只有一条:交付前按用户指定的口径实际计数;如果没有落入范围,就在不新增事实的前提下调整,再重新计数。

这条规则增加了 209 字节,约占修订前候选的 4.6%。即便如此,最终候选仍比基线少 71.2% 的运行时字节。

现在会怎样处理文本

  • 普通润色默认忠实改写,不擅自摘要、扩写、删减或核查。
  • 原文的归因和不确定程度会被保留;如果来源可疑,只在改写之外另作提示。
  • 代码、frontmatter、链接目标、引文、术语、数字和规范词强度默认不动。
  • 查看、解释和审阅默认只读;只有得到明确授权,才写回指定文件和范围。
  • 营销、客服、社交媒体、技术、法律、公文和个人写作分别校准,不会统一改成中性说明文。
  • 原文已经自然准确时少改或不改,不为展示工作量机械重写。
  • 对 AI 作者身份概率不编造结论,可以改为提供表达层面的审阅。

证据目前到哪一步

目前可以确认:

  • 运行时结构检查通过:0 errors、0 warnings、0 risk findings、0 risk unknowns。
  • 运行时树摘要为 sha256:fceed683b455a766d63aea856271561accd38d825a100705b8d6c9222ab760ef
  • 9 个可见用例都生成了结果文件。
  • 补充结果保留了术语、数字、归因、情态强度、受保护内容和文件审阅边界。
  • .DS_Store 和旧 patterns.md 没有进入当前运行时内容。

还不能据此确认:

  • 冻结要求不允许调用外部付费模型,因此没有通过提权重新运行模型矩阵。
  • 密封集、Claude 行为、自动路由、主机激活、长期稳定性以及选定用例之外的泛化仍未验证。

怎么使用

宿主正确安装并显式提供本 Skill 后,可以提出这类请求:

  • “把这段技术译文润色成自然中文,保留术语和数字。”
  • “参考这段作者样本调整语气,不要新增观点。”
  • “只审阅这份文件的翻译腔,不要修改文件。”
  • “压缩到 100 字以内,重点保留时间和回滚条件。”

这个目录存在,不代表 Codex 或 Claude 已经自动发现、激活或路由到该 Skill;这些能力仍取决于宿主的安装位置和运行机制。

About

鉴于人性化脚本英文不具有本土化优势,且直接翻译会使得目标偏移,加之大模型更迭使得部分skill命令本无需重复赘述,又发现本土化脚本仓库暂停更新,英文脚本更新后体量较大,部分规则自我矛盾,本skill在二者基础上,提供一版微分结构的skill,本skill采用本人skill-forge和原生skill-creator 对抗生成,经核实前者效果优于后者,详见README.md

Resources

Stars

3 stars

Watchers

1 watching

Forks

Releases

Packages

Contributors