Humanize Paper
August 25, 2026 · View on GitHub
humanize-paper 是一个面向 Codex 的中英文学术写作 skill。你可以交给它一段套话很多的文字、一节混入内部实验代号的草稿,也可以交给它一篇被实现细节盖住主线的完整论文。输入不同,它获得的编辑权限也不同。
如果输入只是一段或一节,它会留在局部,不会凭局部材料推断全文 thesis。它主要处理重复句架、机械连接词、空洞强调、过度防御、术语漂移和不符合研究社区习惯的表达。中文稿件还有一组单独的 pattern:反复出现的否定—对照句、工整排比、抽象名词堆叠、填充短语和习惯性使用 ——。
如果输入是一篇基本完整的稿件,它还会检查另一类问题:动机是否出现在方案之前,设计选择是否回应了明确需求,control 是否紧邻它要检验的替代解释,结果顺序是否服务于论文主张,而不是照搬实验执行时间。确有问题时,它可以移动或压缩内容;结构本来正确时,它不会为了留下修改痕迹而重排全文。
无论走哪条路径,默认规则都是不改变论文已经知道的事情。事实、否定、modality、scope、比较方向、聚合口径、数字、公式、引用、数据集名、模型名和正式术语都受到保护。may improve 不能因为改写而变成 improves,within 0.5 points 也不能只因为后者更利落就写成 matches。
它会留意的具体问题
语言层会检查常见的 AI 写作 pattern,但不会把词表当检测器。一次 Moreover 或一个破折号本身不是问题;同一种形状反复出现、没有实际功能,或者与证据不匹配,才值得修改。
例如:
delve、pivotal、it is worth noting、plays a crucial role等高频套话;- 每段都套用同一种“问题—方法—优点—总结”结构;
- “another key challenge” 式段首和 “taken together” 式自动收尾;
- 空载的
not merely ... but ...、装饰性比喻和宣传性形容词; - 没有真实 scope 功能的 “we do not claim” 或 “our goal is merely”;
- 在直接结果外连续叠加
seem、suggest和may; run_v3_final、config_A2、checkpoint 名称、W&B/Slurm ID、机器名和绝对路径;- 把项目开发史或实验队列直接写成论文结构;
- 只表示歉意,却没有说明哪个 claim 在什么条件下受限的 limitation 模板。
内部代号不会被凭空改名。如果现有文件无法说明 config_A2 与 config_A3 分别代表什么,skill 会把 artifact identity 留给作者确认,不会擅自合并两个实验条件。
三种输入
段落或小节。 只做局部、语义保持的修改,不从局部材料推断全文结构。
完整稿件。 允许重建论证,但先诊断现状;只有找到具体结构缺陷时才跨段或跨节修改。
完整稿件加独立证据。 表格、定理、结果摘要或原始记录可以授权在证据范围内校准 claim。没有这些独立证据时,即使原句显得过分谨慎,claim 强度仍保持锁定。
边界
这个 skill 不是 AI 检测器,不输出 AI 概率,也不以绕过检测器为目标。它不会故意插入错误,不会编造引用、实验或个人经历,也不会把缺少证据的 claim 写得更有把握。
安装
git clone https://github.com/SyntaxSmith/humanize-paper.git ~/.codex/humanize-paper
mkdir -p ~/.codex/skills
ln -s ~/.codex/humanize-paper/humanize-paper ~/.codex/skills/humanize-paper
如果将仓库克隆到其他位置,请把其中的 humanize-paper 目录链接到 ~/.codex/skills/。
使用
重构完整稿件:
使用 $humanize-paper 重构并修改这篇稿件。保留原有 claim 和证据,并报告无法解决的 claim–evidence mismatch。
局部改写:
使用 $humanize-paper 修改这一节,不要改变 claim、scope、modality、引用、数字和术语。
只做诊断:
使用 $humanize-paper 诊断这篇稿件。区分全文结构问题和语言层模式,暂时不要改写。
对于“humanize paper”“rebuild the narrative”“improve the logic”“去 AI 味”或“润色成人写的”等学术写作请求,Codex 也可以自动选择该 skill。
包含的工具
SKILL.md:工作流、权限、停止条件与输出契约。signal-catalog.md:结构问题和语言问题的实例。community-lexicon.md:社区术语、内部工件命名和中文写作 pattern。manuscript-reconstruction.md:完整稿件路径。diagnose.py:只定位候选、不输出 AI 分数的标准库脚本。verify_invariants.py:检查受保护 span 和语义风险标记是否发生变化。
运行测试:
python3 -m unittest discover -s humanize-paper/scripts -p 'test_*.py'
Invariant checker 能发现一部分具体错误,但不能证明两段文字语义等价。术语、命名实体、citation scope 和 discourse relations 仍需结合上下文阅读。