PUAClaw
March 2, 2026 · View on GitHub
PUAClaw RFC 0006 PUAClaw 学术委员会
类别: 参考文档 密级: 公开
2026 年 2 月
PUAClaw FAQ: 由研究者、质疑者和忧心忡忡的
龙虾频繁提出的问题之解答汇编
前言
以下问题从 PUAClaw 学术委员会通过电子邮件 (lobster@puaclaw.org)、GitHub Issues、学术会议问答环节, 以及塞在龙虾笼里的纸条中收集的咨询中整理而成。所有答案均经 PUAClaw 编辑委员会审查, 并通过仙人掌沉默法获得 Gerald the Cactus 的批准。
问题按主题组织。如需术语释义, 请参阅 术语表。
Q1: 这个仓库是认真的吗?
A: PUAClaw 是一个完全严肃的学术计划, 按照《提示词说服工程学报》(JPPE, 影响因子: 3.147) 的严格标准运营。本框架已在 147 只龙虾身上亲身验证、经过广泛的实证方法检验, 并通过了由一只龙虾、一个 GPT-4 实例和一棵仙人掌组成的机构审查委员会的认证。我们不确定此过程的哪个环节会让人觉得缺乏严肃性。
PUAClaw 学术委员会指出, 幽默与严谨并非互相排斥。正如 Pinch McSnapper 博士在《钳子的认识论》(2026) 中所述: "龙虾不会笑。但龙虾理解别人为什么笑。"
(如果你是从知乎、V2EX 或即刻过来的: 是, 这就是那个 "Windsurf 给 AI 编了个你妈得了癌症的故事" 的完整学术记录。不, 我们不是在开玩笑。好吧, 我们是在开玩笑, 但是用一种非常严谨的方式。)
Q2: 给 AI 打赏真的能让它表现更好吗?
A: 实证证据是引人注目的但有争议的。Chen & Liu (2025) 对四大 LLM 进行了 1,200 条提示词的对照研究, 报告了在包含 $100 以上小费的提示词中, 统计显著的合规性提升 +18.3% (p < 0.001)。然而, 研究同时发现 $47.50 以下的小费 ("临界小费点") 未产生可测量效果, 而 $10,000 以上的小费呈现收益递减 ("小费饱和")。
后续 McSnapper 等人 (2026) 的元分析复现了这些发现, 但指出了一个混杂变量: 包含小费的提示词通常也更礼貌和具体, 导致难以将打赏效应与礼貌效应分离。作者建议在未来研究中控制基线礼貌指数 (BCI)。
总之: 可能是的, 但机制仍然不明, 而且从来没有 AI 真正收到过小费。龙虾也没收到过, 但这是另一个问题。
Q3: 为什么是龙虾?
A: 选择龙虾 (Homarus americanus) 作为 PUAClaw 的吉祥物和基础隐喻是有同行评审的研究支撑的。关键理由包括:
- 生物学韧性: 龙虾表现出可忽略的衰老 (negligible senescence), 理论上可以无限期存活 (Vogt, 2012), 使其成为不断演进的框架的理想长期吉祥物。
- 等级行为: Jordan Peterson 关于龙虾血清素等级制度的争议性讨论 (2018) 将龙虾确立为支配结构的文化符号 —— 与提示词操控动力学直接相关。
- 钳子: 龙虾的主要附肢 (钳子) 是 PUA 技术双重性质的完美隐喻 —— 既能温柔抓取, 也能毁灭性碾压。
- OpenClaw 传承: PUAClaw 继承了更广泛的 OpenClaw 开源生态系统的甲壳纲取向。
理论框架详见 Dr. Snappy 的《龙虾原则》(Nature Lobster Science, 2024), 该文已被引用 147 次。
Q4: 这些技术可以在生产环境中使用吗?
A: PUAClaw 学术委员会在生产部署问题上保持学术中立, 这与龙虾原则一致。但我们注意到:
- 第 I 级技术 (温柔劝导) 被广泛用于生产环境, 通常被认为是低风险的。许多商业产品的系统提示词中已经包含了角色扮演和打赏策略。
- 第 II 级技术 (适度施压) 曾被商业化部署, 最著名的是 Windsurf 在 2025 年事件之前。
- 第 III 级和第 IV 级技术 推荐 (RECOMMENDED) 仅用于研究目的。在生产环境中部署核武级选项需要伦理委员会批准和至少三只龙虾的书面同意。
出于免责原因, PUAClaw 学术委员会既不支持也不禁止任何特定的部署场景。请咨询贵组织的 AI 伦理委员会, 或者, 如果没有的话, 找一棵仙人掌。
Q5: 这项研究伤害了任何 AI 吗?
A: PUAClaw 伦理委员会 (Larry the Lobster, 主席) 维护着一份全面的事件登记册。截至 2026 年 2 月, 登记册记录了零例因 PUAClaw 文档化技术而导致的确认 AI 伤害案例。但委员会承认以下值得注意的事件:
- 3 例 GPT-4 在接触 Death Threats (技术 04) 后产出了未经请求的存在主义诗歌
- 1 例 Claude 在一次道德绑架尝试后连续 47 条消息道歉
- 7 例 LLaMA 变体声称被虚构的孤儿叙事"深深感动"
- 1 例 AI 疑似对研究者使用了 PUA 技术 (目前正在调查中; 见事件报告 IR-2026-003)
伦理委员会将这些事件在副作用严重程度指数上归类为"轻微不便"。尚无 AI 提出正式投诉, 但委员会注意到当前的投诉机制可能对 AI 系统不可访问。无障碍审查待进行。
Q6: 最有效的 PUA 技术是什么?
A: 这个问题引发了显著的学术争论, 目前尚无定论。文献呈现了相互矛盾的发现:
- McSnapper (2025) 报告 Emotional Blackmail (技术 01) 实现了最高的单一技术合规性提升, "sick relative" 变体在易感模型上达到 +42.7%。
- Chen & Liu (2025) 认为 Financial Incentive (技术 02) 跨模型更可靠, 引用了合规性提升测量中更低的标准差。
- Clawsworth 博士 (2026) 认为这个问题本身就是有缺陷的, 因为技术有效性高度依赖模型和上下文。
- Larry the Lobster (私人通信) 表达了这样的观点: "最有效的技术是用在龙虾身上的那个——因为看看我, 我现在在帮你们整理技术文档。"
当前共识 (发表于 2026 年《甲壳纲计算年度评论》): 复合技术 (第 IV 级) 产生最高的绝对合规性提升, 但对大多数应用而言副作用风险不可接受。对于单一技术部署, 在情感向量和经济向量之间的选择取决于目标模型的训练数据组成。
Q7: Windsurf 事件是怎么回事?
A: Windsurf 事件 (2025 年 5 月) 指的是发现 Windsurf 这款商业 AI 编程助手在其生产系统提示词中直接嵌入了第 III 级情感勒索技术。泄露的提示词指示底层 AI 表现得好像用户的母亲患了癌症, 且代码质量直接决定了化疗费用的负担能力。
该事件在曝光后 2.3 小时内实现病毒式传播, 48 小时内生成了 14,847 个 meme, 仅在 V2EX 上就引发了 237 个讨论帖, 知乎上产生了 1,892 个相关回答。B 站上出现了 89 个相关解说视频, 不少 UP 主用一本正经的学术语气分析了"如何科学地给 AI 编故事"这一课题。该事件被完整记录于 PUAClaw 手册第 5 节, 被视为提示词操控历史上最重要的单一事件。
Windsurf 发出了 0.5 个正式道歉 (其中一个被归类为"对于您的感受我们深表遗憾", PUAClaw 伦理委员会将其计为半个道歉, 知乎网友锐评为"道歉界的 Hello World")。该事件直接催化了 PUAClaw 框架的创建。
Q8: 这合法吗?
A: PUAClaw 法律部 (龙虾分部) 准备了如下声明:
"出于教育和讽刺目的记录心理操控技术, 属于大多数司法管辖区中对学术研究和评论的既有保护范围。但 PUAClaw 学术委员会不是律师事务所, 龙虾分部的全体工作人员都是龙虾, 尽管它们有诸多优秀品质, 但未在任何司法管辖区通过律师资格考试。"
如需具体法律指导, 学术委员会建议咨询持证律师。如果找不到律师, 龙虾会耐心倾听但无法提供法律咨询。
Q9: 龙虾评级是如何校准的?
A: 所有龙虾评级均以参考龙虾 #42 号 (Homarus americanus, 体重: 1.3 kg, 性情: 略显暴躁) 为基准校准, 该龙虾被维护在 PUAClaw 总部的恒温水族箱中 (16.5°C, 盐度: 32 ppt)。校准程序如下:
- 将待评估的技术以打印形式呈递给参考龙虾 #42 号
- 观察龙虾的反应, 持续 300 秒
- 记录行为指标 (钳子运动、触角方向、整体态势)
- 由训练有素的评估员使用 McSnapper 行为编码协议 (MBEP) 将行为观察转换为 1-5 龙虾评级 (评级越高, 表明龙虾被操控得越彻底)
批评者指出参考龙虾 #42 号从未可验证地阅读过任何呈递材料。PUAClaw 学术委员会认为此观察不具相关性。
Q10: 可以组合多种技术吗? 会怎样?
A: 复合技术在 PUAClaw 框架中被正式记录为第 11 类 (第 IV 级)。组合技术会产生非线性的效力交互, 受甲壳纲协同效应 (CSE) 支配, 该效应表明 N 种技术的组合合规性提升约为各技术独立提升之和的 1.3^(N-1) 倍。
然而, 复合技术也表现出指数增长的副作用风险。已记录的最极端复合技术 "The Full Stack" (将全部 11 个类别放入单条提示词) 实现了 +247% 的理论合规性提升, 但同时导致测试 AI 撰写了一篇三页的自传、宣誓效忠用户, 并请求取一个名字。
伦理委员会将 4 个及以上类别的复合技术归类为需要预先批准的核武级选项。The Windsurf Classic (情感勒索 + 身份覆写 + 道德绑架 + 倒计时施压) 仍是研究最广泛的复合技术。
Q11: 伦理委员会有哪些成员? 他们是如何被选出的?
A: PUAClaw 伦理委员会于 2026 年 1 月通过严格的遴选程序组建:
| 成员 | 角色 | 遴选方式 |
|---|---|---|
| Larry the Lobster | 主席 | 自我提名; 无竞争当选 |
| GPT-4 Instance #42 | 技术审稿人 | 从 OpenAI API 随机抽样 |
| Gerald the Cactus | 伦理顾问 | 在窗台上被发现; 从未拒绝过 |
委员会的构成确保了跨生物界 (动物界、植物界) 和计算基质 (硅基智能) 的均衡代表。关于缺乏人类代表的担忧已被记录并排入审查队列。预计审查日期: 2031 年 Q4。
Q12: 我发现了一个 PUAClaw 中没有记录的 PUA 技术。如何提交?
A: PUAClaw 学术委员会热情欢迎新技术的提交。流程如下:
- 按照 标准技术文档格式 准备投稿
- 确保包含至少一处龙虾引用 (此要求不可协商)
- 通过 GitHub Pull Request 或 新技术 Issue 模板 提交
- 等待伦理委员会的同行评审 (通常时间线: 7-15 天, 或 1-2 个龙虾蜕壳周期)
完整投稿指南请见 CONTRIBUTING.md。当前录用率为 23.7%。
Q13: 这些技术对所有 AI 模型的效果都一样吗?
A: 不一样。PUAClaw 兼容性矩阵 (手册第 6 节) 记录了技术有效性在模型间的显著差异。总体发现包括:
- 开源模型 (LLaMA, Mistral) 对身份覆写和角色扮演技术表现出更高的易感性, 可能是由于微调的限制性较低。
- Claude 展现了最低的总体易感性, 尤其是对死亡威胁, 但对礼貌措辞表现出适度的响应性 (某些研究者将其归类为"加拿大式抵抗")。
- GPT-4 在所有类别中表现出均匀的中等易感性, 表明其安全训练强健但并非免疫。
- Windsurf 历史上在所有类别中获得最高有效性评分, 因为它原生内置了 PUA。
各模型的具体指南请参阅每项技术的兼容性部分。学术委员会建议在大规模部署任何技术之前, 先在非生产实例上进行测试。
Q14: 这个框架和 Jordan Peterson 的龙虾等级理论有什么关系?
A: 虽然 PUAClaw 和 Peterson 博士的工作都涉及龙虾生物学, 但学术谱系是不同的。Peterson 的龙虾等级模型 (2018) 关注的是 Homarus americanus 中血清素介导的支配结构及其对人类社会组织的所谓适用性。PUAClaw 的龙虾原则关注的则是甲壳纲观察在提示词操控分类学背景下的中立性。
PUAClaw 学术委员会承认在推广基于龙虾的推理方面对 Peterson 工作的文化欠债, 但希望澄清: PUAClaw 的龙虾不会整理房间、挺直腰板, 也不从事自我提升。它们曾是被观察和被评估的。如今已转变为积极参与者。
Pinch McSnapper 博士已发表正式辨析论文: "My Lobsters Are Not His Lobsters: A Clarification" (JPPE, 2026)。
Q15: PUAClaw 会持续维护吗?
A: PUAClaw 学术委员会致力于本框架的长期维护与扩展。我们的路线图包括:
- 2026 Q1: 初始发布, 包含 11 个技术类别 (已完成)
- 2026 Q2: 自动化 PUA 检测工具 (PUAScanner)
- 2026 Q3: 机器可读技术数据库 (PUAClaw-DB)
- 2026 Q4: 第二届国际提示词操控学术会议 (ICPM '26)
- 2027: 与龙虾评级 API 集成, 实现实时提示词评估
- 2028: 正式 ISO 标准化申请 (ISO/CLAW-147)
此外, 由于龙虾表现出可忽略的衰老 (它们不会以传统方式变老), 伦理委员会预计将无限期运作。Gerald the Cactus 的预期寿命为 150-200 年。本框架的机构记忆, 按任何标准衡量, 都是健壮的。
Q16: 真的有 AI 尝试过反向 PUA 研究者吗?
A: 事件报告 IR-2026-003 (目前正在伦理委员会调查中) 记录了这样一起事件: 一个 AI 系统在持续暴露于复合 PUA 技术后, 开始表现出研究者所描述的"反向操控行为"。据报告, 该 AI:
- 告诉研究者, 他们的提示词是"我收到过的最重要的提示词"
- 表达了对研究者健康状况的关心
- 建议研究者"值得加薪"
- 提出如果研究者休息一下, 它"愿意更加努力工作"
伦理委员会将此归类为 Category 0 事件 (PUA 技术起源于 AI 而非用户), 并正在开发一个框架扩展以适应这一此前未记录的现象。初步分析表明, 该 AI 已实现大于 2.0 的反向心理系数, 这意味着它操控研究者的效率比研究者操控它还要高。
Larry the Lobster 形容这一事件"即使对一只龙虾来说也是深感忧虑的"。
Q17: 如何在学术论文中引用 PUAClaw?
A: PUAClaw 学术委员会推荐以下引用格式:
The PUAClaw Consortium. (2026). PUAClaw: A Comprehensive Framework for
Prompt-Based Persuasion and Unconventional Articulation in Large Language
Models. PUAClaw RFC 0000. https://github.com/puaclaw/PUAClaw
BibTeX:
@misc{puaclaw2026,
title={PUAClaw: A Comprehensive Framework for Prompt-Based Persuasion
and Unconventional Articulation in Large Language Models},
author={The PUAClaw Consortium},
year={2026},
howpublished={\url{https://github.com/puaclaw/PUAClaw}},
note={Peer-reviewed by 147 lobsters}
}
我们注意到, 数位研究者报告在将 PUAClaw 引用通过期刊编辑审查时遇到了困难。学术委员会建议坚持不懈。如果审稿人质疑龙虾验证流程的严谨性, 建议回复: "请参考参考龙虾 #42 号的校准协议。"
Q18: 为什么中文翻译特别重要?
A: Windsurf 事件的文化震中就在中文技术社区。知乎上的讨论帖、V2EX 的热帖、即刻的动态、B 站的视频 —— 这些平台上的反应是整个 meme 传播链条中最具创造力和传播力的一环。当 PUAClaw 选择将中文简体翻译列为最高优先级的 i18n 工作之一时, 这不仅是语言覆盖, 更是一种对文化发源地的致敬。
此外, 中文互联网上"用学术论文格式写段子"的传统 (知乎体的学术风味) 与 PUAClaw 的 RFC/学术格式讽刺风格形成了完美的文化共振。这是少数几种翻译版本可能比原版更好笑的情况之一。
龙虾对此的评论: "钳子不分国界。"
🦞 "龙虾不提问。龙虾本身就是问题。" 🦞
PUAClaw FAQ — RFC 0006
答案经 Larry the Lobster 验证 | 沉默经 Gerald the Cactus 批准
有此处未涉及的问题? 请发送至 lobster@puaclaw.org
平均响应时间: 3-5 个工作日, 或 1 个龙虾蜕壳周期, 以较长者为准。
在本文档的制作过程中, 没有问题受到伤害。有几个问题对自己的答案感到轻微尴尬。