隐私与数据安全

March 31, 2026 · View on GitHub

本文档说明心译如何处理你的数据,以及你可以做什么来最大化隐私保护。

README 快速导航 | 技术架构


数据存储

  • 所有数据本地存储,不上传到任何服务器
  • 训练数据、向量库、人格画像全部在 data/ 目录
  • 删除 data/ 目录 = 删除所有本地数据
  • .envconfig.yaml.gitignore 中,不会被提交到 Git

数据流向:什么会发送出去?

心译的数据请求分两种场景:

场景一:训练阶段

发送内容不发送内容
对话片段原文(分批,每次数十条)用于人格分析、信念提取、记忆提取一次性发送完整聊天记录;原始数据库文件

场景二:对话阶段

发送内容不发送内容
当前对话上下文 + 向量检索到的相关对话片段 + 真实聊天样本(few-shot)向量库全量数据

场景三:分析/报告

发送内容不发送内容
采样对话片段 + 统计摘要原始数据库文件

自动脱敏

系统已自动脱敏以下信息类型:

类型示例
手机号138****1234
身份证号110***********1234
邮箱地址u***@example.com

无法完全自动脱敏:聊天中的姓名、地址、公司名等自然语言信息,仍可能包含在发送内容中。如需严格处理,请在导入前手动编辑或脱敏原始数据。


完全离线方案

如需所有数据完全不离开本机,可在 config.yaml 中配置 OllamavLLM 等本地推理服务(需 OpenAI 兼容格式):

api:
  provider: "openai"        # Ollama/vLLM 也走 OpenAI 兼容接口
  api_key: "ollama"         # Ollama 不需要真实 Key
  base_url: "http://localhost:11434/v1"
  model: "llama3"           # 你本地的模型名

嵌入/重排/情感分类等本地小模型(见 架构文档)始终在本地运行,不调用任何外部 API。


重要声明

  • 本工具仅供用户操作本人微信账号的数据。请勿用于获取、解密或分析他人账号数据。
  • 解密过程涉及读取微信进程内存中的加密密钥和 ad-hoc 重签名(macOS),使用前请知悉相关技术风险。
  • 项目仅用于个人学习和研究目的。开发者不对任何滥用行为承担责任。
  • 使用本工具即表示你已理解上述声明,并自行承担使用风险。