隐私与数据安全
March 31, 2026 · View on GitHub
本文档说明心译如何处理你的数据,以及你可以做什么来最大化隐私保护。
数据存储
- 所有数据本地存储,不上传到任何服务器
- 训练数据、向量库、人格画像全部在
data/目录 - 删除
data/目录 = 删除所有本地数据 .env和config.yaml在.gitignore中,不会被提交到 Git
数据流向:什么会发送出去?
心译的数据请求分两种场景:
场景一:训练阶段
| 发送内容 | 不发送内容 |
|---|---|
| 对话片段原文(分批,每次数十条)用于人格分析、信念提取、记忆提取 | 一次性发送完整聊天记录;原始数据库文件 |
场景二:对话阶段
| 发送内容 | 不发送内容 |
|---|---|
| 当前对话上下文 + 向量检索到的相关对话片段 + 真实聊天样本(few-shot) | 向量库全量数据 |
场景三:分析/报告
| 发送内容 | 不发送内容 |
|---|---|
| 采样对话片段 + 统计摘要 | 原始数据库文件 |
自动脱敏
系统已自动脱敏以下信息类型:
| 类型 | 示例 |
|---|---|
| 手机号 | 138****1234 |
| 身份证号 | 110***********1234 |
| 邮箱地址 | u***@example.com |
无法完全自动脱敏:聊天中的姓名、地址、公司名等自然语言信息,仍可能包含在发送内容中。如需严格处理,请在导入前手动编辑或脱敏原始数据。
完全离线方案
如需所有数据完全不离开本机,可在 config.yaml 中配置 Ollama 或 vLLM 等本地推理服务(需 OpenAI 兼容格式):
api:
provider: "openai" # Ollama/vLLM 也走 OpenAI 兼容接口
api_key: "ollama" # Ollama 不需要真实 Key
base_url: "http://localhost:11434/v1"
model: "llama3" # 你本地的模型名
嵌入/重排/情感分类等本地小模型(见 架构文档)始终在本地运行,不调用任何外部 API。
重要声明
- 本工具仅供用户操作本人微信账号的数据。请勿用于获取、解密或分析他人账号数据。
- 解密过程涉及读取微信进程内存中的加密密钥和 ad-hoc 重签名(macOS),使用前请知悉相关技术风险。
- 项目仅用于个人学习和研究目的。开发者不对任何滥用行为承担责任。
- 使用本工具即表示你已理解上述声明,并自行承担使用风险。