00.background.md
May 31, 2026 · View on GitHub
1. 产品概述 产品名称:Lemontea 产品定位:一款面向桌面场景的跨平台 AI 客户端,提供对话交互、多模型接入、工具调用、多 Agent 协作、记忆管理与插件扩展能力。 产品目标:帮助用户在本地桌面环境中,以更安全、可配置、可扩展的方式完成 AI 辅助问答、任务执行和复杂工作流协作。
2. 目标用户
- 个人效率用户 需要一个可在本地桌面使用的 AI 助手,完成问答、写作、总结、翻译、代码辅助等日常任务。
- 开发者与技术用户 希望接入本地模型、调用 Shell/文件工具、配置 MCP Server、扩展插件,并观察 AI 执行过程。
- 重度 AI 工作流用户 需要多 Agent 协作、任务规划、分步执行、结果审核与重试机制,以处理复杂任务。
- 高度个性化配置用户 希望自定义模型、Prompt、Skill、Agent,并构建适合自己工作方式的 AI 工作台。
3. 核心场景
- 日常对话场景 用户发起多轮聊天,查看流式回复、推理过程、代码高亮和附件内容,并管理历史会话。
- 模型切换与配置场景 用户配置不同模型供应商,拉取模型列表,选择默认模型或切换到特定模型执行任务。
- 工具执行场景 用户让 AI 读取文件、执行命令、等待任务完成或调用插件工具;涉及风险操作时,由用户审批。
- 复杂任务协作场景 用户提出复杂目标后,系统自动进入多 Agent 工作流,完成任务拆解、执行、汇总、审核与重试。
- 长期记忆场景 用户希望系统记住偏好、历史信息和上下文,在后续对话中提供更连贯、更个性化的响应。
- 扩展集成场景 用户导入 MCP Server、本地插件或自定义 Skill,扩展系统能力边界。
- 初次安装与上手场景 用户首次打开应用,通过引导流程快速选择供应商并完成基础配置,进入主工作界面。
4. 功能模块 4.1 聊天与会话管理
- 支持多轮对话。
- 支持流式输出与手动停止生成。
- 支持 Markdown 渲染与代码高亮。
- 支持展示推理过程消息。
- 支持本地文件附件与图片预览。
- 支持会话创建、重命名、删除、收藏。
- 支持自动生成会话标题。
- 支持历史消息分页加载与查看。
4.2 模型供应商与模型管理
- 支持多个模型供应商接入。
- 支持 OpenAI 兼容接口类供应商配置。
- 支持本地模型与远程模型并存。
- 支持从供应商接口拉取模型列表。
- 支持设置供应商默认模型。
- 支持新增、删除自定义模型。
- 支持记录本地默认聊天模型。
4.3 Agent 系统
- 提供系统内置 Agent 角色体系。
- 根据任务复杂度选择直接回答或工作流执行。
- 支持子 Agent 委派。
- 支持用户创建自定义 Agent。
- 支持为 Agent 绑定 Prompt、工具和 Skill。
- 支持在设置中心查看和维护 Agent。
4.4 工作流编排
- 支持复杂任务的分阶段执行。
- 支持任务拆解与依赖关系管理。
- 支持并行批次执行。
- 支持汇总、审核与重试。
- 支持中断后任务恢复。
- 支持输出最终执行结果和中间轨迹。
4.5 工具系统与审批
- 提供内置工具能力,如时间、日期、文件、Shell、等待。
- 支持 AI 在对话中调用工具。
- 支持工具审批机制,包括允许、拒绝、自定义反馈。
- 支持审批超时与审批历史记录。
- 支持风险工具调用前的人机确认。
4.6 MCP 接入
- 支持从本地目录导入 MCP Server。
- 支持启用、禁用和删除 MCP 工具。
- 支持 MCP Server 元数据识别与描述展示。
- 支持 MCP 进程生命周期管理。
- 支持把 MCP 工具纳入 Agent 可调用工具集合。
4.7 插件系统
- 支持从本地目录安装插件。
- 支持启用、禁用、删除插件。
- 支持插件运行时状态查看与下载。
- 支持插件设置页、插件视图页。
- 支持插件工具调用与连接测试。
- 支持插件能力映射为 AI 可用工具。
4.8 记忆系统
- 支持从对话中自动提取记忆。
- 支持记忆的编码、整合、遗忘、矛盾检测。
- 支持关键词与语义混合检索。
- 支持配置嵌入模型与检索策略。
- 支持在实验或设置页面启用/关闭记忆相关能力。
4.9 Skill 与 Prompt 管理
- 支持创建、编辑、删除 Skill。
- 支持 Skill 标签分类。
- 支持从本地目录导入 Skill。
- 支持 Prompt 浏览、编辑与保存。
- 支持 Prompt 恢复默认值。
- 支持把 Skill 绑定到自定义 Agent。
4.10 设置与初始化引导
- 提供首次启动引导页。
- 支持用户在引导阶段选择供应商并填写 API 信息。
- 提供统一设置中心。
- 设置中心至少包含:通用、模型供应商、Agent、Skill、插件、Prompt、记忆、关于。
- 支持语言与字体大小设置。
- 支持实验室功能开关。
4.11 国际化
- 支持中文和英文。
- 支持前后端统一国际化资源。
- 支持动态切换语言。
- 支持 Prompt 与界面文案语言适配。
4.12 特殊模式:OPC
- 支持创建 AI 角色与角色资料。
- 支持角色绑定独立 Agent 配置。
- 支持创建群组与群聊式交互。
- 支持角色头像、本地资料管理与对话清理。
- 作为扩展能力,服务于多角色协作或人格化交互场景。
5. 非功能需求 5.1 平台与兼容性
- 支持 macOS、Windows、Linux。
- 预留 iOS、Android 构建能力。
- 支持桌面模式与服务端模式扩展。
5.2 性能
- 聊天回复需支持流式低延迟输出。
- 长任务执行过程中界面需保持可响应。
- 历史消息、会话列表和设置页面加载应可接受。
- 多 Agent 并发执行时需具备稳定的调度能力。
5.3 可靠性
- 应用重启后可恢复部分运行中任务。
- 插件、MCP、模型调用失败时需有明确错误反馈。
- 工具执行异常不能导致主程序崩溃。
- 关键配置和聊天数据需可靠持久化。
5.4 安全性
- API Key 等敏感信息需本地安全存储。
- Shell、文件等高风险工具需支持审批控制。
- 插件和 MCP 接入需具备基本隔离和可控启停能力。
- 用户本地数据默认不应无提示外发。
5.5 可扩展性
- 模型供应商接入方式应可扩展。
- 工具、Skill、Prompt、插件、MCP 都应支持增量扩展。
- Agent 类型与工作流节点应便于新增。
5.6 可观察性
- 提供任务轨迹、工具调用和阶段状态可视化。
- 支持查看审批决策与执行细节。
- 为调试复杂任务保留必要的运行痕迹。
5.7 易用性
- 首次上手流程要清晰。
- 设置项应集中管理、分类明确。
- 移动尺寸窗口和桌面尺寸窗口都应有可用体验。
- 用户无需理解底层架构即可完成基础使用。
如果你需要,我可以继续把这份提纲往下展开成“完整 PRD 初稿”,补上每个模块的“目标、输入输出、关键流程、验收标准”。