00.background.md

May 31, 2026 · View on GitHub

1. 产品概述 产品名称:Lemontea 产品定位:一款面向桌面场景的跨平台 AI 客户端,提供对话交互、多模型接入、工具调用、多 Agent 协作、记忆管理与插件扩展能力。 产品目标:帮助用户在本地桌面环境中,以更安全、可配置、可扩展的方式完成 AI 辅助问答、任务执行和复杂工作流协作。

2. 目标用户

  1. 个人效率用户 需要一个可在本地桌面使用的 AI 助手,完成问答、写作、总结、翻译、代码辅助等日常任务。
  2. 开发者与技术用户 希望接入本地模型、调用 Shell/文件工具、配置 MCP Server、扩展插件,并观察 AI 执行过程。
  3. 重度 AI 工作流用户 需要多 Agent 协作、任务规划、分步执行、结果审核与重试机制,以处理复杂任务。
  4. 高度个性化配置用户 希望自定义模型、Prompt、Skill、Agent,并构建适合自己工作方式的 AI 工作台。

3. 核心场景

  1. 日常对话场景 用户发起多轮聊天,查看流式回复、推理过程、代码高亮和附件内容,并管理历史会话。
  2. 模型切换与配置场景 用户配置不同模型供应商,拉取模型列表,选择默认模型或切换到特定模型执行任务。
  3. 工具执行场景 用户让 AI 读取文件、执行命令、等待任务完成或调用插件工具;涉及风险操作时,由用户审批。
  4. 复杂任务协作场景 用户提出复杂目标后,系统自动进入多 Agent 工作流,完成任务拆解、执行、汇总、审核与重试。
  5. 长期记忆场景 用户希望系统记住偏好、历史信息和上下文,在后续对话中提供更连贯、更个性化的响应。
  6. 扩展集成场景 用户导入 MCP Server、本地插件或自定义 Skill,扩展系统能力边界。
  7. 初次安装与上手场景 用户首次打开应用,通过引导流程快速选择供应商并完成基础配置,进入主工作界面。

4. 功能模块 4.1 聊天与会话管理

  1. 支持多轮对话。
  2. 支持流式输出与手动停止生成。
  3. 支持 Markdown 渲染与代码高亮。
  4. 支持展示推理过程消息。
  5. 支持本地文件附件与图片预览。
  6. 支持会话创建、重命名、删除、收藏。
  7. 支持自动生成会话标题。
  8. 支持历史消息分页加载与查看。

4.2 模型供应商与模型管理

  1. 支持多个模型供应商接入。
  2. 支持 OpenAI 兼容接口类供应商配置。
  3. 支持本地模型与远程模型并存。
  4. 支持从供应商接口拉取模型列表。
  5. 支持设置供应商默认模型。
  6. 支持新增、删除自定义模型。
  7. 支持记录本地默认聊天模型。

4.3 Agent 系统

  1. 提供系统内置 Agent 角色体系。
  2. 根据任务复杂度选择直接回答或工作流执行。
  3. 支持子 Agent 委派。
  4. 支持用户创建自定义 Agent。
  5. 支持为 Agent 绑定 Prompt、工具和 Skill。
  6. 支持在设置中心查看和维护 Agent。

4.4 工作流编排

  1. 支持复杂任务的分阶段执行。
  2. 支持任务拆解与依赖关系管理。
  3. 支持并行批次执行。
  4. 支持汇总、审核与重试。
  5. 支持中断后任务恢复。
  6. 支持输出最终执行结果和中间轨迹。

4.5 工具系统与审批

  1. 提供内置工具能力,如时间、日期、文件、Shell、等待。
  2. 支持 AI 在对话中调用工具。
  3. 支持工具审批机制,包括允许、拒绝、自定义反馈。
  4. 支持审批超时与审批历史记录。
  5. 支持风险工具调用前的人机确认。

4.6 MCP 接入

  1. 支持从本地目录导入 MCP Server。
  2. 支持启用、禁用和删除 MCP 工具。
  3. 支持 MCP Server 元数据识别与描述展示。
  4. 支持 MCP 进程生命周期管理。
  5. 支持把 MCP 工具纳入 Agent 可调用工具集合。

4.7 插件系统

  1. 支持从本地目录安装插件。
  2. 支持启用、禁用、删除插件。
  3. 支持插件运行时状态查看与下载。
  4. 支持插件设置页、插件视图页。
  5. 支持插件工具调用与连接测试。
  6. 支持插件能力映射为 AI 可用工具。

4.8 记忆系统

  1. 支持从对话中自动提取记忆。
  2. 支持记忆的编码、整合、遗忘、矛盾检测。
  3. 支持关键词与语义混合检索。
  4. 支持配置嵌入模型与检索策略。
  5. 支持在实验或设置页面启用/关闭记忆相关能力。

4.9 Skill 与 Prompt 管理

  1. 支持创建、编辑、删除 Skill。
  2. 支持 Skill 标签分类。
  3. 支持从本地目录导入 Skill。
  4. 支持 Prompt 浏览、编辑与保存。
  5. 支持 Prompt 恢复默认值。
  6. 支持把 Skill 绑定到自定义 Agent。

4.10 设置与初始化引导

  1. 提供首次启动引导页。
  2. 支持用户在引导阶段选择供应商并填写 API 信息。
  3. 提供统一设置中心。
  4. 设置中心至少包含:通用、模型供应商、Agent、Skill、插件、Prompt、记忆、关于。
  5. 支持语言与字体大小设置。
  6. 支持实验室功能开关。

4.11 国际化

  1. 支持中文和英文。
  2. 支持前后端统一国际化资源。
  3. 支持动态切换语言。
  4. 支持 Prompt 与界面文案语言适配。

4.12 特殊模式:OPC

  1. 支持创建 AI 角色与角色资料。
  2. 支持角色绑定独立 Agent 配置。
  3. 支持创建群组与群聊式交互。
  4. 支持角色头像、本地资料管理与对话清理。
  5. 作为扩展能力,服务于多角色协作或人格化交互场景。

5. 非功能需求 5.1 平台与兼容性

  1. 支持 macOS、Windows、Linux。
  2. 预留 iOS、Android 构建能力。
  3. 支持桌面模式与服务端模式扩展。

5.2 性能

  1. 聊天回复需支持流式低延迟输出。
  2. 长任务执行过程中界面需保持可响应。
  3. 历史消息、会话列表和设置页面加载应可接受。
  4. 多 Agent 并发执行时需具备稳定的调度能力。

5.3 可靠性

  1. 应用重启后可恢复部分运行中任务。
  2. 插件、MCP、模型调用失败时需有明确错误反馈。
  3. 工具执行异常不能导致主程序崩溃。
  4. 关键配置和聊天数据需可靠持久化。

5.4 安全性

  1. API Key 等敏感信息需本地安全存储。
  2. Shell、文件等高风险工具需支持审批控制。
  3. 插件和 MCP 接入需具备基本隔离和可控启停能力。
  4. 用户本地数据默认不应无提示外发。

5.5 可扩展性

  1. 模型供应商接入方式应可扩展。
  2. 工具、Skill、Prompt、插件、MCP 都应支持增量扩展。
  3. Agent 类型与工作流节点应便于新增。

5.6 可观察性

  1. 提供任务轨迹、工具调用和阶段状态可视化。
  2. 支持查看审批决策与执行细节。
  3. 为调试复杂任务保留必要的运行痕迹。

5.7 易用性

  1. 首次上手流程要清晰。
  2. 设置项应集中管理、分类明确。
  3. 移动尺寸窗口和桌面尺寸窗口都应有可用体验。
  4. 用户无需理解底层架构即可完成基础使用。

如果你需要,我可以继续把这份提纲往下展开成“完整 PRD 初稿”,补上每个模块的“目标、输入输出、关键流程、验收标准”。