AI 服务运行时架构

July 27, 2026 · View on GitHub

定位

本仓是 Pallas-Bot 的可选媒体后端:唱歌、TTS 等异步任务,以及可选的遗留酒后 RWKV。
通用 LLM 闲聊与工具循环在 Bot 内核pallas/product/llm),不经本仓 Chat API。

为何 uvicorn + Celery

组件职责
uvicorn (FastAPI)健康检查、短同步 API、立即返回 task_id
RedisCelery broker / result backend
Celery worker长耗时媒体推理 + callback Bot

媒体与遗留聊天

能力典型 API说明
唱歌 / TTS/v1/sing/*/v1/tts/*(推荐);/api/* 兼容主路径媒体任务;/v1 在配置 Token 时强制 Bearer
媒体任务 / 模型/v1/media/*voices、defaults、异步任务等
酒后 RWKVPOST /api/chat/{id}可选遗留路径;与 Bot 内核 Provider 聊天无关

任务完成后经 /callback 回推 Bot。群口令侧见官方扩展 Plugin-Ai-Media

与 Bot 的边界

  • Bot 配置 AI_SERVER_HOST / AI_SERVER_PORT(或 WebUI「媒体服务」)仅用于媒体与可选 RWKV。
  • @ 闲聊、接话辅助、工具调用由 Bot 内核 Provider 完成;:9099 不可达不影响默认聊天。