概述
July 19, 2026 · View on GitHub
X-AnyLabeling 的聊天机器人是集成在标注流程中的 AI 助手,可与大语言模型(LLM)进行自然语言交互、批量处理图文问答数据,并导入或导出单轮及多轮对话数据。导出的多模态数据采用 ShareGPT 格式,可用于 LLaMA-Factory 等大模型微调框架。
入门
访问聊天机器人
要打开聊天机器人,请点击 X-AnyLabeling 中左侧工具栏的聊天机器人图标或使用如下快捷键快速启动聊天机器人对话界面。
- Windows/Linux:
Ctrl+1 - macOS:
⌘+1
初始设置
首次启动时,您需要在 Chatbot 聊天窗口的右侧面板中配置必要的 API 凭据和模型。
用户界面
该聊天机器人具有一个三面板界面,旨在简化交互。
左侧面板:模型提供商
| 提供商 | API 密钥 | API 文档 | 模型文档 |
|---|---|---|---|
| Anthropic | 链接 | 链接 | 链接 |
| DeepSeek | 链接 | 链接 | 链接 |
| Google AI | 链接 | 链接 | 链接 |
| Ollama | - | 链接 | 链接 |
| OpenAI | 链接 | 链接 | 链接 |
| OpenRouter | 链接 | 链接 | 链接 |
| Qwen | 链接 | 链接 | 链接 |
Note
Custom 提供商支持配置与 OpenAI API 兼容的自定义端点。切换提供商后,模型列表会自动更新为当前提供商的可用模型。
中间面板:聊天界面
- 聊天窗口:查看您与 AI 的对话历史,支持复制、编辑、删除、重新运行功能
- 消息输入:输入您的问题或指令,支持一键清除当前对话历史记录
- 特殊命令:导入图像后,使用
@image提示包含当前图像
右侧面板:图像预览与设置
- 图像预览:显示当前图像。
- 功能组件:切换图像、导入单个图像或目录、导出标注结果以及批量处理图像。
- 后端设置:配置 API 端点、密钥和模型。
- 生成参数:设置系统提示词、温度和最大输出长度。
关键特性
视觉问答
针对当前图像提问,生成单轮或多轮图文对话:
@image 请描述这张图像。
图像批量处理
使用相同的提示处理多张图片以加快工作流程:
- 加载一个图片文件夹
- 点击“运行所有图片”按钮
- 输入要应用于所有图片的提示
- 可设置并发数以控制处理速度(默认值为 CPU 核心数的 80%,最大值为 95%)
数据集导入/导出
支持导入和导出 ShareGPT 格式的多模态图像数据。
其他
配置文件
聊天机器人将其配置存储在用户目录下的如下位置:
~/xanylabeling_data/chatbot/
其中包括:
models.json:包含用户偏好设置和模型配置providers.json:API 提供商设置