经 AI Skill Hub 精选评估,开源AI工作流:多用户AI Agent框架 获评「推荐使用」。这款Agent工作流在功能完整性、社区活跃度和易用性方面表现出色,AI 评分 7.5 分,适合有一定技术背景的用户使用。
多用户AI Agent框架,支持角色扮演、工具调用和对话持久化,提高工作效率和智能化
开源AI工作流:多用户AI Agent框架 是一套完整的 AI Agent 自动化工作流方案。通过可视化的节点编排,将复杂的多步骤任务拆解为清晰的自动化流程,实现全程无人值守的智能处理。支持与数百种外部服务和 API 无缝集成,适合构建数据处理管线、业务自动化和 AI 辅助决策系统。
多用户AI Agent框架,支持角色扮演、工具调用和对话持久化,提高工作效率和智能化
开源AI工作流:多用户AI Agent框架 是一套完整的 AI Agent 自动化工作流方案。通过可视化的节点编排,将复杂的多步骤任务拆解为清晰的自动化流程,实现全程无人值守的智能处理。支持与数百种外部服务和 API 无缝集成,适合构建数据处理管线、业务自动化和 AI 辅助决策系统。
# 方式一:pip 安装(推荐)
pip install votx-agent
# 方式二:虚拟环境安装(推荐生产环境)
python -m venv .venv
source .venv/bin/activate # Windows: .venv\Scripts\activate
pip install votx-agent
# 方式三:从源码安装(获取最新功能)
git clone https://github.com/kesepain-KE/votx-agent
cd votx-agent
pip install -e .
# 验证安装
python -c "import votx_agent; print('安装成功')"
# 命令行使用
votx-agent --help
# 基本用法
votx-agent input_file -o output_file
# Python 代码中调用
import votx_agent
# 示例
result = votx_agent.process("input")
print(result)
# votx-agent 配置文件示例(config.yml) app: name: "votx-agent" debug: false log_level: "INFO" # 运行时指定配置文件 votx-agent --config config.yml # 或通过环境变量配置 export VOTX_AGENT_API_KEY="your-key" export VOTX_AGENT_OUTPUT_DIR="./output"
<p align="center"> <img src="votx-agent.png" width="168" alt="votx-agent logo"> </p>
<p align="center"> <strong>面向个人部署与跨终端自动化的本地多用户 Agent Framework。</strong> </p>
<p align="center"> 以统一对话引擎与 VOTX 多模态网关为核心,集成工具调用、任务计划、持久记忆、知识库、外部消息路由与全栈多模态能力,<br> 为个人智能助手、自动化工作流和多终端智能服务提供可部署、可扩展、可迁移的运行框架。 </p>
<p align="center"> <a href="./LICENSE"> <img src="https://img.shields.io/badge/license-MIT-orange" alt="license"> </a> <a href="https://www.python.org/"> <img src="https://img.shields.io/badge/python-3.10%2B-blue" alt="python"> </a> <a href="https://github.com/kesepain-KE/llm-adapter-votx"> <img src="https://img.shields.io/badge/provider-VOTX%20LLM%20Adapter-brightgreen" alt="provider"> </a> <a href="https://flask.palletsprojects.com/"> <img src="https://img.shields.io/badge/web-Flask%20%2B%20React%20%2B%20TypeScript-lightgrey" alt="web"> </a> </p>
<p align="center"> 中文 · <a href="./README_EN.md">English</a> </p>
[!NOTE] votx-agent 面向个人与小规模多用户部署,强调本地运行、统一工具链、多模态接入和跨平台消息交互。它与 kemo-agent 独立开发、独立维护,不存在继承关系。
| 子系统 | 主要能力 |
|---|---|
| 对话引擎 | Prompt 构建、流式响应、模型与工具多轮循环、历史提交 |
| Provider | VOTX LLM Adapter 与 OpenAI 兼容接口接入 |
| 多用户 | 配置、人格、历史、文件、知识库和任务独立隔离 |
| 工具系统 | 内置 Plugins 与用户 Skills 自动发现、加载与执行 |
| 多模态 | 识图、ASR、文生图、图像编辑、TTS、语音生语音、视频生成 |
| 任务计划 | 计划生成、审批、执行、暂停、恢复和终止 |
| 定时任务 | Cron 创建、更新、暂停、恢复、删除和立即执行 |
| 记忆系统 | 临时记忆、永久记忆、主动审阅与清理 |
| 知识库 | 用户私有知识库与全局共享知识库 |
| 消息路由 | OneBot、NapCat、Telegram、身份映射与附件处理 |
| Web 管理端 | Flask 后端、SSE 流式输出、React + TypeScript 前端 |
| Windows 打包 | PyInstaller 双 EXE,共享运行时,插件与技能外置 |
---
vision
audio_transcription
image_generation
image_edit
speech_generation
speech_to_speech
video_generation
模型选择优先级:
专用能力模型 > 默认聊天模型
python setup.py
python set_user.py add
python start_web.py
默认访问地址:
http://localhost:1478
python start.py
python start_web.py
python start_web.py --port=8080
python start_web.py --host=0.0.0.0 --port=1478
python update.py --dry-run
更新前建议手动备份 users/、skills/、.env 和消息私有配置。
---
votx-agent 使用统一的 VOTX Provider 实现。
配置中的 provider.type 保持为:
{
"provider": {
"type": "votx"
}
}
实际后端由 base_url 决定。
users/<name>/config.json
> 环境变量
> 程序默认值
| 配置文件 | 职责 |
|---|---|
config/config_core.json | 全局默认参数、历史、工具、任务、上下文窗口与改进配置 |
users/<name>/config.json | 用户 Provider、权限、技能、历史和任务设置 |
.env | 启动级参数、密钥与兼容兜底 |
message/config.local.json | 外部消息私有配置 |
message/config.json | 外部消息默认配置 |
---
VOTX_MESSAGE_CONFIG
> message/config.local.json
> message/config.json
/exit
/quit
/q
退出 CLI 时会自动执行摘要与保存。
---
框架优先使用专用 Skill 完成任务,例如:
shell 保留为诊断、构建和系统级操作能力,而不是所有任务的默认入口。
框架包含两类扩展目录:plugins/(内置基础能力)和 skills/(用户扩展能力)。更新脚本覆盖前者,保留后者。
当前内置 20 个 Skill,覆盖文件操作、命令执行、网络请求、下载、搜索、多模态处理(识图/ASR/文生图/图像编辑/TTS/语音转换/视频生成)、记忆管理、任务计划、定时任务、消息推送、知识库检索等场景。其中部分核心技能不可禁用以确保框架基础运行。
用户 Skill 可通过 override: true 覆盖同名内置 Skill。二进制文档处理由用户 Skill 或外部工具承担。
---
votx-agent 是一个专为个人部署设计的本地优先 AI Agent 框架。它具备强大的多用户数据隔离能力,支持 Web UI 与 CLI 双模式交互。框架集成了工具调用、任务计划、持久记忆及自我改进机制,并具备多模态处理能力(如 vision、audio_transcription 等),能够通过外部消息路由实现复杂的自动化任务,是一个高度可扩展的智能体平台。
本项目采用统一的 Provider 接口设计,通过 Kemo LLM Adapter 网关或任何兼容 OpenAI 的 API 进行驱动。核心特性包括:严格的多用户数据隔离(每个用户拥有独立的 config.json、记忆与知识库);Web 与 CLI 共用底层引擎;灵活的 Skills/Plugins 架构,支持用户自定义扩展;以及“工具优先”的工作流,优先使用专用 Skill 处理文件与网络任务,仅在必要时调用 shell 进行诊断。
运行 votx-agent 需要安装 Python 3.10 或更高版本,并确保系统中已安装 git。在进行系统更新时,建议通过执行 `python update.py --yes` 来完成备份、框架同步、配置处理及依赖刷新,以确保环境的稳定性。
首先通过 git 克隆仓库并进入目录。推荐使用 `python setup.py` 进行一键式安装,该脚本会自动处理 pip 依赖安装、前端(React/TypeScript)构建及环境验证。安装完成后,使用 `python set_user.py add` 创建用户并配置模型。最后通过 `python start_web.py` 启动 Web UI。请注意,若跳过 setup.py 直接启动,可能会导致前端页面无法正常显示。
用户可以通过 `python start_web.py` 启动 Web 界面,并支持通过参数自定义端口与 Host。对于模型配置,用户需在 `users/<用户名>/config.json` 中进行设置。系统支持多种模型选择,若需连接 Kemo 网关,请在配置文件中正确填写 `base_url` 与 `api_key`。此外,也可以通过设置环境变量作为配置的兜底方案。
项目的 Provider 配置通过 `config.json` 进行管理。虽然 provider type 统一设为 `kemo`,但 `base_url` 可以灵活指向任何兼容 OpenAI 标准的 API 服务。对于高级多模态能力(如 image_generation 或 speech_to_speech),可以通过在配置文件中设置 `capabilities_override` 来覆盖默认能力声明,从而实现对不同模型能力的精准控制。
除了 Web UI 模式,votx-agent 还提供 CLI 模式,用户可以通过执行 `python start.py` 直接在终端进行交互。框架设计充分考虑了兼容性,通过修改 `base_url` 和 `api_key` 即可轻松切换至其他 OpenAI 兼容 API,实现文本对话与工具调用的平滑过渡。
框架采用插件化架构管理能力:`plugins/` 目录存放框架内置的基础技能,由更新脚本维护;`skills/` 目录则用于存放用户自定义的扩展技能,确保更新时不会被覆盖。内置工具涵盖了文件操作(file)、网络访问(network)及万物下载(download_anything)等核心能力,通过精细化的权限控制(如 network_scope)确保任务执行的安全与高效。
该项目提供了一个开源的AI工作流框架,支持多用户AI Agent,具有较好的扩展性和可定制性,但需要进一步完善和测试
AI Skill Hub 为第三方内容聚合平台,本页面信息基于公开数据整理,不对工具功能和质量作任何法律背书。
建议在沙箱或测试环境中充分验证后,再部署至生产环境,并做好必要的安全评估。
✅ MIT 协议 — 最宽松的开源协议之一,可自由商用、修改、分发,仅需保留版权声明。
AI Skill Hub 点评:开源AI工作流:多用户AI Agent框架 的核心功能完整,质量良好。对于自动化工程师和运维人员来说,这是一个值得纳入个人工具库的选择。建议先在非生产环境试用,再逐步推广。
| 原始名称 | votx-agent |
| 原始描述 | 开源AI工作流: 多用户 AI Agent 框架 — 角色扮演 + 工具调用 + 对话持久化。⭐6 · Python |
| Topics | workflowpython |
| GitHub | https://github.com/kesepain-KE/votx-agent |
| License | MIT |
| 语言 | Python |
收录时间:2026-05-17 · 更新时间:2026-05-30 · License:MIT · AI Skill Hub 不对第三方内容的准确性作法律背书。
选择 Agent 类型,复制安装指令后粘贴到对应客户端