open-webui-tools
扩展 Open WebUI 的模块化 AI 工具集
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
扩展 Open WebUI 的模块化 AI 工具集
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
Open WebUI Tools 是一个为开源 AI 对话平台 Open WebUI 打造的模块化工具集,通过 20+ 款工具、函数管道和过滤器,将普通的聊天界面扩展为支持学术检索、图像生成、音乐创作、自主规划、多模型路由等功能齐全的 AI 工作站。
想象一下:你正在用 Ollama 本地部署的大模型和它对话,突然想查一篇 arXiv 最新论文——你需要关掉对话,去浏览器搜索,再把链接贴回来。想生成一张图片?需要另开一个 Midjourney 网页。想让 AI 自主规划一个旅行行程并调用多个工具执行?你得自己写一堆 API 调用代码。
这就是大多数本地 AI 对话工具的尴尬:各司其职,却互不相通。
Open WebUI 本身是一个优秀的开源 Web UI,支持 Ollama、OpenAI 等多种后端。但它的扩展性一直受限于官方提供的少数内置工具。Haervwe(项目作者)从这一痛点出发,构建了这套工具集合,将原本分散在不同平台的能力,统一收拢到 Open WebUI 一个界面里。
作者在 GitHub 上拥有 17 个 topics 标签,从 academic-research 到 video-generation、从 multi-agent 到 music-generation,基本覆盖了 AI 爱好者最常见的需求场景。项目采用 MIT 许可证,完全开源,社区贡献活跃(72 个 Fork)。
Tools 是 Open WebUI 的基础扩展单元,每款工具解决一个具体问题:
| 工具 | 功能 | 依赖 |
|---|---|---|
| arXiv Search | 学术论文搜索,无需 API Key | searchthearxiv.com |
| Perplexica Search | AI 驱动的网络搜索(需自托管 Perplexica) | Perplexica + Ollama |
| Pexels Media Search | 高质量图片/视频素材搜索 | Pexels API Key |
| YouTube Search & Embed | YouTube 视频搜索并内嵌播放器 | YouTube Data API v3 |
| Native Image Generator | 调用 Open WebUI 原生图像生成后端 | Open WebUI 图像配置 |
| Hugging Face Image Gen | Stable Diffusion 图像生成 | Hugging Face API Key |
| ComfyUI Text-to-Video | 通过 ComfyUI 工作流生成视频(WAN 2.2) | ComfyUI |
| ComfyUI ACE Step 1.5 Audio | 音乐生成 | ComfyUI + ACE 模型 |
| OpenWeatherMap Forecast | 天气预报插件 | OpenWeatherMap API |
| Xquik X Data Tool | X(原 Twitter)数据查询 | X API |
| OutageDeck Status | AI 服务商状态监控 | 无需 API Key |
Function Pipes 是比 Tools 更高级的扩展形式,支持多轮对话、多模型协作:
Filters 在请求/响应层面拦截和处理对话:
Planner Agent v3 值得关注。它采用了多代理编排(Multi-Agent Orchestration)架构,内置 web_search_agent、image_gen_agent、knowledge_agent、code_interpreter_agent、terminal_agent 五种专业化虚拟子代理。通过 asyncio.gather 实现并行执行,显著提升效率。用户可以在执行过程中审批子计划、提供反馈,代理会自我修正。
状态持久化是另一个亮点——任务进度和历史记录以 JSON 附件形式保存在 Open WebUI 中,即使关闭对话也能恢复。
项目中包含多个 ComfyUI workflow JSON 文件(位于 Extras/ 目录),涵盖 Flux Kontext 图像编辑、Qwen Image Edit 2509 工作流、ACE Step 1.5 音频生成、WAN 2.2 视频生成。这意味着用户无需手动在 ComfyUI 中配置,直接导入 JSON 即可使用。
Semantic Router Filter 是另一个实用创新。它不像传统方式按固定规则路由,而是利用模型描述和能力信息,结合用户 Prompt 的语义内容,动态选择最合适的模型。支持 vision 模型的上下文路由,并自动处理不支持 vision 的模型 fallback。
| 安装方式 | 难度 | 适合人群 |
|---|---|---|
| Open WebUI Hub 在线安装 | ⭐ 极简 | 非技术用户 |
| 手动复制 .py 文件 | ⭐⭐ 简单 | 开发者 |
| ComfyUI 工作流配置 | ⭐⭐⭐ 中等 | 创意/AI 开发者 |
| 自托管 Perplexica + 多模型 | ⭐⭐⭐⭐ 复杂 | 高级用户 |
arXiv Search、OutageDeck Status 等工具开箱即用,无需任何配置。这降低了试用门槛——用户可以先体验基础功能,再逐步配置更复杂的工具。
Open WebUI Tools 代表了一个趋势:将专业 AI 能力从独立工具整合进统一的对话界面。随着 Ollama、LM Studio 等本地模型工具的普及,用户对本地 AI 工作站的需求日益增长。Haervwe 的工作填补了 Open WebUI 扩展生态的关键空白——官方 Hub 上线的工具大多来自此仓库。
从 GitHub 数据看,项目自创建以来保持稳定更新(最新版本 Planner v3.10.3),社区 Fork 和 issue 活跃。17 个 topic 标签显示了极宽的功能覆盖范围,这种"瑞士军刀"式的定位在小众工具领域有其独特价值。
Hugging Face Stable Diffusion 在 Open WebUI 内直接生成图像
Perplexica Pipe 在 Open WebUI 中提供带引用的 AI 网络搜索