SwarmUI
模块化 AI 图像生成 WebUI,支持 ComfyUI 和 SD 全家桶
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
模块化 AI 图像生成 WebUI,支持 ComfyUI 和 SD 全家桶
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。

图:SwarmUI v0.9.8 Beta 主界面,支持生成工作流管理与多模型切换
2023 年,Stable Diffusion WebUI(A1111)几乎统治了 AI 绘画社区——但它的界面是为极客设计的,普通用户面对满屏英文参数往往望而却步。Fooocus 用极简重新定义了入门体验,而 SwarmUI 则走了另一条路:做减法的同时,不牺牲高级用户的控制力。
作者 Alex "mcmonkey" Goodwin 是资深的 C# 开发者,也是 ComfyUI 生态的深度参与者。他注意到许多用户其实想要的是:既能一键出图的「傻瓜模式」,又能随时切换到 Comfy Workflow 的「全功能模式」,但不需要来回切换工具。SwarmUI 正是为这个需求而生——一个界面,两个世界。
项目前身为 StableSwarmUI,于 2024-2025 年正式更名为 SwarmUI,标志着它从单纯的 SD UI 向多模态 AI 生成平台的演进。
SwarmUI 最独特的设计哲学是**「初级 + 高级并行」**:
这两个入口共享同一个后端和模型资源,数据完全互通。用户完全不需要在两个工具之间迁移资产。
SwarmUI 的后端抽象层(Backend Handler)是整个系统最核心的设计:它定义了一套统一的接口规范,允许任意兼容的后端接入。当前内置支持:
| 后端 | 类型 | 用途 |
|---|---|---|
| ComfyUI Backend | 主要生产级后端 | 完整功能,支持几乎所有主流模型 |
| Auto WebUI Backend | 兼容后端 | 兼容旧版 SD WebUI 工作流 |
| Swarm Swarm Backend | 内部通信 | Swarm 实例间互操作 |
| LlamaSharp LLM Backend | LLM 后端 | 本地大型语言模型推理 |
| Simple Remote LLM Backend | LLM 后端 | 远程 LLM API 集成 |
项目 README 明确列出支持的模型类型:
SwarmUI 支持类似 VSCode 插件模式的扩展机制:
src/Extensions/ 目录docs/Making Extensions.mdSwarmUI 采用前后端分离但统一部署的架构:
语言:C# (.NET 8.0)
前端框架:Blazor Server + 原生 JavaScript (wwwroot/)
主要依赖:ASP.NET Core
后端通信:与 Python ComfyUI 进程通过本地 HTTP/WebSocket 交互
核心目录结构(src/):
Backends/ ← 后端抽象层(BackendHandler.cs 等)
BuiltinExtensions/ ← 内置扩展(ComfyUI、AutoWebUI、GridGenerator...)
Core/ ← 核心业务逻辑
Extensions/ ← 用户扩展目录
LLMs/ ← 大语言模型集成
Media/ ← 媒体处理(图像、视频、音频)
Pages/ ← Blazor 页面组件
Text2Image/ ← 文本生图核心模块
Utils/ ← 工具函数
WebAPI/ ← REST API 接口
wwwroot/ ← 静态资源(CSS、JS、图片)
SwarmUI 的 Web UI 基于 Blazor Server,这是一种在服务端运行 Razor 组件、通过 SignalR 实时通信的 SSR 框架。与纯前端方案(React/Vue)不同,Blazor Server 不需要在客户端下载大量 JS,界面状态管理集中在服务端,适合内部部署的局域网场景。
默认端口 7800,启动后通过浏览器访问完整 UI,首次启动会自动检测并下载 ComfyUI 后端。
项目根目录提供了多平台启动脚本:
launch-linux.sh / launch-linux-dev.sh — Linuxlaunch-windows.bat / launch-windows-dev.ps1 — Windowslaunch-macos.sh — macOS对于 Docker 部署,官方提供了详尽的 docs/Docker.md 指南,支持:
src/LLMs/ 目录体现了项目对 LLM 能力的布局:LlamaSharp 本地推理 + Remote LLM API 调用,支持将 LLM 能力集成到图像生成流程中(如智能提示词补全、风格推荐等)。尽管原生 LLM 辅助提示功能尚未内置,但社区已有扩展先行实现。
| 资源 | 最低要求 | 推荐配置 |
|---|---|---|
| 显存 | 6GB | 8GB+ |
| 内存 | 16GB | 32GB |
| 存储 | 20GB+ | 50GB+(大模型占用) |
| GPU | NVIDIA (CUDA) / AMD (ROCm) | RTX 3060+ |
sudo apt install dotnet-sdk-8.0git clone https://github.com/mcmonkeyprojects/SwarmUIchmod +x launch-linux.sh./launch-linux.shhttp://localhost:7800Docker 部署参考官方文档,优势在于隔离第三方扩展和 ComfyUI 自定义节点的依赖链,安全性更高。
SwarmUI 的出现填补了 AI 图像生成工具链的一个关键空白:让同一个工具同时满足普通用户和高级用户。它证明了模块化架构在 AI 前端工具中的可行性,也为 ComfyUI 的易用化提供了一个官方级别的参考答案。
作为 StableSwarmUI 的延续,SwarmUI 在不到两年内积累超过 4000+ GitHub Stars,Discord 社区活跃,表明其在专业用户群体中已建立起稳定的口碑。随着多模态(视频、音频)模型的普及,SwarmUI 的全模态扩展架构将更具战略价值。