uni-api
统一聚合 12+ LLM 服务商的 OpenAI 兼容 API 网关,支持负载均衡与自动故障转移
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
统一聚合 12+ LLM 服务商的 OpenAI 兼容 API 网关,支持负载均衡与自动故障转移
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
在日常 AI 开发中,你是否曾为同时使用多个大模型 API 而头疼不已?每当需要切换模型、对比效果、管理密钥时,往往要在不同平台之间来回折腾,配置文件散落一地。uni-api 正是为解决这个痛点而生——它是一个用 Python 构建的大模型 API 网关,通过统一的 OpenAI 兼容接口,汇聚了 OpenAI、Anthropic Claude、Gemini、Vertex AI、Azure、AWS 等十余种后端服务,让开发者只需维护一套配置,就能自由调度所有主流大模型。
uni-api 的诞生背景非常清晰——作者认为 new-api(另一个同类项目)功能过于复杂,混杂了大量商业场景才需要的特性,对个人开发者并不友好。于是 yym68686 从个人使用角度出发,打造了这个"零前端、配置即用"的极简方案。项目完全开源(Apache-2.0),活跃度高,截至 2026 年 6 月 14 日已更新至 v1.7.127,最近一周内就有多次 release 提交。
uni-api 的核心价值在于"统一"二字。它模拟完整的 OpenAI API 格式(/v1/chat/completions、/v1/models、/v1/images/generations 等),接入方无需修改代码,只需将 base_url 指向 uni-api 部署地址,即可自由调用背后接入的任意模型。
多后端汇聚是首要能力。目前已支持:OpenAI 全系列、Anthropic Claude 系列、Google Gemini、Microsoft Azure OpenAI Service、Google Vertex AI(含 Claude 和 Gemini 双支持)、AWS Bedrock、xAI Grok、Cohere、Groq、Cloudflare Workers AI、OpenRouter 等十余家服务提供商。这意味着开发者可以在不同渠道之间灵活切换,充分利用各平台的价格和额度优势。
四种负载均衡机制是另一大亮点:渠道级加权负载均衡(按权重分配请求比例)、Vertex 区域级负载均衡(最高可将并发提升 API数×区域数 倍)、顺序负载均衡(round_robin 轮询)、API Key 级轮训负载均衡(同一渠道多个密钥自动轮换)。这些机制可以最大化利用多个 API 账号的配额。
自动重试与渠道冷却进一步提升了系统鲁棒性。当某个 API 渠道响应失败时,系统会自动重试下一个渠道;如果某个渠道持续失败,它会被"冷却"一段时间后自动恢复,无需人工干预。
在函数调用(tool use)和多模态支持方面,uni-api 也覆盖了主流需求:OpenAI、Anthropic、Gemini、Vertex、Azure、AWS、xAI 的原生 tool use 均已支持;图像识别(DALL-E 图像生成、识图 API)、语音转文字、文字转语音、Embeddings、道德审查(Moderation)等接口也一应俱全。
从代码结构看,uni-api 采用了经典的 Python Web 服务架构:
依赖栈也很简洁:FastAPI + uvicorn + httpx(支持 HTTP/2 和 SOCKS 代理)+ SQLAlchemy + Pydantic。唯一值得注意的是依赖了 httpx-socks 实现 SOCKS 代理支持,这对于在受限网络环境下部署非常实用。
整个项目的代码量约 3285KB(不含 .git),规模适中,模块边界清晰。
这是 uni-api 最有竞争力的地方——部署体验极为简单。项目提供多阶段 Dockerfile(builder 阶段用 uv 安装依赖,运行时用 python:3.11-slim-bullseye 最小镜像),Docker Compose 配置仅需配置一个 CONFIG_URL 或挂载本地 api.yaml 文件即可。
硬件需求也很亲民:无需 GPU,内存仅需 512MB,磁盘约 3GB,任何一台云服务器都能轻松运行。配置过程只需编写一个 YAML 文件填写各渠道的 API Key 和模型映射,无需任何前端界面。部署熟练后,整个过程不超过 5 分钟。
值得注意的是,uni-api 官方并未提供内置的认证面板或 Web UI,所有访问控制依赖 API Key 机制(支持通配符匹配模型权限)。生产环境使用建议配合反向代理(Nginx/Caddy)做额外的访问控制。
此外,由于涉及多个外部 API 的代理转发,网络质量直接影响服务稳定性。建议部署环境有稳定的国际网络访问能力,或配置好 SOCKS 代理。项目也明确在 README 中提示"如果网络不通,请检查代理配置"。
uni-api 代表的趋势是"大模型 API 聚合网关"这一细分类别的快速成熟。随着 Claude、Gemini、DeepSeek 等模型不断涌现,单一 API Key 已经很难满足灵活调用和成本优化的需求。类似的工具(如 One-API、new-api)正在形成一个小生态,而 uni-api 以其"零前端、配置驱动"的极简定位,在个人开发者和极客群体中找到了自己的细分市场。
该项目的高活跃度(周更频率、issue 响应及时)也侧面反映了市场需求的真实存在。如果你有多渠道调用大模型的需求,且希望简化管理复杂度,uni-api 值得一试。
项目速览:Python 3.11+ · FastAPI + uvicorn · 多阶段 Docker 部署 · 无 GPU 需求 · Apache-2.0