suno-api
Suno.ai 音乐生成 API 封装,开发者可轻松集成 AI 作曲能力到 GPTs/Agent
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
Suno.ai 音乐生成 API 封装,开发者可轻松集成 AI 作曲能力到 GPTs/Agent
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
你有没有过这样的灵感瞬间——凌晨两点,突然想听一首"赛博朋克风格的蒸汽波情歌",但哼了两句发现找不到歌,只能作罢?
现在,你可以在自己的服务器上,用一行 API 调用,让 AI 为你生成这首歌。
Suno API 就是这样一款工具:它将 Suno.ai 的 AI 音乐生成能力,封装成任何程序员都能调用的 REST 接口,让"用代码作曲"从科幻变成了现实。

2024 年初,Suno.ai v3 横空出世,几乎重新定义了 AI 音乐生成的天花板。用户只需输入一段文字描述,AI 就能生成包含人声、伴奏、编曲的完整音乐作品。然而问题来了——Suno 官方迟迟没有开放 API 接口。
对于独立开发者和 AI Agent 构建者来说,这成了一个甜蜜的烦恼:Suno 的能力很强,但无法集成到自己的产品里。GitHub 用户 gcui-art 正是被这个问题困扰的开发者之一。他没有选择等待,而是决定自己动手:通过对 Suno 网站内部接口的逆向工程,封装出了一套完整的 REST API。
这个项目在 GitHub 上迅速走红,目前已经积累了超过 3000 颗 Star,成为了 Suno 非官方 API 领域的标杆项目。它甚至登上了 Product Hunt 的精选推荐,获得了社区的广泛认可。
Suno API 的技术实现颇具巧思,核心思路是"用 Playwright 控制真实浏览器来模拟人工操作"。
整个系统的运行流程是这样的:
SUNO_COOKIE(即你在 Suno 官网的登录态),建立与 Suno 服务器的认证会话ghost-cursor-playwright 模拟真实鼠标轨迹,避免被识别为机器人这种方案的优势在于:只要 Suno 官网能用的功能,API 都能用——官方有什么新特性,无需等待第三方适配。但代价是系统复杂度高,依赖外部验证码服务,且对网络环境有一定要求。
Suno API 的野心不只是做一个音乐播放器,它的目标是成为 AI Agent 的"音乐工具插件"。围绕这个目标,它实现了丰富的 API 端点:
| 端点 | 功能 |
|---|---|
/api/generate | 根据文字 Prompt 生成音乐 |
/v1/chat/completions | OpenAI 兼容格式,可无缝对接到 GPT-4、Claude 等 Agent |
/api/custom_generate | 自定义模式:指定歌词、音乐风格、标题 |
/api/generate_lyrics | AI 根据描述生成歌词 |
/api/get | 查询已生成音乐的详情 |
/api/extend_audio | 延长已有音乐的时长 |
/api/generate_stems | 提取人声和伴奏干轨 |
/api/get_aligned_lyrics | 获取歌词每个字的时间戳(卡拉 OK 效果) |
/api/concat | 合并多段音乐 |
/api/persona | 获取用户角色/歌单信息 |
/api/get_limit | 查询账号剩余配额 |
最值得关注的是 /v1/chat/completions 端点——它完全兼容 OpenAI 的 API 格式。这意味着你可以把它当作 GPT 的 function calling 工具:让大模型"思考"出音乐风格描述,然后自动调用 Suno API 生成歌曲,整条链路无需人工干预。
想象一下:一个写作 Agent 在生成一篇赛博朋克小说,写到高潮章节时,它自动为你生成了一首同风格的背景音乐——这就是 Suno API 带来的可能性。
项目提供了三条部署路径,各有适用场景:
Vercel(推荐尝鲜):点击 README 中的 "Deploy with Vercel" 按钮,填入 SUNO_COOKIE 和 TWOCAPTCHA_KEY 两个环境变量,等待 1 分钟即可获得一个可用的 API 地址。但 Vercel 有请求超时限制(10 秒),长时间的音乐生成任务容易超时失败。
Docker Compose(推荐生产):
docker compose build && docker compose up
项目提供了完整的多阶段 Dockerfile:构建阶段安装所有 npm 依赖并编译 Next.js;运行阶段安装 Chromium 浏览器和必要的系统库(libnss3、libdbus 等),开箱即用。需要注意的是,Docker 环境默认禁用 GPU 加速,这是有意为之——Suno API 在有 GPU 的环境下反而可能无法正常工作。
本地开发:直接 git clone 后 npm install,运行 npm run dev。适合需要魔改源码或调试问题的开发者。
项目使用 Next.js 14 + TypeScript 构建,这是一个相当"重"的选型,对于一个 API 服务来说略显奢侈。但考虑到项目还需要托管一个 Web 文档界面和 Swagger UI,Next.js 的 SSR 能力和静态站点生成功能确实能简化部署。
依赖生态颇为丰富:
@playwright/browser-chromium + rebrowser-playwright-core — 浏览器自动化核心代码结构遵循 Next.js App Router 规范,src/app/api/ 下每个子目录对应一个 API 路由,src/lib/SunoApi.ts 是核心业务类,封装了所有与 Suno 服务器的交互逻辑。
必须开诚布公地说明这个项目的几个问题:
依赖外部服务:2Captcha 是付费服务,虽然单价不高(约 5 元人民币 2000 次),但如果你的应用需要高频率调用,这会是不小的成本。更糟糕的是,一旦 2Captcha 服务不可用,整个 API 将陷入瘫痪。
法律灰色地带:Suno API 是对 Suno 内部接口的逆向工程,Suno 官方并未授权。尽管项目 README 明确标注了"仅供学习研究使用",但在实际商业产品中集成仍存在法律风险。Suno 随时可能修改接口导致项目失效。
稳定性隐患:由于依赖真实浏览器和外部网站,网络波动、Suno 网站改版、CAPTCHA 服务故障都可能引发请求失败。项目作者虽然维护频繁(Issue #197 显示已支持 v4),但维护进度完全依赖个人驱动。
无官方支持:这不是 Suno 官方的产品,遇到问题只能靠 GitHub Issues 和社区互助。
如果把 AI Agent 理解为能感知、理解、决策的智能体,Suno API 解决的问题是:如何让这个智能体"能唱歌"。
在 Suno API 出现之前,开发者想让 AI 生成音乐,必须自己操控浏览器或模拟登录,体验糟糕且难以产品化。有了这层封装,AI Agent 获得了一个标准化的"音乐技能"——无论底层是 GPT-4、Claude 还是国产大模型,只要支持 function calling,就能轻松调用 AI 作曲能力。
类似的生态正在形成:GPTs 的 Actions、Coze 的插件、LangChain 的 Tools……Suno API 正在成为这个生态中音乐维度的标准接口。这种"AI Agent 的插件市场"模式,可能是 AI 应用落地的一条重要路径。
一句话评价:如果你需要在自己的应用或 Agent 中集成 AI 音乐生成能力,Suno API 是目前最成熟、最完整的开源方案;但请做好依赖管理,备好验证码服务的预算,并接受"非官方"带来的稳定性风险。