ai-dj
VST3/AU 插件形态的 AI 音乐实时生成工具,8 轨采样 + MIDI 触发 + 9 种 AI 引擎,适合现场演出
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
VST3/AU 插件形态的 AI 音乐实时生成工具,8 轨采样 + MIDI 触发 + 9 种 AI 引擎,适合现场演出
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象这样的场景:你在后台刚调好 DJ 台,Ableton Live 里加载着OBSIDIAN Neural——一款嵌在你 DAW 中的 VST 插件。舞台监督喊你"还有三分钟"。你快速在8个音轨上输入关键词:bass drop、breakbeat、atmospheric pad、acid lead……30秒后,4段完美契合 128 BPM 的 AI 生成循环出现在各自轨道上,按下 MIDI 控制器对应的琴键,C3 触发 bass loop、B3 触发 lead,演出正式开始。
这就是 OBSIDIAN Neural——由法国开发者 Anthony Charretier(InnerMost47)打造的开源 AI 音乐生成插件。它不是 Suno 或 Udio 那样"一键生成完整歌曲"的工具,而是一个实时演奏乐器:你在控制音乐走向,AI 负责生成素材。

OBSIDIAN Neural 插件界面,支持 VST3/AU 格式,可直接嵌入主流 DAW
Anthony Charretier 是一位活跃的音乐制作人(SoundCloud: Moteka),在日常创作中,他发现市面上的 AI 音乐工具都有一个通病——把音乐人变成观众,而不是演奏者。Suno 生成完整歌曲后,你需要反复修改提示词才能得到想要的结果;Udio 更像是一个自动作曲机,缺乏实时交互。
他想要的,是一款把 AI 当作"超级采样器"的工具:传统采样器触发的是预先录制的采样,而 AI 采样器触发的是实时生成的循环素材,并且与 DAW 的 tempo、key 完全同步,不露破绽。
2023年起,他开始基于 JUCE 框架(C++ 跨平台音频应用框架)开发这款插件,并将整个工具链逐步开源:
| 仓库 | 功能 |
|---|---|
| ai-dj(本项目) | VST3/AU 插件核心 |
| obsidian-neural-central | 中央推理服务器 |
| obsidian-neural-provider | GPU 节点接入套件 |
| obsidian-neural-frontend | 用户前台与仪表盘 |
| obsidian-neural-controller | 配套 MIDI 手机控制器 |
| raveMorph | 神经音色变形插件(RAVE 算法) |
| beatcrafter | 智能 MIDI 鼓机 VST |
这一套生态系统,让 OBSIDIAN Neural 从一个插件,演变成了一个去中心化 AI 音乐推理网络。
OBSIDIAN Neural 的核心使用流程极其简洁:输入文字 → 获取循环,全程不超过 30 秒。
插件内置 8 轨采样器,每轨对应 MIDI 键盘的一个区域(C3-B3)。每个音轨支持 4 页(A/B/C/D)变体,每页 8 个序列,总共可存储 256 个 patterns。在现场演出中,你可以提前编排好多种变化,演出时实时切换,无需暂停。
这个设计非常接近 Roland TR-808 或 Native Instrument Maschine 的工作流——但触发的不再是预录音采样,而是 AI 实时生成的素材。
在服务器模式下,OBSIDIAN Neural 支持 9 个专门的 AI 生成引擎,你可以为每个音轨分配不同的引擎:
| 引擎 | 专长 | BPM 范围 |
|---|---|---|
| stable-audio-open-1.0 | 鼓组/混音纹理 | 80-160 |
| Stable Audio 3 Medium | 完整音轨/隔离干声/FX | 80-160 |
| Foundation-1 | 标签驱动旋律和声 | 100-150 |
| Audialab EDM Elements | EDM lead/超锯齿/Pluck | 100-150 |
| RC Infinite Pianos | 钢琴独奏 | 100-150 |
| RC Vocal Textures | 合唱/歌剧/氛围人声 | 100-150 |
| SAO Instrumental | 旋律陷阱/Lo-fi 爵士说唱 | 75-160 |
| StableBeaT | Trap 鼓机/808 | 75-160 |
| gluten_v1 | 可循环旋律陷阱/波浪主题 | 90-160 |
AI 生成的素材进入采样器后,还有一套完整的声音处理链:
这套工具链的设计理念很清晰:AI 提供素材,人类把控声音质感。
新推出的本地版使用 Stable Audio 3 Medium,在你自己 CPU 上运行,无需 GPU。一次性购买后即可离线永久使用。
参考性能:现代笔记本 CPU 生成一段循环约需 11 秒,同时运行 DAW 完全无压力。macOS 仅支持 Apple Silicon(M1+)。
下载开源插件后,连接 OBSIDIAN Neural 中央推理服务器。免费用户有 20 个 credits,付费订阅(€7.99-14.99/月)可获得 150-500 个 credits/月。
进阶用户也可以自托管整个推理集群:部署 obsidian-neural-central + obsidian-neural-provider,接入分布式 GPU 节点网络,订阅收入由 Stripe Connect 按贡献比例分配(公开透明,平台仅收 15% 运营费)。
OBSIDIAN Neural 独立版内置了 Ableton Link 支持——这是一个允许不同音乐软件/设备通过网络同步 tempo 和播放状态的协议。你可以在手机上用 OBSIDIAN Neural 控制电脑上的 Ableton Live tempo,或者同时运行多个 Link 设备保持节拍一致。这是现场演出中非常实用的功能。
作者在 README 中坦诚写道:"It occasionally hallucinates." AI 生成的音乐循环并不总是符合预期——可能生成风格不匹配的素材,或者节拍/调性有偏差。这是当前 AI 音乐生成技术的共同局限,需要用户在采样器中实时筛选和调整。
OBSIDIAN Neural 不是 Suno/Udio 的替代品。如果你想要一键生成 3 分钟的完整歌曲,它不适合。但如果你想在一个 live set 中快速获取高质量素材循环,它可能是目前最好的开源选择。
本项目采用 AGPL-3.0 许可证,意味着如果你基于此代码开发网络服务,必须开源你的修改版本。这对商业化场景有一定限制,但对于插件本身的用户没有影响。
OBSIDIAN Neural 基于 JUCE 框架 构建,使用 CMake 管理跨平台编译(C++17 标准),支持 Windows/macOS(VST3 + AU)/Linux(VST3)三大平台。
代码采用严格的模块化架构:
PluginProcessor:JUCE AudioProcessor 子类,协调所有子模块,持有 JUCE ThreadPool 处理 AI 请求TrackManager:管理 8 轨采样数据、变体页、播放状态GenerationManager:AI 生成任务队列,与服务器 API 通信DjIaClient:HTTP REST API 客户端,处理认证和推理请求SequencerManager:16 步序列器,支持多小节循环MidiLearnManager:全参数 MIDI 学习支持硬件控制器AudioManager:音频 IO、缓冲管理和 Ableton Link 同步UI 层完全基于 JUCE GUI 组件自定义渲染,包括波形编辑器(DrawingCanvas)、混音台(MixerPanel)和 8 轨音轨视图。依赖 Ableton Link C++ 库实现网络同步。
OBSIDIAN Neural 代表了一种新的 AI 音乐工具思路:把 AI 当乐器,而不是当歌手。它的分布式 GPU 推理网络设计也有趣——让社区成员贡献 GPU 算力,换取订阅收入分成,形成一个去中心化的 AI 服务市场。
目前项目规模较小(237 stars),但产品完成度较高,文档详尽,商业模式清晰。AGPL-3.0 许可证和开源插件本身的定位,使其在音乐制作人社区中具有独特竞争优势——与闭源的 Suno/Udio 形成鲜明对比。
未来,随着 Stable Audio 3 Medium 本地版成熟,以及更多社区 GPU 节点接入,这款工具在独立音乐人群体中的影响力有望持续扩大。
本报告基于 GitHub 仓库公开信息生成,分析时间:2026-08-02。