airi
开源虚拟角色平台,复刻 Neuro-sama 的 AI 伴侣,支持实时语音、游戏交互和 Live2D
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
开源虚拟角色平台,复刻 Neuro-sama 的 AI 伴侣,支持实时语音、游戏交互和 Live2D
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。

图1:Project AIRI 官方横幅
你有没有想象过,有一天能和《夏娜》里的亚珑一样,和一个真正拥有灵魂的虚拟角色生活在一起?她们会记得你说的话,会在你玩《我的世界》时陪在旁边出谋划策,会用真实的语音和你对话——而不是那种机械的问答复读机?
Project AIRI 正在将这个想象变成现实。这是一个开源项目,目标只有一个:复刻 Neuro-sama,或者说,创造一个真正"有灵魂"的 AI 虚拟伴侣。
简单来说,AIRI 是一个自托管的虚拟角色容器。你可以把它理解为:一个让 AI 角色"活"起来的全栈开发框架。它不是简单的聊天机器人,也不是预训练的对话模型,而是一套完整的系统工程——整合了实时语音对话、游戏交互(MineCraft、Factorio)、Live2D 虚拟形象、VRM 模型支持,以及跨平台 UI(Web / macOS / Windows / iOS / Android)。
该项目的核心理念是"you-owned"——即你拥有这个角色的数据和灵魂。它定位为 Grok Companion 的开源替代方案,但野心更大:不只是语音助手,而是一个数字生命平台。
翻开 AIRI 的代码仓库,第一感受是:这不像是一个"个人项目"。
整个项目使用 TypeScript 作为主力语言,采用了 pnpm monorepo 架构,根目录有 47 个文件和 46 个 packages 子包,规模相当可观。核心技术栈包括:
值得注意的是,项目还内置了视觉自动化运行时(vishot-runtime)和 Electron 端集成,意味着它能截屏、理解屏幕内容并作出反应——这是让 AI"看懂游戏"的基础能力。
AIRI 的语音交互不是简单的 TTS+ASR 串联。项目内置了 audio-pipelines-transcribe 和 model-driver-lipsync 等包,实现了语音驱动的嘴唇同步(Lip Sync),让虚拟形象的嘴型与语音精准匹配。这需要端到端的音频处理 pipeline,门槛相当高。Live2D 和 VRM 虚拟形象的唇形动画必须与音频流实时同步,这涉及到 ASR(自动语音识别)→ LLM 推理 → TTS(语音合成)→ Lip Sync 模型的完整链路,每个环节的延迟都必须控制在 500ms 以内才能保证体验流畅。
这是 AIRI 最具想象力的功能。在 games 部分,AIRI 展示了让 AI 角色"进入" Minecraft 和 Factorio 的能力——AI 能理解游戏状态、读取屏幕、执行操作。这背后依赖 vishot-runtime 的屏幕感知能力和 MCP(Model Context Protocol)协议通信。
要实现这一点,需要同时具备:计算机视觉(理解屏幕内容)+ 游戏 API(执行动作)+ LLM 推理(三者协调)。这是一个典型的 Agent + Tool Use 问题,解决起来远比想象的复杂。AI 需要"看见"游戏中发生的事,理解你的意图,然后调用游戏内置命令完成操作——比如"帮我在这个位置建一个熔炉"。
AIRI 支持 Live2D 动画模型和 VRM(VRoid Hub Model)格式,前者提供 2D 动画效果,后者提供 3D 虚拟形象。packages/stage-ui-live2d 和 packages/stage-ui-three 分别对应这两种渲染路径。用户可以根据喜好选择不同风格的"外壳"。Live2D 通过 Spine 骨骼动画实现面部表情和肢体动作,VRM 则基于 VRM 1.0 规范支持更精细的 3D 模型控制。

图2:Project AIRI 品牌标识(Light 主题)
AIRI 提供了完整的 Docker 部署方案。apps/server/Dockerfile 基于 node:24-alpine,采用多阶段构建,将 server 和 UI 分别打包。docker-compose.yml 定义了服务编排,可以一键启动前后端。但实际部署仍需要:
文档站点(airi.moeru.ai/docs)提供了多语言指南(中文、日语、韩语等),但具体到 self-hosted 部署指南,仍处于"早期"状态,有一定的探索成本。配置 LLM API(Groq/Gemini 等)、TTS 服务、麦克风输入等多个组件,本地部署需要逐一配置,门槛不低。
需要坦诚地说:AirI 目前仍处于积极开发中的阶段(v0.10.2),大规模生产部署可能会遇到以下问题:
Project AIRI 代表的,是 AI 陪伴赛道的一个分支——从"对话"升级到"共同存在"。
Neuro-sama 的成功证明了:用户不只想要一个回答问题的 AI,他们想要一个"在那里"的数字生命。VTube Studio + AI 的组合正在被更多人所认可,AIRI 的开源实现让这个能力惠及每一个有技术背景的爱好者。
从增长曲线看,AIRI 在 GitHub 上的 stars 已突破 39,000,且保持着活跃的开发节奏(v0.10.2,平均每月发布)。Discord 社区活跃,贡献者涵盖开发者、设计师和 VTuber 爱好者。这是一个真实的社区在推动的项目。
如果你对"让 AI 角色真正活起来"感兴趣,无论是想打造自己的 AI VTuber、为游戏 NPC 注入灵魂,还是探索数字陪伴的可能性,AIRI 都值得你花时间研究。它的代码质量和工程规模远超平均水平,是一个真正在做实事儿的项目。
一句话总结:AIRI 是一个野心勃勃的开源虚拟角色平台,将实时语音、游戏伴侣、Live2D/VRM 形象整合在一起,是目前开源社区中距离"复刻 Neuro-sama"最近的项目之一。