
数字生命不是概念了
Neuro-sama 是 Vedal 搞出来的一个 AI VTuber,能直播、能打游戏、能和观众互动。但她只能在线,下播就没了,也不开源。
moeru-ai 的 Project AIRI 想做的是:让你自己拥有一个这样的数字生命。GitHub 上 44.4k Stars,MIT 协议,v0.10.2 已经可以下载。Windows、macOS、Linux 都能装,甚至浏览器里也能跑。
它支持 VRM 和 Live2D 两种模型格式。你喜欢的二次元角色模型导入进去,AI 就能附着在上面。自动眨眼、自动注视、空闲时眼球自然移动——不是那种僵硬的纸片人。
Github:
技术栈有点意思
AIRI 和其他 AI VTuber 项目最大的区别是:它用 Web 技术栈。
WebGPU 渲染 3D 模型,WebAudio 处理音频,Web Workers 跑后台任务,WebAssembly 跑本地推理。桌面版通过 Tauri/Electron 封装,同时调用本地 CUDA(NVIDIA)和 Metal(Apple)做加速——借助 HuggingFace 的 candle 项目实现,不需要折腾 CUDA 环境。
这意味着 AIRI 能跑在浏览器里,也能跑在手机上(已有 PWA 支持),真正的全平台。
大脑、耳朵、嘴巴、身体
项目把 AI 的能力分成了几个模块:
大脑部分,LLM 支持 20 多家 API 提供商。OpenAI、Claude、DeepSeek、Qwen、Gemini、Ollama 等等全部开箱即用。xsai 这个内部库类似一个缩小的 Vercel AI SDK。还支持纯浏览器端的 WebGPU 本地推理(实验性)。
记忆系统用了 DuckDB WASM(纯浏览器内嵌数据库),还有基于 pglite 和 PGVector 的方案。一个叫 Memory Alaya 的记忆层还在开发中。
耳朵部分,支持浏览器麦克风输入和 Discord 语音输入。语音识别在客户端完成,也有说话检测功能。
嘴巴部分,TTS 支持 ElevenLabs、Azure Speech、OpenAI TTS、阿里云百炼,还有本地的 Kokoro TTS。声音可以调。
身体部分,VRM 和 Live2D 都支持,有自动动画系统。
玩游戏是真的
这不是聊天框里的文字冒险。AIRI 会真的操作游戏。
Minecraft 通过 Mineflayer(一个 Node.js 的 Minecraft 机器人库)接入。Factorio 通过 Factorio RCON API 和 autorio 库实现自动化控制。还有 Kerbal Space Program 的支持在计划中。Helldivers 2 的协作模式也在开发。
每个游戏都用一个独立的 agent 模块处理,通过 server-runtime 和 xsAI 连接到大模型。
社区生态
项目已经有了一套完整的子项目生态。Awesome AI VTuber 列表收集了同类项目。unspeech 是通用的 ASR/TTS 代理服务器,类似 LiteLLM 但专注语音。MCP Launcher 让任何人都能方便地启动 MCP 服务器。还有专门做模型管理和默认配置的 inventory 后端服务。
社区有 Discord、Telegram、QQ 群、微信群。Crowdin 上有多语言翻译项目,文档站支持多国语言。

安装和上手
winget install MoeruAI.AIRI(Windows) brew install --cask airi(macOS) nix run github:moeru-ai/airi(Linux)
或者直接打开 airi.moeru.ai 在浏览器里体验。装好后配置 LLM API Key,导入 VRM/Live2D 模型,就能开始对话了。
说点实在的
项目还在早期阶段(v0.10.2),文档站的 DevLog 一直在更新。Tauri 的桌面版还在迭代,有些功能可能不够完善。开发者很坦诚地在招募前端、模型师、RL 工程师,甚至策划和主播。
Token 消耗需要自己承担(除非用本地模型),TTS 服务大部分也要 API Key。不过考虑到它是一个自托管的开源项目,自由度是最大的优势。
Github:
关注
AI VTuber 正在成为大语言模型最有意思的应用场景之一。关注我,我会持续挖掘 GitHub 上那些真正有想象力的开源项目。