发现一款适合有声书创作者开源项目

0 阅读3分钟
  • 发现一款适合有声书创作者开源项目
  • 一、项目简介
  • 二、项目功能
  • 三、项目亮点
  • 四、项目目录结构
  • 五、技术栈
  • 六、本地快速部署启动
      1. 安装桌面应用(推荐)
      1. 从源码构建运行
  • 七、写在最后

发现一款适合有声书创作者开源项目

一、项目简介

发现一款适用于 macOS 和 Windows 的开源声音创作工具,在本地将文字转化为自然、富有表现力的语音。支持音色复刻、情绪控制与音频作品管理,可自主选择 TTS 模型,无需调用云端 API,也没有按字数计费的开销,让旁白、配音和有声内容创作更自主、更低成本。

二、项目功能

  • 语音与表达:支持使用参考声音、匹配参考表演、调整情绪或用文字描述来指导语音生成。
  • 完整的音频工作流:提供从导入或录制参考音频、剪辑片段、预览语音到导出作品的完整流程。
  • 声音设计与克隆:通过 VoxCPM2 模型,支持文本引导的声音设计、可控克隆以及带自动多语言处理的转录辅助克隆,并输出 48 kHz 音频。
  • 本地模型运行:通过 audio.cpp 运行 IndexTTS 2.0 / 2.5 和 VoxCPM2 模型,支持断点续传下载模型和导入 GGUF 格式。
  • 硬件加速:在 Apple Silicon 上支持 Metal 加速;在 Windows 上支持 CPU、NVIDIA CUDA 和实验性的 Vulkan 加速。
  • Agent Skill:允许 AI 助手通过命令行接口(CLI)安装技能、设置本地语音生成,并根据文本和参考音频创建配音。

三、项目亮点

  • 完全本地化:所有语音生成和处理都在本地完成,不依赖云端 API,保障了数据隐私,且没有按字符计费的开销。
  • 情感可控:提供多种情绪预设(如平静、愉快、温柔)和强度调节,让生成的语音更具表现力。
  • 跨平台支持:同时支持 macOS (Apple Silicon) 和 Windows (x64) 系统。
  • AI 助手集成:独特的 Agent Skill 功能,可以通过自然语言指令让 AI 助手自动化完成语音生成任务。

四、项目目录结构


    
    
    
  yovoice/
├── .github/workflows/      # GitHub Actions 工作流配置
├── cmd/                    # 命令行工具入口
├── desktop/                # 桌面应用主程序
├── docs/                   # 文档
├── internal/workbench/     # 内部工作台相关代码
├── scripts/                # 脚本文件
├── skills/yovoice/         # AI 助手技能配置
├── web/                    # Web 相关代码
├── .gitignore              # Git 忽略文件配置
├── AGENTS.md               # AI 助手相关说明
├── LICENSE                 # 项目许可证
├── Makefile                # 构建和运行脚本
├── README.md               # 项目说明文档(英文)
├── README_zh.md            # 项目说明文档(中文)
├── THIRD_PARTY_NOTICES.md  # 第三方依赖声明
└── go.mod                  # Go 语言模块定义

五、技术栈

  • 编程语言:项目主要使用 Go、TypeScript、Swift、C#、Python 等多种语言开发。

  • 核心模型

    • IndexTTS:用于语音合成的核心模型。
    • VoxCPM:用于声音设计和克隆的模型。
  • 推理引擎:使用 audio.cpp 作为本地音频推理引擎。

  • 硬件加速

    • macOS:Metal (Apple Silicon)
    • Windows:CPU, NVIDIA CUDA, Vulkan (实验性)

六、本地快速部署启动

你可以通过以下两种方式在本地运行该项目:

1. 安装桌面应用(推荐)

这是最简单的方式,适合普通用户。

  1. 前往项目的 Releases 页面

  2. 根据你的操作系统下载对应的安装包:

    • macOS (Apple Silicon) : 下载 .dmg 文件,打开后将 yovoice 拖入 Applications 文件夹。
    • Windows (x64) : 下载 -setup.exe 文件,运行安装程序,然后从开始菜单打开。
  3. 首次打开应用后,在设置中下载所需的 TTS 模型(如 IndexTTS 或 VoxCPM2)即可开始使用。

2. 从源码构建运行

这种方式适合开发者。

  1. 克隆项目

    
        
        
        
      git clone https://github.com/leemysw/yovoice.git
    cd yovoice
    
  2. 安装依赖并运行

    项目使用 Makefile 来管理构建和运行任务。

    
        
        
        
      # 安装依赖
    make install
    
    # 运行桌面应用
    make app-run
    

七、写在最后

项目代码地址:
github.com/leemysw/yov…