Novel2Voice - 小说/视频字幕转多角色配音
一句话简介
把小说文本或视频字幕(.srt/.ass)自动转成多角色有声书:AI 识别角色 → 分配不同音色 → 加情感标签 → 生成音频。
核心能力
- 自动角色分配:LLM 分析性别/年龄/性格,自动匹配最合适的音色
- 情感与风格控制:50+ 标签,支持情绪、方言(粤语/台湾腔/东北话等 9 种)、甚至唱歌模式
- 字幕转语音:SRT/ASS 支持,自动识别编码 + 时间轴对齐
- 异步并发:多线程生成,速度提升 3–5 倍,支持断点续跑
- 音色库巨大:500+ Edge TTS 音色(28 个精选中文)+ 9 个 MiMo 音色
- 章节自动切分:识别"第 X 章/回/节"
- 响度标准化:EBU R128 标准,听感一致
- HTML 音色预览页:内置
技术栈
- Python ≥ 3.8
- FFmpeg(MP3 编码 + 响度归一化)
- Edge TTS(默认,无需 key) + MiMo TTS(需
MIMO_API_KEY) - 跨平台:Linux / macOS / Windows
- 依赖轻量:
requests、charset_normalizer
使用示例
给你的ai说 帮我安装一下这个skill https://github.com/jangviktor-web/novel2voice
或
bash
# 全自动模式 + 并发
python3 scripts/generate_audiobook.py --auto novel.txt ./output --async --concurrent 5
# 字幕转配音
python3 scripts/generate_audiobook.py --subtitle movie.srt ./output
# 手动指定角色音色
--character-voices '{"旁白":"云扬","许七安":"云希"}'1
2
3
4
5
6
7
8
2
3
4
5
6
7
8
文本内嵌样式标签:(温柔)、(东北话)、[叹气]、[轻笑] 等直接写在原文里生效。
输出:
output_complete.mp3(合并总音频)- 分章节 MP3 文件
- 逐段音频片段
- 生成日志
- 首次运行会先出 3 段预览,供你确认音色
典型应用场景
- 小说转多人有声书(爽文/网文/长篇小说)
- 视频字幕配音(自媒体解说、二创配音、无人声视频加旁白)
- AI 数字人 / 短视频批量配音生产
- 方言配音(粤语/台湾腔/东北话营造角色差异)
- 情感驱动叙事——比传统单音色 TTS 生动得多
一句话记住
Novel2Voice = 小说/字幕 → LLM 分角色 → 多音色 + 情感标签 → 一键出多人有声书,最大亮点是"自动角色识别 + 情感/方言表达 + 并发提速"。