开源TTS语音合成:Edge TTS和ChatTTS怎么选

📘 教程 2026-07-19 约 3 分钟阅读

想做视频配音,但请人配音太贵,AI配音又怕不自然。有没有免费又好用的本地TTS方案?

💡 你将学到

想做视频配音,但请人配音太贵,AI配音又怕不自然。有没有免费又好用的本地TTS方案?

📜 目录

开源TTS的现状

2026年,开源语音合成已经可以做到跟真人差不多的效果。最流行的方案是 ChatTTSEdge TTS

方案一:Edge TTS(最简单)

微软Edge浏览器内置的TTS引擎,被开源社区做成了Python包。

优点:极其自然、免费、无需显卡。

pip install edge-tts

# 基本用法
edge-tts --text "你好,欢迎收听今天的节目。" --voice zh-CN-Yunxi --write-media output.mp3

# 中文男声
edge-tts --text "今天我们来聊聊AI。" --voice zh-CN-YunxiNeural --write-media output.mp3

# 中文女声
edge-tts --text "大家好,我是小爱。" --voice zh-CN-XiaoxiaoNeural --write-media output.mp3

支持的语音:中文多种方言、英语、日语等。

方案二:ChatTTS(情感最丰富)

专门为对话场景训练的TTS模型,能表达语气、情感、笑声。

git clone https://github.com/2noise/ChatTTS
git clone https://huggingface.co/2noise/ChatTTS
cd ChatTTS
pip install -r requirements.txt
import ChatTTS
import torch

chat = ChatTTS.Chat()
chat.load_models()

texts = ["你好,今天过得怎么样?", "我很开心!"]

wavs = chat.infer(texts, use_decoder=True)
# wavs 就是音频数据

ChatTTS能自动在句子里加入「嗯」「啊」「哈哈」这些语气词,听起来更自然。

方案三:Bark(音乐也能生成)

Suno开源的TTS模型,不仅能说话,还能生成音乐、非语言声音(咳嗽、叹气)。

pip install git+https://github.com/suno-ai/bark.git
from bark import SAMPLE_RATE, generate_audio, preload_models

preload_models()

audio_array = generate_audio("你好,我是AI助手。")

速度对比

方案 是否需要GPU 速度 自然度 中文质量
Edge TTS 不需要(云端) 秒出 极好
ChatTTS GPU推荐 实时 极高
Bark GPU推荐 较慢 一般

实际应用

做视频配音的最佳方案:

  1. 用Edge TTS生成配音(快、自然、中文好)
  2. 用ChatTTS做对话场景(两个角色对话)
  3. 用剪映/PR对时间轴
# 批量生成长文配音
cat script.txt | while IFS= read -r line; do
    if [ -n "$line" ]; then
        edge-tts --text "$line" \
            --voice zh-CN-YunxiNeural \
            --write-media "output_$(date +%s).mp3"
    fi
done

一句话

视频配音选Edge TTS最简单,对话场景选ChatTTS最自然。

相关文章

相关文章
2026-07-10
我用AI当mentor学Rust,它比教科书讲得好十倍
2026-07-16
AI Agent调试指南:Agent不按预期工作的10个常见原因
2026-08-13
FLUX 模型详解 2026:架构、尺寸,以及 Black Forest Labs 如何改变图像 AI

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论