2026年开源AI音乐生成:AudioCraft(2.3万星)对比 Stable Audio Tools,本地免费生成音乐

📘 教程 2026-08-05 约 4 分钟阅读

Meta的AudioCraft(23,536星)和Stability的stable-audio-tools(3,835星)能用自己的GPU生成音乐、音效和循环乐段——免费、无订阅、版权归你。

💡 你将学到

Meta的AudioCraft(23,536星)和Stability的stable-audio-tools(3,835星)能用自己的GPU生成音乐、音效和循环乐段——免费、无订阅、版权归你。

📜 目录

直接给结论

Meta的AudioCraft(23,536星,MIT)是最完整的开源音乐生成库:包含MusicGen(文字生成音乐)、AudioGen(文字生成音效)和EnCodec(压缩)。stable-audio-tools(3,835星,MIT)是Stability的开源版本——在更强的显卡上能生成更长、更高质量的立体声音乐。

用MusicGen生成第一首曲子

pip install audiocraft
from audiocraft.models import MusicGen
model = MusicGen.get_pretrained('facebook/musicgen-medium')  # 1.5B参数
model.set_generation_params(duration=8)

descriptions = ["upbeat electronic dance track with synth lead", "calm lo-fi beats for studying"]
wav = model.generate(descriptions)

好用的提示词技巧

  1. 写清楚风格+速度+乐器:"jazz piano trio, slow tempo, 60s film noir mood"
  2. 加制作质感词:"with vinyl crackle"(黑胶底噪)、"radio-friendly mix"
  3. 先生成4-8秒的循环乐段——比整曲可控得多

真实数据

FAQ

Q:生成的音乐能商用吗? A:代码是MIT,模型权重开放使用,但每个checkpoint要看模型卡——MusicGen权重是研究友好授权。

Q:显卡弱怎么办? A:用免费Colab显卡,或在Vast.ai/RunPod上租RTX 4090(约0.3美元/小时)批量生成。

Q:做声音转换呢? A:声音转换和歌声合成用RVC(37,104星),这是开源标准——配Coqui TTS(45,857星)使用。

相关文章

❓ 常见问题

Can I use the generated music commercially?

The code is MIT and the model weights are released for use, but check the model card for each checkpoint - MusicGen weights are research-friendly licensed.

My GPU is weak - alternatives?

Use a free Colab GPU, or rent an RTX 4090 on Vast.ai/RunPod for ~$0.30/hour to generate a batch of tracks.

RVC for voice?

For voice conversion and singing, RVC (37,104 stars) is the standard open-source choice - pair it with a TTS like Coqui (45,857 stars).

相关文章
2026-08-11
合成数据生成2026:训练更好模型的工具与方法
2026-07-19
AI模型部署策略:从开发到生产的完整流程
2026-07-19
AI Agent容错设计:挂了也能继续跑

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论