← 返回博主原创
BiFish original · 2026-07-25

AudioCraft:Meta 出品的 AI 作曲家,描述风格就能编曲

告诉它你想要什么风格的音乐,AudioCraft 就帮你作曲编曲,还能生成各种音效

它是什么

你知道 Meta 吧?就是 Facebook、Instagram、WhatsApp 的母公司。他们搞了个 AI 音乐项目叫 AudioCraft,简单说就是:你用文字描述想要的音乐风格,它就帮你作曲、编曲、生成完整的音乐。

打个比方,以前你想做一首歌,得找作曲、编曲、录音、混音一堆人。现在你跟 AudioCraft 说一句「来一段 80 年代复古合成器风格的电子音乐,节奏中等,带点忧伤的感觉」,30 秒后它就给你交作业了。

AudioCraft 其实是一个「三合一」工具箱,里面包含三个工具:

  • MusicGen:负责生成音乐。你描述风格,它作曲编曲一条龙搞定。
  • AudioGen:负责生成音效。比如「下雨声」「脚步声」「开门声」,说啥来啥。
  • EnCodec:负责音频压缩(把大音频文件变小但音质不怎么损失),是前两个工具的底层技术。

解决什么问题

做音乐这件事,门槛一直很高。你得懂乐理、会乐器、会用编曲软件(那些密密麻麻的轨道和按钮,看着就头大)。就算你只是想给视频配个 30 秒的背景音乐,也得折腾半天。

AudioCraft 解决的核心问题是:让「描述音乐」代替「制作音乐」。

你不需要懂什么是 C 大调、什么是 4/4 拍,你只需要会说「我想要一首欢快的、适合夏天海边听的吉他曲」就够了。

特别适合这些人:

  • 视频创作者需要原创背景音乐(不想有版权问题)
  • 游戏开发者需要大量不同风格的 BGM(背景音乐)
  • 设计师做 Demo(演示样品)时需要配乐
  • 纯粹好奇 AI 能做出什么音乐的人

长什么样

AudioCraft 提供了一个网页界面(通过 Gradio 搭建),打开后你会看到:

  • 顶部:一个文本输入框,写着「Describe your music」(描述你的音乐)
  • 中间:几个滑块,可以调节生成时长(最长 30 秒)、音乐质量等参数
  • 可选区域:可以上传一段参考旋律,让 AI 基于它来编曲
  • 底部:一个「Generate」按钮和音频播放器

整体界面很简洁,没有那些让人眼花缭乱的按钮。基本上就是:打字 → 点按钮 → 听结果。

怎么安装

跟着来,一步步操作:

  1. 确认电脑装了 Python 3.9 或更高版本。打开命令行输入 python --version 检查。没有就去 python.org 下载,安装时勾选「Add Python to PATH」。
  2. 确认装了 Git(一个代码下载工具)。命令行输入 git --version 检查。没有就去 git-scm.com 下载安装,一路点「Next」就行。
  3. 打开命令行,把项目代码下载到本地:
    git clone https://github.com/facebookresearch/audiocraft.git
  4. 进入项目文件夹:
    cd audiocraft
  5. 安装依赖(就是项目运行需要的其他工具包):
    pip install -e .
    这步可能要等几分钟。
  6. 启动网页界面:
    python -m demos.musicgen_app --server 127.0.0.1
  7. 看到命令行里出现一个网址(http://127.0.0.1:7860),用浏览器打开它,就能看到界面了。

硬件要求:最好有 NVIDIA 显卡(6GB 显存以上体验较好)。没有显卡也能跑,但生成速度会慢不少。

怎么用

第一步:描述你想要的音乐

在文本框里用英文描述(目前英文效果最好),比如:

  • lo-fi hip hop beat, chill, rainy day mood, soft piano(低保真嘻哈节拍,放松,雨天氛围,柔和钢琴)
  • epic orchestral music, cinematic, dramatic strings, building up(史诗管弦乐,电影感,戏剧性弦乐,逐渐增强)
  • upbeat pop song, catchy melody, summer vibes, female vocal style(欢快流行歌,洗脑旋律,夏日感,女声风格)

第二步:调整参数

  • 时长:拖动 Duration 滑块,选 10 秒、20 秒或 30 秒
  • 模型大小:small(快但质量一般)、medium(平衡)、large(慢但最好听)

第三步:点击 Generate

等 10-60 秒(取决于你的电脑配置和选的模型大小),音频就出来了。页面上会显示一个播放器,点播放试听。

第四步:不满意就改描述再来一次

觉得太欢快了?加个「melancholic」(忧郁的)。觉得太简单了?加个「complex arrangement, multiple instruments」(复杂编曲,多种乐器)。多试几次就能找到感觉。

生成音效(用 AudioGen):

启动音效界面:

python -m demos.audiogen_app --server 127.0.0.1
然后输入描述,比如 dog barking in a park(公园里狗叫)、thunder and heavy rain(打雷下大雨)。

需要 AI 模型吗?

AudioCraft 本身就是 AI 模型,不需要你额外去申请什么 API Key(身份验证密码)。安装好之后,第一次运行会自动下载预训练模型(大概 1-3GB,取决于你选的模型大小),之后就可以离线使用了。

所有计算都在你自己电脑上完成,不联网也能用,不用担心隐私问题。

如果你想了解更多可用的 AI 模型,或者想对比不同工具哪个更适合你,可以去模型导航挑一个适合你的 AI 助手 →

费用

完全免费,开源的。

AudioCraft 采用 MIT 协议开源,个人使用和商用都不收钱。Meta 这么大公司做的东西,免费给你用,挺良心的。

唯一的花费就是你的电脑硬件——如果显卡太老(低于 4GB 显存),可能需要升级一下才能流畅运行。

适合谁

  • 视频/短视频创作者:需要大量不重样的原创 BGM,告别版权烦恼
  • 独立游戏开发者:一个人做游戏,配乐也自己搞定
  • 播客/直播主:需要片头曲、转场音乐、背景氛围音
  • 音乐爱好者:不会乐器但脑子里有旋律,想让 AI 帮你实现
  • 广告/营销从业者:快速出 Demo 给客户听效果
  • 学生/教育者:做课件、做项目需要配乐素材

项目地址

GitHub(全球最大代码托管平台,22000+ 人点了星):https://github.com/facebookresearch/audiocraft

这是 Meta 官方研究团队(Facebook Research)维护的项目,代码质量和文档都比较靠谱。README 里有详细的安装说明和示例代码。

本文基于公开来源进行分析,AI 参与资料整理与初稿生成,最终由人工确认选题和发布。涉及产品能力、价格或政策时,请以原始来源的最新信息为准。