L O A D I N G
↓ 向下滚动进入
ORIZURU

不只有 Suno:AI 音乐工具全景与本地部署

这篇假设你已经看过前四篇,至少用 Suno 生成过一首歌,知道”抽卡”是怎么回事。 如果你直接从这篇开始读也行,但会有几个词看不懂。

全文约 40 分钟。第三章(开源本地部署)需要显卡和命令行,第一次读可以整节跳过,跳过不影响后面。

本篇涉及大量价格与条款信息。凡是我没查到一手来源的,都会显式写”未查证”,请不要把这些当成事实去做决策。

这是 AI 音乐系列六篇的第五篇:

  1. AI 写歌到底是怎么回事
  2. Suno 保姆级教程
  3. 让 AI 听懂你要的那个味道
  4. 把 AI demo 变成能听的成品
  5. 本篇——不只有 Suno:工具全景与本地部署
  6. AI 音乐怎么合法地发出去

零、先说用途,再选工具

先说用途,再选工具你要做什么带人声的歌纯背景音乐不想花钱Suno主力生态最成熟教程可迁移SOUNDRAWLoudlyStable Audio授权最干净ACE-Step 1.5本地跑需要显卡和命令行国内直连海绵音乐网易天音条款请自查AIVA 注意免费档版权归它Pro 档才归你MusicGen 注意权重 CC-BY-NC禁止商用选工具的第一问永远不是「哪个音质好」,而是「我这个用途,它的授权允许吗」

0.1 选工具的第一问不是”哪个音质好”

大部分人挑 AI 音乐工具的方式是错的:先去搜”2026 最强 AI 音乐工具排行”,然后挑排第一的。

这个顺序反了。

这些工具在”好不好听”这个维度上的差距,远小于它们在”你这个用途能不能用”这个维度上的差距。

举个最直接的例子:你用某个工具的免费档做了一段背景音乐,配到客户的宣传片里,收了钱。听感上完全没问题,但如果那家的免费档条款写的是”版权归我们、仅限非商业用途”,你这单就是违约的。音质好不好在这个场景下毫无意义。

所以正确的第一问是:我这个用途,它的授权允许吗。

0.2 三条分支

上面这张图把选择压缩成了三个问题。你只需要回答一个。

分支一:我要做带人声的完整歌曲。

主力仍然是 Suno。原因不是它一定最好听,而是三点:生态最成熟(分轨、续写、编辑都在一个界面里)、教程和社区经验最多、你在本系列前四篇学到的所有东西都是围绕它讲的。

国内能直连的替代品有海绵音乐、网易天音,见第一章——但它们的条款我这次没查到,别当成”随便用”。

分支二:我只要一段没有人声的背景音乐。

去 SOUNDRAW、Loudly、Stable Audio 这一类。它们的卖点不是音色,是授权干净。见第二章。

分支三:我不想花订阅费,也不介意折腾。

开源本地部署,ACE-Step 1.5。见第三章。但先看一眼第四章的成本账——大概率你会发现订阅更便宜。

0.3 这篇不会做的事

  • 不做”十大工具横评打分”。评分这种东西三个月就废了,而且大多是软文。
  • 不复述我没核实过的价格和额度。凡是标”未查证”的,请自己去官网当场看。
  • 不教你怎么绕过地区限制。

0.4 一句话状态更新(截至 2026-07-23)

在往下读之前,先把几个你可能听说过的名字对齐一下当前状态:

  • Suno:仍是市场第一,主力模型 v5.5(2026-03-26 发布)。中国大陆不能直接访问
  • Udio:2025 年 10 月与环球音乐和解后关闭了全部下载功能,截至 2026-07-23 下载仍未恢复,说好的授权版新平台也还没上线。作品出不来,现阶段不建议作为主力工具。
  • Riffusion:已被 Google 收购(二手来源称 2026-02-24),riffusion.com 和 producer.ai 现在打开是同一个页面,标题是「Google Flow Music」,由 Lyria 3 驱动。定价页写着 Free / Starter $6 月 / Plus $18 月 / Member $48 月。它的商用条款我没抓到 Terms 页,未查证。
  • Mureka(昆仑万维,前身天工 SkyMusic):mureka.ai/pricing 是 404,官网首页正文里挂着一段自称是「2025 Subscription Plans」的价格表。一个 2026 年的网站挂着 2025 年的价目表,这个信息时效存疑,我不把它当事实写,实际以你登录后看到的订阅页为准。

一、国内可直连的产品(截至 2026-07-23)

1.1 先把这一节的可信度说清楚

这是全篇最需要你自己动手核实的一节。

我这次调研对国内几家产品的抓取结果是这样的:官网能打开,首页文案能看到,但凡是涉及免费额度、单曲时长、是否可商用、能不能导出分轨的信息,全部需要登录后才可见,本次均未查证

所以这一节我只写两类内容:

  1. 官网当天实际能看到的页面信息(可以当事实)
  2. 明确标注为”未查证”的空白(不要当事实)

免费额度与商用条款均未查证,请以各家官网当前条款为准。 这句话在这一节里会重复出现,不是凑字数,是因为它真的重要。

1.2 海绵音乐(字节跳动)

官网https://www.haimian.com/

2026-07-23 抓取到的事实

  • 官网可以正常访问,不需要任何网络工具。
  • 首页主文案是「海绵音乐 Agent 让你的想法变成歌」。
  • 页面上标注的模型标识是 Music 5.3
  • 界面上有「纯音乐」选项——说明它支持只出伴奏、不出人声。
  • 有一个「免费创作」按钮。

以上就是全部能确认的信息。 下面这些,我没查到:

  • 免费额度是多少(每天几首、每月几首、有没有额度)——未查证
  • 单曲最长能生成多久——未查证
  • 免费档生成的歌能不能商用——未查证
  • 能不能导出分轨(人声/伴奏分开)——未查证
  • 导出格式是什么——未查证

「免费创作」这个按钮的存在,只能说明”有一条不付费的路径”,不能推出”完全免费”或”免费的能商用”。 这两件事是不同的。

1.3 网易天音

官网https://tianyin.163.com/

2026-07-23 抓取到的事实

  • 官网可以访问。
  • 页面是 JS 渲染的(意思是:内容由浏览器脚本动态生成,抓取工具拿不到正文),实际抓到的只有一个页面标题:「网易天音 - 一站式AI音乐创作工具」。

除了这个标题,其余全部未查证:功能范围、价格、商用条款、以及网上流传的各种”激励金活动”细节,本次一个都没核到。

我知道这一节看起来很空。空是诚实的结果。 我宁可写”没查到”,也不愿意给你一个抄自某个导航站的数字,让你拿它去做商业决策。

1.4 其他几家的状态

  • 天工 SkyMusic(昆仑万维):2024 年国内首个公开可用的音乐生成大模型,后来演进成了国际版品牌 Mureka。它作为一个独立产品是否还在运营,未查证。
  • QQ 音乐「启明星」、腾讯 Lyra 等本次未调研。 不是说它们不行,是我没查,所以不写。

1.5 为什么不采信 AI 导航站的说法

这一小节值得单独拿出来讲,因为它决定了你以后怎么判断信息。

搜”海绵音乐 免费”,你会搜到一堆结论明确的说法:「已完全免费」「免费最长 1 分钟」「无限次生成」。这些说法的来源,绝大多数是AI 工具导航站——那种收录了几千个 AI 工具、每个工具一个卡片页的网站。

为什么不能信它们

一、它们的内容通常是批量生成的。 一个站要覆盖几千个工具,不可能每个都去登录测试。常见做法是抓官网首页 + 让模型扩写成一段介绍。里面的数字很可能是模型顺手编的。

二、它们没有更新动力。 收录页面写完就挂在那里吃搜索流量,产品半年后改了价格,页面不会改。你搜到的”免费”可能是一年前的状态。

三、它们的商业模式是导流,不是准确。 很多站带联盟推广链接,“免费""无限”这类词能提高点击率。这不是阴谋论,是激励机制的自然结果。

四、它们会互相抄。 你会发现五个不同的站说着一模一样的话。五个来源说同一句话,不等于五重验证,可能只是同一个错误被复制了五次。

判断一条信息可不可信,看它能不能追到一手页面。 追不到的,就当它不存在。

1.6 你应该怎么自己核实(三步)

如果你打算认真用某个国产工具,花十分钟做这三件事,比看十篇测评有用:

第一步:注册并登录,看真实的额度页面。 未登录状态下的宣传页和登录后的账户页经常不一致。以账户页为准。

第二步:在官网页脚找「用户协议」「服务条款」「版权说明」,搜三个词。 搜「商用」「版权」「归属」。这三个词能定位到 90% 你需要的条款。看不到这些页面本身就是一个信号。

第三步:生成一首,下载,检查文件。 确认三件事:能不能下载、下载的是什么格式、文件里有没有 AI 标识。第三件尤其重要——按中国现行法规,音频类生成内容在提供下载时必须带显式标识,这会直接影响你后面能不能发布。具体规则在篇六讲。

把这三步的结果截图存下来。 条款是会变的,你留的是”我当时看到的是这样”的证据。


二、纯 BGM 工具:差别在授权,不在音色(截至 2026-07-23)

纯 BGM 工具,差别在授权不在音色截至 2026-07-23,条款请以各家官网当前版本为准自有数据 + 可转让授权分档授权SOUNDRAW / Loudly / Stable Audio训练数据来源相对干净授权可以跟着作品走适合:商单、客户交付以及需要长期使用的项目AIVA免费档:版权归 AIVA付费 Pro 档:版权归你最容易踩的坑:用免费档做了商单判断路径一:作品要交付给客户 → 必须选授权可转让的,且留存授权凭证判断路径二:只是自己视频的配乐 → 免费档通常够用,但仍要确认平台的商业化政策

2.1 先搞懂这类工具在解决什么问题

BGM = background music,背景音乐。这一类工具只出器乐,不出人声。

它们的核心卖点从来不是”更好听”,而是”出事的时候我能不能拿出授权证明”。

场景说明白一点:

  • 你给客户做了一条产品片,配乐用了某个 AI 工具生成的曲子。
  • 三个月后客户被平台通知这段音乐涉嫌侵权,或者被 Content ID 匹配上了。
  • 客户来找你。你需要拿出一份能证明”这段音乐我有权给你用”的东西。

这份东西就是 BGM 工具在卖的商品。 音色只是附带的。

2.2 两条不同的授权路线

图里的左右两栏,是两种完全不同的模式。

左边:自有数据 + 可转让授权。

代表是 SOUNDRAW、Loudly、Stable Audio。

它们的共同主张是:训练模型用的音乐是我们自己做的或者拿到授权的,不是从网上抓的别人的歌。 因为数据源头干净,所以它们敢把使用权明确地转让给你,你再转给客户。

具体到各家(均为 2026-07-23 抓取的官网表述):

  • SOUNDRAW:官网首页大字写「100% Copyright-Safe,不抓取他人歌曲,只用我们自己内部制作的音乐训练」。另有一个「for Artists」计划,宣称可以把作品发行到 Spotify / Apple Music / TikTok,并且你收取 100% 的歌曲版税
  • Loudly:自称「Rights-Safe AI Audio Engine」,声明其自有音乐数据集是通过”授权同意、透明、版权合规”建立的,因此能安全地把使用权转让给客户
  • Stable Audio(Stability AI):当前是 3.0,官网定位为「在完全授权数据上训练的模型家族」,三个卖点是开放权重可自行实验、可用自有曲库定制、企业授权提供法律赔偿保障

这里有一个措辞细节值得你留意:Loudly 转让的是「使用权(rights of usage)」,不是著作权。这两个不一样。使用权 = 你可以用;著作权 = 这东西是你的、别人不能用。别把”我能用”理解成”这是我的”。

右边:分档授权。

代表是 AIVA。这是本章最重要的一段。

2.3 AIVA 的坑:免费档的版权不归你

AIVA 提供 250 多种风格,支持上传音频或 MIDI 作为影响源。功能上没什么好挑的。

但它的授权是按档位分的,而且分得很彻底:

  • 免费档:生成作品的版权归 AIVA,你只能非商业使用,而且必须署名 AIVA
  • Pro 档:你永久拥有作品的完整版权

(以上为 2026-07-23 官网表述。各档位的具体价格数字未查证——它的价格表是 JS 渲染的,我只抓到 Free 那一档标的是 €0。)

为什么这是”最容易踩的坑”

因为整个流程里没有任何一步会拦住你。免费档能生成、能试听、能下载。文件拿到手上,和付费档的文件长得一模一样。没有水印,没有弹窗,没有任何提示告诉你”这个不能拿去接商单”。

于是最典型的翻车是这样的:用免费档做了几首,觉得挺好,直接用到了客户项目里。等到需要出授权证明的时候才发现,按条款这些作品的版权根本不是你的,而且你连署名都没加。

怎么避免:只要作品会离开你自己的电脑——发布、交付、投放、上架——就先确认你当时用的是哪个档位。

2.4 另外两家和它们的空白

  • Beatoven.ai:站点定位是 Royalty Free AI Music Generator(免版税 AI 音乐生成器),另有音效、API、Music Intelligence 产品线。它的版权/商用规则未查证,价格也未查证(/pricing 返回 404)。
  • Boomy:官网全部是 JS 渲染,本次什么都没抓到,全部未查证

2.5 价格:这一整块我都没查到

必须直说:本章提到的 BGM 工具,价格数字我一个都没能确认。

  • SOUNDRAW:/pricing 和 /pricing_plan 都是 404 —— 未查证
  • Beatoven.ai:/pricing 404 —— 未查证
  • Loudly:/pricing 404 —— 未查证
  • AIVA:价格表 JS 渲染,只抓到 Free = €0 —— 未查证
  • Boomy:官网全 JS —— 未查证
  • Stable Audio:stableaudio.com/pricing 抓取为空,面向个人的订阅价格未查证

这类工具改价很频繁,官网结构也经常调整(上面那么多 404 就是证据)。请直接去官网看当前价格,别信任何二手数字,包括半年后的这篇文章。

2.6 判断路径:你到底该选哪家

图里给了两条判断路径,我把它展开成可执行的。

路径一:作品要交付给客户 → 必须选授权可转让的,并且留存授权凭证。

这条路上你要做的事:

  1. 选左栏那一类(自有数据 + 明确可转让授权)。
  2. 用付费档,不要用免费档。
  3. 下载并保存授权文件——很多工具会在账户页提供 license 证书或收据,下载下来存到项目文件夹里,和交付物放在一起。
  4. 在给客户的交付清单里写明音乐来源和授权类型。

第 3 步是最多人漏掉的。 “我记得当时是付费账号”在需要举证的时候没有任何用。

路径二:只是自己视频的配乐 → 免费档通常够用,但仍要确认平台的商业化政策。

注意”通常”两个字。免费档能不能用在你的视频里,取决于你的视频算不算商业用途。

一个很多人不知道的点:如果你的视频开了平台的流量分成、带货、或者接了商单,那条视频在多数条款里就属于商业用途了,免费档的”仅限非商业”就管到你头上了。个人号发着玩确实没事,一旦开始赚钱,规则就变了。

2.7 和 Suno 那条路线的区别

顺带说清一件容易混的事。

  • BGM 工具走的是”训练数据从一开始就干净”路线。它们的授权底气来自源头。
  • Suno 这类走的是”先做出来,再和大厂谈和解拿授权”路线。它们的规则还在变——2025 年 11 月到 12 月之间,Suno 的版权说明措辞就改过一次。

对你的实际影响是:接商单、做投放、给客户交付,优先用前者;自己做歌、发着玩、练手,后者更好用。 这不是谁高谁低,是两种工具解决的问题不一样。


三、开源本地部署(需要显卡和命令行,第一次读可以整节跳过)

这一整节可以跳过。

它需要你有一张独立显卡(显存 8GB 以上才有意义),并且愿意在命令行里折腾环境。第一次配环境半天到一天是常态。

如果你没有独立显卡,直接跳到第四章。 那一章会用数字告诉你:为了做几首歌去买显卡,是笔亏本买卖。

开源方案,先看你的显卡这一节需要显卡和命令行,第一次读可以整节跳过ACE-Step 1.5YuEMusicGenMIT 协议可商用Apache-2.0可商用权重 CC-BY-NC禁止商用官方给了显存分级从 6GB 到 24GB都有对应配置24GB 只能跑两段整首歌需要 80GB 以上只出器乐不出人声消费级显卡上唯一实际可用的整歌方案个人机器基本别想跑整首适合做实验不适合做作品如果你只想试一个,试 ACE-Step如果你没有独立显卡,这整节都不用看——订阅费比显卡便宜得多,理由见下一张图

3.1 先解释三个词

  • 显存:显卡自己的内存,单位 GB。模型必须先装进显存才能跑。显存不够就直接报错,不是”跑得慢一点”。 这是本节最重要的一个概念。
  • 权重:模型训练出来的那一大堆参数文件,通常几个 GB 到十几个 GB。跑模型 = 下载权重 + 加载进显存 + 喂输入。
  • 开源许可:这份代码和权重允许你怎么用。代码的许可和权重的许可可以是两份不同的东西——这一点后面会要你的命。

3.2 三个方案的定位(一句话版)

  • ACE-Step 1.5:MIT 许可,可商用。消费级显卡上唯一实际可用的整歌方案。 想试一个,就试它。
  • YuE:Apache-2.0,可商用。质量有口碑,但个人机器基本别想跑整首
  • MusicGen权重是 CC-BY-NC,禁止商业使用。 只出器乐不出人声。适合做实验,不适合做作品。

3.3 ACE-Step 1.5(MIT,显存数据截至 2026-07-23)

仓库https://github.com/ace-step/ACE-Step-1.5

为什么它是这三个里唯一实际可用的

  1. MIT 许可——最宽松的开源许可之一,商用没有障碍。
  2. 官方明确支持 Mac、AMD、Intel、CUDA 四类平台。不是只有 N 卡能跑。
  3. 官方给了一张完整的显存分级表,从 6GB 以下一直到 24GB 以上都有对应配置。这件事比听起来重要——大多数开源项目只写”推荐 24GB”,然后你的 12GB 卡就只能自己试。

官方显存分级表(原文抓取,2026-07-23):

你的显存推荐 DiT推荐 LM后端备注
≤6GB2B turbo不启用 LMINT8 量化 + 全量 CPU offload
6–8GB2B turbo0.6Bpt轻量 LM + PyTorch 后端
8–16GB2B turbo/sft0.6B(8–12GB)/ 1.7B(12–16GB)vllm
16–20GB2B sft 或 XL turbo1.7BvllmXL 在 20GB 以下需 CPU offload
20–24GBXL turbo/sft1.7BvllmXL 可不 offload,4B LM 可用
≥24GBXL sft4Bvllm全部模型不 offload,质量最好

表里的词都是什么意思

  • DiT / LM:两个模型部件。你不需要懂原理,只需要知道它们越大质量越好、也越吃显存
  • 2B / XL(4B):模型规模。数字越大越吃显存。
  • turbo / sft:同一规模的两个版本。turbo 快,sft 质量更好。
  • 量化:把模型参数压缩成更小的格式,用一点质量换显存。
  • CPU offload:显存装不下的部分放到内存里。能跑,但明显更慢
  • 后端(pt / vllm):跑模型的引擎。vllm 更快,但对环境要求更高。

权重占用(官方数据):XL(4B) 约 9GB 显存,2B 约 4.7GB。XL 需要 12GB 以上(配 offload + 量化)或 20GB 以上(不 offload)。

一个省事的事实:官方 UI 会按你的显卡自动选配置。上面这张表主要是给你”我这张卡到底能跑到什么档”的预期,不是要你手动填参数。

3.4 ACE-Step 的最小可跑路径(思路,不是逐步安装教程)

先说清楚我不做什么:我不会在这里写具体的安装命令。

原因很实在:开源项目的安装步骤三个月就会变一次——依赖版本、参数名、模型下载地址都在动。我在这里写死一串命令,你半年后照着敲,大概率报错,而且你不知道是哪一步错的。照抄一串过期命令,比自己读一遍 README 更浪费时间。

所以这一小节给的是前提条件 + 路径形状。真正的命令请以仓库 README 当前版本为准。

动手之前先确认四件事

一、你的显存有多少。 Windows:任务管理器 → 性能 → GPU,看”专用 GPU 内存”。Mac:统一内存架构,显存和内存共享,看总内存。 对着上面那张表判断你能跑哪一档。低于 6GB 就别开始了。

二、你有几十 GB 的空闲硬盘。 模型权重加上依赖库,占用不小。硬盘满了会在下载到一半时失败,很难排查。

三、你能接受第一次配环境花半天到一天。 这不是危言耸听,是常态。Python 环境、显卡驱动、依赖版本,任何一环对不上都要查。

四、网络能稳定访问 GitHub 和模型托管站。 权重文件很大,下载中断重来非常消耗耐心。

路径的形状(四步)

  1. 准备一个独立的 Python 环境。 别装在系统环境里——依赖冲突会污染你电脑上其他的 Python 项目,清理起来很烦。用 venv 或 conda 都行。
  2. 按仓库 README 装依赖。 这一步是最容易出问题的地方。README 里通常会区分 CUDA / Mac / CPU 的不同装法,认准你自己那一条,别混着装
  3. 拉取模型权重。 有的项目在首次运行时自动下载,有的需要手动拉。看 README。
  4. 启动官方 UI,让它自动选配置,先生成一段最短的试试。

第 4 步的”先生成最短的”很关键。 第一次跑别急着要整首歌——先确认整条链路是通的。链路通了以后再加长度,出问题时你才知道是”环境没配好”还是”显存不够”。

关于失败:本地部署第一次跑不通是常态,不是你笨。最常见的三类错误是显存不足(OOM)、依赖版本不匹配、模型文件没下全。把报错信息原样复制去搜,或者贴给 AI 助手,比自己盯着屏幕猜快得多。

3.5 两条官方要求,别忽略

ACE-Step 的 License & Disclaimer 里明确要求使用者做三件事:

  1. 核验作品的原创性——别生成出一段和现有歌曲高度雷同的东西然后拿去发。
  2. 清楚披露 AI 参与——这和中国的标识办法、Spotify 的披露机制方向一致。
  3. 改编受保护的风格或素材时取得许可

“开源”意味着代码免费,不意味着你可以不管版权。 而且开源方案不提供任何法律保护——商业产品出事至少还有条款和厂商,开源出事全部由你自己承担。

3.6 一个安全提醒:小心仿冒站点

ACE-Step 官方专门警告过这件事:唯一的官方站点是它的 GitHub 仓库和 GitHub Pages。网上存在多个仿冒的收费域名(形如 ac**p.com / a**p.org),不要在那些站点付款

判断方法很简单:一个 MIT 许可的开源项目,官方不会向你收费。 任何要你付钱下载 ACE-Step 的页面,都不是官方。

3.7 YuE(Apache-2.0):好,但你的机器跑不动

仓库https://github.com/multimodal-art-projection/YuE (HKUST / M-A-P 出品)

许可:模型与权重均为 Apache-2.0,可商用。官方条款鼓励创作者自由把输出用于商业项目,建议署名「YuE by HKUST/M-A-P」,并建议在上传流媒体平台时标注「AI-generated / AI-assisted」。

许可这块没问题,问题在硬件。官方原文写得很清楚

  • 24GB 及以下显存,最多只能跑 2 个 session(默认是 1 段主歌 + 1 段副歌),再多就会显存溢出。
  • 要生成完整的一首歌(4 个以上 session),建议 ≥80GB 显存——H800 / A100 这个级别,或者多张 4090 做张量并行。

翻译成人话:一张 4090 是 24GB,是消费级显卡的顶配。顶配也只够出两段。 80GB 是数据中心显卡的规格,个人不会有。

社区确实有 YuE-exllamav2、YuEGP 这类降低配置要求的方案,但官方自己承认这些方案会牺牲音乐性

结论:个人机器上,YuE 基本别想跑出整首歌。 这是它和 ACE-Step 最大的差距——不是质量差距,是”能不能用”的差距。

3.8 MusicGen / AudioCraft(Meta):最容易踩的许可陷阱

仓库https://github.com/facebookresearch/audiocraft

这一段是本章最重要的一条信息

MusicGen 的代码是 MIT,但模型权重是 CC-BY-NC 4.0 —— 也就是”禁止商业使用”。

为什么这么多人踩

因为大家看到 GitHub 页面右侧标着 “MIT License” 就放心了。但你实际跑的时候用的是权重,不是代码。 仓库里有两份许可文件——LICENSE(代码,MIT)和 LICENSE_weights(权重,CC-BY-NC)。第二份才是管你输出的那一份。

CC-BY-NC 里的 NC = NonCommercial(非商业)。 意味着:

  • 你不能拿 MusicGen 的输出去接商单
  • 不能用在会赚钱的视频里
  • 不能上架到流媒体分成
  • 不能卖给客户

它适合什么:学习、研究、纯个人玩。理解 AI 音乐生成是怎么回事,它是个不错的起点。

另外它只出器乐,不出人声。 想要带唱的歌,它本来也不是选项。

3.9 开源方案现在到底什么水平

必须给一个诚实的判断。

网上能搜到不少”ACE-Step 1.5 已超越商业方案”的说法。这类说法基本来自它自己的宣传页和 SEO 站点,我没有找到任何独立的盲测数据,所以不采信。

我能给出的稳妥说法是:

开源已经到了”可用”的程度,但在人声自然度和混音完成度上,仍然落后于 Suno v5.5。

具体表现在:人声的咬字和情绪起伏不如 Suno 自然;出来的成品更”生”,需要更多后期(见篇四)。

开源真正的优势不是质量,是这三条

  1. 许可清楚——MIT / Apache-2.0 写在那里,不会因为某家公司和唱片公司谈了个协议就变。
  2. 数据不出本机——需要保密的项目,这一条是刚需。
  3. 不受额度限制——跑多少次都不扣点数,只花电费和时间。

如果你的诉求只是”做几首好听的歌”,这三条对你都没用。 那就用云端。


四、本地 vs 云端的真实成本账

本地部署到底省不省钱云端订阅本地部署每月固定几十块显卡几千到上万一次性投入开箱即用零配置时间第一次配环境半天到一天生成快几十秒一首看显卡慢的要几分钟规则由厂商定随时可能变规则由你定断网也能跑什么情况下本地才划算:你已经有一张 12GB 以上的显卡、要跑的量很大、或者需要数据不出本机只是想做几首歌自己听——订阅永远更便宜

4.1 结论先说

如果你只是想做几首歌自己听,订阅永远更便宜。没有例外。

这一节剩下的内容都是在解释为什么。如果你已经接受这个结论,可以直接跳到第五章。

4.2 四个维度的对照

图里列了四组对比,我逐条说清楚。

一、钱:每月固定几十块 vs 显卡几千到上万的一次性投入。

云端这一侧我有一个查证过的锚点:Suno Pro 档按年付折算是 $8/月,Premier 是 $24/月(suno.com/pricing,2026-07-23,页面默认展示年付价)。

本地这一侧,显卡是一次性投入。具体价格我没有查证,不写数字——显卡价格波动大,而且新卡二手卡差别巨大。图里给的”几千到上万”是一个量级判断,够用了。

关键在于怎么比。 把显卡钱换算成”等于多少个月的订阅”,你会立刻得到答案:一张够用的显卡,钱大概等于好几年的订阅费。

而且这个对比对本地还不公平,因为:

  • 显卡会折旧,三年后它不值那个钱了
  • 电费是持续支出(具体功耗和电价我没查证,不给数字,但它不是零)
  • 显卡还有个使用寿命问题

二、时间:开箱即用、零配置 vs 第一次配环境半天到一天。

这一项最容易被低估。

云端:注册、付款、开始生成。十分钟内你就在听第一首歌了。

本地:装环境、装驱动、装依赖、下权重、调参数、排错。半天到一天是顺利的情况,卡住的话可能是两三天。

把你的时间按小时估个价,再乘上去。 对绝大多数人来说,光是第一次配环境的时间成本就已经超过一年的订阅费了。

三、速度:几十秒一首 vs 看显卡,慢的要几分钟。

云端跑在专业硬件上,还有优化过的推理服务。你的显卡跑不过它。

这一项在实际使用中的影响比数字看起来大得多。因为 AI 音乐的工作方式是抽卡——生成十首挑一首(见篇二)。

  • 一首 30 秒:抽十次 5 分钟,你还在状态里。
  • 一首 3 分钟:抽十次半小时,你已经走神了。

慢会直接杀死创作节奏。 这不是”多等一会儿”的问题。

四、控制权:规则由厂商定、随时可能变 vs 规则由你定、断网也能跑。

这是本地唯一真正无可替代的优势。

云端的规则确实在变,而且变得不慢。举两个已经发生的例子:

  • Udio 在 2025 年 10 月和解当天关闭了全部下载功能,到 2026-07-23 仍未恢复。用户的作品就那么被锁在里面了。
  • Suno 已经预告,新的授权模型上线后现有模型将被弃用,免费档歌曲将不可下载,付费档会有每月下载次数上限(二手来源,截至 2026-07-23 定价页尚未体现)。

本地部署的模型不会有这种事。 权重下载到你硬盘上,那就是你的了,断网也能跑。

4.3 什么情况下本地才划算

图里给的三个条件,满足任意一个才值得考虑:

一、你已经有一张 12GB 以上的显卡。

注意是”已经有”。为了跑 AI 音乐去买显卡,成本账算不过来。但如果你本来就有(打游戏、做视频、跑别的 AI),那边际成本就只剩电费和时间了——这时候值得试。

12GB 这个门槛对应 ACE-Step 分级表里”能舒服跑起来”的位置。

二、你要跑的量非常大。

比如你在批量做素材,一天要出几百段。这时候云端的额度费用会变成一笔真实开销,本地的固定成本才有摊薄的空间。

做几首歌的人不属于这一类。 判断标准很简单:如果你每个月的订阅额度都用不完,那你不是大批量用户。

三、你需要数据不出本机。

商业保密项目、客户素材不允许上传第三方服务器。这种情况下,本地是唯一选项,不是成本问题,是能不能做的问题。

4.4 一个折中方案

如果你既想试开源,又不想买显卡:租云 GPU 按小时付费。

思路是:在云上租一台带显卡的机器,跑完关掉,按小时计费。这样你能试到开源模型,又不用一次性投入。

具体平台和价格我没有调研,不给推荐。 只是告诉你有这条路,别以为”用开源”就等于”必须买显卡”。


五、这一篇里哪些信息最先过期

这一节直接引用调研报告的「变化速度分级」。本篇写于 2026-07-23,你现在读到的时候,下面这几段很可能已经不准了。

5.1 极快(3 个月内必过期)

这几条请务必以官网当前页面为准,别信本文:

  1. Suno 的所有权 / 商用条款措辞。 2025 年 11 月到 12 月之间已经改过一次——从「你拥有歌曲」弱化为「你被授予商用使用权」。Warner 授权模型上线后还会再改。
  2. Suno 的下载规则。 已预告免费档不可下载、付费档加月度下载上限,但截至 2026-07-23 定价页仍未体现。随时会落地。
  3. Suno 的模型代号与可用模型列表。 官方已预告”新授权模型上线后现有模型将被弃用”,v5.5 随时可能不再是主力。
  4. Udio 是否恢复下载 / 授权版新平台是否上线。 从 2025-10 拖到 2026-07 仍未上线,但它 2026-07-17 宣布了内容保护方面的技术合作,说明临门一脚。
  5. 各流媒体 / 发行商的 AI 披露机制。 详见篇六

对本篇的影响:第零章那份”一句话状态更新”最先失效。

5.2 较快(半年一变)

  1. 所有工具的价格与额度。 Suno、Riffusion、LALAL.ai、Mureka 都在过去一年内调过档位。
  2. 中国大陆产品的可用性与免费策略。 海绵音乐、网易天音的免费额度与商用政策变动频繁,而且官网信息本来就稀薄,必须实际登录确认
  3. 开源模型的版本与显存要求。 ACE-Step 从 1.0 到 1.5 的显存分级表已经整个重写过一次;YuE 的社区降配方案在持续演进。

对本篇的影响:第一章(国内产品)和第三章那张显存表最先失效。第三章那张表尤其要注意——它是 1.5 版本的表,换个版本号可能就整张换掉。

5.3 相对稳定(一年以上)

这几条你可以放心引用:

  1. 开源许可:MusicGen 权重 CC-BY-NC(禁商用)、ACE-Step MIT、YuE Apache-2.0、Demucs MIT。这些是稳定事实。
  2. 各工具的「训练数据主张」定位:SOUNDRAW / Loudly / Stable Audio 的”干净数据”路线是它们商业模式的根基,不会轻易变。
  3. 「能商用 ≠ 有版权」这条原则:除非各国版权法修改,否则长期成立。
  4. 中国《人工智能生成合成内容标识办法》的条文:部门规章,2025-09-01 施行,短期内不会改(但配套国标与平台执行细则会变)。

5.4 本篇明确标注为”未查证”的清单

方便你集中核实。以下每一条,我这次都没查到可靠一手来源:

  • 海绵音乐的免费额度 / 单曲时长 / 商用条款 / 分轨能力
  • 网易天音的功能、价格、商用条款(官网只抓到页面标题)
  • 天工 SkyMusic 独立产品是否还在运营
  • QQ 音乐「启明星」、腾讯 Lyra(本次未调研)
  • Riffusion / Google Flow Music 的商用条款
  • Mureka 的当前有效价格(官网挂的是自称 2025 年的方案)
  • SOUNDRAW / Beatoven / Loudly / Boomy 的价格
  • AIVA 各档位的价格数字
  • Boomy 的全部信息
  • Stable Audio 个人订阅价格
  • Stable Audio Open 开放权重的具体商用许可条款
  • 显卡功耗与电费的具体数字(本文只给量级判断)
  • 云 GPU 租用平台与价格(本次未调研)

处理原则:这些条目在正文里要么没写,要么写了但明确标了”未查证”。如果你在别处看到有人给出了这些数字,先问一句”来源是哪个页面”。


六、翻车速查

按”你遇到的现象”查。

现象:用免费档做的音乐用到了客户项目里,事后才发现条款不允许。

  • 原因:免费档普遍限定非商业用途,AIVA 甚至明确写版权归它自己。
  • 处理:立刻停止使用,换付费档重新生成一版替换掉。不能靠”补订阅”追溯——多数条款不支持事后补授权(Suno 官方就明确说了不行)。
  • 预防:作品只要会离开你自己的电脑,就先确认档位。

现象:客户要授权证明,你拿不出来。

  • 原因:只记得”当时是付费账号”,没留凭证。
  • 处理:登录当时的账户,找账单记录、license 证书、生成记录,能截多少截多少。
  • 预防:交付时把授权文件和成品放在同一个文件夹里。

现象:照着网上教程装 ACE-Step,命令报错。

  • 原因:那篇教程的命令过期了。开源项目的安装步骤三个月一变。
  • 处理:回到官方仓库 README 重新走一遍,别在过期教程上继续排错。
  • 预防:任何开源项目,第一手信息永远是它的 README,不是转载教程。

现象:本地跑模型报显存不足(OOM)。

  • 原因:模型配置超出了你的显卡。
  • 处理:对照官方显存分级表降档——换更小的模型、开量化、开 CPU offload。降档能跑起来,代价是慢和质量下降。
  • 预防:开始前先查清自己的显存,按表选档。

现象:本地生成一首歌要好几分钟,完全没法抽卡。

  • 原因:正常现象,你的显卡跑不过云端的专业硬件。
  • 处理:先用最短时长跑通流程,需要大量抽卡的阶段用云端,最终定稿再考虑本地。
  • 预防:见第四章——大多数人不该本地跑。

现象:拿 MusicGen 的输出接了商单。

  • 原因:只看了仓库的 MIT 标签,没看权重许可。
  • 处理:立刻换掉。CC-BY-NC 是明确禁止商用的,这不是灰色地带。
  • 预防:开源项目要分开看代码许可和权重许可,看仓库里有没有第二份 LICENSE 文件。

现象:搜到的国内产品免费额度和实际登录后看到的对不上。

  • 原因:你搜到的多半是 AI 导航站的批量生成内容,可能过期,也可能本来就是编的。
  • 处理:以登录后账户页为准,截图存证。
  • 预防:见 1.5。追不到一手页面的信息,就当它不存在。

现象:在某个网站上付钱下载了 ACE-Step。

  • 原因:仿冒站点。官方已经点名警告过存在多个收费仿冒域名。
  • 处理:立刻申请退款并检查支付安全。
  • 预防:MIT 许可的开源项目不会向你收费。 认准 GitHub 官方仓库。

七、下一步

这一篇讲的是”还有哪些工具、以及它们各自的授权边界”。到这里你应该能回答三个问题:

  • 我这个用途该用哪一类工具
  • 这个工具的授权允许我做什么
  • 我的电脑值不值得折腾本地部署

下一篇是最后一篇,也是最不能跳过的一篇。

篇六:AI 音乐怎么合法地发出去 讲的是把歌真正发出去的完整链路:

  • 中国的《人工智能生成合成内容标识办法》怎么落地到你的具体操作——音频要在什么位置加什么标识、导出文件要带什么、发布时要声明什么
  • Spotify、Apple Music、YouTube 三个平台的 AI 披露要求各是什么
  • 怎么不被 Spotify 的 spam 过滤器误伤
  • 发行商怎么选,以及为什么这一节只给选型维度不给具体条款
  • 三条变现路径的诚实期望值

如果你打算把作品发到任何公开平台上,篇六是必读的。 本篇讲的是”用哪个工具不违约”,篇六讲的是”发出去不违法”——后者的风险更高。

往回看:

  • 本地部署跑出来的成品需要后期,回到 篇四
  • 换了工具以后提示词写法也要调整,参考 篇三(篇三的方法论通用,但具体标签语法是 Suno 的社区经验,换工具不一定认)

本篇事实基准日:2026-07-23。 全部价格、条款、版本号、显存要求均为该日抓取的官网信息。 标注为「未查证」的条目,请勿当作事实使用。 建议每季度复核一次第零章、第一章、第三章。