这篇假设你已经看过前四篇,至少用 Suno 生成过一首歌,知道”抽卡”是怎么回事。 如果你直接从这篇开始读也行,但会有几个词看不懂。
全文约 40 分钟。第三章(开源本地部署)需要显卡和命令行,第一次读可以整节跳过,跳过不影响后面。
本篇涉及大量价格与条款信息。凡是我没查到一手来源的,都会显式写”未查证”,请不要把这些当成事实去做决策。
这是 AI 音乐系列六篇的第五篇:
- AI 写歌到底是怎么回事
- Suno 保姆级教程
- 让 AI 听懂你要的那个味道
- 把 AI demo 变成能听的成品
- 本篇——不只有 Suno:工具全景与本地部署
- AI 音乐怎么合法地发出去
零、先说用途,再选工具
0.1 选工具的第一问不是”哪个音质好”
大部分人挑 AI 音乐工具的方式是错的:先去搜”2026 最强 AI 音乐工具排行”,然后挑排第一的。
这个顺序反了。
这些工具在”好不好听”这个维度上的差距,远小于它们在”你这个用途能不能用”这个维度上的差距。
举个最直接的例子:你用某个工具的免费档做了一段背景音乐,配到客户的宣传片里,收了钱。听感上完全没问题,但如果那家的免费档条款写的是”版权归我们、仅限非商业用途”,你这单就是违约的。音质好不好在这个场景下毫无意义。
所以正确的第一问是:我这个用途,它的授权允许吗。
0.2 三条分支
上面这张图把选择压缩成了三个问题。你只需要回答一个。
分支一:我要做带人声的完整歌曲。
主力仍然是 Suno。原因不是它一定最好听,而是三点:生态最成熟(分轨、续写、编辑都在一个界面里)、教程和社区经验最多、你在本系列前四篇学到的所有东西都是围绕它讲的。
国内能直连的替代品有海绵音乐、网易天音,见第一章——但它们的条款我这次没查到,别当成”随便用”。
分支二:我只要一段没有人声的背景音乐。
去 SOUNDRAW、Loudly、Stable Audio 这一类。它们的卖点不是音色,是授权干净。见第二章。
分支三:我不想花订阅费,也不介意折腾。
开源本地部署,ACE-Step 1.5。见第三章。但先看一眼第四章的成本账——大概率你会发现订阅更便宜。
0.3 这篇不会做的事
- 不做”十大工具横评打分”。评分这种东西三个月就废了,而且大多是软文。
- 不复述我没核实过的价格和额度。凡是标”未查证”的,请自己去官网当场看。
- 不教你怎么绕过地区限制。
0.4 一句话状态更新(截至 2026-07-23)
在往下读之前,先把几个你可能听说过的名字对齐一下当前状态:
- Suno:仍是市场第一,主力模型 v5.5(2026-03-26 发布)。中国大陆不能直接访问。
- Udio:2025 年 10 月与环球音乐和解后关闭了全部下载功能,截至 2026-07-23 下载仍未恢复,说好的授权版新平台也还没上线。作品出不来,现阶段不建议作为主力工具。
- Riffusion:已被 Google 收购(二手来源称 2026-02-24),riffusion.com 和 producer.ai 现在打开是同一个页面,标题是「Google Flow Music」,由 Lyria 3 驱动。定价页写着 Free / Starter $6 月 / Plus $18 月 / Member $48 月。它的商用条款我没抓到 Terms 页,未查证。
- Mureka(昆仑万维,前身天工 SkyMusic):mureka.ai/pricing 是 404,官网首页正文里挂着一段自称是「2025 Subscription Plans」的价格表。一个 2026 年的网站挂着 2025 年的价目表,这个信息时效存疑,我不把它当事实写,实际以你登录后看到的订阅页为准。
一、国内可直连的产品(截至 2026-07-23)
1.1 先把这一节的可信度说清楚
这是全篇最需要你自己动手核实的一节。
我这次调研对国内几家产品的抓取结果是这样的:官网能打开,首页文案能看到,但凡是涉及免费额度、单曲时长、是否可商用、能不能导出分轨的信息,全部需要登录后才可见,本次均未查证。
所以这一节我只写两类内容:
- 官网当天实际能看到的页面信息(可以当事实)
- 明确标注为”未查证”的空白(不要当事实)
免费额度与商用条款均未查证,请以各家官网当前条款为准。 这句话在这一节里会重复出现,不是凑字数,是因为它真的重要。
1.2 海绵音乐(字节跳动)
2026-07-23 抓取到的事实:
- 官网可以正常访问,不需要任何网络工具。
- 首页主文案是「海绵音乐 Agent 让你的想法变成歌」。
- 页面上标注的模型标识是 Music 5.3。
- 界面上有「纯音乐」选项——说明它支持只出伴奏、不出人声。
- 有一个「免费创作」按钮。
以上就是全部能确认的信息。 下面这些,我没查到:
- 免费额度是多少(每天几首、每月几首、有没有额度)——未查证
- 单曲最长能生成多久——未查证
- 免费档生成的歌能不能商用——未查证
- 能不能导出分轨(人声/伴奏分开)——未查证
- 导出格式是什么——未查证
「免费创作」这个按钮的存在,只能说明”有一条不付费的路径”,不能推出”完全免费”或”免费的能商用”。 这两件事是不同的。
1.3 网易天音
2026-07-23 抓取到的事实:
- 官网可以访问。
- 页面是 JS 渲染的(意思是:内容由浏览器脚本动态生成,抓取工具拿不到正文),实际抓到的只有一个页面标题:「网易天音 - 一站式AI音乐创作工具」。
除了这个标题,其余全部未查证:功能范围、价格、商用条款、以及网上流传的各种”激励金活动”细节,本次一个都没核到。
我知道这一节看起来很空。空是诚实的结果。 我宁可写”没查到”,也不愿意给你一个抄自某个导航站的数字,让你拿它去做商业决策。
1.4 其他几家的状态
- 天工 SkyMusic(昆仑万维):2024 年国内首个公开可用的音乐生成大模型,后来演进成了国际版品牌 Mureka。它作为一个独立产品是否还在运营,未查证。
- QQ 音乐「启明星」、腾讯 Lyra 等:本次未调研。 不是说它们不行,是我没查,所以不写。
1.5 为什么不采信 AI 导航站的说法
这一小节值得单独拿出来讲,因为它决定了你以后怎么判断信息。
搜”海绵音乐 免费”,你会搜到一堆结论明确的说法:「已完全免费」「免费最长 1 分钟」「无限次生成」。这些说法的来源,绝大多数是AI 工具导航站——那种收录了几千个 AI 工具、每个工具一个卡片页的网站。
为什么不能信它们:
一、它们的内容通常是批量生成的。 一个站要覆盖几千个工具,不可能每个都去登录测试。常见做法是抓官网首页 + 让模型扩写成一段介绍。里面的数字很可能是模型顺手编的。
二、它们没有更新动力。 收录页面写完就挂在那里吃搜索流量,产品半年后改了价格,页面不会改。你搜到的”免费”可能是一年前的状态。
三、它们的商业模式是导流,不是准确。 很多站带联盟推广链接,“免费""无限”这类词能提高点击率。这不是阴谋论,是激励机制的自然结果。
四、它们会互相抄。 你会发现五个不同的站说着一模一样的话。五个来源说同一句话,不等于五重验证,可能只是同一个错误被复制了五次。
判断一条信息可不可信,看它能不能追到一手页面。 追不到的,就当它不存在。
1.6 你应该怎么自己核实(三步)
如果你打算认真用某个国产工具,花十分钟做这三件事,比看十篇测评有用:
第一步:注册并登录,看真实的额度页面。 未登录状态下的宣传页和登录后的账户页经常不一致。以账户页为准。
第二步:在官网页脚找「用户协议」「服务条款」「版权说明」,搜三个词。 搜「商用」「版权」「归属」。这三个词能定位到 90% 你需要的条款。看不到这些页面本身就是一个信号。
第三步:生成一首,下载,检查文件。 确认三件事:能不能下载、下载的是什么格式、文件里有没有 AI 标识。第三件尤其重要——按中国现行法规,音频类生成内容在提供下载时必须带显式标识,这会直接影响你后面能不能发布。具体规则在篇六讲。
把这三步的结果截图存下来。 条款是会变的,你留的是”我当时看到的是这样”的证据。
二、纯 BGM 工具:差别在授权,不在音色(截至 2026-07-23)
2.1 先搞懂这类工具在解决什么问题
BGM = background music,背景音乐。这一类工具只出器乐,不出人声。
它们的核心卖点从来不是”更好听”,而是”出事的时候我能不能拿出授权证明”。
场景说明白一点:
- 你给客户做了一条产品片,配乐用了某个 AI 工具生成的曲子。
- 三个月后客户被平台通知这段音乐涉嫌侵权,或者被 Content ID 匹配上了。
- 客户来找你。你需要拿出一份能证明”这段音乐我有权给你用”的东西。
这份东西就是 BGM 工具在卖的商品。 音色只是附带的。
2.2 两条不同的授权路线
图里的左右两栏,是两种完全不同的模式。
左边:自有数据 + 可转让授权。
代表是 SOUNDRAW、Loudly、Stable Audio。
它们的共同主张是:训练模型用的音乐是我们自己做的或者拿到授权的,不是从网上抓的别人的歌。 因为数据源头干净,所以它们敢把使用权明确地转让给你,你再转给客户。
具体到各家(均为 2026-07-23 抓取的官网表述):
- SOUNDRAW:官网首页大字写「100% Copyright-Safe,不抓取他人歌曲,只用我们自己内部制作的音乐训练」。另有一个「for Artists」计划,宣称可以把作品发行到 Spotify / Apple Music / TikTok,并且你收取 100% 的歌曲版税。
- Loudly:自称「Rights-Safe AI Audio Engine」,声明其自有音乐数据集是通过”授权同意、透明、版权合规”建立的,因此能安全地把使用权转让给客户。
- Stable Audio(Stability AI):当前是 3.0,官网定位为「在完全授权数据上训练的模型家族」,三个卖点是开放权重可自行实验、可用自有曲库定制、企业授权提供法律赔偿保障。
这里有一个措辞细节值得你留意:Loudly 转让的是「使用权(rights of usage)」,不是著作权。这两个不一样。使用权 = 你可以用;著作权 = 这东西是你的、别人不能用。别把”我能用”理解成”这是我的”。
右边:分档授权。
代表是 AIVA。这是本章最重要的一段。
2.3 AIVA 的坑:免费档的版权不归你
AIVA 提供 250 多种风格,支持上传音频或 MIDI 作为影响源。功能上没什么好挑的。
但它的授权是按档位分的,而且分得很彻底:
- 免费档:生成作品的版权归 AIVA,你只能非商业使用,而且必须署名 AIVA。
- Pro 档:你永久拥有作品的完整版权。
(以上为 2026-07-23 官网表述。各档位的具体价格数字未查证——它的价格表是 JS 渲染的,我只抓到 Free 那一档标的是 €0。)
为什么这是”最容易踩的坑”:
因为整个流程里没有任何一步会拦住你。免费档能生成、能试听、能下载。文件拿到手上,和付费档的文件长得一模一样。没有水印,没有弹窗,没有任何提示告诉你”这个不能拿去接商单”。
于是最典型的翻车是这样的:用免费档做了几首,觉得挺好,直接用到了客户项目里。等到需要出授权证明的时候才发现,按条款这些作品的版权根本不是你的,而且你连署名都没加。
怎么避免:只要作品会离开你自己的电脑——发布、交付、投放、上架——就先确认你当时用的是哪个档位。
2.4 另外两家和它们的空白
- Beatoven.ai:站点定位是 Royalty Free AI Music Generator(免版税 AI 音乐生成器),另有音效、API、Music Intelligence 产品线。它的版权/商用规则未查证,价格也未查证(/pricing 返回 404)。
- Boomy:官网全部是 JS 渲染,本次什么都没抓到,全部未查证。
2.5 价格:这一整块我都没查到
必须直说:本章提到的 BGM 工具,价格数字我一个都没能确认。
- SOUNDRAW:/pricing 和 /pricing_plan 都是 404 —— 未查证
- Beatoven.ai:/pricing 404 —— 未查证
- Loudly:/pricing 404 —— 未查证
- AIVA:价格表 JS 渲染,只抓到 Free = €0 —— 未查证
- Boomy:官网全 JS —— 未查证
- Stable Audio:stableaudio.com/pricing 抓取为空,面向个人的订阅价格未查证
这类工具改价很频繁,官网结构也经常调整(上面那么多 404 就是证据)。请直接去官网看当前价格,别信任何二手数字,包括半年后的这篇文章。
2.6 判断路径:你到底该选哪家
图里给了两条判断路径,我把它展开成可执行的。
路径一:作品要交付给客户 → 必须选授权可转让的,并且留存授权凭证。
这条路上你要做的事:
- 选左栏那一类(自有数据 + 明确可转让授权)。
- 用付费档,不要用免费档。
- 下载并保存授权文件——很多工具会在账户页提供 license 证书或收据,下载下来存到项目文件夹里,和交付物放在一起。
- 在给客户的交付清单里写明音乐来源和授权类型。
第 3 步是最多人漏掉的。 “我记得当时是付费账号”在需要举证的时候没有任何用。
路径二:只是自己视频的配乐 → 免费档通常够用,但仍要确认平台的商业化政策。
注意”通常”两个字。免费档能不能用在你的视频里,取决于你的视频算不算商业用途。
一个很多人不知道的点:如果你的视频开了平台的流量分成、带货、或者接了商单,那条视频在多数条款里就属于商业用途了,免费档的”仅限非商业”就管到你头上了。个人号发着玩确实没事,一旦开始赚钱,规则就变了。
2.7 和 Suno 那条路线的区别
顺带说清一件容易混的事。
- BGM 工具走的是”训练数据从一开始就干净”路线。它们的授权底气来自源头。
- Suno 这类走的是”先做出来,再和大厂谈和解拿授权”路线。它们的规则还在变——2025 年 11 月到 12 月之间,Suno 的版权说明措辞就改过一次。
对你的实际影响是:接商单、做投放、给客户交付,优先用前者;自己做歌、发着玩、练手,后者更好用。 这不是谁高谁低,是两种工具解决的问题不一样。
三、开源本地部署(需要显卡和命令行,第一次读可以整节跳过)
这一整节可以跳过。
它需要你有一张独立显卡(显存 8GB 以上才有意义),并且愿意在命令行里折腾环境。第一次配环境半天到一天是常态。
如果你没有独立显卡,直接跳到第四章。 那一章会用数字告诉你:为了做几首歌去买显卡,是笔亏本买卖。
3.1 先解释三个词
- 显存:显卡自己的内存,单位 GB。模型必须先装进显存才能跑。显存不够就直接报错,不是”跑得慢一点”。 这是本节最重要的一个概念。
- 权重:模型训练出来的那一大堆参数文件,通常几个 GB 到十几个 GB。跑模型 = 下载权重 + 加载进显存 + 喂输入。
- 开源许可:这份代码和权重允许你怎么用。代码的许可和权重的许可可以是两份不同的东西——这一点后面会要你的命。
3.2 三个方案的定位(一句话版)
- ACE-Step 1.5:MIT 许可,可商用。消费级显卡上唯一实际可用的整歌方案。 想试一个,就试它。
- YuE:Apache-2.0,可商用。质量有口碑,但个人机器基本别想跑整首。
- MusicGen:权重是 CC-BY-NC,禁止商业使用。 只出器乐不出人声。适合做实验,不适合做作品。
3.3 ACE-Step 1.5(MIT,显存数据截至 2026-07-23)
仓库:https://github.com/ace-step/ACE-Step-1.5
为什么它是这三个里唯一实际可用的:
- MIT 许可——最宽松的开源许可之一,商用没有障碍。
- 官方明确支持 Mac、AMD、Intel、CUDA 四类平台。不是只有 N 卡能跑。
- 官方给了一张完整的显存分级表,从 6GB 以下一直到 24GB 以上都有对应配置。这件事比听起来重要——大多数开源项目只写”推荐 24GB”,然后你的 12GB 卡就只能自己试。
官方显存分级表(原文抓取,2026-07-23):
| 你的显存 | 推荐 DiT | 推荐 LM | 后端 | 备注 |
|---|---|---|---|---|
| ≤6GB | 2B turbo | 不启用 LM | — | INT8 量化 + 全量 CPU offload |
| 6–8GB | 2B turbo | 0.6B | pt | 轻量 LM + PyTorch 后端 |
| 8–16GB | 2B turbo/sft | 0.6B(8–12GB)/ 1.7B(12–16GB) | vllm | |
| 16–20GB | 2B sft 或 XL turbo | 1.7B | vllm | XL 在 20GB 以下需 CPU offload |
| 20–24GB | XL turbo/sft | 1.7B | vllm | XL 可不 offload,4B LM 可用 |
| ≥24GB | XL sft | 4B | vllm | 全部模型不 offload,质量最好 |
表里的词都是什么意思:
- DiT / LM:两个模型部件。你不需要懂原理,只需要知道它们越大质量越好、也越吃显存。
- 2B / XL(4B):模型规模。数字越大越吃显存。
- turbo / sft:同一规模的两个版本。turbo 快,sft 质量更好。
- 量化:把模型参数压缩成更小的格式,用一点质量换显存。
- CPU offload:显存装不下的部分放到内存里。能跑,但明显更慢。
- 后端(pt / vllm):跑模型的引擎。vllm 更快,但对环境要求更高。
权重占用(官方数据):XL(4B) 约 9GB 显存,2B 约 4.7GB。XL 需要 12GB 以上(配 offload + 量化)或 20GB 以上(不 offload)。
一个省事的事实:官方 UI 会按你的显卡自动选配置。上面这张表主要是给你”我这张卡到底能跑到什么档”的预期,不是要你手动填参数。
3.4 ACE-Step 的最小可跑路径(思路,不是逐步安装教程)
先说清楚我不做什么:我不会在这里写具体的安装命令。
原因很实在:开源项目的安装步骤三个月就会变一次——依赖版本、参数名、模型下载地址都在动。我在这里写死一串命令,你半年后照着敲,大概率报错,而且你不知道是哪一步错的。照抄一串过期命令,比自己读一遍 README 更浪费时间。
所以这一小节给的是前提条件 + 路径形状。真正的命令请以仓库 README 当前版本为准。
动手之前先确认四件事:
一、你的显存有多少。 Windows:任务管理器 → 性能 → GPU,看”专用 GPU 内存”。Mac:统一内存架构,显存和内存共享,看总内存。 对着上面那张表判断你能跑哪一档。低于 6GB 就别开始了。
二、你有几十 GB 的空闲硬盘。 模型权重加上依赖库,占用不小。硬盘满了会在下载到一半时失败,很难排查。
三、你能接受第一次配环境花半天到一天。 这不是危言耸听,是常态。Python 环境、显卡驱动、依赖版本,任何一环对不上都要查。
四、网络能稳定访问 GitHub 和模型托管站。 权重文件很大,下载中断重来非常消耗耐心。
路径的形状(四步):
- 准备一个独立的 Python 环境。 别装在系统环境里——依赖冲突会污染你电脑上其他的 Python 项目,清理起来很烦。用 venv 或 conda 都行。
- 按仓库 README 装依赖。 这一步是最容易出问题的地方。README 里通常会区分 CUDA / Mac / CPU 的不同装法,认准你自己那一条,别混着装。
- 拉取模型权重。 有的项目在首次运行时自动下载,有的需要手动拉。看 README。
- 启动官方 UI,让它自动选配置,先生成一段最短的试试。
第 4 步的”先生成最短的”很关键。 第一次跑别急着要整首歌——先确认整条链路是通的。链路通了以后再加长度,出问题时你才知道是”环境没配好”还是”显存不够”。
关于失败:本地部署第一次跑不通是常态,不是你笨。最常见的三类错误是显存不足(OOM)、依赖版本不匹配、模型文件没下全。把报错信息原样复制去搜,或者贴给 AI 助手,比自己盯着屏幕猜快得多。
3.5 两条官方要求,别忽略
ACE-Step 的 License & Disclaimer 里明确要求使用者做三件事:
- 核验作品的原创性——别生成出一段和现有歌曲高度雷同的东西然后拿去发。
- 清楚披露 AI 参与——这和中国的标识办法、Spotify 的披露机制方向一致。
- 改编受保护的风格或素材时取得许可。
“开源”意味着代码免费,不意味着你可以不管版权。 而且开源方案不提供任何法律保护——商业产品出事至少还有条款和厂商,开源出事全部由你自己承担。
3.6 一个安全提醒:小心仿冒站点
ACE-Step 官方专门警告过这件事:唯一的官方站点是它的 GitHub 仓库和 GitHub Pages。网上存在多个仿冒的收费域名(形如 ac**p.com / a**p.org),不要在那些站点付款。
判断方法很简单:一个 MIT 许可的开源项目,官方不会向你收费。 任何要你付钱下载 ACE-Step 的页面,都不是官方。
3.7 YuE(Apache-2.0):好,但你的机器跑不动
仓库:https://github.com/multimodal-art-projection/YuE (HKUST / M-A-P 出品)
许可:模型与权重均为 Apache-2.0,可商用。官方条款鼓励创作者自由把输出用于商业项目,建议署名「YuE by HKUST/M-A-P」,并建议在上传流媒体平台时标注「AI-generated / AI-assisted」。
许可这块没问题,问题在硬件。官方原文写得很清楚:
- 24GB 及以下显存,最多只能跑 2 个 session(默认是 1 段主歌 + 1 段副歌),再多就会显存溢出。
- 要生成完整的一首歌(4 个以上 session),建议 ≥80GB 显存——H800 / A100 这个级别,或者多张 4090 做张量并行。
翻译成人话:一张 4090 是 24GB,是消费级显卡的顶配。顶配也只够出两段。 80GB 是数据中心显卡的规格,个人不会有。
社区确实有 YuE-exllamav2、YuEGP 这类降低配置要求的方案,但官方自己承认这些方案会牺牲音乐性。
结论:个人机器上,YuE 基本别想跑出整首歌。 这是它和 ACE-Step 最大的差距——不是质量差距,是”能不能用”的差距。
3.8 MusicGen / AudioCraft(Meta):最容易踩的许可陷阱
仓库:https://github.com/facebookresearch/audiocraft
这一段是本章最重要的一条信息:
MusicGen 的代码是 MIT,但模型权重是 CC-BY-NC 4.0 —— 也就是”禁止商业使用”。
为什么这么多人踩:
因为大家看到 GitHub 页面右侧标着 “MIT License” 就放心了。但你实际跑的时候用的是权重,不是代码。 仓库里有两份许可文件——LICENSE(代码,MIT)和 LICENSE_weights(权重,CC-BY-NC)。第二份才是管你输出的那一份。
CC-BY-NC 里的 NC = NonCommercial(非商业)。 意味着:
- 你不能拿 MusicGen 的输出去接商单
- 不能用在会赚钱的视频里
- 不能上架到流媒体分成
- 不能卖给客户
它适合什么:学习、研究、纯个人玩。理解 AI 音乐生成是怎么回事,它是个不错的起点。
另外它只出器乐,不出人声。 想要带唱的歌,它本来也不是选项。
3.9 开源方案现在到底什么水平
必须给一个诚实的判断。
网上能搜到不少”ACE-Step 1.5 已超越商业方案”的说法。这类说法基本来自它自己的宣传页和 SEO 站点,我没有找到任何独立的盲测数据,所以不采信。
我能给出的稳妥说法是:
开源已经到了”可用”的程度,但在人声自然度和混音完成度上,仍然落后于 Suno v5.5。
具体表现在:人声的咬字和情绪起伏不如 Suno 自然;出来的成品更”生”,需要更多后期(见篇四)。
开源真正的优势不是质量,是这三条:
- 许可清楚——MIT / Apache-2.0 写在那里,不会因为某家公司和唱片公司谈了个协议就变。
- 数据不出本机——需要保密的项目,这一条是刚需。
- 不受额度限制——跑多少次都不扣点数,只花电费和时间。
如果你的诉求只是”做几首好听的歌”,这三条对你都没用。 那就用云端。
四、本地 vs 云端的真实成本账
4.1 结论先说
如果你只是想做几首歌自己听,订阅永远更便宜。没有例外。
这一节剩下的内容都是在解释为什么。如果你已经接受这个结论,可以直接跳到第五章。
4.2 四个维度的对照
图里列了四组对比,我逐条说清楚。
一、钱:每月固定几十块 vs 显卡几千到上万的一次性投入。
云端这一侧我有一个查证过的锚点:Suno Pro 档按年付折算是 $8/月,Premier 是 $24/月(suno.com/pricing,2026-07-23,页面默认展示年付价)。
本地这一侧,显卡是一次性投入。具体价格我没有查证,不写数字——显卡价格波动大,而且新卡二手卡差别巨大。图里给的”几千到上万”是一个量级判断,够用了。
关键在于怎么比。 把显卡钱换算成”等于多少个月的订阅”,你会立刻得到答案:一张够用的显卡,钱大概等于好几年的订阅费。
而且这个对比对本地还不公平,因为:
- 显卡会折旧,三年后它不值那个钱了
- 电费是持续支出(具体功耗和电价我没查证,不给数字,但它不是零)
- 显卡还有个使用寿命问题
二、时间:开箱即用、零配置 vs 第一次配环境半天到一天。
这一项最容易被低估。
云端:注册、付款、开始生成。十分钟内你就在听第一首歌了。
本地:装环境、装驱动、装依赖、下权重、调参数、排错。半天到一天是顺利的情况,卡住的话可能是两三天。
把你的时间按小时估个价,再乘上去。 对绝大多数人来说,光是第一次配环境的时间成本就已经超过一年的订阅费了。
三、速度:几十秒一首 vs 看显卡,慢的要几分钟。
云端跑在专业硬件上,还有优化过的推理服务。你的显卡跑不过它。
这一项在实际使用中的影响比数字看起来大得多。因为 AI 音乐的工作方式是抽卡——生成十首挑一首(见篇二)。
- 一首 30 秒:抽十次 5 分钟,你还在状态里。
- 一首 3 分钟:抽十次半小时,你已经走神了。
慢会直接杀死创作节奏。 这不是”多等一会儿”的问题。
四、控制权:规则由厂商定、随时可能变 vs 规则由你定、断网也能跑。
这是本地唯一真正无可替代的优势。
云端的规则确实在变,而且变得不慢。举两个已经发生的例子:
- Udio 在 2025 年 10 月和解当天关闭了全部下载功能,到 2026-07-23 仍未恢复。用户的作品就那么被锁在里面了。
- Suno 已经预告,新的授权模型上线后现有模型将被弃用,免费档歌曲将不可下载,付费档会有每月下载次数上限(二手来源,截至 2026-07-23 定价页尚未体现)。
本地部署的模型不会有这种事。 权重下载到你硬盘上,那就是你的了,断网也能跑。
4.3 什么情况下本地才划算
图里给的三个条件,满足任意一个才值得考虑:
一、你已经有一张 12GB 以上的显卡。
注意是”已经有”。为了跑 AI 音乐去买显卡,成本账算不过来。但如果你本来就有(打游戏、做视频、跑别的 AI),那边际成本就只剩电费和时间了——这时候值得试。
12GB 这个门槛对应 ACE-Step 分级表里”能舒服跑起来”的位置。
二、你要跑的量非常大。
比如你在批量做素材,一天要出几百段。这时候云端的额度费用会变成一笔真实开销,本地的固定成本才有摊薄的空间。
做几首歌的人不属于这一类。 判断标准很简单:如果你每个月的订阅额度都用不完,那你不是大批量用户。
三、你需要数据不出本机。
商业保密项目、客户素材不允许上传第三方服务器。这种情况下,本地是唯一选项,不是成本问题,是能不能做的问题。
4.4 一个折中方案
如果你既想试开源,又不想买显卡:租云 GPU 按小时付费。
思路是:在云上租一台带显卡的机器,跑完关掉,按小时计费。这样你能试到开源模型,又不用一次性投入。
具体平台和价格我没有调研,不给推荐。 只是告诉你有这条路,别以为”用开源”就等于”必须买显卡”。
五、这一篇里哪些信息最先过期
这一节直接引用调研报告的「变化速度分级」。本篇写于 2026-07-23,你现在读到的时候,下面这几段很可能已经不准了。
5.1 极快(3 个月内必过期)
这几条请务必以官网当前页面为准,别信本文:
- Suno 的所有权 / 商用条款措辞。 2025 年 11 月到 12 月之间已经改过一次——从「你拥有歌曲」弱化为「你被授予商用使用权」。Warner 授权模型上线后还会再改。
- Suno 的下载规则。 已预告免费档不可下载、付费档加月度下载上限,但截至 2026-07-23 定价页仍未体现。随时会落地。
- Suno 的模型代号与可用模型列表。 官方已预告”新授权模型上线后现有模型将被弃用”,v5.5 随时可能不再是主力。
- Udio 是否恢复下载 / 授权版新平台是否上线。 从 2025-10 拖到 2026-07 仍未上线,但它 2026-07-17 宣布了内容保护方面的技术合作,说明临门一脚。
- 各流媒体 / 发行商的 AI 披露机制。 详见篇六。
对本篇的影响:第零章那份”一句话状态更新”最先失效。
5.2 较快(半年一变)
- 所有工具的价格与额度。 Suno、Riffusion、LALAL.ai、Mureka 都在过去一年内调过档位。
- 中国大陆产品的可用性与免费策略。 海绵音乐、网易天音的免费额度与商用政策变动频繁,而且官网信息本来就稀薄,必须实际登录确认。
- 开源模型的版本与显存要求。 ACE-Step 从 1.0 到 1.5 的显存分级表已经整个重写过一次;YuE 的社区降配方案在持续演进。
对本篇的影响:第一章(国内产品)和第三章那张显存表最先失效。第三章那张表尤其要注意——它是 1.5 版本的表,换个版本号可能就整张换掉。
5.3 相对稳定(一年以上)
这几条你可以放心引用:
- 开源许可:MusicGen 权重 CC-BY-NC(禁商用)、ACE-Step MIT、YuE Apache-2.0、Demucs MIT。这些是稳定事实。
- 各工具的「训练数据主张」定位:SOUNDRAW / Loudly / Stable Audio 的”干净数据”路线是它们商业模式的根基,不会轻易变。
- 「能商用 ≠ 有版权」这条原则:除非各国版权法修改,否则长期成立。
- 中国《人工智能生成合成内容标识办法》的条文:部门规章,2025-09-01 施行,短期内不会改(但配套国标与平台执行细则会变)。
5.4 本篇明确标注为”未查证”的清单
方便你集中核实。以下每一条,我这次都没查到可靠一手来源:
- 海绵音乐的免费额度 / 单曲时长 / 商用条款 / 分轨能力
- 网易天音的功能、价格、商用条款(官网只抓到页面标题)
- 天工 SkyMusic 独立产品是否还在运营
- QQ 音乐「启明星」、腾讯 Lyra(本次未调研)
- Riffusion / Google Flow Music 的商用条款
- Mureka 的当前有效价格(官网挂的是自称 2025 年的方案)
- SOUNDRAW / Beatoven / Loudly / Boomy 的价格
- AIVA 各档位的价格数字
- Boomy 的全部信息
- Stable Audio 个人订阅价格
- Stable Audio Open 开放权重的具体商用许可条款
- 显卡功耗与电费的具体数字(本文只给量级判断)
- 云 GPU 租用平台与价格(本次未调研)
处理原则:这些条目在正文里要么没写,要么写了但明确标了”未查证”。如果你在别处看到有人给出了这些数字,先问一句”来源是哪个页面”。
六、翻车速查
按”你遇到的现象”查。
现象:用免费档做的音乐用到了客户项目里,事后才发现条款不允许。
- 原因:免费档普遍限定非商业用途,AIVA 甚至明确写版权归它自己。
- 处理:立刻停止使用,换付费档重新生成一版替换掉。不能靠”补订阅”追溯——多数条款不支持事后补授权(Suno 官方就明确说了不行)。
- 预防:作品只要会离开你自己的电脑,就先确认档位。
现象:客户要授权证明,你拿不出来。
- 原因:只记得”当时是付费账号”,没留凭证。
- 处理:登录当时的账户,找账单记录、license 证书、生成记录,能截多少截多少。
- 预防:交付时把授权文件和成品放在同一个文件夹里。
现象:照着网上教程装 ACE-Step,命令报错。
- 原因:那篇教程的命令过期了。开源项目的安装步骤三个月一变。
- 处理:回到官方仓库 README 重新走一遍,别在过期教程上继续排错。
- 预防:任何开源项目,第一手信息永远是它的 README,不是转载教程。
现象:本地跑模型报显存不足(OOM)。
- 原因:模型配置超出了你的显卡。
- 处理:对照官方显存分级表降档——换更小的模型、开量化、开 CPU offload。降档能跑起来,代价是慢和质量下降。
- 预防:开始前先查清自己的显存,按表选档。
现象:本地生成一首歌要好几分钟,完全没法抽卡。
- 原因:正常现象,你的显卡跑不过云端的专业硬件。
- 处理:先用最短时长跑通流程,需要大量抽卡的阶段用云端,最终定稿再考虑本地。
- 预防:见第四章——大多数人不该本地跑。
现象:拿 MusicGen 的输出接了商单。
- 原因:只看了仓库的 MIT 标签,没看权重许可。
- 处理:立刻换掉。CC-BY-NC 是明确禁止商用的,这不是灰色地带。
- 预防:开源项目要分开看代码许可和权重许可,看仓库里有没有第二份 LICENSE 文件。
现象:搜到的国内产品免费额度和实际登录后看到的对不上。
- 原因:你搜到的多半是 AI 导航站的批量生成内容,可能过期,也可能本来就是编的。
- 处理:以登录后账户页为准,截图存证。
- 预防:见 1.5。追不到一手页面的信息,就当它不存在。
现象:在某个网站上付钱下载了 ACE-Step。
- 原因:仿冒站点。官方已经点名警告过存在多个收费仿冒域名。
- 处理:立刻申请退款并检查支付安全。
- 预防:MIT 许可的开源项目不会向你收费。 认准 GitHub 官方仓库。
七、下一步
这一篇讲的是”还有哪些工具、以及它们各自的授权边界”。到这里你应该能回答三个问题:
- 我这个用途该用哪一类工具
- 这个工具的授权允许我做什么
- 我的电脑值不值得折腾本地部署
下一篇是最后一篇,也是最不能跳过的一篇。
篇六:AI 音乐怎么合法地发出去 讲的是把歌真正发出去的完整链路:
- 中国的《人工智能生成合成内容标识办法》怎么落地到你的具体操作——音频要在什么位置加什么标识、导出文件要带什么、发布时要声明什么
- Spotify、Apple Music、YouTube 三个平台的 AI 披露要求各是什么
- 怎么不被 Spotify 的 spam 过滤器误伤
- 发行商怎么选,以及为什么这一节只给选型维度不给具体条款
- 三条变现路径的诚实期望值
如果你打算把作品发到任何公开平台上,篇六是必读的。 本篇讲的是”用哪个工具不违约”,篇六讲的是”发出去不违法”——后者的风险更高。
往回看:
本篇事实基准日:2026-07-23。 全部价格、条款、版本号、显存要求均为该日抓取的官网信息。 标注为「未查证」的条目,请勿当作事实使用。 建议每季度复核一次第零章、第一章、第三章。
留言功能暂时不可用,请稍后再试。