suno:~/music$ cat suno.md

Suno AI音乐生成:权威技术参考

# 全面介绍V5.5中有效的所有Suno标签与元标签:风格提示词、结构标签、[no vocals]、音乐风格字段及MILO-1080,并附可直接复制粘贴的示例。

author: words: 2854 read_time: 51m updated: 2026-07-25 14:45
$ less suno.md

更新于2026年5月13日

TL;DR:Suno可根据文本提示词生成完整歌曲(人声、乐器、编曲和混音)。V5.5可生成工作室级音频,每次生成最长8分钟,并新增Voices、Custom Models和My Taste自适应偏好。掌握三套系统(提示词文本+metatags(元标签)+Creative Sliders)后,Suno就会成为生产工具,而不是新奇玩具。使用Custom Mode获得控制力,用metatags安排歌曲结构,再通过Song Editor进行迭代优化。Pro方案(10美元/月,或年付8美元/月)可使用V5.5并获得商业权利。点数不会结转。

Suno的200万付费订阅用户每天生成700万首曲目,每两周就会超过Spotify整个1亿首歌曲的曲库规模。18 V5跨过了早期版本无法达到的门槛:生成的作品能让听众投入其中,而不会意识到这是AI生成的。1 它不再只是猎奇内容或占位素材,而是真正用于制作场景的音乐。

“有意思的AI音乐”和“我真的会发布的音乐”之间,差别在于是否理解三套控制系统:

  1. 提示词文本:用自然语言描述流派、情绪、配器和人声风格
  2. Metatags:用于控制编曲的结构指令,例如[Verse][Chorus][Bridge]
  3. Creative Sliders:通过Weirdness、Style Influence和Audio Influence塑造生成结果的个性

默认工作流(输入一句话,然后点击生成)的结果往往不稳定,因为Suno优化的是广泛吸引力,而不是您具体想要的效果。精准控制,才是可用输出与随机结果之间的分水岭。

我已经在Suno支持的所有流派中生成了数千首曲目,测试过所有已记录和未记录的metatag组合,并摸清了每个模型版本擅长与薄弱的边界。本指南将这些经验提炼为一份权威技术参考。


核心要点

  • 要进行严肃创作,必须使用 Custom Mode。 Simple Mode 会移除使 Suno 成为制作工具的各项控制功能。本指南中的所有技巧均以 Custom Mode 为前提,并分别使用 Style、Lyrics 和 Title 字段。
  • 控制系统有3套,而非1套。 提示词文本定义音乐特征。元标签(metatags)控制编曲和结构。Creative Sliders 塑造生成内容的个性。只有融会贯通这3套系统,才能摆脱随机结果,获得真正可用的作品。
  • 元标签是影响最大的技能。 使用 [Verse]/[Chorus]/[Bridge] 结构并添加参数化修饰语([Verse: whispered vocals, acoustic guitar only]),仅凭文本即可逐段控制,编曲能力接近 DAW 水平。
  • V5.5 是当前的旗舰模型。 V5 奠定了制作级品质基础(录音室级音频、自然人声、清晰的真实乐器分离),V5.5 在此之上增加了 Voices、根据您的风格个性化定制的 Custom Models,以及可自适应偏好的 My Taste。使用 V5.5、Voices 和 Custom Models 需要订阅 Pro 套餐(每月10美元,或按年订阅时每月8美元)。
  • 反复迭代,不要听天由命。 生成循环(构思 -> 选择 -> 优化 -> Extend -> 编辑 -> 导出)通常需要为每首精修曲目消耗50–100积分。应为迭代预留积分,而非指望一次生成便尽善尽美。
  • 每月积分不会结转,但额外购买的积分不会过期。 每月积分会在各计费周期开始时重置。只要订阅仍然有效,购买的额外积分便会一直保留,因此适合在密集创作前储备积分。13

如何使用本指南

您属于…… 从这里开始 然后深入了解
Suno 新手 入门指南提示词架构 Suno 标签和元标签流派和风格描述词
希望获得更好效果的普通用户 提示词架构Creative Sliders 高级元标签模式故障排除
为正式发行制作音乐 生成循环Suno Studio DAW DAW 集成商业许可
正在比较 Suno 与其他替代方案 什么是 Suno?竞争平台和替代方案 API 和集成状态版权与法律现状

目录

第1部分:基础知识

  1. 什么是 Suno?
  2. 入门指南
  3. 模型和版本
  4. 定价和积分

第2部分:提示词工程

  1. 提示词架构
  2. 提示词增强助手
  3. 流派和风格描述词
  4. 人声风格设计
  5. 纯音乐模式

第3部分:歌曲结构

  1. Suno 标签和元标签
  2. 结构标签
  3. 器乐和人声标签
  4. 高级元标签模式

第4部分:创意控制

  1. Creative Sliders
  2. Song Editor
  3. Covers 和 Remixes
  4. Voices
  5. My Taste(V5.5)

第5部分:制作工作流

  1. 生成循环
  2. Suno Studio DAW
  3. stem 分离和导出
  4. DAW 集成

第6部分:高级技巧

  1. 流派融合
  2. 多段式作曲
  3. 提示词链式衔接
  4. 故障排除

第7部分:商业与法律

  1. 商业许可
  2. 版权与法律现状
  3. 竞争平台和替代方案

第8部分:参考资料

  1. API 和集成状态
  2. 快速参考卡
  3. 更新日志
  4. 参考资料

什么是 Suno?

Suno 是一个生成式 AI 平台,可根据文本描述创作完整歌曲。与 DAW、采样库或基于循环乐段的工具不同,Suno 会同时生成曲目的所有元素:旋律、和声、节奏、配器、人声(含歌词)、编曲和混音。您只需描述想要的效果,Suno 就会生成一首完整歌曲。

Suno 与传统音乐制作相比有何不同?

方面 Suno 传统制作
输入 文本提示词 + 可选歌词 音符、MIDI、录音
输出 完整混音歌曲 需要混音的独立音轨
首次获得成品所需时间 约30秒 数小时至数天
所需音乐知识 描述性词汇 乐器演奏能力、乐理、混音
迭代方式 重新输入提示词、编辑段落、调整滑块 重新录制、重新编曲、重新混音
最大长度 每次生成最长8分钟(可扩展;网页端的 Duration 滑块可设定目标长度) 无限制

您可以创作:

  • 带人声的完整歌曲:任意流派、任意语言,可使用原创歌词或 AI 生成的歌词
  • 纯音乐:背景音乐、配乐、氛围曲目
  • 流派实验:实现原本需要多位专业乐手协作的跨流派融合
  • 不同版本:围绕同一概念生成数十个版本,再从中择优
  • 制作素材:用于传统 DAW 工作流的 stems

Suno 并非:

  • 并非 DAW:无法手动进行混音、母带处理或编曲(但 Studio 提供了部分相关功能)
  • 并非确定性工具:相同的提示词每次都会产生不同结果
  • 并非采样库:无法精准分离并重复使用单个声音
  • 并非无限制使用:生成内容会消耗积分,而且每次生成的质量参差不齐

入门指南

快速入门(5分钟)

  1. suno.com 创建账户。免费套餐每天提供50积分(约可生成10首歌曲,通常为5批、每批2首的 Create 操作)。

  2. 先尝试 Simple Mode。 输入类似 “upbeat indie rock song about a road trip” 的简短描述,然后单击 Create。Suno 会自动生成歌词、旋律、编曲和人声。

  3. 切换至 Custom Mode 以获得更多控制。Custom Mode 将提示词拆分为不同字段:

  4. Style of Music:流派、情绪和配器描述词
  5. Lyrics:包含结构元标签的歌词
  6. Title:歌曲标题

  7. 试听两个生成结果。 Suno 每次创作都会生成两个不同版本。选择更符合创作意图的版本,然后继续优化。

  8. 设定目标长度(网页端)。 生成前,在 Create 表单中拖动 Duration 滑块,选择歌曲长度。此功能可在网页端搭配 V5.5 模型使用(于2026年7月20日新增)。41 在该滑块推出之前,歌曲长度由模型决定,只能在生成后调整。

  9. 使用 Extend 延续歌曲,使其超出初始生成长度;也可使用 Song Editor 替换特定段落。

界面概览

Suno 的网页界面提供两种主要创作模式:

Simple Mode:仅有一个文本框。使用自然语言描述歌曲,Suno 会推断流派、编写歌词并生成全部内容。适合探索,不适合精准控制。

Custom Mode:提供3个独立字段(Style、Lyrics、Title)以及 Creative Sliders。严肃创作应在 Custom Mode 中完成。Style 字段接受流派和制作描述词,Lyrics 字段接受包含元标签的文本,而滑块用于控制生成内容的个性。

请从 Custom Mode 开始。 Simple Mode 虽然方便,却会移除使 Suno 适用于音乐制作的控制功能。本指南中的所有技巧均以 Custom Mode 为前提。

模型和版本

Suno自发布以来迭代迅速。每个版本都带来了实质性的质量提升,但访问权限会因订阅层级而异。

版本时间线

Version Release Key Improvements
V2 2023年秋 首个公开模型。短片段(约30秒)、风格范围有限、AI痕迹明显。
V3 2024年3月 延长至2分钟。人声清晰度提升。风格覆盖范围扩大。
V3.5 2024年夏 混音更好,瑕疵减少,人声自然度提升。
V4 2024年11月19日 质量大幅跃升。4分钟生成、多语言人声、Covers功能、2-stem分离。
V4.5 2025年5月1日 8分钟单次生成(从4分钟提升)、Creative Sliders(Weirdness、Style Influence)、Prompt Enhancement Helper、风格准确性扩大、人声增强。19
V4.5-All 2025年末 免费层级模型。结合V4.5改进并提供更广泛访问。
V5 2025年9月 录音室级音频20、更高的母带质量、Suno Studio DAW2、12-stem分离22、Persona Voices15。内部名称:chirp-crow。20
V5.5 2026年3月26日 当前旗舰版本。带验证的Voices(Pro/Premier)、Custom Models(每位Pro/Premier订阅者最多3个)、My Taste自适应偏好系统(所有用户)。3031

当前模型访问权限

Tier Model Access Quality Notes
Free V4.5-All 质量不错,但在人声自然度和混音清晰度上明显低于V5.5。无Voice Cloning或Custom Models。可使用My Taste。
Pro ($10/mo) V5.5 录音室级质量。Voices、最多3个Custom Models、My Taste。
Premier ($30/mo) V5.5 + Studio 生成质量与Pro相同,另含Suno Studio DAW。Voices、最多3个Custom Models、My Taste。

V5相较V4.5是一次有意义的升级。差异在人声自然度(“AI歌手”感更弱)、低频清晰度(贝斯和底鼓分离)以及立体声成像方面最为明显。如果您正在评估Suno是否适合生产用途,请基于V5评估,而不是免费层级。

V5改变了什么

V5(内部称为“chirp-crow”20)代表了Suno单个版本中最大的一次改进:1

  • 录音室级音频保真度:V5的母带质量高于V4.5;官方文档用制作术语描述改进,而没有标明具体采样率。某第三方Suno产品中心列出V5为44.1 kHz;如果精确采样率对您的流程很重要,请检查导出的WAV。1620
  • 人声自然度:降低了以往版本中明显的“恐怖谷”质感。颤音、呼吸声和辅音咬字更具说服力。1
  • 乐器分离度:混音中的各个乐器更清晰可辨。减少了“声墙”式的混杂感。1
  • 动态范围:更好地处理由弱到强的过渡。以往版本往往会把所有内容都压缩得过满。1
  • 风格准确性:更好地遵循风格惯例。“jazz”提示听起来更像真正的爵士,而不是“带爵士和弦的流行乐”。19
  • Suno Studio:用于生成后编辑的浏览器内DAW。无需重新生成即可调整混音、隔离stem并修改编曲。2

V5.5改变了什么

V5.5(2026年3月26日)在V5的音频质量基础上加入了3项个性化功能:3031

  • Voices:克隆或复用您自己的声音,用于生成内容。Suno要求通过验证,即将一段朗读短语与上传或实时采集的人声样本进行比对。仅限Pro/Premier,需要v5.5模型,并且可用性受年龄和地区限制。在Create菜单中,Voices按钮已取代Personas按钮,不过Style Personas仍可在Voices菜单中访问。31
  • Custom Models:基于您曲库中的歌曲或在Suno之外制作的音轨,训练最多3个个性化V5.5版本。Suno当前的v5.5公告称Custom Models至少需要6首歌曲;建议使用风格一致的音轨,而不是混入随机风格,因为模型学习的是您的声音特征,而不是毫不相关参考素材的集合。3031
  • My Taste:面向所有用户的自适应偏好系统。它会从您喜欢的风格、情绪以及创作/聆听习惯中学习,让未来生成更偏向您偏好的风格、制作审美和人声特质。当Style Augmentation启用时,Styles框右上角的魔杖图标会生成个性化风格描述。My Taste默认启用,可从头像菜单编辑或禁用。31

定价和点数

截至2026年5月已验证。Suno定价可能随时变更,恕不另行通知。请查看suno.com/pricing了解当前价格。13

套餐对比

Feature Free Pro ($10/mo) Premier ($30/mo)
Annual billing N/A $8/mo ($96/yr) $24/mo ($288/yr)
Credits 50/天 2,500/月 10,000/月
Model V4.5-All V5.5 V5.5
Songs included 10/天 最多500/月 最多2,000/月
Concurrent songs 共享队列中4首 优先队列中10首 优先队列中10首
Audio upload limit listed on pricing page 最多8分钟 最多30分钟 最多30分钟
Song Editor 受限 完整 完整
Covers/Remixes
Persona Voices
Voice Cloning
Custom Models 最多3个 最多3个
My Taste
Suno Studio
Stem Separation Split from Mix(2) Split from Mix + Auto Split(12) Split from Mix + Auto Split + Advanced Split(约100)
Commercial use
Priority generation
Credit rollover N/A
Top-up credits

点数经济性

每首歌大约消耗5点数。一次典型的Create操作会返回两个歌曲变体,因此每个双歌批次大约应预留10点数。Pro订阅每月2,500点数,最多可生成500首歌13

节省点数的做法: - 使用Custom Mode并编写具体提示,减少废弃生成 - 对有潜力的音轨使用Extend,而不是从头重新生成 - 使用Song Editor修复局部段落,而不是重新生成整首歌 - 在生成前先打磨Style提示,以节省点数

每月点数不会结转。账单周期结束时未使用的点数会失效。请相应规划您的生成会话。

每月额度用完后会提供每日奖励点数。一旦每月点数耗尽,付费订阅者每天会获得50个奖励点数,直到下一个账单周期;这与免费层级的每日额度相同。这样可以避免月底完全无法生成,不过相比月度折算速率会大幅降低(Pro约83/天,Premier约333/天,而此处为50/天)。24

只要订阅保持有效,Top-up credits不会过期。已购买的点数充值需要有效订阅才能使用。如果取消订阅,Top-up credits将无法使用,直到重新订阅。其持久性使充值适合在密集制作会话前提前囤积点数。13


提示词架构

Suno 的 Custom Mode 将创意输入分为3个字段,每个字段各司其职。理解哪些内容应放在哪里(以及哪些不该放),决定了结果是时好时坏,还是始终稳定。

Style 字段

Style 字段定义生成音乐的特征。它接受自然语言描述,可用于指定流派、情绪、速度、配器、人声特质和制作风格。

最佳公式:

[Genre] [Subgenre], [Tempo/Energy], [Key instruments], [Vocal style], [Production quality], [Mood]

示例:

Indie folk rock, mid-tempo, acoustic guitar and mandolin, warm female vocals, lo-fi production, nostalgic and wistful

描述词的最佳数量:4至7个。少于4个会给 Suno 留下过大的发挥空间。超过7个后,描述词之间便会相互冲突,导致结果混乱,各项特征都无法清晰呈现。14

前后对比:提示词精度至关重要

即使创作意图完全相同,Style 字段的精度不同,也会产生截然不同的结果:

模糊的提示词(2个描述词):

rock, energetic

结果:生成普通的流行摇滚,采用标准鼓组、失真吉他和男性人声,并默认使用适合电台播放的音色。Suno 会用最常见的默认选项补全所有未指定的参数。连续生成10次,没有两首听起来属于同一风格。

精确的提示词(6个描述词):

Garage rock, raw and aggressive, distorted bass, room mic drums, shouted male vocals, lo-fi production

结果:稳定生成具有鲜明低保真特征的车库摇滚。鼓声带有房间麦克风的收音质感,贝斯突出,人声粗粝。连续生成10次,所有作品都具备可辨识的声音特征。差异体现在旋律和编曲上,而非根本风格。

差异原因:每个描述词都会约束输出的一个维度。单独使用“Rock”时,速度、人声风格、制作质量、乐器平衡和情绪全由 Suno 决定。添加“garage”会限定子流派惯例,“lo-fi production”会限定声音质感,“shouted male vocals”则会限定演唱方式。这样一来,模型采用通用默认选项的空间就更小。

过度指定的提示词(10个以上描述词):

Garage rock, raw and aggressive, distorted bass, room mic drums, shouted male vocals, lo-fi production, 145 BPM, minor key, reverb-heavy, vintage tube amp warmth, 1960s Detroit influence

结果:混乱而折中的成品。Suno 无法同时满足所有约束,因此只能部分实现每项要求。“1960s Detroit influence”可能与“145 BPM”冲突,而“reverb-heavy”又与“lo-fi production”相互矛盾。最终输出听起来杂乱无章,而非特征鲜明。

Style 字段中的有效内容

描述词类型 示例 效果
流派 rock, jazz, hip-hop, EDM, classical, country 确定主要音乐框架
子流派 shoegaze, bossa nova, trap, dubstep, baroque 缩小流派惯例的范围
速度 slow, mid-tempo, upbeat, fast, 120 BPM 控制速度(BPM 数值仅为近似值,并不精确)
乐器 acoustic guitar, synth pad, brass section, strings 建议使用的配器(不作保证)
人声特质 raspy male vocals, ethereal female vocals, choir 塑造人声特征
制作风格 lo-fi, polished, raw, overdriven, clean 决定整体声音质感
情绪 melancholic, euphoric, aggressive, dreamy, dark 决定情感基调
年代 80s, 90s grunge, 2000s pop, vintage, modern 引入特定时期的风格惯例

Style 字段中的无效内容

  • 特定艺人姓名:“Sounds like Adele”并不可靠,也可能被过滤。请改用等效的描述:“powerful female vocal, piano-driven pop ballad”
  • 专业混音术语:“Sidechain compression on the kick”会被忽略。Suno 无法理解混音参数
  • 精确控制 BPM:“127 BPM”只会被视为近似指引,而非严格锁定的节拍器速度
  • 否定式指令:在 Style 字段中使用“No drums”并不可靠。若要排除不需要的乐器和元素,请使用 Advanced Options 下的官方 Exclude 字段;若要控制整首曲目的结构,请使用 Instrumental 开关;若要控制特定段落,请使用 metatags(元标签)

Lyrics 字段

Lyrics 字段接受歌曲文本,也可以添加 metatags(元标签)来控制结构。若不使用 metatags,Suno 会根据换行和内容模式推断歌曲结构。

基础歌词(无 metatags):

Walking down the empty road
Headlights fading in the rain
Every mile feels like a year
But I keep driving through the pain

带 metatags 的歌词(推荐):

[Verse 1]
Walking down the empty road
Headlights fading in the rain

[Chorus]
Keep driving, keep driving
Through the storm and through the night

[Verse 2]
Every mile feels like a year
But the horizon's getting bright

[Chorus]
Keep driving, keep driving
Through the storm and through the night

[Outro]
And the sun comes up again

始终使用 metatags。若不使用,Suno 会自行决定歌曲结构,结果可能与创作意图不符。[Chorus] 标签可确保段落重复并突出旋律,[Bridge] 标签则表示和声将发生变化。这些结构提示能显著提高输出的一致性。

网页版 Lyrics Editor(2026年7月)

2026年7月,Suno 围绕专用的 Lyrics Editor 重新设计了网页版歌词创作体验。40其中有5项新增功能会影响本指南介绍的工作流程:

  • Lyricist:用于保存并锁定写作风格的个人资料,让后续歌词创作始终保持一致的表达方式,而不会每次都重置为 Suno 的默认语体。
  • 自然语言编辑:输入“make this line funnier”之类的指令,编辑器便会直接修改原文,无需再手动改写和粘贴。
  • 押韵和替代表达建议:选中某个单词或句子,即可获得相应的押韵选项和替代表达。
  • 歌曲结构标签:将段落标记为 Verse、Chorus 或 Outro,告诉模型曲目应如何推进。这些标签通过编辑器的点击式界面,完成与上文纯文本歌词中方括号 metatags 相同的工作。有关两种操作方式之间的关系,请参阅 Suno 标签和元标签
  • 支持自动保存的无干扰全屏编辑器:提供全屏写作模式,并在输入时自动保存。

编辑器改变的是歌词稿的创作方式,而非模型接受的内容:仍可将上述示例那样带有完整标签的纯文本歌词稿直接粘贴到 Lyrics 字段中,其工作方式与以往完全相同。

Title 字段

Title 字段用于命名生成内容。它对音乐输出几乎没有影响,但会显示在元数据和 Suno 的音乐库中。建议使用描述性名称,方便自行整理。


Prompt Enhancement Helper

Prompt Enhancement Helper 于 V4.5 中推出,是一项由 AI 驱动的功能,会在生成前改写 Style 字段中的提示词。启用后,Suno 会将描述词扩展为更详细的提示词,以便模型更准确地理解。14

工作原理

  1. 编写 Style 提示词:indie rock, energetic
  2. Helper 将其扩展为类似以下内容:Energetic indie rock, driving electric guitars, punchy drums, dynamic bass, bright and raw production, anthemic and youthful
  3. Suno 使用扩展后的提示词生成内容,而非原始提示词

适用场景

场景 是否使用 Helper? 原因
简短、模糊的提示词 Helper 会补充您未提供的具体信息
探索新流派 呈现您可能不了解的描述词
精确、详细的提示词(5个以上描述词) Helper 可能覆盖或弱化您的创作意图
重复使用已验证有效的 Style 提示词 此时需要的是一致性,而非重新诠释

重要行为特征

  • Helper 具有非确定性:即使输入相同,每次改写的结果也会不同
  • 生成后可以查看扩展后的提示词,了解 Suno 认为哪些描述词有用
  • 扩展后的提示词是很好的学习工具:先使用 Helper 生成一次,阅读扩展结果,然后在后续提示词中直接使用这些描述词,无需再启用 Helper
  • 对于需要精确控制 Suno 接收内容的正式制作工作,请将其禁用

使用 Helper 来学习,而非依赖它。从扩展结果中提取有用的描述词,将其纳入自己的词汇库,然后自行编写精确的提示词。完全由您掌控的提示词,往往能带来最佳效果。


流派与风格描述词

Suno能够识别数百种流派和风格术语。研究显示,AI音乐模型训练数据中约86%来自全球北方流派,其中吉他、钢琴、鼓等乐器占训练片段的52–67%,而地域性乐器占比不足3%。21因此,流派准确性会直接受到具体程度和文化来源的影响。

高置信度流派(结果稳定)

这些流派在训练数据中覆盖充分,因此能够产生可靠且准确的输出:

流派 有效描述词 说明
Pop pop, synth-pop, indie pop, dream pop, electropop Suno最擅长的流派。如未指定,默认行为往往偏向pop。
Rock rock, indie rock, alt-rock, classic rock, punk rock, post-punk 乐器分离效果好。吉他音色可信度高。
Hip-Hop/Rap hip-hop, trap, boom bap, lo-fi hip-hop, conscious rap Rap人声在V5中表现良好。可通过歌词格式控制flow和delivery。
Electronic/EDM EDM, house, techno, trance, drum and bass, dubstep 擅长build-drop结构。Synth质感丰富多样。
R&B/Soul R&B, neo-soul, contemporary R&B, motown 人声质感顺滑。擅长基于groove的编曲。
Country country, country rock, outlaw country, bluegrass 原声乐器渲染良好。Pedal steel和banjo具有较高辨识度。
Folk folk, indie folk, folk rock, Americana 侧重原声质感。人声风格自然。
Jazz jazz, smooth jazz, jazz fusion, bebop, swing 在V5中显著改进。和声复杂度明显优于V4。

中等置信度流派(需提供引导)

流派 有效描述词 说明
Metal metal, heavy metal, death metal, black metal, metalcore 失真吉他音色表现良好。极端人声(growls、screams)效果不稳定。
Classical classical, orchestral, chamber music, symphony 基础管弦乐编曲表现不错。复杂对位较弱。
Latin reggaeton, salsa, bossa nova, cumbia, bachata 节奏型通常准确。具体乐器表现有所差异。
Afrobeats afrobeats, afropop, highlife 正在改进。V5的节奏准确性优于V4。
K-Pop/J-Pop K-pop, J-pop, city pop 制作风格辨识度高。除非歌词另行指定,否则人声语言可能默认使用英语。

低置信度流派(需要反复迭代)

流派 有效描述词 说明
Microtonal/Avant-garde avant-garde, experimental, noise 难以预测。结果往往有创意,但很少精准符合意图。
Traditional/Folk(非西方) gamelan, raga, Tuvan throat singing 训练数据有限。结果更像近似模拟,而非真实复现。
Sound design/SFX ambient drone, soundscape 更适合交由Stable Audio处理。Suno更偏向优化歌曲结构。

人声风格

人声特征是Suno输出中最容易控制的方面之一。V5显著提升了人声的自然度和表现力。

人声描述词

描述词 效果
性别 “male vocals”, “female vocals”, “androgynous vocals”
音色 “warm”, “bright”, “dark”, “rich”, “thin”, “breathy”
技巧 “raspy”, “smooth”, “vibrato”, “falsetto”, “belt”, “whisper”
风格 “soulful”, “punk”, “operatic”, “conversational”, “spoken word”
处理 “reverb-heavy”, “dry vocals”, “auto-tuned”, “distorted”, “lo-fi”
和声 “harmonized”, “choir”, “backing vocals”, “vocal layering”

组合人声描述词

叠加2–3个人声描述词,可获得更精确的控制:

Raspy male vocals with subtle vibrato, lo-fi warmth
Ethereal female vocals, breathy and reverb-heavy, choir harmonies
Deep baritone, smooth jazz delivery, minimal processing

语言与多语言人声

Suno V5支持生成多语言人声。模型会根据歌词推断语言。对于非英语歌词:

  • 在Lyrics字段中使用目标语言编写歌词
  • 可选择在Style字段中加入语言:”Japanese city pop, female vocals”
  • 英语、西班牙语、葡萄牙语、法语、日语、韩语和普通话通常效果最佳
  • 覆盖较少的语言可能出现口音或发音不够准确的问题

Instrumental Mode

在Custom Mode中开启Instrumental,即可生成无人声曲目。此时Style字段会成为唯一的创意输入。

何时应该使用Instrumental Mode?

  • 背景音乐:播客开场、视频配乐、氛围型工作音乐
  • 制作元素:Beat beds、和弦进行、氛围纹理
  • 流派探索:在不受人声质量变量影响的情况下测试流派描述词
  • DAW集成:为现场人声录制生成伴奏轨

Instrumental提示词模式

没有人声时,Style字段需要更具体的描述细节来弥补:

Cinematic orchestral score, sweeping strings, French horns, timpani rolls, epic and triumphant, Hans Zimmer inspired
Lo-fi hip-hop beat, jazzy piano chords, vinyl crackle, mellow drums, study music
Ambient electronic, pad textures, slow evolving synths, ethereal and spacious, Brian Eno inspired

提示:即使在Instrumental Mode中,也建议在Lyrics字段加入[Instrumental][Instrumental Break]metatags,以强化意图并控制编曲结构。


Suno 标签与元标签

Suno 的标签(在大多数 Suno 文档中写作“metatags”,在多数搜索查询中写作“meta tags”;两者含义相同)是其结构控制语言。将它们置于 Lyrics 字段中的方括号内,即可控制编曲、配器、动态和人声表现。元标签让 Suno 从一个根据提示词生成歌曲的玩具,转变为真正的作曲工具。10

Suno 有两套标签系统,分别用于两个不同的字段:

  • 元标签放在 Lyrics 字段中,并用方括号括起:[Verse][Chorus][Guitar Solo][Fade Out]。它们控制歌曲结构和各段落的表现。本节及其后3节提供完整参考。
  • 风格标签以不带方括号的普通描述词形式放在 Style 字段中:流派、速度、配器、人声质感、制作风格和情绪。它们控制音乐的整体特征。完整的风格词汇请参阅提示词架构流派与风格描述词

Suno 标签速览

可将以下任意内容复制粘贴到 Lyrics 字段中:

类别 常用标签 复制粘贴示例
结构 [Intro][Verse 1][Pre-Chorus][Chorus][Bridge][Outro][End] 在副歌歌词前单独一行写入 [Chorus]
器乐 [Instrumental][Instrumental Break][Guitar Solo][Piano Solo][Synth Solo] 在第2段主歌与桥段之间写入 [Instrumental Break]
人声 [Male Vocal][Female Vocal][Choir][Harmony][Rap][Whisper][Spoken Word] 在安静、亲密的歌词前写入 [Whisper]
动态与制作 [Fade In][Fade Out][Crescendo][Silence][Key Change][Tempo: slow] [Fade Out] 作为尾声的最后一行
参数化标签 [Verse: whispered vocals, acoustic guitar only][Chorus: full band, soaring vocals] 在任意结构标签内添加 : descriptors,即可控制各段落

接下来的3节提供完整表格:结构标签涵盖所有段落标签,器乐与人声标签介绍乐器和人声控制,高级元标签模式则涵盖参数化标签与动态控制。

复制粘贴入门模板:完整标注标签的歌词稿

[Intro: sparse, atmospheric]

[Verse 1]
Your first verse lyrics here

[Chorus]
Your hook lyrics here

[Verse 2]
Your second verse lyrics here

[Chorus]
Your hook lyrics here (same text encourages melodic repetition)

[Bridge: stripped down, different energy]
Your contrast lyrics here

[Chorus]
Your hook lyrics here

[Outro: fade out]
[End]

是否存在 [no vocals] 标签?

没有专用的 [no vocals] 元标签,在 Style 字段中写入“no vocals”也并不可靠(其中的否定指令往往会被忽略)。要稳定生成无人声曲目,请结合使用以下设置:

  1. 在 Custom Mode 中开启 Instrumental
  2. 在 Lyrics 字段中添加 [Instrumental](如果只希望含人声歌曲中的某个段落无人声,则使用 [Instrumental Break]
  3. 在 Advanced Options 下的官方 Exclude 字段中填写 vocals

有关适用于无人声曲目的提示词模式,请参阅器乐模式

元标签的工作原理

元标签会被当作编曲指令处理,而不是歌词。当 Suno 遇到 [Chorus] 时,它会: 1. 标记编曲中的段落切换 2. 应用典型的副歌特征(突出旋律、增加配器、提升能量) 3. 如果相同的 [Chorus] 文本再次出现,则尝试重复其旋律和编曲

元标签不区分大小写:[VERSE][Verse][verse] 等效。

为什么元标签比提示词文本更重要:如果没有元标签,Suno 会根据换行和歌词内容推断歌曲结构。模型会依据训练中学到的模式,猜测主歌在何处结束、副歌从何处开始。元标签消除了这种不确定性。与其期待 Suno 自行将副歌识别为副歌,不如使用 [Chorus] 明确触发符合副歌特点的音乐表现:鲜明的旋律钩子、更丰富的配器、更高的能量,以及后续再次出现时的重复。这样的效果会贯穿整首歌曲并不断累积。对于一首3分钟、没有元标签的曲目,可能有6至8项结构决策由 Suno 推断完成;使用元标签后,这6至8项结构决策将由您亲自决定。

V5.5 中的标签行为

截至 V5.5,元标签词汇保持不变:2026年3月发布的版本新增了 Voices、Custom Models 和 My Taste,但没有增加新标签,也未更改标签处理方式。以下4个 V5.5 时代的具体要点值得了解:

  • 应优先使用 Exclude 字段,而非否定标签。 Style 字段中的否定指令(如“no drums”)并不可靠;Advanced Options 下的 Exclude 字段才是排除不需要的乐器和元素的官方控制方式。
  • 网页 Lyrics Editor 中的结构标签,只是同一控制功能的另一种操作界面。 2026年7月推出的 Lyrics Editor 允许您通过界面将段落标记为 Verse、Chorus 或 Outro,以告知模型曲目应如何推进——这与纯文本歌词稿中的 [Verse]/[Chorus]/[Outro] 方括号标签作用相同。在编辑器内创作时使用界面标签;在 Suno 外部准备好歌词稿再粘贴时,则使用方括号标签。标签词汇本身并未改变。40
  • My Taste 不会覆盖您的标签。 当提示词描述不充分时,My Taste 会影响默认设置;但明确填写的 Style 字段描述词仍会覆盖其偏好,Lyrics 字段中的元标签也仍然决定歌曲结构。魔法棒图标(Style Augmentation)生成的是个性化风格文本,而非结构标签。
  • 拍号属于编辑界面设置,而非生成标签。 Studio 网格和节拍器支持 3/4、6/8 及不规则拍号,但此设置本身不会影响生成模型。

结构标签

这些标签用于定义歌曲段落并控制编曲走向。

主要结构标签

标签 用途 音乐效果
[Intro] 开场段落 通常为器乐或稀疏编曲,用于奠定基调
[Verse][Verse 1] 主歌段落 能量适中,侧重叙事,旋律有所变化
[Pre-Chorus] 铺垫至副歌 能量逐渐上升,采用过渡性和声
[Chorus] 钩子/叠句 能量达到顶峰,旋律易于记忆,配器完整
[Post-Chorus] 副歌后段落 延续能量,并逐步过渡回较平缓的状态
[Bridge] 对比段落 使用不同的和弦与能量表现,增加变化
[Breakdown] 精简编曲段落 减少配器,营造空间感
[Build][Build-Up] 能量递增段落 强度逐步提升,常见于 EDM
[Drop] 高能量爆发段落 配器和能量达到最大值,通常紧随递增段落之后
[Hook] 抓耳乐句 简短且易于记忆的音乐乐句
[Interlude] 器乐间奏 衔接不同段落,转换听觉氛围
[Outro] 收尾段落 逐渐降低能量,为歌曲画上句号
[End] 立即结束 表示歌曲应当结束(防止产生拖尾音频)

编号段落

使用数字区分重复出现的同类段落:

[Verse 1]
First verse lyrics here

[Chorus]
Chorus lyrics

[Verse 2]
Second verse with different lyrics

[Chorus]
Same chorus lyrics (encourages melodic repetition)

为主歌编号有助于 Suno 理解:每段主歌应采用不同的旋律,而各段副歌则应重复相同的旋律。


器乐与人声标签

这些标签用于控制各段落中的配器和人声表现。

器乐标签

标签 效果
[Instrumental] 无人声段落
[Instrumental Intro] 器乐开场
[Instrumental Break] 歌曲中段的器乐段落
[Guitar Solo] 以吉他为主的器乐段落
[Piano Solo] 以钢琴为主的段落
[Drum Solo] 以打击乐为主的段落
[Bass Solo] 以贝斯为主的段落
[Saxophone Solo] 以萨克斯为主的段落
[Strings Rise] 弦乐声部渐强
[Percussion Break] 以节奏为主的精简编曲段落
[Synth Solo] 合成器主奏段落

人声标签

标签 效果
[Male Vocal] 切换为男声
[Female Vocal] 切换为女声
[Duet] 两个人声声部
[Choir] 合唱人声
[Harmony] 人声和声
[Rap] 说唱演绎
[Spoken Word] 念白演绎,不进行演唱
[Whisper] 耳语式演绎
[Scream] 嘶吼/喊唱式演绎(金属、朋克)
[Ad-lib] 即兴人声乐句
[Humming] 哼唱旋律
[Backing Vocals] 背景人声声部

高级元标签模式

参数化元标签

元标签(metatags)可在冒号后添加描述性修饰语:

[Verse: whispered vocals, acoustic guitar only]
Walking through the morning mist
The world still sleeping, still

[Chorus: full band, powerful vocals]
But I'm awake, I'm alive
And every sound is a sign

借助冒号语法,无需更改全局 Style 字段,即可调整各个段落。参数化元标签是功能最强大的元标签特性,可让您逐段控制编曲。

动态与制作元标签

标签 效果
[Fade In] 音量逐渐增大
[Fade Out] 音量逐渐减小
[Silence] 音频短暂停顿
[Crescendo] 强度逐渐增强
[Decrescendo] 强度逐渐减弱
[Tempo: slow] 段落级速度变化
[Key Change] 和声转调

组合结构标签与修饰标签

[Intro: ambient pads, reversed guitar, ethereal]
[Verse 1: lo-fi drums, muted bass, whispered vocals]
Words that float on morning air
Disappearing into light

[Pre-Chorus: building energy, adding layers]
But something shifts beneath the surface

[Chorus: full production, soaring vocals, epic drums]
We break through the silence
Into the wide open sky

[Bridge: stripped down, piano only, vulnerable vocals]
And in the quiet after the storm

[Outro: fade out, ambient reprise]

最终仅凭文本即可实现 DAW 级别的编曲控制。


Creative Sliders

Creative Sliders 是 V4.5+ 中用于塑造生成作品个性的控件。它们位于 Custom Mode 的 Lyrics 字段下方。11

为何滑块与文本提示词并存:文本提示词定义要生成什么(流派、乐器、情绪),滑块则控制模型如何解读这些提示词。低 Weirdness 下的“jazz”提示词会生成传统的爵士标准曲;相同提示词在高 Weirdness 下则会生成打破自身惯例的爵士乐。提示词定义词汇,滑块定义语法。

Weirdness

范围:Safe ← → Chaos(滑块,不显示数值)

位置 效果
Safe(左侧) 结构传统,严格遵循可预测的流派特征,旋律选择稳妥
中间(默认,约 50%) 保持平衡,在流派惯例内加入一些创意惊喜
Chaos(右侧) 结构突破常规,和声选择出人意料,并可跨越流派边界;但生成内容不连贯的风险更高

Weirdness 的实际表现:数值较低时,Suno 会在每一步选择最可能出现的下一个音乐事件,从而生成符合传统的结果;数值较高时,低概率事件会更频繁地出现,形成令人意外的组合。Suno 并未公开具体机制,但可以明显观察到连贯性方面的取舍:设置越稳妥,听感越精致;设置越怪异,创意越丰富,但输出也可能越不连贯。

适合提高 Weirdness 的情况: - 实验或先锋流派 - 传统生成结果显得千篇一律时 - 进行流派融合实验时

适合降低 Weirdness 的情况: - 需要听起来“正常”的商业音乐 - 必须严格遵守流派惯例时 - 制作不应喧宾夺主的背景音乐或氛围音乐时

Style Influence

范围:Loose ← → Strong(滑块)

位置 效果
Loose(左侧) 风格描述仅作为建议,而非硬性要求。Suno 拥有更大的创作空间
中间(默认) 均衡遵循风格描述
Strong(右侧) 严格遵循风格描述,减少创意偏离

如果 Style 字段描述精确,并且希望生成结果与描述完全一致,请使用 Strong。如果希望 Suno 更自由地解读提示词,甚至带来意外惊喜,请使用 Loose

Audio Influence

范围:控制上传的音频参考对生成结果的影响程度。

使用 Audio Upload(Covers、Remixes 或 Add Vocals/Instrumentals)时可用。数值越高,输出越贴近参考音频的特征。


Song Editor

Song Editor 支持在生成后进行编辑,无需重新创建整首歌曲。它解决了“歌曲已有 90% 完美,但某个段落有问题”的难题。12

可用操作

操作 功能 适用场景
Inpainting 用新内容替换指定时间范围 主歌表现较弱,但副歌已经完美
Extend 从当前结尾继续延长歌曲 歌曲结束得太早,或还需要增加一个段落
Crop 将歌曲裁剪至更短的长度 删除末尾静音或不需要的段落
Fade In/Out 在开头或结尾应用渐进式音量变化 为前奏或尾奏增添专业质感
Replace Section 根据新指令重新生成某个段落 桥段的调性效果不理想

Inpainting 工作流程

  1. 选择要替换的时间范围(在波形上拖动)
  2. 可选择为替换段落提供新的歌词或元标签
  3. 生成:Suno 会创建与前后音频相匹配的新内容
  4. 试听并比较。接受结果或重新生成。

Inpainting 是一个迭代过程。首次替换很少能与前后内容完美衔接。建议预留 2–5 次尝试,以获得流畅自然的过渡。

Extend 工作流程

  1. 在任意现有生成作品上点击 Extend
  2. 可选择为续写部分提供歌词或元标签
  3. Suno 会生成约 30–60 秒的新音频,从原有结尾继续创作
  4. 每次 Extend 都属于单独生成(会消耗积分)

最佳实践:在 Extend 提示词的开头加入结构元标签(例如 [Chorus][Outro]),以引导续写内容的生成方向。


Covers 与 Remixes

Pro 和 Premier 套餐可以基于现有 Suno 曲目创建 Covers 和 Remixes。

Covers

上传或选择现有 Suno 曲目作为参考,然后应用新风格:

Style: Acoustic folk cover, fingerpicked guitar, soft female vocals, intimate production

Cover 会保留旋律和歌词,同时重新构思编曲与制作方式。

Remixes

Remixes 对现有曲目的改编力度比 Covers 更大:

Style: EDM remix, heavy bass, 128 BPM, drop-focused, festival energy

Add Vocals / Add Instrumentals

这两种专用模式可在现有音频上叠加内容:

  • Add Vocals:上传一条器乐曲目,Suno 会在其上生成人声
  • Add Instrumentals:上传一条人声轨道,Suno 会为其生成伴奏

这两种模式均可将 Suno 融入传统制作流程:录制真实人声并由 Suno 生成伴奏,或反向操作。

Voices

Voices系统(Pro/Premier,v5.5)允许您在多次生成中创建并复用一致的声乐角色。您不必再寄希望于每次生成都分配到相似的声音,而是可以定义一个声音并引用它。Voices建立在早期Personas工作的基础之上;Suno当前帮助中心说明,Create菜单现在使用Voices,而Style Personas仍保留在Voices菜单内。1531

创建Persona Voice

  1. 生成一首带有人声且您喜欢的歌曲
  2. 点击该生成结果上的三点菜单,然后选择“Create Persona”
  3. 为persona取一个描述性名称(例如“Warm Alto Folk”、“Raspy Baritone Rock”、“Ethereal Soprano”)
  4. 该persona会保存到您的账户库中

创建有效personas的建议: - 应专门为persona进行生成,而不是把它当作另一首歌曲的副产物。使用清晰、符合流派的人声突出的Style prompt。 - 避免从带有重度人声处理(auto-tune、失真)的歌曲中创建personas。persona捕捉的是处理后的声音,而不是底层嗓音。 - 创建面向特定流派的personas,而不是一个“通用”声音。基于独立民谣曲目训练的persona,用在trap节拍上会产生难以预测的结果。

使用Persona Voices

在Custom Mode中,生成前从Persona下拉菜单选择已保存的persona。该persona会应用于当前会话中的所有生成结果,直到您更改它为止。

Persona行为: - persona会保留音色(人声音调、共鸣)和基本演唱风格(气声、沙哑、顺滑) - 它不会保留精确的旋律模式、乐句处理或节奏化演唱。这些由Style prompt和metatags决定 - 将persona应用到不同速度和调性通常效果良好。跨越差异极大的流派(例如把爵士persona用于death metal)则会产生不一致的结果。

Persona管理

  • 存储限制:Suno允许保存多个personas(确切上限未公开记录,但用户反馈20个以上也没有问题)
  • 命名规范:使用包含人声特质和流派语境的描述性名称。否则很快就会忘记“Voice 3”是什么
  • 删除:可以从您的库中删除personas。删除后无法恢复。
  • 账户限定:personas无法在账户之间共享,也无法导出

限制

  • Persona Voices捕捉的是音色和基本演唱风格,不是精确的人声技巧
  • 当persona被应用到远离其原始流派的场景时,结果会有所波动
  • Persona Voices限定于账户,无法共享
  • 2025年12月更新提升了persona在多次生成中的一致性,但仍不能保证完全复现15

Voice Cloning(V5.5)

V5.5引入了Voices,允许Pro和Premier订阅者克隆自己的声音并用于生成。3031与Persona Voices(从生成歌曲中提取音色)不同,经过验证的Voice会捕捉真实人声的特征。

工作方式:

  1. 录制或上传一段人声样本
  2. 完成验证流程,将一段朗读短语与您上传或实时采集的人声样本进行比对
  3. 克隆后的声音会作为可选voice出现在Custom Mode中

与Persona Voices的关键区别:

方面 Persona Voices Voice Cloning
来源 生成的Suno歌曲 真实人声录音
验证 需要身份验证
保真度 捕捉音色和基本演唱方式 对源声音进行更高保真度的复现
可用性 Pro/Premier 仅限Pro/Premier,v5.5;受年龄/地区限制

验证与共享:Suno要求验证,以防止未经授权克隆他人的声音。您必须确认自己是被克隆声音的所有者,或已获得明确使用许可。只有您可以使用自己的Voice进行创作,但如果您发布或分享包含您Voice的歌曲,并在发布选项中允许remixing,其他用户可以对该歌曲进行covered或remixed。31

Custom Models(V5.5)

Custom Models允许Pro和Premier订阅者根据自己的特定音乐风格个性化V5.5。3031它不是每次都从Suno的通用模型开始,而是将Custom Model调校到您的创作偏好。

Custom Models的工作方式:

  1. 上传至少6首来自您曲库的歌曲,或上传在Suno之外制作、能够代表目标风格的曲目
  2. 保持训练素材在风格上一致。把随机流派混在一个模型中会让学习过程变得嘈杂;坚持单一方向(例如完整管弦乐、future bass、独立民谣)能让模型获得更清晰的方向
  3. 为Custom Model命名,Suno会基于这些选择训练一个个性化版本的V5.5
  4. 在未来生成中使用该Custom Model,让结果继承您的风格指纹

限制:每位Pro或Premier订阅者最多可拥有3个Custom Models。这使您可以为不同项目或流派维护独立模型(例如一个用于独立民谣,一个用于电子乐,一个用于hip-hop)。

Custom Models捕捉的内容:来自您所选训练歌曲的流派倾向、编曲模式、制作审美和风格偏好。它们不会记忆或复现训练素材中的具体旋律或歌词。


My Taste(V5.5)

My Taste是V5.5功能,面向所有用户开放(包括免费层级),会随着时间推移让Suno的生成行为适应个人偏好。3031

工作方式:随着您生成、点赞并与歌曲互动,Suno会建立偏好画像。My Taste默认启用,但可以从头像菜单中查看、编辑或禁用。Styles框右上角的魔杖图标是主要触发入口:启用Style Augmentation后,它会生成一段贴合您品味画像的风格文本。31My Taste会影响生成默认值,并对您持续偏好的流派、制作风格、人声特质和结构模式形成细微倾向。

My Taste影响的内容: - 当prompt描述不足时的默认流派和风格倾向 - 制作审美偏好(lo-fi与精致制作、稀疏与密集) - 人声风格偏向 - 编曲和结构模式

My Taste不会替代的内容: - 明确的Style字段描述仍会覆盖My Taste偏好 - Creative Sliders仍会独立发挥作用 - Persona Voices和Voice Cloning不受影响

实际影响:My Taste降低了新用户容易得到通用结果的“冷启动”问题。随着时间推移,即便是“upbeat rock song”这样简单的prompt,也会根据您的生成历史,产出更贴近您所偏好的具体摇滚风味的结果。


生成循环

高效使用Suno遵循的是迭代式工作流,而不是单次prompt方法。

制作周期

1. IDEATION
    Generate 5-10 variations with different Style descriptors
    (Cost: ~25-50 credits)

2. SELECTION
    Pick the 1-2 best results
    Identify what works and what doesn't

3. REFINEMENT
    Adjust Style descriptors based on what you heard
    Refine lyrics and metatags
    Regenerate with tighter prompts
    (Cost: ~15-30 credits per round)

4. EXTENSION
    Extend the best track to full length
    Add missing sections (bridge, outro)
    (Cost: ~5-15 credits)

5. EDITING
    Use Song Editor to fix weak sections
    Inpaint, crop, fade as needed
    (Cost: ~5-20 credits)

6. EXPORT
    Download final audio (MP3/WAV)
    Optionally export stems for DAW work

一首精修曲目的典型成本:50–100 credits(约10–20首生成歌曲,通常为5–10个双曲Create批次加上编辑)。

演练:从概念到导出的一首歌

下面是一首单曲的完整制作周期,展示每个阶段的实际prompt和决策:

1. 概念:“关于失眠的阴郁indie folk歌曲。”

2. 第一个Create批次(10 credits,2个变体):

Style: Indie folk, slow tempo, acoustic guitar fingerpicking, soft female vocals, intimate lo-fi recording, melancholic
Lyrics:
[Verse 1]
The ceiling holds no answers
Just shadows and the clock
Every hour stretches longer
When the world has gone to dark

[Chorus]
Sleep won't come, sleep won't come
I'm counting every sound

[Verse 2]
The neighbors' lights went out at ten
The street grew still by twelve
Now it's somewhere past forever
And I'm talking to myself

[Chorus]
Sleep won't come, sleep won't come
I'm counting every sound

[Outro: fade out, humming]

3. 选择:Variation B的人声音色合适,但副歌旋律相对整体情绪过于明快。Variation A的副歌更好,但吉他音色偏薄。

4. 精修(10 credits):调整Style后重新生成:将“lo-fi recording”改为“warm analog recording”,并添加“sparse arrangement”。歌词保持不变。新的Variation A保留了第一轮的温暖质感,并带有更克制的副歌。

5. 扩展(5 credits):歌曲在2:30结束。使用[Bridge: piano only, vulnerable vocals]+新歌词+[Chorus]+[Outro: fade out, ambient reprise]进行Extend。Bridge自然引入钢琴。

6. 编辑(10 credits):第2段verse进入chorus的过渡过于突兀。使用Song Editor在该衔接处对4秒窗口进行inpaint。第二次inpainting尝试实现了平滑衔接。

7. 导出:下载WAV,用于在Logic Pro中进行母带处理。总成本:35 credits,约7次歌曲级生成或编辑。

关键洞察:大部分credits花在前两轮(寻找正确声音)上,而不是最后三步(精修一个优秀take)上。前置提高prompt精度,相比“模糊prompt加反复迭代”的做法,至少节省了30 credits。

节省credits的工作流技巧

  1. 把时间花在prompt上,而不是生成次数上。精心设计的Style+Lyrics prompt,比用模糊prompt快速迭代更容易产出优质首轮结果。
  2. 按批次生成。探索一个概念时,一次生成4–6个变体,然后先选出最佳方向,再进入精修。
  3. 优先使用Song Editor,而不是重新生成。如果一首歌80%都不错,就编辑剩下的20%,而不是整首重新生成。
  4. 保存成功的Style prompt。当某组描述词组合效果很好时,保存下来便于复用。

Suno Studio DAW

Suno Studio(Premier档位,随V5推出)是一款浏览器内数字音频工作站,用于生成后的编辑。它弥合了Suno生成引擎与传统音乐制作之间的距离。2

Studio功能

功能 作用
多轨视图 带有独立stem轨道的可视化时间线
混音控制 按stem调节音量、声像、静音和solo
Warp markers 对特定段落进行时间拉伸,而不影响音高
Remove FX 从stems中移除混响、延迟和其他效果
Alt takes 为特定段落生成替代版本
拍号 调整或修正拍号解析
Stem隔离 访问最多12个独立stems,用于细致混音

Studio 1.2(2026年2月)

最新Studio更新加入了:25

  • 带Quantize的Warp markers:对单个音符和乐句的时值进行微调,并通过吸附网格量化实现更紧密的节奏对齐
  • Remove FX:移除AI添加的混响和延迟,得到干声stems
  • Alt takes:在时间线内生成并试听替代段落
  • Studio网格中的拍号支持:网格和节拍器支持3/4、6/8以及不规则拍号,用于编辑和对齐。拍号尚未影响生成模型本身;该标签/高级设置影响的是编辑界面,而不是生成行为。4

Suno的Sounds(浏览并叠加预制音频元素)是Create Mode中的一个独立beta功能,并非Studio 1.2功能。Personas另有单独文档;请查看应用内UI和官方帮助中心,以确认二者当前的可用界面。

WavTool收购

Suno于2025年6月收购了WavTool。WavTool是一款基于浏览器的DAW,支持VST插件、采样级精确编辑和AI驱动功能。27 WavTool核心团队加入Suno,担任产品和工程领导角色。这次收购解释了Studio功能的快速发展:Warp Markers、Remove FX和Sounds库,都体现了WavTool专业DAW能力被整合进Suno“生成优先”的工作流。CEO Mikey Shulman将这一举措表述为用“放大人类创造力的工具”赋能音乐人。27

MILO-1080:AI Step Sequencer

2026年3月,Suno推出MILO-1080(Model-Integrated Loop Orchestrator),这是一款面向资深制作人和beatmaker的16轨step sequencer与合成器设计工具。28 MILO-1080将手动编曲与AI生成声音结合起来:

  • 文本到声音生成:从文本prompt创建sample
  • Suno曲库:从此前生成的Suno曲目中提取片段
  • 内置合成器引擎:无需AI即可手动设计声音
  • MIDI支持:用于硬件集成的标准MIDI输入/输出
  • 16轨:带单轨控制的完整多轨编曲

MILO-1080代表Suno正在从text-to-music向完整创意平台推进。结合WavTool收购和Studio DAW来看,这表明Suno的目标不仅是休闲用户,也包括专业制作人。

应该使用Studio,还是导出到DAW?

场景 使用Studio 导出到DAW
快速修正(音量平衡、静音某个stem)
完整专业混音与母带处理
尝试编曲变体
添加外部音频(现场乐器、人声)
日常聆听和分享
商业发行准备 视情况而定

Stem分离与导出

Suno提供3种stem分离方法,并于2026年6月11日进行了全面改造,以获得更干净、更清晰、无伪影的输出:37

Split from Mix(2个stems,所有档位)

从混音中提取任何单一乐器或人声,并得到2个stems:目标乐器或人声,以及其他所有内容。这扩展了较早的“人声vs伴奏”拆分方式——目标不再必须是人声。

适用于:卡拉OK版本、人声采样、隔离单一乐器、基础remixing。

Auto Split(12个类别,Pro/Premier)

Suno的经典模型,可将一首歌拆分为最多12个stem类别:22 - Vocals、drums、bass、guitar、keys/piano、synths、strings、brass、woodwinds、percussion、effects、other

Advanced Split(Premier)

从近100种乐器列表中精确选择要提取的内容,生成一组针对该曲目调校的自定义stems。仅限Premier。37

一个重要区别:Suno的“stem separation”与iZotope RX或Demucs等工具有本质不同。这些工具会分析一个混合后的音频文件,并试图在事后隔离音源。Suno很可能是直接导出各个生成层,因为所有音频最初就是由它创建的。其结果更接近从DAW导出submixes,而不是事后音源分离。23 实际使用中,Suno stems比第三方分离工具在同一个混音文件上生成的结果更干净,但它们未必能与原始混音通过完美的null-test。

质量说明:stems之间可能存在一些串音,尤其是在频率相近的乐器之间。V5中的分离质量有显著提升。对于任意音频文件(非Suno生成)的专业工作,Demucs和iZotope RX等专用工具仍然是标准选择。23

导出格式

  • MP3:标准压缩音频。适合分享、流媒体和草稿。
  • WAV:未压缩音频。专业DAW工作和母带处理所必需。

DAW集成

Suno的输出可通过stem导出集成到传统制作工作流中。

推荐工作流

  1. 在Suno中生成,直到编曲和氛围都符合预期
  2. 导出12个stems(Pro/Premier),格式为WAV文件
  3. 导入您的DAW(Logic Pro、Ableton、Pro Tools、FL Studio、Reaper)
  4. 使用专业工具和处理链进行混音与母带处理
  5. 按需替换或增强单个stems,例如加入现场录音

DAW混音能带来什么

  • EQ和压缩:按stem进行音色塑形,这是Suno的AI混音无法提供的
  • 空间处理:精确的立体声定位、混响发送、延迟点缀
  • 自动化:随时间变化的动态调整(淡入推进、滤波扫频)
  • 外部乐器:将现场录音与AI生成的stems叠加
  • 母带链:响度标准化、限制处理,以及发布前的最终润色
  • 自动化脚本:使用Claude Code构建prompt模板、批量处理Style字段变体,或为“生成-筛选-细化”循环编写脚本

流派融合

Suno的一项独特优势,是能够生成位于不同流派交汇处的音乐;在传统制作中,这通常需要多位专业乐手协作。

有效的融合模式

双流派融合(最可靠):

Jazz-funk fusion, slap bass, Rhodes piano, syncopated drums, groovy and sophisticated

流派+时代混搭:

80s synthwave meets modern trap, analog synths, 808 bass, retro-futuristic

流派+意外乐器:

Death metal with jazz saxophone solos, blast beats, dissonant chords

融合规则

  1. 以主导流派开头。“Jazz with electronic elements”和“Electronic with jazz elements”会产生不同结果。
  2. 限制在2–3种流派内。超过这个范围后,Suno的输出往往会变成缺乏焦点的折中结果。
  3. 使用时代标记锚定风格。“90s”或“2020s”有助于Suno选择合适的制作惯例。
  4. 提高Weirdness以获得更不寻常的融合效果。默认Weirdness设置会尝试把一切都归一化,这会削弱流派融合的意义。

多段式作曲

对于超过8分钟的歌曲,需要分多次生成并进行拼接。

策略1:Extend

先生成第一段,然后使用Extend添加后续段落。每次扩展都会以前一段的结尾作为上下文。

优点:音乐连续性好。每次扩展都会自然承接前一段。 缺点:对后续段落的控制较弱。多次扩展后可能出现音乐漂移。

策略2:逐段生成

使用特定的metatag + Style组合分别生成每个段落,然后在DAW中拼接。

优点:可最大限度控制每个段落的特征。 缺点:独立生成的段落之间可能听起来衔接突兀。拼接需要DAW技能。

策略3:混合方法(推荐)

  1. 将歌曲核心部分(主歌-副歌-主歌-副歌)作为一次生成完成
  2. 使用Extend生成bridge和最终chorus
  3. 使用Song Editor对薄弱转场进行inpaint
  4. 导出stems,并在DAW中完成最终制作

Prompt串联

通过一系列相关生成构建复杂歌曲。

串联模式

Generation 1: "Atmospheric intro, ambient pads, slow build"
    Extend with: "[Build-Up] [Drop: full energy, heavy drums]"
    Extend with: "[Verse 1: vocals enter, riding the beat]"
    Extend with: "[Chorus: anthemic, crowd-singing energy]"
    Extend with: "[Outro: fade out, return to ambient pads]"

每次扩展都会继承上一代生成结果的音乐DNA,从而在不必每次从零开始的情况下,创建连贯的多段式作品。


故障排查

为什么我的Suno歌曲听起来不对?

问题 可能原因 解决方案
歌曲听起来完全不像Style prompt 描述词相互竞争,或Weirdness过高 减少到4–5个核心描述词。降低Weirdness。
人声听起来像机器人 免费层级使用V4.5-All模型 升级到Pro以获得V5人声质量。
歌曲突然结束 没有[Outro]标签 在歌词中添加[Outro][End]
歌曲在自然结尾后仍继续播放 Suno在填满最大时长 在最终段落后添加[End]标签。
错误的流派占主导 第二个列出的流派被降低优先级 将主要流派放在Style字段的最前面。
Metatags显示成歌词 标签语法错误 检查拼写错误。标签必须使用方括号,格式为[Tag]
各段人声不一致 未设置Persona Voice 使用Persona Voices确保多次生成之间的一致性。
扩展内容与原曲不匹配 原曲与扩展之间隔了太多次生成 从最新版本进行Extend,而不是从原始版本。
纯器乐曲目出现人声伪影 Style描述词暗示了人声 明确切换Instrumental模式。添加[Instrumental]标签。

生成质量检查清单

在花费点数进行细化之前,请确认您的prompt涵盖:

  • [ ] 流派足够具体(不是只写“rock”,而是“indie rock”或“post-punk”)
  • [ ] 描述了人声风格(或已开启Instrumental)
  • [ ] Metatags定义了结构(至少包括:Verse、Chorus、Outro)
  • [ ] Style字段中有4–7个描述词(不要太少,也不要太多)
  • [ ] 情绪表达明确(如果没有指导,Suno默认偏向欢快/积极)

商业授权

截至2026年5月已验证。授权条款可能变化。请查看Suno当前的服务条款,以确认具有约束力的表述。5

各层级允许的用途

用途 Free Pro Premier
个人收听
社交媒体发布 仅限非变现
变现YouTube/TikTok
流媒体平台(Spotify、Apple Music)
商业产品(广告、游戏、电影)
向Suno支付版税的义务 N/A 无(100%归您) 无(100%归您)

重要注意事项

100% AI内容的版权保护在法律上仍未定论。Suno当前帮助中心将付费计划输出视为订阅者所有,适用于平台和商业使用目的:这些歌曲可根据您的计划条款使用、变现和分发。26但这并不保证其在当地法律下获得正式版权保护。美国版权局已表示,纯AI生成作品在缺乏足够人类作者贡献的情况下不能受版权保护。因此,Suno在其平台上授予的所有权,并不会自动转化为可依法执行的版权主张。其影响包括: - 您拥有商业使用权(Suno在付费计划中授予您所有权) - 但如果缺少人类作者元素,该作品可能不符合版权登记资格 - 您可能无法阻止他人使用相同或相似输出 - 加入人类创作元素(原创歌词、现场乐器录音、在DAW中的编曲选择)会增强您的版权主张 - 无追溯授权:在免费层级创建歌曲后再开始付费订阅,并不会追溯授予该歌曲的商业权利34 - 消费者计划不承诺赔偿:Suno当前的定价和权利页面并未宣传为Pro或Premier用户提供赔偿。如果某首Suno生成歌曲被指控侵犯现有受版权保护的音乐,不应默认认为消费者订阅包含法律抗辩或赔付。51326

收入归您所有。Pro和Premier用户保留Suno生成音乐收入的100%。Suno不主张版税或收入分成。5


版权与法律环境

AI音乐生成所处的法律环境仍在不断演变。

重要法律进展

  • Warner Music合作(2025年11月):Warner与Suno就诉讼达成和解,并宣布建立战略合作伙伴关系。Suno收购了Songkick,并将开发采用WMG授权内容的模型,计划于2026年发布;目前未经授权的模型将逐步下线。34 合作公告描述了未来的下载政策:免费用户将无法下载音频,付费用户也将面临下载次数上限,但可购买额外次数。截至2026年5月,Suno官方帮助中心仍未实施这些限制。Suno的文档依然说明免费用户可以下载MP3,而WAV仅向付费方案开放。在Suno公布正式推行方案之前,应将下载次数限制视为已宣布但尚未上线的政策。选择加入的艺术家和词曲作者将有机会从AI生成音乐中获得收入。艺术家仍可控制其姓名、形象、肖像和声音的使用方式。635
  • UMG和Sony诉讼:主要唱片公司针对Suno提起的诉讼仍在进行。UMG Recordings v. Suno案的终局动议现须于2027年4月9日前提交——Saylor法官于2026年6月30日批准了双方共同提出的修改日程动议,将截止日期从此前广泛报道的2027年1月8日延后。修改后的日程规定:文件提交持续至2026年7月30日,事实调查和证人询问持续至9月30日,专家披露截止至11月18日,专家证人询问截止至2027年3月5日。32 2026年3月,UMG执行副总裁兼首席数字官Michael Nash公开表示:“从收入角度来看,我们没有发现任何迹象表明AI造成的版税稀释是UMG面临的重大问题。”这与UMG在法庭文件中所称市场将被Suno生成作品“淹没”的主张直接矛盾。33 相关诉求主要围绕Suno涉嫌在训练数据中使用受版权保护的录音。6
  • 源代码泄露与数据泄露(2026年7月):一名黑客泄露了Suno在2023至2024年间的源代码,其中记录了大规模抓取训练数据的行为——来源包括YouTube Music(超过200万个片段,约113,879小时)、Pond5、IMSLP、Genius、Deezer、Jamendo、Freesound、MuseScore,以及通过RSS获取的播客。这为唱片公司诉讼核心所涉及的流媒体抓取指控提供了佐证。42 同一事件还泄露了5530万名用户的账户数据,包括电子邮件地址、姓名、电话号码、实际地址、购买记录和部分银行卡数据。Have I Been Pwned于2026年7月20日证实了此次泄露;事件本身可追溯至2025年11月,起因是一名员工的凭据遭到盗用。Suno表示不打算逐一通知受影响用户。43 如果拥有Suno账户,请将此次凭据泄露视为真实风险:立即更改密码,并警惕引用您Suno购买记录的网络钓鱼信息。
  • GEMA诉讼(德国):德国音乐著作权集体管理组织GEMA在慕尼黑对Suno提起诉讼。首次庭审于2026年3月9日举行;慕尼黑地区法院原定于2026年6月12日作出裁决,随后因法院内部原因(“aus dienstlichen Gründen”)将裁决推迟至2026年7月31日。如果GEMA胜诉,这将成为欧洲首个认定AI平台使用受版权保护的音乐进行训练必须获得授权的重要裁决。2938
  • Spark孵化计划(2026年6月25日):Suno推出了面向18岁及以上未签约艺术家的孵化计划Spark——提供数千至数万美元不等的资助、营销资金、歌曲创作营邀请和反馈,计划至少持续至2027年3月。参与者保留创作权和商业权利,并可自行选择发行商。请仔细阅读细则:有关参与协议的报道指出,其中包含永久性不得贬损条款(永远不得发表任何有关Suno的负面言论),以及自最后一篇赞助内容发布后60天内不得使用竞争性AI音乐工具的排他期——违反任一条款均构成重大违约。39
  • Udio与UMG和解(2025年):竞争平台Udio与UMG达成和解,为行业确立了一定先例。7
  • 美国版权局:该机构表示,完全由AI生成的作品不受版权保护,但包含AI元素且具备充分人类创作贡献的作品可能符合版权保护条件。8

实用建议

  1. 不要使用Suno复刻特定的受版权保护歌曲。 Covers功能用于翻唱由Suno生成的曲目,而非商业录音。
  2. 加入人类创作元素,以增强版权主张:创作原创歌词、在Suno的stems上录制真实乐器,或在DAW中作出编曲决策。
  3. 记录创作过程。 如果作品日后受到质疑,人类创作选择的证据将有助于巩固您的立场。Obsidian等工具可以用作带时间戳的创作日志。
  4. 持续关注最新法律进展。 这一领域日新月异。

竞争平台与替代方案

平台 优势 劣势 最适合
Suno 整体歌曲质量最佳,编辑工具丰富,配备Studio DAW 没有官方API、结果不确定、额度不会结转 完整歌曲制作
Udio stem质量最佳(原生48kHz),曲风还原准确 用户规模较小,编辑工具较少 基于stem的制作
Stable Audio 提供官方API,具备音效/声音设计能力,开放权重 人声质量较弱,输出时长较短 API集成、音效
Google MusicFX 免费、易于使用 控制能力有限,输出时长较短,不可商用 休闲探索
AIVA 专注古典音乐/影视配乐,可导出MIDI 曲风范围较窄 影视和游戏配乐

应该使用哪款AI音乐生成器?

  • 包含人声的完整歌曲:Suno(V5.5)
  • 用于DAW制作的stems:Udio(stem质量最高)
  • 由API驱动的生成:Stable Audio(本次对比中提供公开API选项)
  • 声音设计和音效:Stable Audio
  • 影视配乐:AIVA(可导出MIDI进行管弦乐编辑)
  • 使用AI生成专辑封面:请参阅Midjourney指南,了解适合搭配音乐制作工作流的提示词工程(prompt engineering)技巧

API与集成状态

已核实至2026年5月。

Suno目前的文档和定价页面均未发布官方公共开发者API。 本次核查未发现面向个人用户或开发者的官方REST API或SDK文档。逆向工程封装均应视为非官方方案,稳定性难以保证。1317

现有选项

访问类型 状态 详情
官方公共API 不可用 尚未公布时间表
企业/合作伙伴API 未公开提供文档 请直接联系Suno,不要想当然地认为消费者方案包含API访问权限。
社区封装 非官方 gcui-art/suno-api,一个通过逆向工程开发的封装。未经Suno认可,可能随时失效。9
Chirp API 历史项目 早期API访问计划,现已不再接受新用户。

面向开发者

如果需要以编程方式生成音乐: - Stable Audio:提供具有完整端点文档的官方API - Replicate:托管开放源代码的音乐生成模型,并提供API访问 - 自定义部署:可自行托管MusicGen(Meta)等开放源代码模型


快速参考卡

Custom Mode模板

STYLE FIELD:
[Genre] [Subgenre], [Tempo], [Key instruments], [Vocal style], [Production], [Mood]

LYRICS FIELD:
[Intro: descriptors]

[Verse 1]
Your lyrics here

[Pre-Chorus]
Building lyrics

[Chorus]
Hook lyrics

[Verse 2]
More lyrics

[Chorus]
Same hook (for melodic repetition)

[Bridge: contrasting descriptors]
Different energy lyrics

[Chorus]
Final hook

[Outro: fade out]

常用metatags(元标签)

标签 用途
[Verse] 叙事段落
[Chorus] 记忆点/副歌
[Bridge] 对比段落
[Intro] 开场
[Outro] 收尾
[End] 立即结束
[Instrumental] 无人声
[Guitar Solo] 突出乐器演奏
[Fade Out] 渐弱结束
[Tag: descriptors] 按段落控制

Creative Sliders速查表

滑块 左侧 中间 右侧
Weirdness 传统常规 平衡 实验性
Style Influence 宽松解读 默认 严格遵循
Audio Influence 最低程度参考 平衡 强力参考

定价快速参考

免费版 Pro($10/月) Premier($30/月)
额度 50/天 2,500/月 10,000/月
V5.5
商用
Studio

更新日志

日期 变更 来源
2026-07-25 诉讼案卷更正:决定性动议的截止日期是2027年4月9日,而非1月8日。 2026年6月30日,Saylor法官批准了UMG Recordings诉Suno案中关于修改排期令的联合动议(ECF No. 251);本指南先前采用的日期源自2026年3月的一篇二手报道,现已被该命令取代。“关键法律进展”要点和32现均直接引用诉讼案卷,并列出完整的修订后排期。另有记录:Suno对该泄露事件的公开定性(“一起有限的安全事件”“没有敏感个人信息遭到泄露”“主要涉及过时的源代码”)与HIBP核实的泄露字段清单形成反差,后者包括姓名、地址、电话号码、购买记录和部分银行卡数据;唱片公司申请将涉案作品从560部扩大到61,026部的动议仍待裁决。自7月22日以来,产品功能界面没有变化。持续关注事项:GEMA裁决将于7月31日公布;Duration滑块帮助文档仍未发布;尚无诉讼文件引用泄露的源代码。 32
2026-07-22 源代码泄露及涉及5,530万个账户的数据泄露事件已纳入法律形势分析。 7月15日的报道披露了泄露的2023—2024年源代码,其中记录了按来源抓取训练数据的情况(YouTube Music约113,879小时,以及Pond5、IMSLP、Genius、Deezer等),为唱片公司关于流媒体抓取的指控提供了佐证;同一事件还暴露了55,282,226个账户(HIBP于7月20日核实,泄露发生于2025年11月,起因为Shai-Hulud npm蠕虫利用一名员工泄露的凭据),且不计划逐一通知受影响用户。“关键法律进展”新增要点,并补充面向用户的密码安全建议。这些事件发生在本次更新窗口之前,但此前的扫描有所遗漏,因此基于相关性提升处理优先级。持续关注事项不变:GEMA裁决将于7月31日公布;帮助中心仍未发布Duration滑块的范围和适用套餐详情。 42 43
2026-07-21 网页版新增Duration滑块(7月20日)。 网页版Create表单新增V5.5控制项:生成前拖动Duration滑块即可选择歌曲时长。相关内容已记录于“快速入门”和“Suno与传统DAW对比”表格中。Suno帮助中心尚未公布最短/最长范围或适用套餐;本文仅记录发行说明中已经确认的事实。本次更新窗口内,模型、定价、元标签或API均无变化。 41
2026-07-17 网页版Lyrics Editor重新设计(7月9日)。 Suno重构了网页版歌词创作体验:Lyricist(可保存并固定您写作风格的配置文件)、自然语言编辑(例如直接就地执行“让这一句更有趣”)、针对选中单词或歌词行的押韵和替代表达建议、歌曲结构标签(Verse/Chorus/Outro——其界面功能与方括号元标签的流程控制相同),以及支持自动保存的无干扰全屏编辑器。相关内容已记录于“Lyrics字段”和“V5.5中的标签行为”。仅记入更新日志的内容:iMessage键盘扩展于7月15日上线(iOS);移动端于7月7日新增自定义足球助威歌模板。模型、定价、元标签词汇和API均无变化;V5.5仍是旗舰模型,Pro 10美元/Premier 30美元的价格不变。 40
2026-07-06 规范化的“Suno标签和元标签”章节。 将“元标签参考”章节改名为“Suno标签和元标签”,并将其设为规范标签入口:说明元标签与风格标签的术语区别,提供涵盖所有类别、附带可复制粘贴示例的标签速览表,一份完整标注标签的入门歌词稿,解答[no vocals]的实现方式(Instrumental开关+[Instrumental]+Exclude字段),并新增“V5.5中的标签行为”小节,汇总指南其他位置已有的具体说明。没有新增Suno相关事实,仅进行编辑整合。目录和内部锚点已更新。 编辑
2026-07-01 GEMA裁决延期+Spark孵化计划。 慕尼黑地区法院将GEMA诉Suno案的裁决日期从6月12日推迟至2026年7月31日(“aus dienstlichen Gründen”,即“因公务原因”)——该案仍有望成为欧洲首个关于AI平台是否必须取得训练音乐许可的重要裁决(请参阅“版权与法律形势”)。Spark(6月25日):面向未签约艺人的孵化计划,至少持续至2027年3月,提供资助、营销资金和歌曲创作营;艺人保留权利并可自行选择发行方式,但报道指出协议包含永久性非贬损条款,以及为期60天的竞品工具排他期(请参阅“关键法律进展”)。模型、元标签、定价和API均无变化;V5.5仍是旗舰模型。标题和描述已与常青型CTR审计格式保持一致。 38 39
2026-06-16 stem分离于6月11日全面改版为3种命名方法。 Suno以Split from Mix(从混音中提取任意单一乐器或人声,形成2个stems——是旧版人声/伴奏分离的扩展)、Auto Split(经典的最多12类别模型)和Advanced Split(仅限Premier:可从近100种乐器中选择,创建自定义stem组合)取代了原有的2-stem/12-stem拆分方式;输出更加干净,不含伪影。重写了“stem分离与导出”章节,并更新套餐对比表。没有新模型(V5.5仍是旗舰模型),定价、积分、元标签和API均无变化。 37
2026-06-08 维护检查(仅更新日志,正文无变化)。V5.5(2026年3月26日发布)仍是旗舰模型——没有V5.x小版本更新,没有V6,元标签、Studio、Creative Slider、Voices、定价和积分均无变化,API也未公开上线。已核实5月13日之后的事项,均不影响技术参考内容:Suno完成4亿美元D轮融资,估值达54亿美元(6月3日),并预告首个“与音乐行业合作开发”的授权模型将于“未来数月”开始逐步推出(仅已宣布,尚未发布);移动应用的Create新增人声性别选择、提示词记忆和歌词模型选择器(5月14日);“从iOS备忘录和语音备忘录分享”功能上线(6月4日);官方发布Voices最佳实践文章(6月5日)。 36
2026-05-13 时效性审查:将定价核实时间更新至2026年5月;将积分计算单位从“生成次数”更正为歌曲/每次Create生成两首歌曲的批次;进一步明确Voices的限制;更新GEMA裁决日期;将API/赔偿相关表述收紧至官方已有文档支持的范围;修复衍生FAQ结构化数据的内容偏移;并依据Suno的v5.5公告恢复Custom Models至少需要6首歌曲的要求。 多个来源
2026-04-20 将Studio 1.2的功能范围更正为官方新增内容(Remove FX、带Quantize的Warp Markers、Alternates、网格/节拍器的Time Signature支持);删除关于Studio 1.2包含Studio内Personas、Sounds素材库和浏览器内EQ功能的错误说法。根据当前文档,将V5采样率从48kHz弱化表述为录音室级。更正时长说法(4→8分钟)。将WMG时期的下载上限重新表述为已宣布但尚未上线。 多个来源
2026-04-04 将Persona Voices改名为Voices,以匹配V5.5界面,并从当前建议中移除源自社区的提示词遵循度表述。
2026-04-01 V5.5细节完善:新增Voices、Custom Models、My Taste、UMG诉讼背景和WMG授权说明。后续基于一手来源的审查移除了缺乏依据的功能最低要求、API、下载和法律抗辩细节。 31 32 33 34
2026-03-30 新增V5.5:带验证机制的Voice Cloning(Pro/Premier)、Custom Models(每位订阅用户最多3个)和My Taste自适应偏好(所有用户)。更新模型访问权限表和定价。 30
2026-03-24 新增MILO-1080步进音序器(2026年3月上线)。新增GEMA诉Suno案(德国,欧洲首起法律挑战)。 28 29
2026-03-12 在Studio DAW章节中补充收购WavTool(2025年6月)的背景信息 27
2026-03-07 新增Studio 1.2背景、付费套餐每日奖励积分、WMG合作详情(授权模型、Songkick),并更新版权归属表述 多个来源
2026-03-04 发布审查:修正引文归属(将1拆分至已核实来源)、新增V4.5的8分钟生成能力、提示词修改前后示例、完整歌曲演练、对元标签和Creative Sliders的“原因”说明、西方训练数据偏差的引文、stem分离的技术区别、6条新参考资料18-23、内部交叉链接及以统计数据开篇的内容 质量审查
2026-03-04 质量审查:新增“关键要点”“如何使用本指南”和“Prompt Enhancement Helper”章节;扩充Persona Voices内容;补齐所有引文;修正Udio/UMG引文;新增年度定价和积分加购详情 质量审查
2026-03-03 创建指南,涵盖V5、定价、元标签、Studio、制作工作流、授权许可及完整的提示词工程(prompt engineering)参考 多个来源
2026-02-01 Suno Studio 1.2:Warp Markers、Remove FX、Alt Takes、Time Signatures 4
2025-09-25 V5(chirp-crow)发布:录音室级音频、Studio DAW、12-stem分离、Persona Voices 1
2025-11-01 Warner Music达成和解 6
2025-05-01 V4.5发布:8分钟生成、Creative Sliders、Prompt Enhancement Helper 19
2024-11-19 V4发布:4分钟生成、Covers、2-stem分离 3

参考资料


  1. Suno V5 发布与评测。V5(chirp-crow)于2025年9月23日至25日发布。提供录音室级音频、更高的母带质量、Suno Studio DAW、12个stem分离和Persona Voices。第三方平台有时报告该模型采用48kHz或44.1kHz;Suno自己的营销资料仅从制作层面描述改进,并未注明具体采样率。因此,如果确切采样率对您的工作流程至关重要,请检查导出的WAV。 

  2. Suno Studio 简介。用于生成后编辑的浏览器内DAW。提供多轨视图、混音控制和stem隔离。 

  3. Suno 模型时间线。从V2到V5的官方模型版本历史。 

  4. Suno Studio 1.2 完整指南。2026年2月更新:Warp Markers、Remove FX、替代版本以及扩展的拍号支持。 

  5. Suno 权利与所有权。商业许可:Pro和Premier用户可保留100%的收入。免费层级仅限非商业用途。 

  6. WMG 与 Suno 达成合作。Warner于2025年11月达成和解。Suno收购了Songkick,并将开发获得WMG许可的模型。艺术家保留对姓名、形象、肖像和声音使用方式的控制权。 

  7. UMG 就 Udio 诉讼达成和解并宣布合作。UMG与Udio于2025年10月29日达成和解。双方计划在2026年推出获得许可的新型AI音乐创作平台,其中包括录制音乐和音乐出版许可。 

  8. 美国版权局关于AI生成作品的说明。纯AI生成的作品无法获得版权保护。包含充分人类创作的作品可能符合版权保护条件。 

  9. gcui-art/suno-api。非官方的Suno社区封装工具,未获Suno认可,可能随时失效且不另行通知。 

  10. Suno metatags(元标签)完整指南。社区汇编的500多个metatags,涵盖结构、人声、乐器和制作。 

  11. Suno Creative Sliders 指南。Weirdness、Style Influence和Audio Influence控制项的官方文档。 

  12. Suno Song Editor。Replace Section、Extend、Crop和Fade操作的官方文档。 

  13. Suno 定价方案。当前层级对比:公开定价页面列出了Free、Pro和Premier、V5.5访问权限、点数、并发歌曲数量、附加点数、充值点数规则以及音频上传限制。 

  14. Suno 提示词工程(prompt engineering)最佳实践。关于有效提示词结构和描述词用法的社区指南。 

  15. Suno AI Personas。Persona的创建、使用方式和限制。 

  16. Suno V5 音频规格。不同层级的音频质量对比:采样率、位深和导出格式。 

  17. Suno API 的实际情况。针对官方与非官方API访问方式的第三方分析。本文仅以此说明非官方封装工具的风险;我们已于2026年5月检查Suno自己的定价页面和帮助中心,当时未发现官方公开的开发者API页面。 

  18. Suno 付费订阅用户达到200万,ARR达到3亿美元。TechCrunch,2026年2月。每天生成700万首曲目;每两周生成的曲目数量便会超过Spotify拥有1亿首歌曲的曲库规模。 

  19. V4.5 简介。Suno官方公告。支持单次生成8分钟歌曲、Creative Sliders、Prompt Enhancement Helper、更准确的扩展曲风识别以及更出色的人声。 

  20. Suno V5(chirp-crow)规格。第三方Wiki页面。该页面称V5的内部模型名称为chirp-crow,支持320kbps导出、Persona和stem导出。同一页面还称采样率为48kHz;其他第三方平台报告V5采用44.1kHz,而Suno自己的营销资料并未注明具体采样率。在检查导出的WAV之前,应将该采样率数据视为未经验证。 

  21. 缺失的旋律:AI音乐生成及其对全球南方的忽视。AI音乐训练数据中有86%来自全球北方的音乐类型。吉他、钢琴和鼓占训练片段的52%至67%,地区性乐器则不足3%。 

  22. Suno Stem 提取。关于2个stem(人声+伴奏)和12轨stem提取的官方文档。 

  23. Suno 分离质量与 SpectraLayers 对比。该讨论认为,Suno的stem导出可能会重新生成各个独立音层,而不是在生成后执行音源分离。 

  24. Suno 定价与点数详情。每月点数用完后,付费订阅用户每天可获得50点奖励点数,直至下一个计费周期。 

  25. Suno Studio 1.2 公告。Studio 1.2官方新增功能:Remove FX、带Quantize的Warp Markers、替代版本和拍号支持(用于网格/节拍器,不用于模型条件控制)。Personas和Suno Sounds的文档独立于Studio 1.2。 

  26. Suno帮助中心的歌曲所有权版权指南。付费订阅用户拥有订阅期间创作的歌曲,可用于平台内用途和商业用途;正式版权保护取决于当地法律,无法保证,纯AI生成的作品尤其如此。 

  27. Suno 收购 WavTool。2025年6月。WavTool是一款基于浏览器的DAW,支持VST、采样级精确编辑和AI功能。其核心团队加入Suno,担任产品与工程领导职务。 

  28. Suno 最新动作是推出AI驱动的步进音序器MILO-1080。2026年3月。提供16轨步进音序器、文本生成声音、合成器引擎和MIDI支持,面向经验丰富的制作人。 

  29. GEMA新闻稿GEMA 起诉 Suno,以及巴伐利亚州司法部的GEMA 诉 Suno Inc. 案庭审。庭审于2026年3月9日举行;裁决原定于2026年6月12日宣布。 

  30. V5.5 简介。2026年3月26日。Voice Cloning提供验证流程(面向Pro/Premier);Custom Models可根据用户风格进行个性化定制(每位Pro/Premier订阅用户最多可创建3个);My Taste为所有用户提供自适应偏好系统。 

  31. Suno帮助中心的v5.5 新增功能Voices 常见问题Voices:在 Suno 中使用您的声音My Taste。关于Voices、Custom Models、My Taste、v5.5模型要求、年龄和地区限制、Remixes/Covers行为、Style Augmentation以及其他v5.5个性化行为的官方指南。 

  32. UMG Recordings, Inc.诉Suno, Inc.案,案号1:24-cv-11611(马萨诸塞州联邦地区法院),案件记录。ECF第251号文件:法院于2026年6月30日发布电子命令,批准双方共同提出的日程修改动议:“裁决性动议截止日期为2027年4月9日。”修改后的日程为:文件提交截止2026年7月30日,事实调查和证人作证截止2026年9月30日,承认请求截止2026年10月14日,专家披露截止2026年11月18日,反驳意见截止2026年12月16日,专家答复报告截止2027年1月15日,专家作证截止2027年3月5日。该日程取代了chatgptiseatingtheworld.com于2026年3月报道的原定2027年1月8日日期。已于2026年7月25日对照案件记录核实。 

  33. Universal Music Group 承认Suno案中的基础法律主张毫无根据。2026年3月。UMG执行副总裁Michael Nash表示,“没有迹象表明AI造成的版税稀释对UMG的收入构成重大问题。” 

  34. Suno 预告 Warner Music 合作协议下的2026年变化。当前模型将逐步停用,由获得WMG许可的模型取代。合作公告称下载限制的具体规则(免费层级失去下载权限、付费层级采用每月下载上限)将在之后公布;截至2026年5月,这些限制在Suno官方帮助中心仍未上线。订阅前创作的歌曲无法追溯获得许可。 

  35. Suno帮助中心的如何下载歌曲?为什么无法下载WAV文件?。免费用户可以下载MP3/音频或视频;Pro和Premier用户除MP3/M4A外,还可以下载WAV文件。 

  36. 2026年6月8日针对Suno主要来源进行的维护检查。D轮融资公告(2026年6月3日):以54亿美元投后估值融资4亿美元,同时预告首个“与音乐行业合作开发”的许可模型将在“未来数月”推出(截至2026年6月8日尚未发布)。发行说明:移动端Create新增人声音别选择、提示词记忆和歌词模型选择器(5月14日);“从iOS备忘录和语音备忘录共享”(6月4日)。Suno 博客:发布Voices最佳实践文章“重新构想您的声音”(6月5日)。旗舰生成模型仍为V5.5(v5.5 博客,2026年3月26日);帮助中心的模型时间线文章本身已经过时,仍只列到V5,因此v5.5博客和发行说明才是权威的版本来源。在此期间,metatags、Studio、Creative Slider、Voices/Persona、定价/点数和API均无变化。 

  37. Suno 发行说明,2026年6月11日“Stem Separation”更新。提供3种方式:Split from Mix(“从混音中提取任意乐器或人声,并获得2个stems:该乐器或人声,以及其余所有声音”);Auto Split(“我们的经典模型,将歌曲拆分为12类stem”);Advanced Split(“从近100种乐器列表中准确选择要提取的内容”——“仅面向Premier订阅用户”)。该页面将输出宣传为“更干净、更清晰、无伪影”。只有Advanced Split明确标注了层级(Premier);页面未注明Split from Mix或Auto Split所属层级,因此本指南沿用此前Auto Split(12个stem)仅面向Pro/Premier的限制。已于2026年6月16日通过主要来源核实。 

  38. GEMA诉Suno案延期:CMS AI与版权案件追踪器——德国,GEMA诉Suno及同期报道(aimusicpreneur):慕尼黑地区法院第42民事审判庭以法院内部原因为由,将裁决日期从2026年6月12日推迟至7月31日。口头审理已于2026年3月结束。已于2026年7月1日(PST)在当前会话中核实。 

  39. Suno Spark于2026年6月25日推出:VarietyDigital Music NewsThe Hollywood Reporter;参与协议中的细则(永久不得贬损条款、60天竞品工具排他期)来自Music Business Worldwide。该计划面向年满18岁且未签约的艺术家开放,至少持续至2027年3月;资助金额从数千美元到数万美元不等;艺术家保留权利并自主选择发行方式。已于2026年7月1日(PST)在当前会话中核实。 

  40. Suno 发行说明,2026年7月9日“网页版歌词改进”。重新设计的网页版歌词界面包括:Lyricist,可保存并锁定您写作风格的配置文件;自然语言编辑(输入“让这一行更有趣”等指令,编辑器会就地应用修改);针对高亮单词或歌词行的押韵与替代表达建议;歌曲结构标签(将各部分标记为Verse/Chorus/Outro,以告诉模型曲目应如何推进);以及支持自动保存的无干扰全屏编辑器。同一发行说明页面还列出了iMessage键盘扩展(2026年7月15日,iOS)和自定义足球助威歌曲模板(2026年7月7日,移动端)。已于2026年7月17日通过主要来源核实。 

  41. Suno 发行说明,2026年7月20日“Duration slider”:“拖动Create表单中新增的Duration滑块,即可选择歌曲时长。可在网页端使用V5.5模型时使用。”已于2026年7月21日通过主要来源核实;帮助中心的时长文章尚未更新范围或层级详情。 

  42. 黑客攻击揭示Suno AI音乐生成器抓取了YouTube、Deezer和Genius,404 Media,2026年7月15日。泄露的2023至2024年源代码列出了各来源的抓取量:YouTube Music 2,013,545个片段(113,879小时)、Pond5 62,117小时、IMSLP 19,514小时、Genius 17,615小时、Deezer 12,287小时,此外还包括Jamendo、Freesound、MuseScore和播客RSS内容摄取。 

  43. Have I Been Pwned:Suno数据泄露记录(已验证条目):涉及55,282,226个账户;泄露日期为2025年11月25日;于2026年7月20日添加;暴露的信息包括电子邮件地址、姓名、电话号码、实际地址、购买记录和部分银行卡数据。据CyberInsider(2026年7月21日)报道,攻击途径是通过一名员工被盗的凭据传播Shai-Hulud npm蠕虫;Suno表示,该事件已于2025年11月被发现并得到控制,无需向个人发送通知。 

NORMAL suno.md EOF