你写下的一段话,会变成一首完整的歌。定好曲风和情绪,粘贴自己的歌词或者让 AI 代写,旋律、编曲、人声、混音一次做完,生成的音频可以直接下载商用。下面这些是让结果更接近你想要的声音的实操写法。
能做什么
平时需要录音棚才能解决的部分——歌曲结构、配器、演唱、混音——这里一次做完。
Why YES Music
结果平庸还是能用,差别几乎全在提示词怎么写。要点就下面六条。
「流行」太宽了。写成「九十年代末的 R&B 味流行,真鼓」,模型就有了具体的声音参照,输出范围一下子收窄。
比起谁来唱,更该说怎么唱。「气声偏多的女声,贴麦,稍微拖在节拍后面」比「女声」得到的演唱具体得多。
安静开场、第二段加厚、副歌之后落下来、最后一遍减配——不写结构,系统会挑一个默认编排,未必对得上你的视频节奏。
写「90 BPM,松弛但往前推」这种 BPM 区间加劲头的描述,比只写曲风更能控制节奏感。当歌要垫在画面下面时尤其明显。
写「独立公路片片尾字幕」这类歌曲响起的画面,情绪会稳定得多。指名某位真实歌手,反而更容易得到平庸的结果。
出来的版本接近但不对时,只改一个变量再抽。整句重写会把原本已经对的地方一起弄丢,等于回到起点。
风格
这几种是用得最多的,每种附上真正管用的写法。
歌词带着歌走的类型。人声性别、音域、咬字方式分开写,再补一个年代,质感就定下来了。
先定节奏:BPM、鼓的质感、低音的分量。Flow 和咬字要和伴奏分开写,否则两边会糊在一起。
写走向,别写乐器。哪里堆、哪里抽空、哪里到顶。再补一个场景,配器基本会自己跟上。
要垫在别的东西底下时,写明动态范围小、不要突然转折、不要人声。做视频和直播垫乐时,这套设定最好用。
FAQ
关于生成、歌词和授权的实际问题。
就是把一段文字描述变成一首完整的音乐——旋律、和声、编曲,通常还包括人声。你不用演奏也不用编程,用中文把想要的歌说清楚,系统生成一首原创音频。
可以。贴进来之后,人声会照着你的字句和断句唱。也可以只给一个主题,让 AI 出草稿,你改完再生成。
最长八分钟,够撑起完整的歌曲结构,而不只是一个循环片段。如果这首歌要垫在视频或播客下面,短一点通常更好用。
这个页面上的示例不登录就能听。生成自己的歌需要一个免费账号,这样你做的曲子和下载记录才能存进你的音乐库。
能。生成的歌是免版税的,在平台条款范围内可以用于视频、播客、广告、游戏、直播和客户项目,没有按次授权费,也不需要标注来源。
生成不是确定性的,每次都是对你那句话的一次全新诠释。这在实际使用里反而是好事:喜欢的提示词多抽几次挑最合适的,比从头重写提示词更快。