你寫下的一段話,會變成一首完整的歌。定好曲風和情緒,貼上自己的歌詞或者讓 AI 代寫,旋律、編曲、人聲、混音一次做完,生成的音檔可以直接下載商用。以下這些是讓結果更接近你想要的聲音的實作寫法。
能做什麼
平常需要錄音室才能解決的部分——歌曲結構、配器、演唱、混音——這裡一次做完。
Why YES Music
結果平庸還是能用,差別幾乎全在提示詞怎麼寫。要點就下面六條。
「流行」太寬了。寫成「九〇年代末的 R&B 味流行,真鼓」,模型就有了具體的聲音參照,輸出範圍一下子收窄。
比起誰來唱,更該說怎麼唱。「氣聲偏多的女聲,貼麥,稍微拖在節拍後面」比「女聲」得到的演唱具體得多。
安靜開場、第二段加厚、副歌之後落下來、最後一遍減配——不寫結構,系統會挑一個預設編排,未必對得上你的影片節奏。
寫「90 BPM,鬆弛但往前推」這種 BPM 區間加勁道的描述,比只寫曲風更能控制節奏感。當歌要墊在畫面下面時尤其明顯。
寫「獨立公路片片尾字幕」這類歌曲響起的畫面,情緒會穩定得多。指名某位真實歌手,反而更容易得到平庸的結果。
出來的版本接近但不對時,只改一個變數再抽。整句重寫會把原本已經對的地方一起弄丟,等於回到起點。
風格
這幾種是用得最多的,每種附上真正管用的寫法。
歌詞帶著歌走的類型。人聲性別、音域、咬字方式分開寫,再補一個年代,質感就定下來了。
先定節奏:BPM、鼓的質感、低音的分量。Flow 和咬字要和伴奏分開寫,否則兩邊會糊在一起。
寫走向,別寫樂器。哪裡堆、哪裡抽空、哪裡到頂。再補一個場景,配器基本會自己跟上。
要墊在別的東西底下時,寫明動態範圍小、不要突然轉折、不要人聲。做影片和直播墊樂時,這套設定最好用。
FAQ
關於生成、歌詞和授權的實際問題。
就是把一段文字描述變成一首完整的音樂——旋律、和聲、編曲,通常還包括人聲。你不用演奏也不用編程,用中文把想要的歌說清楚,系統生成一首原創音檔。
可以。貼進來之後,人聲會照著你的字句和斷句唱。也可以只給一個主題,讓 AI 出草稿,你改完再生成。
最長八分鐘,夠撐起完整的歌曲結構,而不只是一個循環片段。如果這首歌要墊在影片或 Podcast 下面,短一點通常更好用。
這個頁面上的範例不登入就能聽。生成自己的歌需要一個免費帳號,這樣你做的曲子和下載紀錄才能存進你的音樂庫。
能。生成的歌是免版稅的,在平台條款範圍內可以用於影片、Podcast、廣告、遊戲、直播和客戶專案,沒有按次授權費,也不需要標註來源。
生成不是確定性的,每次都是對你那句話的一次全新詮釋。這在實際使用裡反而是好事:喜歡的提示詞多抽幾次挑最合適的,比從頭重寫提示詞更快。