技術

Suno新功能可朗讀你的詩,並一次生成配樂

Susan Hill
在 Google 中新增我們

Suno 這款以將一句提示詞變成歌曲打響名號的 App,如今能用更特別的方式處理你的文字:一邊朗讀,一邊在同一次生成中譜寫配樂。輸入一首詩、一段祝酒詞或一則睡前故事,再描述想要的聲線和氛圍,Speech 就會生成一條音軌,讓旁白與配樂共同創作,而不是事後才疊在一起。製作個人音訊作品時,真正棘手的往往不是找到聲音,而是讓人聲和音樂聽起來像是來自同一個空間。

對於需要製作婚禮祝酒詞、短影音、引導式冥想或 Podcast 開場的人來說,這項功能省去了一道通常得靠兩款 App 和剪輯時間軸才能完成的工序。過去要做這件事,得先在一個地方錄製旁白,再到另一個地方找免版稅配樂,接著反覆調整音量,直到音樂不再蓋過人聲。Suno 的主打特色是由單一模型處理這兩部分,讓配樂依照講話內容創作,而不是後來才貼在旁白底下。

Speech 提供兩種模式。簡易模式只要描述一個構想,例如海盜船長號召船員出航,Suno 就會代寫內容並朗讀。進階模式則可輸入自己的稿件,並設定聲音性別、說話風格,以及每次生成時語氣變化的幅度。音軌最長約八分鐘,足以容納完整的睡前故事或一段短冥想;配樂預設為開啟,也可以切換關閉,讓只需要旁白的人使用。

Suno 產品長傑克·布羅迪(Jack Brody)形容,這是首個能將人聲與音樂一併生成、組成完整音軌的音訊模型。單獨生成合成旁白並非新鮮事。ElevenLabs、Adobe 和 Google DeepMind 都提供聽起來像真人的文字轉語音服務,但配樂仍得由使用者自行製作,再手動混音。Suno 則從相反方向切入:它原本是音樂公司,如今加入人聲;而不是語音公司再加入音樂。

這項功能確實還有不少不成熟之處,Suno 也坦承了其中一些問題。公司提醒,英國口音可能會一路飄到澳洲再飄回來,戲劇性的停頓也可能真的非常戲劇化。目前沒有精確控制音訊長度或逐字掌握時間點的選項;Suno 也尚未說明,使用者已可為歌曲錄製的自訂聲音能否用於 Speech。公司同樣沒有公布這項功能支援哪些語言;對英語市場以外的聽眾來說,這是個重要的資訊缺口。此外,旁白音軌會消耗多少點數也尚未公開。使用免費方案時,Suno 的標準條款仍將使用者生成內容的所有權保留在 Suno 手中,並禁止商業用途,因此打算製作付費 Podcast 或廣告的人,最好先仔細閱讀條款。

Speech 在經過約一個月的小規模測試後,於 10 月 1 日向所有 Suno 網頁版及 iOS、Android App 使用者開放。這項功能目前仍標示為 Beta,使用的點數方案與歌曲生成相同,而 Suno 尚未公布正式版的推出日期。

這項功能推出之際,Suno 也正處於法律糾紛之中。Warner Music Group 已於 2025 年 11 月與 Suno 達成和解並授權音樂;但 Universal Music Group 和 Sony Music 在 9 月針對 v6 音樂模型提起新訴訟,指控該公司複製超過 60,000 段錄音,並要求最高達 90 億美元的法定損害賠償。案件目前仍在波士頓聯邦法院審理,也就是說,你睡前故事底下的配樂,來自一家仍在法庭上為其音樂生成方式辯護的公司。

標籤: , , , , ,

在 Google 中新增我們

討論

共有 0 則留言。