Adobe Firefly 評測:這三款全新的 AI 音訊工具到底好不好用?
我們測試了 Adobe Firefly 的三款全新 AI 音訊工具。了解它們的實際效果如何,以及是否值得在您的作品中嘗試使用。
你需要知道的最重要的事情
- 在這些工具中,“生成音樂”是“真正的贏家”,它最初生成的曲目尚可接受,但當使用精確的文字命令來定義情緒、風格、目的和能量水平時,曲目品質會顯著提高。
- 「產生音效」工具非常實用,需要精確的手動文字命令,並允許添加多個音軌,同時控制它們在時間軸上的位置和音量。
- Generate Speech 45 為演講者提供暫停控制選項,這對於行銷人員和內容創作者來說很有用,可以加快日常影片製作速度,但它並不能取代專業的配音演員。
- Adobe推出三款全新音訊工具 借助人工智慧 《螢火蟲》
- 創作者現在可以使用「生成音樂」、「生成語音」和「生成音效」功能。
- 我測試了一下,看看它在影片製作中的效果如何。
經過一段時間的測試,Adobe Firefly 現已發布三款全新的 AI 音訊工具,承諾為所有創作者提供「錄音室級音質」。我逐一測試了這些工具,看看它們是否名副其實——總體而言,它們確實不錯,只是存在一些小問題。

「生成音樂」、「生成音效」和「生成語音」是 Adobe 基於瀏覽器的 AI 平台最新推出的音訊功能(其功能從名稱上就能看出來)。
根據我使用這三款工具的經驗,Generate Music 最為出色;它遠超我的預期,我相信行銷人員和內容創作者都會從中受益匪淺。您可以點擊此處親自體驗。
那麼,有什麼新情況呢?
現在,所有人都可以使用三款人工智慧工具。它們的功能大多不言自明,但以下是您需要了解的內容:
- 生成音樂 它允許您創建與影片長度和氛圍相匹配的授權音樂曲目。
- 生成語音 文字被轉換成語音解說。
- 產生音效 它會產生——正如你所猜測的那樣——與影片的動作和時間相匹配的音效。
但它真的那麼好嗎?
我之前曾撰文表達我對人工智慧的普遍懷疑,以及我對它在創意作品中應用的擔憂。在我看來,它只不過是藝術的模仿。
然而,Adobe 的工具甚至打動了我團隊中最堅定的 AI 懷疑論者——尤其是其影片編輯軟體中的生成式擴充功能等功能。我自己也比較開放,所以我決定親自試用這些工具,看看它們究竟如何。
至少目前來看,重點是加快行銷人員和內容創作者的創意工作流程。
利用人工智慧創作音樂

我首先使用了「生成音樂」工具,你可以自由輸入文字指令或上傳影片片段,人工智慧會嘗試猜測你想要的音樂類型。我用的是一段27秒的短視頻,這段視頻是我之前為reMarkable Paper Pure評測錄製的(因為它還在我的下載資料夾裡)。
基於此,Firefly 建議使用腳本指令來「為產品展示創作一首平靜、深沉、氛圍感十足的電子歌曲」。
我按下「生成」按鈕,幾秒鐘之內——速度之快令人驚嘆——就出現了四首曲目可供選擇,風格各異,但感覺卻很相似。它們……還算可以。有點千篇一律,但應急的時候或許能湊合用,或是用來快速完成某個專案。 (想了解更多人工智慧對音樂產業的影響,請閱讀我們關於蘋果音樂要求藝術家為人工智慧生成的音樂添加標籤的文章。)
我決定在腳本命令中添加一些其他術語,例如“爵士樂”和“電影感”,以便在“vlog”和“預告片”中使用。我還將“能量”設定從“低”改為“中”。效果好多了。
與其他人工智慧工具一樣,文字指令越精確,輸出結果就越好。如果您有具體的想法,也可以選擇自行描述氛圍、風格和用途。
你可以從這裡下載音樂和視頻,或只下載音樂。
創建人工智慧生成的配音

接下來是「產生語音」工具,我首先使用側邊欄選擇要使用的 AI 模型;在撰寫本文時,有 Adobe 的商業安全型 Firefly 模型和合作夥伴 ElevenLabs Multilingual V2 模型。
然後我從 45 個選項中選擇一個演講者,每個選項都被描述為男性、女性、非二元性別者、年輕人、中年人、老年人等等。
最後,我把文字貼到文字框裡;Firefly 可以偵測我使用的語言,但你也可以自己選擇。我用的是詩作《奧西曼德斯》(在此向雪萊致上誠摯的歉意)。
我喜歡的一點是,一旦你輸入了文本,你可以選擇添加額外的文本,或者指示人工智慧在特定位置停止。
要預覽音頻,我必須選擇整個片段並使用上下文選單;你也可以在這裡糾正發音和調整語氣。
現在都在談論如何加快工作流程,但我覺得這反而是個錯誤。它只需要在螢幕底部加個開始按鈕就行了。
我必須調整暫停間隔,讓文字有喘息的空間。設定好之後,我就可以透過點擊預覽畫面上的暫停按鈕來更改時間。不知為何,「land」這個字讓AI感到困惑,它把它讀成了「lan」。
建立人工智慧驅動的音效 (SFX)

在這次測試中,我再次使用了之前為 reMarkable 評測拍攝的影片——這次是一個 12 秒的片段,對比了 reMarkable 2 和 Paper Pure。
這個過程要複雜得多,也就是說,人工智慧不會猜測可能的聲音效果(SFX)是什麼。我必須手動描述我想要的效果。然後,我點擊了“增強提示”,並添加了更多描述。
於是,我們最終得到了一個「平滑下落並帶有淡淡金屬聲的滑音哨聲」。點擊「生成」後,很快就出現了四種不同的、震耳欲聾的變奏曲。我就不給你們看這些結果了,這對誰都不公平。
為了湊夠影片時長,這段聲音被改為持續 12 秒的較輕柔的「田野裡的蟋蟀聲」。
音效 (SFX) 選項的最大優點是您可以新增多個音軌,並使用控制柄來調整它們的位置。
螢幕底部的時間軸讓它感覺更像一個真正的音訊編輯器(至少在某種程度上是這樣)。拖曳音量控製手柄即可調整音量或刪除音軌。
值得這麼做嗎?
總的來說,我希望看到一些使用者介面方面的調整,以加快生產工作流程。
我不認為它會在短期內取代專業的音效設計師、作曲家和音樂家。但就我從事行銷的工作經驗而言,我認為它在行銷人員和日常影片創作中佔有一席之地。
自從微軟 Sam 式的機器人語音時代以來,語音技術已經發展了很多,但要達到準確的語音表現,沒有什麼能比得上專業錄音室裡的表演者。
然而,音效(SFX)的優勢要大得多。跨越多個世代,我根本無法區分人工智慧產生的聲音和我擁有的老式音效光碟上播放的聲音。
真正的亮點在於“生成音樂”功能。即使是最基本的生成效果,也能營造出適合產品展示、評測、商業解說或其他類似場合的自然音效。而且,每次生成後效果都會提升。
因此,對於快節奏的影片製作來說,這是一個值得探索的更新。
評論被關閉。