從新手村到配音大師的完整闖關手冊——六大關卡,逐步解鎖聲音的超能力。不只教你會用,更教你用得漂亮!
關卡 1 · 快速上手
3 步生成你的第一段語音
第一次來到 Soundwaver?照著這三步走,一分鐘內就能聽到 AI 幫你開口說話。
點擊右上角「工作室」,你會看到三大功能分頁。新手先留在「文字轉語音」就好,其他關卡稍後再解鎖。
不用安裝任何軟體,打開瀏覽器就能開工。
在輸入框打下任何句子,再從聲音列表選一個喜歡的嗓音。中文推薦晴晴(活潑)、柔柔(溫柔),英文試試 Aria。
滑桿可調語速(10-200%)與音高,先用預設值,聽熟了再微調。
按下生成按鈕,幾秒內就能試聽。滿意的話直接下載 WAV 或 MP3,馬上能用在你的影片、簡報或 Podcast 裡。
生成紀錄會自動存進歷史頁,手滑關掉也不怕。
關卡 2 · 文字轉語音
掌握標籤、風格與唱歌模式
文字轉語音不只是「唸稿機」。看懂操作面板、學會標籤咒語,它能替你演出整齣戲。
內建聲音各有語言與個性——中文有晴晴、柔柔、磊磊、沉風;英文有 Aria、Luna、Rex、Cole。
10% 到 200% 自由調整。旁白建議 90-110%,快節奏廣告可以拉到 130%。
想要低沉磁性就往下調,可愛童聲往上調,搭配語速一起微調效果最自然。
切換後 AI 會帶著旋律感演出,適合 jingle、生日祝福或趣味短片內容。
在文字裡插入標籤,就能直接指揮 AI 的情緒與呼吸。只要記住兩種寫法:
用小括號包住、寫在句子最前面,可以疊加多個,決定整句的演技基調。
(興奮)我們贏了!這場比賽實在太精彩了!
用方括號包住、附在句尾,控制停頓、氣口與擬真音效。
這個消息真是令人難以置信[嘆氣]讓我緩一緩。
點一個標籤加進台詞裡,感受 AI 演技的變化!
歡迎來到 Soundwaver,這裡是聲音的遊樂場。 ← 點擊標籤試試
( ) 風格/語言標籤
[ ] [音訊標籤]
點擊標籤會立刻合成並播放,先聽為快!
老手秘訣:合成小秘诀:送進 WaveMind 的文字與標籤本身用簡體中文寫(如 (开心)、[叹气])——WaveMind 對繁體字的發音與標籤辨識較不穩定。頁面顯示照常用繁體即可。
老手秘訣:同一句話套不同標籤各生成一次、對比著聽,你會最快建立「標籤手感」。
關卡 3 · 聲音克隆
用一段音檔複製任何聲音
想讓 AI 說話像你(或你已授權的人)?聲音克隆只需要兩樣東西:一段乾淨音檔+對應的文字稿。
建議 5-30 秒的清晰錄音:環境安靜、距離麥克風穩定、語速自然。支援 MP3、WAV、FLAC 等常見格式。
把音檔裡說的內容打成文字一起提交。文字與語音內容越對齊,克隆的音色與韻律就越準。
送出後稍待片刻,新聲音會出現在聲音列表裡。取個好認的名字,之後在文字轉語音就能隨時呼叫。
老手秘訣:克隆品質八成取決於素材。寧可花五分鐘重錄一段乾淨音檔,也不要拿吵雜的會議錄音硬上。
關卡 4 · 聲音設計
用文字從零打造獨特嗓音
手邊沒有音檔?沒關係——聲音設計讓你用文字「捏」出一個前所未有的聲音。CharacterWizard 會帶你走完五步。
先想清楚這個聲音是誰:年齡、性別、個性、用途。描述越具體,AI 越容易抓住感覺。
選擇從零設計全新聲音,或以既有聲音特徵為基底進行混搭。
用文字刻畫音色,例如「30 歲男性、低沉沙啞、像深夜電台主持人」。不會寫?套用內建描述模板再改,或讓 AI 潤色自動擴寫。
AI 依描述生成候選聲音。不滿意就調整描述再生成,多試幾輪直到命中為止。
滿意後命名保存,之後在文字轉語音的聲音列表就能直接選用。
好描述「60 歲老爺爺,聲音沙啞帶著笑意,語速偏慢,像在爐火邊說故事的爺爺。」
壞描述「一個老的聲音。」——太模糊,AI 只能瞎猜。
老手秘訣:用「職業、場景、比喻」來形容音色,比羅列參數更有用——「像深夜電台主持人」勝過「低頻、慢語速」。
關卡 5 · 角色與歷史
管好你的聲音資產庫
用得越久,聲音與音檔累積越多。這一關教你把聲音資產管理得井井有條。
克隆與設計的聲音都收藏在聲音列表,與內建聲音並列。點擊即可試聽,也能直接用於合成。
每次生成自動存檔,可回放、下載或刪除。需要找特定音檔時,用內容關鍵字搜尋最快。
儀表板的「用量」分頁即時顯示 Credits 餘額,快用完時記得升級方案。
老手秘訣:養成「生成完立刻下載」的習慣。歷史紀錄方便回顧,但原始音檔握在自己手裡最安心。
關卡 6 · 進階攻略
導演級配音的隱藏技巧
基礎關卡都通關了?以下是讓配音從「能用」變「專業」的隱藏技巧,來自重度玩家的實戰整理。
風格標籤可以疊加——「(開心)(耳語)」會產生開心卻壓低音量的神秘感。多試組合,你會挖出全新的聲音表情。
像導演下指令一樣在開頭寫:「(興奮)用體育主播的語氣播報」,再接台詞。AI 會理解角色設定並全程入戲。
長篇稿件別一次生成。依段落拆分、逐段調整語速與情緒,最後再拼接,節奏掌控精準得多。
刪節號「……」製造遲疑、驚嘆號拉高音量、問號帶出上揚語調。只改標點不改字,情緒立刻不同。
開頭用唱歌模式唱一句 jingle、正文切回朗讀、結尾加 [笑]——三分鐘做出有記憶點的節目片頭。
克隆出來的聲音同樣吃標籤!加上 (悲傷) 或調高語速,一個聲音瞬間多種戲路。
(激動)用體育主播的語氣播報——各位觀眾,最後十秒,球進了! (低沉)切換到深夜紀錄片旁白……這座城市,從來沒有真正睡著。 (溫柔)像給孩子說睡前故事一樣,放慢語速:於是,小狐狸悄悄闖進了森林。
老手秘訣:把好聽的參數組合(聲音+語速+音高+標籤)記在筆記裡,下次直接套用,品質穩定又省時。