官方玩家手冊

Soundwaver 使用攻略

從新手村到配音大師的完整闖關手冊——六大關卡,逐步解鎖聲音的超能力。不只教你會用,更教你用得漂亮!

預計通關時間: 約 10 分鐘
1

關卡 1 · 快速上手

快速上手

3 步生成你的第一段語音

第一次來到 Soundwaver?照著這三步走,一分鐘內就能聽到 AI 幫你開口說話。

1

進入工作室

點擊右上角「工作室」,你會看到三大功能分頁。新手先留在「文字轉語音」就好,其他關卡稍後再解鎖。

不用安裝任何軟體,打開瀏覽器就能開工。

2

輸入文字、挑個聲音

在輸入框打下任何句子,再從聲音列表選一個喜歡的嗓音。中文推薦晴晴(活潑)、柔柔(溫柔),英文試試 Aria。

滑桿可調語速(10-200%)與音高,先用預設值,聽熟了再微調。

3

點擊生成、試聽下載

按下生成按鈕,幾秒內就能試聽。滿意的話直接下載 WAV 或 MP3,馬上能用在你的影片、簡報或 Podcast 裡。

生成紀錄會自動存進歷史頁,手滑關掉也不怕。

2

關卡 2 · 文字轉語音

文字轉語音

掌握標籤、風格與唱歌模式

文字轉語音不只是「唸稿機」。看懂操作面板、學會標籤咒語,它能替你演出整齣戲。

先認識操作面板

聲音選擇

內建聲音各有語言與個性——中文有晴晴、柔柔、磊磊、沉風;英文有 Aria、Luna、Rex、Cole。

語速滑桿

10% 到 200% 自由調整。旁白建議 90-110%,快節奏廣告可以拉到 130%。

音高滑桿

想要低沉磁性就往下調,可愛童聲往上調,搭配語速一起微調效果最自然。

唱歌模式

切換後 AI 會帶著旋律感演出,適合 jingle、生日祝福或趣味短片內容。

標籤系統:配音的魔法咒語

在文字裡插入標籤,就能直接指揮 AI 的情緒與呼吸。只要記住兩種寫法:

(風格/語言標籤)→ 放在句首

用小括號包住、寫在句子最前面,可以疊加多個,決定整句的演技基調。

(開心)(耳語)(悲傷)(憤怒)(英文)

(興奮)我們贏了!這場比賽實在太精彩了!

[音訊標籤] → 接在句尾

用方括號包住、附在句尾,控制停頓、氣口與擬真音效。

[停頓][嘆氣][笑][呼吸]

這個消息真是令人難以置信[嘆氣]讓我緩一緩。

互動試煉場

點一個標籤加進台詞裡,感受 AI 演技的變化!

歡迎來到 Soundwaver,這裡是聲音的遊樂場。 ← 點擊標籤試試

( ) 風格/語言標籤

[ ] [音訊標籤]

點擊標籤會立刻合成並播放,先聽為快!

老手秘訣:合成小秘诀:送進 WaveMind 的文字與標籤本身用簡體中文寫(如 (开心)、[叹气])——WaveMind 對繁體字的發音與標籤辨識較不穩定。頁面顯示照常用繁體即可。

老手秘訣:同一句話套不同標籤各生成一次、對比著聽,你會最快建立「標籤手感」。

3

關卡 3 · 聲音克隆

聲音克隆

用一段音檔複製任何聲音

想讓 AI 說話像你(或你已授權的人)?聲音克隆只需要兩樣東西:一段乾淨音檔+對應的文字稿。

1

準備乾淨的音檔

建議 5-30 秒的清晰錄音:環境安靜、距離麥克風穩定、語速自然。支援 MP3、WAV、FLAC 等常見格式。

2

上傳音檔+文字稿

把音檔裡說的內容打成文字一起提交。文字與語音內容越對齊,克隆的音色與韻律就越準。

3

生成並命名你的聲音

送出後稍待片刻,新聲音會出現在聲音列表裡。取個好認的名字,之後在文字轉語音就能隨時呼叫。

推薦做法

  • 錄音環境安靜,沒有回音與雜音
  • 音檔內容清晰、語速自然
  • 事先取得聲音主人的明確授權
  • 文字稿與音檔說的內容一致

避坑指南

  • 背景混著音樂、風扇或鍵盤聲
  • 素材太短(低於 5 秒)或剪得太碎
  • 未經同意克隆他人聲音
  • 使用變聲器處理過的音檔

老手秘訣:克隆品質八成取決於素材。寧可花五分鐘重錄一段乾淨音檔,也不要拿吵雜的會議錄音硬上。

4

關卡 4 · 聲音設計

聲音設計

用文字從零打造獨特嗓音

手邊沒有音檔?沒關係——聲音設計讓你用文字「捏」出一個前所未有的聲音。CharacterWizard 會帶你走完五步。

1

角色設定

先想清楚這個聲音是誰:年齡、性別、個性、用途。描述越具體,AI 越容易抓住感覺。

2

聲音來源

選擇從零設計全新聲音,或以既有聲音特徵為基底進行混搭。

3

人物設定

用文字刻畫音色,例如「30 歲男性、低沉沙啞、像深夜電台主持人」。不會寫?套用內建描述模板再改,或讓 AI 潤色自動擴寫。

4

生成試聽

AI 依描述生成候選聲音。不滿意就調整描述再生成,多試幾輪直到命中為止。

5

保存角色

滿意後命名保存,之後在文字轉語音的聲音列表就能直接選用。

好描述「60 歲老爺爺,聲音沙啞帶著笑意,語速偏慢,像在爐火邊說故事的爺爺。」

壞描述「一個老的聲音。」——太模糊,AI 只能瞎猜。

三個常見地雷
  • • 只寫性別不寫年齡音色(如「一個女的」),AI 只能隨機猜
  • • 堆砌衝突形容詞(又低沉又清亮又活潑),反而互相抵銷
  • • 把舞台指示寫進描述(如「請用激動語氣」),描述應該形容聲音本身

老手秘訣:用「職業、場景、比喻」來形容音色,比羅列參數更有用——「像深夜電台主持人」勝過「低頻、慢語速」。

5

關卡 5 · 角色與歷史

角色與歷史

管好你的聲音資產庫

用得越久,聲音與音檔累積越多。這一關教你把聲音資產管理得井井有條。

自訂聲音庫

克隆與設計的聲音都收藏在聲音列表,與內建聲音並列。點擊即可試聽,也能直接用於合成。

歷史紀錄

每次生成自動存檔,可回放、下載或刪除。需要找特定音檔時,用內容關鍵字搜尋最快。

用量監控

儀表板的「用量」分頁即時顯示 Credits 餘額,快用完時記得升級方案。

老手秘訣:養成「生成完立刻下載」的習慣。歷史紀錄方便回顧,但原始音檔握在自己手裡最安心。

6

關卡 6 · 進階攻略

進階攻略

導演級配音的隱藏技巧

基礎關卡都通關了?以下是讓配音從「能用」變「專業」的隱藏技巧,來自重度玩家的實戰整理。

1

標籤疊加演出法

風格標籤可以疊加——「(開心)(耳語)」會產生開心卻壓低音量的神秘感。多試組合,你會挖出全新的聲音表情。

2

導演劇本寫法

像導演下指令一樣在開頭寫:「(興奮)用體育主播的語氣播報」,再接台詞。AI 會理解角色設定並全程入戲。

3

長文分段配音

長篇稿件別一次生成。依段落拆分、逐段調整語速與情緒,最後再拼接,節奏掌控精準得多。

4

標點符號就是演技

刪節號「……」製造遲疑、驚嘆號拉高音量、問號帶出上揚語調。只改標點不改字,情緒立刻不同。

5

唱段與效果音混搭

開頭用唱歌模式唱一句 jingle、正文切回朗讀、結尾加 [笑]——三分鐘做出有記憶點的節目片頭。

6

克隆聲音 × 標籤 = 專屬聲優

克隆出來的聲音同樣吃標籤!加上 (悲傷) 或調高語速,一個聲音瞬間多種戲路。

導演模式完整示例

(激動)用體育主播的語氣播報——各位觀眾,最後十秒,球進了!
(低沉)切換到深夜紀錄片旁白……這座城市,從來沒有真正睡著。
(溫柔)像給孩子說睡前故事一樣,放慢語速:於是,小狐狸悄悄闖進了森林。

通關檢查清單0/3

老手秘訣:把好聽的參數組合(聲音+語速+音高+標籤)記在筆記裡,下次直接套用,品質穩定又省時。

前往工作室實戰