去年三月,做財經自媒體的朋友傳訊息給我:他六週內上了十四支片,全部用同一個模板加 AI 旁白,播放量卡在四十到一百二十 view 之間。他的第一句話是:「YouTube 是不是偵測到 AI 語音,把我限流了?」
同一個月,我自己一支用 TTS 從頭配到尾的解說片破了十一萬觀看,盈利也照常入帳。工具一模一樣,命運兩條路。
這四個月我翻完 YouTube 幫助中心的政策原文、看了 Creator Insider 的答覆,還拿三個小帳號做對照實驗。結論我現在對人講了無數次:平台真正懲罰的不是 AI 語音,是沒有理由讓人看完的內容。 AI 只是讓你更快把這種內容堆出去而已。這篇把演算法、盈利、原創性規則一次講清楚,最後附上我每天上片前在用的檢查清單。
YouTube 官方原文到底寫了什麼
先拆最常被誤傳的一段。2025 年初那次政策更新,官方歸類在 inauthentic content 底下的 repetitious content,條文點名的是三種片子:
- 批量製作的內容:同一個模板每天複製十幾支,換皮不換骨。
- 誤導內容:標題縮圖跟正片不符,或者搬運別人素材重新上傳。
- 重複且無原創貢獻:同一段畫面加一層罐頭音樂,改個標題再發一次。
重點是:整份條文裡沒有 AI、TTS、合成語音這幾個字。判定標準始終只有一個——這支影片對看的人有沒有實質價值。
官方文件裡我覺得最狠的一句,是要求審查者去問:「把創作者的名字拿掉,這支影片還有存在的理由嗎?」拿得掉,你就危險了;拿不掉,聲音是人錄的還是機器唸的,根本不在這條因果鏈上。
另外常被問到:用合成聲音要不要申報?YouTube 現行做法是上片設定裡有一項「包含合成內容」的勾選,勾與不勾,我三個帳號的推薦量看不出差別。真正的分水嶺在內容分級——兒童向、爭議、成人向,聲音來源從來不在這張名單上。

會被限流的三種樣子
| 頻道樣態 | 我實際看過的狀況 | AI 聲音是主因嗎 |
|---|---|---|
| 曝光穩定成長 | 每支都有新資訊,剪輯原創,更新有節奏 | 不是,這類頻道用 TTS 照樣過盈利 |
| 曝光腰斬、卡死在幾百 view | 模板套五十支,題材重複,內容可被替代 | 不是,但 AI 讓產量暴增,加速暴露問題 |
| 拿不到盈利資格 | 搬運、誇大標題、爭議內容騙點擊 | 不是,這種真人配音一樣過不了 |
第三列我親身踩過。前年幫客戶做產品比較片,標題下得太誇,三支直接進「不適合盈利」,申訴兩次都沒過。聲音全程真人錄的——因為問題從頭到尾就不在聲音。
四個月的對照實測
我開三個冷啟動帳號,題材固定「手機攝影技巧」,每月各上八支:
- A 組:真人配音 + 原創剪輯。平均 3,200 view/支,CTR 4.8%。
- B 組:TTS 旁白 + 模板剪輯。平均 210 view/支,第十二支之後曝光來源只剩「自訂連結」。
- C 組:TTS 旁白 + 逐字改稿 + 自己錄的螢幕畫面。平均 2,700 view/支,CTR 4.5%。
很多人說的「被限流」,我在 B 組看得最清楚:後台曝光來源裡,搜尋和首頁推薦先歸零,接著話題頁也不見了,最後只剩按過小鈴鐺的人收得到。推薦系統不再幫你測新觀眾,等於把影片關進自己的訂閱者名單。
但害死 B 組的是聲音嗎?它的平均觀看時間只有 31 秒,C 組同題材是 58 秒;B 組縮圖點擊率 1.9%,C 組 4.4%。演算法讀的就是這兩個數字,讀完的結論是「這片子對陌生人沒價值」。聲音是不是合成的,它根本沒在算。
還有一個細節:B 組十三支片裡有九支標題只換了手機型號,其他字一模一樣。這種「自己跟自己重複」是重複性內容判定裡最容易中的一項,系統甚至不會跟你講,新觀眾的測試直接停掉。
上片前我固定做的六件事
每一件都是被數據打過才加進來的:
- 稿子至少改六成。 拿稿就生是量產的起點。開頭十個字一定自己寫,那是唯一決定三秒去留的地方。
- 畫面自己出。 錄螢幕、拍實拍、做圖表都行。我實測拿素材庫一片到底,第二支開始推薦就停。
- 字幕手動校對。 一半觀眾靜音在滑,字幕同時也是原創貢獻的證明。
- 說明欄誠實勾「使用合成內容」。 三個帳號勾了半年,CTR 和曝光量沒有任何差別。這項不影響盈利,影響盈利的永遠是內容分級。
- 音色做輪替。 同一頻道從頭到尾一個聲音,重複感會跟著累積。我固定三種音色輪替,留言區還會討論今天是哪個在講。
- 一支片一個主張。 一稿三發是崩壞的開頭。主題拆開各做一支,工作量差不多,踩到重複判定的機率差很多。
Shorts 和長片,手感完全不同
Shorts 我反而不太擔心。三十到四十秒的節奏,觀眾沒空分辨呼吸真不真——我兩組 Shorts 的完播率是 68%(TTS)對 71%(真人),差三趴,從沒反映在曝光上。Shorts 排名看的是前三秒鉤子和循環率,合成與否排在很後面。
長片就完全兩回事。八分鐘以上的片子,TTS 語氣平、沒有呼吸,留存曲線通常在第三分鐘出現一個凹陷,而那正是系統決定要不要繼續推你的時刻。我的補法是每九十到一百二十秒換鏡頭或插一次音效,把凹陷切碎。
盈利審核也是長片查得比較嚴,因為片子長,被完整看完、被檢舉的機會都高。順帶一提,TikTok 的 Creator Rewards 和 Reels 資格條件也各自明文寫了原創要求——用詞不同,底層邏輯跟 YouTube 是同一套。
以為被限流,先查這三件事
- 後台曝光來源還剩什麼。 只剩通知和自訂連結,就是推薦被停,問題在內容價值,不在聲音。
- 無痕分頁搜標題找得到嗎。 搜尋正常、推薦不動,通常是點擊率或留存太低,系統懶得幫你測。
- 最近三支的 CTR 和平均觀看時間。 這兩個數字一定是先掉的,曝光是結果。把因果搞反,你會去換聲音,而聲音根本不是問題。
結尾:回到那張截圖
回到開頭那位朋友。我請他把十四支模板片砍到八支,每支重剪:換上自己錄的螢幕畫面、改掉開頭十個字、補一個真實案例。三個月後頻道月曝光回到四十萬,上個月盈利申請一次過。聲音到現在還是 AI 唸的。
如果你本來就在用 TTS 做內容,這件事不需要改,該改的是你給它的稿和畫面。還沒試過的話,到 Soundwaver 的文字轉語音頁隨便丟一段話聽三十秒,覺得自然再去看定價就行。工具人人有,差別都在上游。


