歌曲已經完成,腦中也有畫面:下雨的車站、獨自等待的角色,以及副歌一來就突然展開的天空。結果用 AI 生成幾個漂亮鏡頭後,主角每一幕都換了髮型、外套,甚至差點換了物種。用 AI 製作動畫 MV,真正困難的通常不是做出一個好看的動漫風片段,而是讓整首歌留在同一個世界裡。
好消息是,你不需要逐格畫動畫,也不用第一天就精通專業剪輯軟體。從歌曲出發,把角色設定、分鏡、提示詞與場景生成拆成幾個清楚步驟,零基礎也能逐步完成一支原創動漫音樂影片。
傳統 AMV 常指把現有動畫作品的片段配上音樂重新剪輯。本文所說的原創動畫 MV,是使用自己擁有或獲准使用的歌曲,並為歌曲新設計角色與場景。它不是從受版權保護的動漫作品裡取片重剪。
先聽懂歌曲變化,不要急著選動漫風格
「90 年代動漫、霓虹東京、電影感」可以生成漂亮畫面,卻還不是一支完整 MV。先聽歌,標記情緒、節奏與空間感改變的位置。
- 前奏:交代角色、地點或謎題。
- 主歌:補充細節,讓故事開始移動。
- 預副歌:增加張力、動作或畫面尺度。
- 副歌/Drop:放入觀眾最容易記住的畫面。
- Bridge:打破原本節奏,揭露新的事情。
- 尾奏:收束故事,或用已經改變的狀態呼應開頭。
不需要懂樂理,用白話寫時間點就好,例如「0:42 視野應該打開」、「2:10 突然變得很孤單」。如果整首歌每一秒都要求史詩感,副歌反而沒有登場的空間。
接下來用一首電子流行歌曲做例子:一位單車快遞員,每晚追逐天亮前就會消失的星星。主歌安靜,預副歌開始加速,副歌則明亮又像失去重力。
用一句話定義能拍成畫面的故事
原創動漫風 MV 不需要十二個王國和完整家族史,只要一個能延伸成多個場景的清楚概念。
每到夜晚,單車快遞員就在雨城裡追逐一顆墜落的星;天亮時,她才發現那道光一直在帶她回家。
這句話已經有主角、行動、世界和結尾。生成前先回答:
- 我們跟著誰?
- 她想得到什麼?
- 哪個視覺元素會反覆出現?
- 最後一幕之前,什麼事情改變了?
「女孩回憶夏天」只是氣氛;「女孩回到空無一人的海邊車站,找到當年留下的紅絲帶」才是可以安排鏡頭的故事。
生成場景前,先建立角色視覺錨點
AI 動畫製作最常見的問題之一,就是同一角色在不同鏡頭裡變了臉。不要只重複「同一個女孩」,而要設定少數、看得見且能反覆描述的特徵。
| 固定項目 | 範例 | 作用 |
|---|---|---|
| 輪廓 | 短雨披、窄版單車安全帽 | 遠景也能辨認角色 |
| 頭髮與臉 | 及下巴黑髮、琥珀眼、臉頰小疤 | 減少特寫時換臉 |
| 服裝 | 芥末黃外套、深藍短褲、紅手套 | 避免每幕自動換裝 |
| 代表物件 | 星形扣環的銀色快遞包 | 連結角色與故事 |
| 色彩 | 雨藍、街燈琥珀、星光青色 | 統一整支動畫 MV 的世界 |
錨點要短到能在每個重要提示詞中重複。與其列二十個容易變形的小配件,不如守住五個強特徵。先確認一張角色參考,再擴展到完整分鏡。
把歌曲結構變成動畫 MV 分鏡
這一步會把零散 AI 片段變成完整 MV。不要逐字解釋每句歌詞,而是讓歌曲每個段落負責一個情緒或故事任務。
| 歌曲段落 | 故事節點 | 視覺方向 |
|---|---|---|
| 前奏 | 星星墜落 | 安靜廣角、無人車站、一道青色光穿過雲層 |
| 主歌 | 快遞員開始追逐 | 輪胎、濕招牌、地圖燈光,鏡頭保持克制 |
| 預副歌 | 光的路徑變得混亂 | 狹窄巷弄、加速追蹤、倒影分成假路 |
| 副歌 | 她衝上城市高架 | 空中廣角、明亮青色、明確向前運動 |
| Bridge | 星光消失 | 近乎靜止、降低飽和、黎明中的孤獨 |
| 最後副歌 | 星光回到城市窗戶 | 暖光逐扇亮起,她騎向家的方向 |
副歌不只是剪接變多,而是空間和顏色真的改變,觀眾才會感覺歌曲被推高。想先把鏡頭規劃清楚,可以搭配AI 故事板指南。
為單一鏡頭寫提示詞,不要一次塞完整首歌
要求 AI 用一個超長提示詞完成三分鐘影片,等於同時交給它太多工作。先定義全片共用規則,再為每個鏡頭寫聚焦的指示。
製作第一段副歌的原創動漫風動畫 MV 鏡頭。及下巴黑髮、琥珀眼、穿芥末黃雨衣與紅手套、背著星形扣環銀色快遞包的單車快遞員,從藍調時刻的狹窄街道衝上城市高架。一顆小小青色星光飛在前方。使用手繪賽璐璐動畫質感、雨藍陰影、暖琥珀窗光;攝影機平順側向追蹤,再拉成空中廣角。臉、服裝、單車、快遞包與色彩保持和參考圖一致。只保留一個向前運動,不換裝、不加群眾、不出現可讀文字。
每個鏡頭盡量只有一個主要動作與一種運鏡。角色又跑、又旋轉、又唱歌、又變身,攝影機還要繞過三個地點,生成結果通常只會更混亂。需要更多曲風方向時,可查看不同曲風的 AI 音樂影片提示詞。
先生成副歌的關鍵鏡頭
歌曲從第 0 秒開始,不代表生成也要從片頭開始。先做副歌展開、Drop 或情緒特寫等最重要畫面,把它當成後續場景的品質標準。
- 預定景別中,角色仍然容易辨認。
- 畫面有明確動漫風,而不是模糊的「會動插畫」。
- 同一配色能延伸到安靜和高能量場景。
- 動作強度符合這一段歌曲。
- 構圖也能用作縮圖或短影音預告。
關鍵鏡頭不對,就先修角色參考或視覺方向,不要把問題複製到十五個場景。確認後再向前、向後擴展分鏡。
只修失敗的場景,不要重做整個世界
AI 影片需要反覆調整。有時雨景很漂亮,臉卻跑掉;有時角色穩定,單車卻變成奇怪雕塑。這不代表整份故事板失敗。
- 連貫性:看起來還是同一個人嗎?
- 故事任務:這個鏡頭有推進內容嗎?
- 音樂任務:動作與節奏符合歌曲這一段嗎?
一次只調整一個類別:簡化動作、穩定鏡頭,或補回消失的角色錨點。目標不是每格完全相同,而是讓觀眾相信這些畫面受到同一個導演控制。
組合完整 MV,再準備發布格式
完成後看兩遍:第一遍像聽眾一樣,找出注意力掉下來的地方;第二遍關掉聲音,只看畫面能不能理解故事。沒有音樂就完全看不懂,可能代表少了交代地點或關係的鏡頭。
- 16:9:YouTube 完整 MV、橫式嵌入。
- 9:16:TikTok、Reels、Shorts 的副歌與 Hook。
- 1:1:部分社群貼文和封面動態循環。
確認歌曲、歌詞、角色參考、標誌、字體與上傳素材的使用權。不要把未獲授權的既有動漫角色、動畫片段或在世藝術家的標誌性風格,當作自己的原創作品發布。
AI 動畫 MV 製作的 6 個步驟
標記前奏、主歌、副歌、Bridge、尾奏和情緒變化。
決定主角、目標、重複意象和最後的變化。
先確認少數視覺錨點和一張角色參考。
讓歌曲每個段落有故事與視覺任務。
從副歌關鍵鏡頭擴展,只重做失敗場景。
先完成主版,再重構適合直式短影音的段落。
在 SoulVid AI 動漫音樂影片生成器中,可以把歌曲、角色設定、分鏡、場景生成與單幕修改留在同一個專案。準備好音源和一句清楚的視覺想法,就能開始。



