AI 故事板不是把畫面畫得很漂亮的分鏡板,而是在花點數生成影片前,先告訴 AI 影片模型每個鏡頭要完成什麼的小型計畫。
AI 影片最容易犯的錯,是用一整段大提示詞要求模型自己發明完整片段。故事板的作用,是先把一個想法拆成幾個清楚鏡頭,再為每個鏡頭各寫一段提示詞。
- 想法
- 一個影片概念
- 規劃
- 3 到 6 個鏡頭
- 重點
- 每個鏡頭只做一件事
- 輸出
- 每個鏡頭一段提示詞
先從一份簡短場景清單,以及一個可複製的提示詞範本開始。
AI 故事板實際長什麼樣
用在 AI 影片時,故事板可以只是文字。你只需要足夠的細節,避免模型替你猜完整段影片。
最簡單的形式是:先寫影片目標,再為每個鏡頭寫一行。本文後面的可複製範本,也是用這個結構。
每個鏡頭都應該回答五個問題:
- 這個鏡頭為什麼存在?
- 觀眾應該看到什麼?
- 畫面中會發生什麼變化?
- 攝影機應該怎麼看這件事?
- 下一個鏡頭必須保持一致的是哪個細節?

為什麼故事板對 AI 影片有幫助
AI 影片模型更擅長生成一個清楚鏡頭,而不是從模糊想法直接發明完整序列。Sora、Runway 和 Adobe Firefly 的提示詞指南通常也是這個邏輯:描述鏡頭,而不是只描述氣氛。
沒有故事板時,常見問題通常是:
- 第一段看起來不錯,但下一段像是另一支影片。
- 角色的臉、服裝、髮型或年齡突然變了。
- 鏡頭運動很隨機。
- 故事沒有開頭、中段和結尾。
- 你一直重抽,卻不知道到底該修哪裡。
新手 AI 故事板工作流程
第一次做專案可以用這套流程。下面的例子會一路沿用同一個小故事:一台小小的廚房機器人,帶著發光紙星星穿過雨中的海邊小鎮,在日出前重新點亮燈塔。整體調性是可愛、溫暖、有電影感。
步驟 1:寫一句話影片目標
- 這支影片呈現一台小廚房機器人,把發光紙星星從溫暖麵包店帶到黑暗海邊燈塔。
如果句子只有「做得有電影感」或「做得感人」,就還沒準備好。那是風格備註,不是影片目標。
步驟 2:做一版 4 鏡頭草稿
現在把目標拆成四個節拍。先不要寫提示詞。這個階段,每個鏡頭只需要一個任務和一個可見變化。
| 鏡頭 | 任務 |
|---|---|
| 鏡頭 1 | 交代故事從哪裡開始。 |
| 鏡頭 2 | 清楚展示主要主體。 |
| 鏡頭 3 | 製造主要動作、揭示或能量變化。 |
| 鏡頭 4 | 落在觀眾應該記住的最後畫面。 |
檢查方式很簡單:如果兩個鏡頭做的是同一件事,就合併它們,或讓其中一個改做不同任務。
| 部分 | 草稿 |
|---|---|
| 目標 | 這支影片呈現一台小廚房機器人,把發光紙星星從溫暖麵包店帶到黑暗海邊燈塔。 |
| 鏡頭 1 | 日出前,雨中的海邊小鎮裡,一扇溫暖麵包店窗戶亮著。 |
| 鏡頭 2 | 小機器人從沾著麵粉的桌上捧起發光紙星星。 |
| 鏡頭 3 | 機器人穿過濕亮石板路,星光照亮水窪。 |
| 鏡頭 4 | 機器人小小地、驕傲地舉起星星,燈塔燈光重新亮起。 |
草稿保持短就好。你現在是在決定順序,不是在修飾文字。攝影機、服裝、光線和一致性規則下一步再加。
步驟 3:加入鏡頭與連貫性
鏡頭細節欄位
鏡頭 [編號]
目的:
場景:
主體:
動作:
鏡頭:
連貫性:
填好的鏡頭細節
鏡頭 2
目的:介紹主要角色和重要物件
場景:日出前的溫暖麵包店廚房
主體:一台圓滾滾的小廚房機器人,藍色琺瑯機身,黃銅手掌
動作:從沾著麵粉的木桌上捧起發光紙星星
鏡頭:從中景慢慢推近到特寫
連貫性:藍色機器人機身、黃銅手掌、溫暖麵包店燈光、柔和金色紙星星光芒
步驟 4:把一個鏡頭變成一段提示詞
不要把整份故事板貼進每個提示詞。一次只轉換一個鏡頭。每段提示詞只處理你現在要生成的那個鏡頭。
一台可愛機器人在麵包店拿著星星,電影感,漂亮,高品質。
更好的提示詞會給模型一個任務、一個場景、一個鏡頭運動和連貫性規則。弱提示詞只給了氣氛。
步驟 5:生成後,只修最弱的鏡頭
- 主體是否保持可辨識?
- 主要動作是否真的發生?
- 攝影機是否符合計畫?
- 風格是否接近前一個鏡頭?
- 這個鏡頭是否仍然完成自己的目的?
如果答案是否定的,先修故事板那一行:
問題:鏡頭 3 裡機器人看起來不一樣。
修連貫性欄位:同一台圓滾滾藍色琺瑯小機器人,同樣的黃銅手掌,同樣柔和金色紙星星光芒。
問題:雨中街道鏡頭太暗,失去可愛電影感。
修風格欄位:濕亮石板街道帶有溫暖麵包店倒影,柔和金色星光,溫柔微縮電影感,不要恐怖氛圍。
可複製 AI 故事板範本
短篇故事片段
影片目標:
這支影片呈現 [角色] 從 [起始狀態] 走向 [結束狀態]。鏡頭 1:
目的:建立故事世界
場景:[故事開始的地方]
主體:[主要角色和重要視覺細節]
動作:[畫面中會發生什麼變化]
鏡頭:[遠景 / 中景 / 特寫 / 跟拍]
連貫性:[需要穩定保持的臉、服裝、道具、光線或地點細節]
鏡頭 2:
目的:介紹角色
場景:[能清楚看見角色的地方]
主體:[角色外觀和服裝]
動作:[簡單可見的動作]
鏡頭:[鏡頭角度或運動]
連貫性:[延續鏡頭 1 的角色細節]
鏡頭 3:
目的:呈現轉折點
場景:[主要變化發生的地方]
主體:[聚焦的角色、物件或環境]
動作:[關鍵動作或揭示]
鏡頭:[支撐這個變化的鏡頭運動]
連貫性:[不能漂移的細節]
鏡頭 4:
目的:落在最後畫面
場景:[最後地點或視覺狀態]
主體:[應該吸引注意的內容]
動作:[最後姿勢、動作或揭示]
鏡頭:[結尾鏡頭類型]
連貫性:[相同風格和關鍵視覺細節]
音樂影片段落
歌曲段落:
[前奏 / 主歌 / 副歌 / 橋段]情緒:
[孤單 / 夢幻 / 憤怒 / 自信 / 懷舊]
視覺符號:
[雨 / 鏡子 / 紅圍巾 / 空房間 / 城市燈光]
主要角色:
[外觀和服裝]
鏡頭 1:
目的:建立這個段落的情緒
場景:[符合情緒的地點]
主體:[表演者、聆聽者、物件或符號]
動作:[配合音樂的小動作]
鏡頭:[慢慢推近 / 固定遠景 / 手持跟拍]
連貫性:[符號、光線、服裝或色彩]
鏡頭 2:
目的:介紹表演者或主要角色
場景:[同一世界中更清楚的畫面]
主體:[表演者或角色細節]
動作:[手勢、走路、回望或表演節拍]
鏡頭:[中景 / 特寫 / 跟拍]
連貫性:[相同符號和段落色彩]
鏡頭 3:
目的:展示能量變化
場景:[環境隨音樂產生反應]
主體:[表演者、符號或人群細節]
動作:[隨段落上升的動作]
鏡頭:[更快運動或更強構圖]
連貫性:[相同角色和視覺符號]
鏡頭 4:
目的:停在最有力的歌詞畫面
場景:[這個段落的最後畫面]
主體:[最有力量的符號或角色姿態]
動作:[最後動作或停留瞬間]
鏡頭:[特寫 / 結尾遠景 / 慢慢拉遠]
連貫性:[相同情緒、色彩和符號]
處理歌詞時,不要把每一句都照字面畫出來。選出段落情緒,以及一個可以反覆出現的符號。
在 SoulVid 裡,這就是生成前有用的規劃層:先整理歌詞、視覺想法、角色方向和故事板備註,再把場景轉成影片片段。
產品預告片
產品:
[名稱或物件]問題:
[什麼很混亂、很慢、很無聊或很痛苦?]
結果:
[產品出現後有什麼改變?]
鏡頭 1:
目的:清楚展示問題
場景:[問題發生的地方]
主體:[人物、工作區、物件或螢幕]
動作:[看起來混亂、緩慢或痛苦的事情]
鏡頭:[遠景或細節特寫]
連貫性:[需要保持清楚的問題細節]
鏡頭 2:
目的:介紹產品或介面
場景:[產品出現後的同一設定]
主體:[產品、App 畫面或物件細節]
動作:[第一次互動或揭示]
鏡頭:[乾淨中景 / 微距細節 / 螢幕特寫]
連貫性:[品牌色、產品形狀或 UI 狀態]
鏡頭 3:
目的:展示解決問題的動作
場景:[能看見解法的地方]
主體:[正在使用中的產品]
動作:[產品帶來的具體變化]
鏡頭:[跟拍、推近或前後對比構圖]
連貫性:[相同產品和環境]
鏡頭 4:
目的:展示乾淨的最後結果
場景:[改善後的最終狀態]
主體:[觀眾應該記住的結果]
動作:[平靜的最後動作或定格]
鏡頭:[最後遠景或精緻特寫]
連貫性:[相同品牌和視覺風格]
常見 AI 故事板錯誤
- 鏡頭太多:先從 3 到 6 個開始。鏡頭越多,越容易漂移。
- 每個鏡頭沒有不同任務:如果三個鏡頭都只是「讓角色看起來很酷」,就合併或重寫。
- 先寫提示詞才規劃:單段影片好看,不代表整段序列會成功。
- 每個鏡頭都換風格:除非有意設計轉變,否則保持同一套視覺語言。
- 沒有鏡頭方向:加入遠景、特寫、慢慢推近、跟拍或固定鏡頭。
- 沒有連貫性規則:重複寫出必須穩定的服裝、臉、道具、光線或地點細節。
你應該使用 AI 故事板生成器嗎?
卡住時可以用 AI 故事板生成器,但不要把它當成最後控制權。它可以提出鏡頭想法、場景順序、攝影機角度或替代版本;但只要你在意一致性,最後仍然需要自己編輯計畫。
- 請 AI 給你 6 個粗略鏡頭想法。
- 刪掉弱的或重複的鏡頭。
- 用自己的話重寫最好的 3 到 5 個鏡頭。
- 加入連貫性規則。
- 一次生成一個鏡頭。
最後重點
從一句話開始。拆成 3 到 6 個鏡頭。讓每個鏡頭都有任務、可見動作、鏡頭方向和連貫性規則。然後把每個鏡頭各自轉成一段提示詞。目標不是讓計畫看起來厲害,而是讓下一次生成少一點隨機。



