做 AI 短劇時,我剛開始嘗試,常遇到一個很挫折的情況:劇本明明寫好了,誰先進門、誰說話、誰生氣、最後發生什麼轉折,全都很清楚;開始製作後,畫面卻不一定照著劇本走。
同一個角色到了下一個鏡頭,臉突然不一樣;衣服、髮型或手上的道具改變;上一鏡還站在門口,下一鏡突然坐到沙發;台詞在講生氣,人物表情卻很平靜。每個鏡頭單獨看都漂亮,剪在一起卻像不同支影片。
一開始,我也會一直修改提示詞,或換一個模型再試。但生成次數越多,我越發現:如果同一個問題反覆出現,可能不是提示詞不夠長,而是前面的製作流程少了一層。
劇本完成,不代表已經可以直接生成
看到「女主角生氣地走進房間,質問男主角」時,人可以自己想像很多細節。但影片模型需要更明確的資料:角色外觀與服裝、移動方向、彼此位置與視線、可見的情緒動作、鏡頭景別、完成秒數,以及下一鏡要從什麼狀態接下去。
如果這些內容沒有先定義,模型就會替我們決定。每次生成補出的答案都可能不同,人物與鏡頭自然不容易連續。
第一步:先把角色鎖定,不要每鏡重新介紹
我會先替主要角色建立固定的「建模」資料,包括年齡範圍與外觀特徵、臉型、髮型與髮色、固定服裝與配件、身形、聲音音色和表情習慣。
不能只寫「漂亮的年輕女性」,因為這個描述每次都可能生成不同的人。同一場戲若沒有換裝,就不要在下一個鏡頭重新改寫服裝;手上拿著手機,下一鏡也要交代手機去了哪裡。
角色一致不只是臉長得像,還包括服裝、道具、情緒與上一個動作有沒有延續。
第二步:不要一次生成整場戲,先拆成可控制的時間段
一場戲可能有進門、對視、質問、反應與轉折。如果把所有事件一次塞進十幾秒,模型容易省略動作、改變順序,或讓角色同時完成太多事情。
- 0~4 秒:女主角推門進入,停在門口,看見房內的男主角。
- 4~9 秒:女主角快步走近並質問;鏡頭由中景推到近景。
- 9~15 秒:男主角先移開視線,再抬頭回應;女主角由憤怒轉成錯愕。
每一段只處理一個主要變化,模型比較容易知道什麼先發生、什麼後發生。
第三步:每個鏡頭都要寫清楚
整理分鏡時,我會讓每一鏡至少回答五個問題:
- 畫面裡有誰?
- 角色現在在哪裡?
- 角色正在做什麼?
- 臉部表情與視線往哪裡?
- 運鏡與攝影機的方向是什麼?
第四步:先做分鏡預演,再生成正式畫面
正式生成前,可以先用分鏡表、首尾幀、簡單動態預演,甚至方塊人物,確認人物位置、走位、鏡頭軸線、台詞與動作時間、前後鏡銜接,以及情緒轉變是否有足夠時間被看見。
這個階段不追求成片漂亮,而是提早找出結構問題。如果連簡單預演都接不起來,直接進入正式生成,通常只會花更多次數反覆抽卡。
這些需要做到全自動嗎?
不用一開始就全自動。AI 可以協助把劇本拆成角色表、場景表、分鏡與提示詞,也可以檢查前後鏡頭資訊是否一致;但故事節奏、人物情緒、鏡頭選擇,以及哪一個生成結果真正適合劇情,仍需要人的判斷。
- 人先確認劇情與角色。
- AI 協助拆解分鏡與時間。
- 用預演檢查走位和鏡頭。
- 人確認後再生成正式片段。
- 逐鏡驗收人物、動作、情緒與銜接。
- 通過後才進入剪輯、聲音與背景音樂製作。
AI 可以加快拆解和整理,但不能跳過導演的思維。
真正要控制的,是前後狀態
AI 短劇做不穩定時,不一定要先換模型,也不一定要把提示詞寫得更長。先檢查角色有沒有鎖定、動作有沒有拆開、鏡頭有沒有交代、情緒有沒有可見,以及上一鏡的結束能不能接到下一鏡的開始。
當故事被拆成可以檢查的畫面與動作,AI 才比較有機會把劇本真正拍出來。
常見問題
AI 短劇角色為什麼每個鏡頭長得不一樣?
常見原因是每個鏡頭重新描述角色,或沒有固定臉型、髮型、服裝、配件與道具。先建立角色鎖定資料,再沿用相同設定。
AI 短劇鏡頭接不起來怎麼辦?
把整場戲拆成可控制的時間段,明確寫出人物位置、動作、視線、情緒與運鏡,並檢查上一鏡結束狀態能否接到下一鏡。
AI 短劇需要一次生成完整場景嗎?
不需要。每段只處理一個主要變化,先用分鏡表、首尾幀或簡單預演檢查,再生成正式片段,通常更容易控制。