新手如何製作 AI 影片:分鏡轉成鏡頭規格、測試小樣到批准輸出

新手如何製作 AI 影片:分鏡轉成鏡頭規格、測試小樣到批准輸出

Olivia Park
2026年8月24日· 9 分鐘讀完

要可靠地製作 AI 影片,應在劇本和分鏡獲批後才開始。為每項輸入釐清權利,把每格分鏡變成精確的鏡頭規格,先產生小樣測試,每次只改一個變數,逐格檢查連貫性和身份,加入核實過的聲音和字幕,最後要求由人批准確切的輸出版本。

本指南不重複劇本和分鏡規劃。如果敘事、主張或鏡頭次序仍未確定,請先看 AI 影片劇本與分鏡指南。

關鍵要點

  • 劇本、主張、分鏡和輸入權利獲批前,不要開始生成。
  • 把每個鏡頭視為一份獨立規格,寫明主體、動作、場景、機位、時長和排除項目。
  • 投入完整序列前,先產生低成本的測試。
  • 每次只改一個變數,並保存提示、設定、輸入和選定的輸出。
  • 檢查連貫性、人體結構、物理、文字、產品行為、身份和事實語境。
  • 以獨立的核查流程加入聲音、字幕、披露和來源資料。

第 1 步:批准製作包和輸入權利

生成前先凍結創作意圖。製作包應包括獲批的劇本、分鏡格編號、必需的主張及來源、目標受眾、畫面比例、大約鏡頭長度、品牌規則、無障礙要求、禁止內容和最終批准人。

為每項輸入建立權利登記表:

輸入使用前要回答的問題
劇本與分鏡由誰撰寫或委託?是否包含第三方段落?
參考圖片誰擁有圖片?授權是否容許這種用途和轉換?
人物或聲音是否已就身份、肖像、聲音、地區和期限取得知情同意?
產品或地點是否可見商標、設計、私人地方或機密資料?
音樂與聲效詞曲、錄音、表演和同步權利是否齊備?
生成素材適用哪些工具條款、來源資料和披露義務?

不要把「網上找到」當作權利狀態。沒有明確授權和批准資料路徑,不要把私人客戶片段、未推出的產品、身份證明文件或個人媒體上載到工具。

把每格分鏡轉成鏡頭規格

一個提示描述一個鏡頭。為每個鏡頭設定編號,並記錄:

  • 敘事目的和來源主張;
  • 主體身份和不可變的特徵;
  • 有清晰起訖狀態的動作;
  • 場景、時間、天氣和背景活動;
  • 景別、鏡頭感、機位和移動;
  • 光線、色調、物料和視覺風格;
  • 畫面比例和預期剪接長度;
  • 為字幕或圖像預留的空白位置;
  • 排除項目,例如標誌、多餘人物、可讀文字或不安全動作;
  • 可觀察的驗收與拒絕條件。

Adobe 現行的提示指引建議描述鏡頭類型、主體、動作、地點和美學,並指出可以指定機位角度、移動和距離。[3] 把這些視為可控的製作欄位,而不是神奇的字眼。

一份有用的規格可以是:「鏡頭 03,平視遠景。晨光從窗戶照進,木枱上放着一隻陶瓷杯。緩慢推近;熱氣自然上升;不出現手、標誌、屏幕介面或可讀文字。右邊三分一留空放字幕。只有杯的形狀、把手、熱氣方向和光線保持穩定時才接納。」

第 2 步:核對工具當前能力與政策

影片工具變化很快。製作前,在官方說明頁核實支援的輸入類型、輸出控制、供應情況、資料保留、水印或來源標記行為,以及內容政策。除非會在執行當日重新核對,否則不要把模型名、時長、價格或地區寫成長期保證,放進製作計劃。

Google 的 Gemini 說明目前介紹以提示產生影片,部分體驗亦可加入圖片或檔案;供應情況和限制視乎目前的產品體驗。[1] Adobe 同樣把文字生成影片記錄為一項含模型和生成設定的流程,這些設定可能改變。[2] 把這些頁面視為註明日期的能力例子,而非對每個帳戶的保證。

上載獲批的正式素材前,先以不敏感的內容作一次測試。確認輸出和記錄在哪裏顯示、如何刪除,以及帳戶屬個人還是機構。

第 3 步:製作 AI 影片時先生成代表性小樣

揀選最難而又最具代表性的鏡頭:人物轉身、物件互動、產品細節、鏡頭移動或光線轉變。產生一個小樣,以正常速度、慢速和逐格方式審查。

檢查:

  • 主體在各格之間的形狀和身份;
  • 手、臉、四肢、反射、陰影和接觸點;
  • 物件數目、幾何形狀、標籤和產品控制項;
  • 鏡頭移動和地平線的穩定性;
  • 物理因果、方向和時間;
  • 背景人物和移動物件;
  • 剪接所需的開始和結束畫面;
  • 必需的留空位置。

如果這個代表性鏡頭反覆失敗,就改變製作設計:簡化動作、拆成兩個鏡頭、使用獲授權的實拍鏡頭,或改用其他工具。不要以為多生成幾次便一定能解決結構性的限制。

第 4 步:每次只改一個變數

保存生成記錄,列明鏡頭編號、輸入素材、提示、排除項目、設定、輸出編號、審查備註和選用狀態。測試失敗時,先為失敗分類,再作修改。

例如:

  • 鏡頭移動不對 → 只改鏡頭相關字句或控制項;
  • 主體不穩定 → 簡化動作,或加強對不可變特徵的描述;
  • 背景雜亂 → 刪去背景事件,而非主體;
  • 構圖薄弱 → 改變景別或參考構圖;
  • 風格不一致 → 使用獲批的風格參考和固定色板;
  • 生成的文字無法辨認 → 刪去生成文字,其後再加入真實字體排版。

AI 圖像提示指南解釋了主體、構圖、光線和排除項目如何互相影響。影片多了時間這個維度:提示還必須界定變化、連貫性和鏡頭行為。

實驗時不要覆蓋已選定的輸出。保留一個穩定的候選版本,並按確切的驗收準則把新版本與它比較。

第 5 步:檢查跨鏡頭連貫性

單獨看很好的片段,仍可能破壞整個序列。為人物、服裝、道具、環境、光線方向、天氣、時間、畫面方向、機位高度、色調和聲音透視建立一份連貫性表。

這幅圖是審查流程,並非生成的影片結果,也不證明任何工具會執行這些檢查。

把相鄰片段放上時間線,檢查剪接位。比較前一鏡結束狀態與下一鏡的開始畫面。留意物件換邊、面孔漂移、服裝細節變異、門的位置移動、光線反轉或動作跳接。

只有在擁有權利而且工具支援這種流程時,才使用參考畫面。未經許可,不要把真人的臉或創作者的獨特作品當作保持連貫性的捷徑。

第 6 步:審核事實、身份和安全

生成的影片可能製造出看似證據、實則從未發生的場景。確認輸出沒有把虛構的事件、產品行為、醫療效果、引文、客戶體驗、地點或測試結果當作真實呈現。

仔細審查身份和敏感語境:

  • 能否合理地認出或冒充某個真實的人?
  • 是否描繪了未成年人或弱勢人士?
  • 場景有否把某人置於犯罪、性、醫療、政治或其他敏感語境?
  • 標誌、制服、介面、文件或地標是否具誤導性?
  • 剪接有否暗示來源不支持的因果關係或認可?
  • 內容是否需要畫面上的披露或來源標籤?

NIST 的生成式 AI 風險概況所列的風險包括虛構、有害內容、資料私隱、資訊完整性和人機配置。[4] 身份含糊或影響重大的主張,請合資格人士覆核,並設有記錄的停止途徑。

第 7 步:分開處理聲音和字幕

不要只因生成的語音、音樂或環境聲符合氣氛就接納。核實劇本、讀音、名稱、數字、引文、同意和權利。不要讓聲音在未獲批准下模仿他人身份。

根據獲批的最終旁白或文字稿產生字幕,再對照聲音校對。檢查時間、換行、說話者標籤、聲音描述、對比度、安全邊界和閱讀速度。從獲批的語意來源翻譯字幕,而不是從未經核實的自動轉錄翻譯。

如果畫面中出現生成的文字,就在剪接時以受控的字體排版取代。影片模型經常令文字隨時間扭曲;真實的標題層更易閱讀,也便於審計。

第 8 步:精確批准並輸出

最終審查包應包括:

  • 最終時間線或不可變的審查輸出版;
  • 劇本和來源版本;
  • 選用的鏡頭編號和生成記錄;
  • 權利和同意登記表;
  • 事實和身份審查;
  • 聲音、音樂和字幕審查;
  • 披露和來源標記的決定;
  • 目標渠道、畫面比例、解像度、幀率和安全範圍;
  • 未解決的限制和回退負責人。

批准精確輸出版本。如果任何片段、旁白句子、字幕、披露、音樂或發布目的地有變,就退回相關審查人。人工批准指南說明如何避免把籠統的創作認可當作對其後所有變體的許可。

輸出一份審查母版和所需的交付版本。由頭到尾重看編碼後的檔案,檢查掉格、色彩偏移、聲畫同步、字幕被裁切、壓縮瑕疵、元數據和披露。輸出成功並不能證明內容準確或權利已清。

總結

  • 只在劇本、分鏡、主張和權利獲批後才開始。
  • 每次只規定並審查一個鏡頭。
  • 盡早測試最難的鏡頭;限制屬結構性時便重新設計。
  • 每次只改一個變數,並保存生成證據。
  • 審查畫面和相鄰剪接位的連貫性、身份、物理和事實含義。
  • 以獨立的檢查加入核實過的聲音和字幕。
  • 把批准綁定到確切的時間線,並重看每一份輸出的交付成果。

常見問題

製作 AI 影片前要有分鏡嗎?

就受控的流程而言,需要。分鏡界定鏡頭目的和次序,可防止隨機生成的結果主導敘事。進入這個製作循環前先完成分鏡。

新手應選哪個 AI 影片工具?

按現行官方功能、容許的輸入、權利條款、私隱、來源標記、帳戶供應情況,以及你需要的鏡頭來選擇。不要依賴一份靜態的「最佳 AI 影片工具」清單。

AI 影片提示要多詳細?

詳細到能界定一個鏡頭的主體、動作、場景、機位、光線、風格、時長意圖、排除項目和驗收準則。刪去不影響鏡頭的細節。

如何保持人物一致?

凍結身份和服裝細節,簡化動作,在容許時使用獲批的參考素材,並比較相鄰畫面。如果工具無法保持所需身份,就改變設計或製作方法。

可用名人或他人的臉和聲音嗎?

沒有清晰授權,亦未審查適用的肖像、公開權、私隱、勞工、平台和合成媒體規則前,不要這樣做。敏感或具欺騙性的冒充,應令項目停下來。

為何生成文字經常錯?

文字必須在各格之間保持幾何穩定,而生成模型往往處理不好。把文字從生成的鏡頭中移除,在剪接時加入受控的字體排版。

必須披露 AI 生成嗎?

要求取決於法律、平台、客戶、語境和風險。在規劃時決定披露方式,輸出時重新核對現行規則;即使毋須公開標示,也要保留來源記錄。

生成完成可直接發布嗎?

不可以。生成只是製作的其中一步。權利、連貫性、事實含義、身份、安全、聲音、字幕、披露、最終批准和編碼後的交付審查仍未完成。


延伸閱讀:

免責聲明:本文提供一般創意製作資訊,不構成法律建議。版權、肖像、私隱、勞工、廣告、合成媒體和平台規則不同,請核對當前條款。

來源:

  1. Google Gemini Apps Help — Generate videos with Gemini Apps — https://support.google.com/gemini/answer/16126339
  2. Adobe Firefly Help — Generate videos using text prompts — https://helpx.adobe.com/firefly/web/work-with-audio-and-video/work-with-video/generate-videos-using-text-prompts.html
  3. Adobe Firefly Help — Writing effective text prompts for video generation — https://helpx.adobe.com/firefly/web/work-with-audio-and-video/work-with-video/writing-effective-text-prompts-for-video-generation.html
  4. NIST — Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile — https://www.nist.gov/publications/artificial-intelligence-risk-management-framework-generative-artificial-intelligence

Sources checked 2026 年 8 月 24 日。

開啟 3 天免費試用

註冊即可免費體驗全部高級功能。

*只限新用戶;每位用戶只可獲得一次試用。

新手如何製作 AI 影片:分鏡轉成鏡頭規格、測試小樣到批准輸出 | AethoVPN