想要四個鏡頭,但不想要四個毫無關聯的片段?當您在開始命名鏡頭和攝影機運動之前,先決定好每個剪接點的用途,Kling 3.0 多鏡頭功能的效果最佳。 Dan Kieft 的 Kling 3.0 教學影片在約 3:31 處進入多鏡頭單元,並在完整的生成工作流程脈絡中展示此功能。請將該段落作為視覺導引,再依照以下指南將此功能轉化為可重複使用的分鏡方法。 規劃原則 先撰寫故事節拍,為每個節拍分配時長,再加入構圖、攝影機運動、對白及連貫性限制條件。只有當每個剪接點都能帶來新資訊時,增加更多剪接才有意義。 本文內容 自動多鏡頭與自訂多鏡頭的差異 從故事節拍開始,而非攝影術語 在撰寫每個鏡頭前先規劃時長分配 以分層方式撰寫自訂多鏡頭提示詞 在剪接間保護角色與產品的一致性 利用攝影機變換來增加資訊量 處理對白與原生音訊而不使場景負荷過重 製作多鏡頭產品廣告且避免呈現出幻燈片感 修正 Kling 多鏡頭的常見問題 使用 Media.io 生成並完成序列 Kling 3.0 多鏡頭品質確認清單 關於 Kling 3.0 多鏡頭的常見問題 自動多鏡頭與自訂多鏡頭的差異 當您對場景有清晰的概念但不在意剪接點確切位置時,請使用自動多鏡頭模式。描述場所、主體、動作、對白及視覺節奏,模型便能在生成過程中自行規劃鏡頭轉換與攝影機涵蓋範圍。 當剪接結構至關重要時,請使用自訂多鏡頭模式。Kling 的官方說明指出,必須先啟用多鏡頭功能,才能使用自訂多鏡頭。在自訂模式中,您可以指定鏡頭數量與每個鏡頭的時長,再為每個節拍描述其構圖、視角、動作及攝影機運動。 一個實用的決策原則很簡單: 模式 最適合的情境 自動多鏡頭 探索性創作與快速發想。 自訂多鏡頭 您已有明確的分鏡腳本,或需要保護產品、對白臺詞或關鍵揭露的呈現方式。 單一鏡頭 連貫性比涵蓋範圍更重要時,例如一個優雅的環繞鏡頭或一段不間斷的表演。 在開始之前,建議先回顧更全面的Kling 3.0 AI 影片生成器功能介紹,以便了解多鏡頭功能何時真正解決了製作需求,而非增加不必要的複雜度。 從故事節拍開始,而非攝影術語 在決定鏡頭大小之前,先將場景寫成一連串事件的順序。例如,一支 12 秒的護膚廣告可能包含四個節拍: 創作者在浴室鏡子前注意到肌膚乾燥。 她拿起精華液並展示瓶身。 她塗抹一滴並自然地呈現反應。 產品以清爽的主視覺構圖落版,創作者在背景中柔焦呈現。 這些都是故事節拍,它們告訴您觀看者需要理解的內容。只有在節拍確立之後,才應選擇廣角鏡頭、特寫、過肩鏡頭或推鏡。 這能避免一個常見的提示詞問題,即使用者列出「廣角鏡頭、特寫、手持、環繞、滑軌、微距」,卻沒有說明攝影機為何要改變。攝影機語言在支撐可見的敘事動作時效果最佳。 在撰寫每個鏡頭前先規劃時長分配 Kling 3.0 能提供比舊版短片工作流程更長的時間,但每個鏡頭仍需要足夠的時長來讓觀眾讀取資訊。若您在 10 秒的生成中規劃六個鏡頭,平均每個鏡頭不到兩秒。這對快速蒙太奇剪輯或許可行,但對於每個片段都包含複雜對白、產品操作和攝影機運動而言,時間並不充裕。 以一個 15 秒的場景為例,均衡的結構可以是 3 + 4 + 4 + 4 秒。一支開頭節奏較快的廣告可以使用 2 + 3 + 4 + 3 + 3 秒。一段對話交流可能使用一個較寬的建立鏡頭、兩個反應鏡頭和一個共同的結尾。 請為動作的沉澱預留時間。若產品需要旋轉到清晰可讀的角度,請勿在其到位的瞬間就立刻剪接。讓最終位置有足夠的畫格數呈現。同樣的原則適用於面部反應和對白臺詞。 一個鏡頭通常應包含一個主要動作和一個攝影機概念。若演員需要穿越房間、打開盒子、取出產品、說一句臺詞,而攝影機同時還要進行環繞,請將這些動作拆分開來。 以分層方式撰寫自訂多鏡頭提示詞 一個可靠的提示詞包含兩個層次。第一個層次定義整個場景中應保持一致的元素;第二個層次定義逐鏡頭的變化內容。 從全局場景描述開始: 「明亮的現代浴室,清晨時分,自然窗光,同一位穿著奶油色浴袍的女性,同一瓶貼有白色標籤的琥珀色精華液瓶,寫實的 UGC 風格,穩定的膚色與產品識別度,親切自然的表達方式。」 接著加入分鏡計畫: 「鏡頭一,3 秒:中景鏡子鏡頭。她觸碰臉頰並察覺乾燥感。固定攝影機,帶有輕微手持的真實感。」 「鏡頭二,4 秒:特寫她的手將精華液瓶舉向鏡頭。保持標籤方向清晰可讀。緩慢推鏡。」 「鏡頭三,4 秒:中特寫。她塗抹一滴在臉頰上並微笑。攝影機維持眼睛水平。」 「鏡頭四,4 秒:產品主視覺鏡頭,置於洗手台台面。她柔焦呈現於背景中。緩慢向瓶身方向受控推鏡。」 提示詞無需在每個鏡頭中重複所有服裝和場景細節。只需定義一次穩定的元素,再用每個鏡頭的描述呈現新的動作即可。 在剪接間保護角色與產品的一致性 每個剪接點都是模型重新詮釋場景的機會。角度變化越大,您就越需要謹慎定義哪些元素不能改變。 對於角色,請鎖定明顯的身份識別特徵:臉部、髮型、年齡範圍、服裝、配件及任何獨特特徵。若您使用圖片參考,請重複使用同一組已核准的參考圖,而非在鏡頭間替換相近但不同的圖片。 對於產品,請保護幾何形狀、包裝顏色、標籤位置、瓶蓋形狀、材質及比例。當細小的印刷細節必須保持完美時,避免要求產品旋轉至極端角度。使用細節鏡頭確保標籤清晰可讀,另外再用獨立的互動鏡頭呈現手持操作。 這與一般的AI 影片一致性密切相關,但多鏡頭功能增加了另一個風險:每個新的構圖都可能觸發新的詮釋。請在剪接點審查連貫性,而不僅僅是在每個鏡頭內部進行確認。 利用攝影機變換來增加資訊量 攝影機的變換應揭示前一個鏡頭無法同樣呈現的內容,這可能是情境、情緒、產品細節、肢體動作或空間關係。 合理的剪接理由包括: 廣角到特寫:從情境轉向細節。 特寫到反應鏡頭:呈現動作的情緒結果。 正面視角到過肩鏡頭:揭示角色正在注視的對象。 產品互動到主視覺鏡頭:將真實使用畫面與品牌呈現分開。 雙人鏡頭到單人鏡頭:在不失去場景空間感的情況下建構對話結構。 Kling 也支援在鏡頭內使用明確的攝影機運動語言。緩慢推鏡可以強化注意力集中感;追蹤運鏡可以跟隨行走中的主體;克制的手持感可以支撐 UGC 風格。請參閱 Media.io 的AI 攝影機運動指南學習相關詞彙,再為每個鏡頭選擇一個合適的運動方式。 處理對白與原生音訊而不使場景負荷過重 Kling 3.0 支援原生音訊,這使分鏡規劃變得更加重要。對白有其時間節奏,剪接點可以發生在一句話開始前、反應過程中或一句話說完之後。若說話的主體在鏡頭之間發生改變,請明確標示說話者。 對於簡短對白,請將確切臺詞寫在對應說話的鏡頭旁邊。臺詞的長度應與分配的時長相符。若有人說話時攝影機切換至聆聽者,請說明聲音在畫面外繼續。若場景使用旁白,請標明為旁白,以免模型嘗試讓每個角色都進行口型同步。 不要用語音填滿每一秒。自然的序列需要留出空間給產品動作、反應及視覺轉場。若音訊是生成內容的主要特色,Media.io 現有的Kling 音訊提示詞指南是結構化對白和音效提示的實用參考資料。 製作多鏡頭產品廣告且避免呈現出幻燈片感 一支薄弱的 AI 廣告往往感覺像四張毫無關聯的圖片。解決方法是在鏡頭之間建立視覺上的交接。 假設您正在製作一支咖啡機廣告: 鏡頭一:廚房廣角畫面。創作者拿著一個空杯子進入畫面。 鏡頭二:咖啡機特寫,她將杯子放在出水口下方。 鏡頭三:咖啡倒出的微距插入鏡頭,帶有蒸汽和溫暖的晨光。 鏡頭四:她品嚐咖啡時的中景反應鏡頭。 鏡頭五:產品主視覺置於台面,背景為相同的廚房場景。 相同的杯子、台面、機器、光線方向和創作者服裝將整個序列串聯起來。動作也跨越剪接點延續:鏡頭一中出現的杯子,在鏡頭二中出現在機器下方,在鏡頭四中出現在創作者手中。這些細微的連貫性使剪輯呈現出經過精心規劃的感覺。 修正 Kling 多鏡頭的常見問題 鏡頭正確但感覺毫無關聯 強化全局場景說明。重複使用相同的場所、身份參考、服裝、色彩調性和重要道具。加入一個能從一個鏡頭延續到下一個鏡頭的動作或物件。 模型忽略了某個鏡頭 規劃內容對總時長而言可能過於密集。減少節拍數量,為每個鏡頭分配更多時間,並確保每個鏡頭的描述在視覺上具有明顯區別。 產品在剪接間發生變化 使用更清晰的產品參考圖,減少極端角度的變化,將清晰可讀的標籤鏡頭與手持互動鏡頭分開,並在每個剪接點核查產品。若品牌保真度至關重要,請將產品漂移的鏡頭視為失敗的素材,而非因為動作看起來不錯就予以接受。 對白時間感覺很趕 縮短臺詞或增加鏡頭時長。口語表達需要真實的時間,不能因為書面提示詞很短,就假設一句長話能塞進兩秒鐘之內。 攝影機感覺很隨意 移除裝飾性的攝影機指令。為每個鏡頭提供一個清晰的構圖,以及最多一個有目的性的運動。剪輯本身已能創造足夠的視覺動感。 使用 Media.io 生成並完成序列 若您想在更廣泛的創作工作流程中測試 Kling 3.0,請開啟Media.io Kling 3.0 生成頁面或從Video AI開始。準備一個簡短的全局場景說明,再決定您的概念是否真的需要多個鏡頭,或者一個受控的單一拍攝是否會更為簡潔。 渲染完成後,先看一遍整個序列以確認故事性,再看一遍以確認連貫性。在第二遍時,在每個剪接點暫停。檢查臉部身份識別、手部動作、產品幾何形狀、標籤、背景物件、視線方向、服裝、光線方向及音訊連貫性。一個高品質的多鏡頭生成作品應能經得起逐格檢視,而不僅僅是在正常速度下看起來令人印象深刻。 使用 Kling 3.0 開始創作 Kling 3.0 多鏡頭品質確認清單 在匯出商業或敘事序列之前,請確認以下事項: 每個鏡頭都有明確的故事目的。 鏡頭時長加總符合實際需求。 第一個鏡頭建立了足夠的情境脈絡。 角色身份與服裝保持穩定一致。 產品形狀、顏色、標誌及標籤不會產生偏移。 攝影機角度維持清晰易懂的畫面空間感。 對白能夠舒適地融入指定的鏡頭之中。 原生音訊在剪接之間不會改變環境氛圍或人聲特質。 最後一個鏡頭完整收尾場景,而非在動作進行中突然結束。 關於 Kling 3.0 多鏡頭的常見問題 什麼是 Kling 3.0 多鏡頭功能? 這是一個 VIDEO 3.0 的工作流程,可在單次生成中建立多個鏡頭。自動多鏡頭模式讓模型自行規劃轉場,而自訂多鏡頭模式則讓您自行定義每個鏡頭的時長與創作方向。 Kling 3.0 多鏡頭影片最長可以是多少? Kling 目前的 VIDEO 3.0 規範說明支援彈性生成,最長可達 15 秒。這使其非常適合用於緊湊的敘事場景、廣告、對話節拍以及短篇電影序列。 我應該使用幾個鏡頭? 只使用故事所需的鏡頭數量即可。一個具有清晰視覺定位的四鏡頭序列,通常比六個倉促的剪接更具說服力。Kling 官方多鏡頭資料目前說明最多支援六個鏡頭,但實際的節奏掌握才應決定您最終的鏡頭數量。 我應該使用自動多鏡頭還是自訂多鏡頭? 當您希望模型自行詮釋場景並選擇鏡位時,請使用自動模式。當您需要指定特定的剪接點、時長、構圖、動作或攝影機運動時,請使用自訂模式。 如何保持角色在不同鏡頭之間的一致性? 保持單一的身份描述、重複使用相同的參考素材、避免不必要的服裝與燈光變化,並在每個剪接點仔細檢查主體。多鏡頭的一致性,是強力參考素材與嚴謹鏡頭規劃相互結合的成果。 Kling 多鏡頭功能可以製作產品廣告嗎? 可以,尤其是在您將情境、互動、細節、反應與主打鏡頭分開規劃時效果更佳。產品廣告需要更嚴格的品質把關,因為標誌、標籤、手部動作以及細微的幾何變化,比一般電影風格的變化更容易被察覺。