鏡提示詞進(jìn)階:推拉搖移寫法與避坑指南)
做AI視頻最容易被忽視、又最能拉開質(zhì)量差距的就是AI視頻運(yùn)鏡提示詞。很多朋友花大量時(shí)間打磨人物、場(chǎng)景、光影的細(xì)節(jié)畫面單看確實(shí)不錯(cuò)但生成出來的視頻總有一種靜感——不是畫面沒動(dòng)而是鏡頭本身是死的。我接觸AI視頻生成工具一年多踩了無數(shù)坑之后最大的體會(huì)就是推拉搖移各有各的寫法運(yùn)鏡提示詞如果只寫一句鏡頭動(dòng)起來生成結(jié)果大概率會(huì)讓你失望。這篇文章我就把自己反復(fù)測(cè)試出來的運(yùn)鏡寫法、參數(shù)控制技巧和翻車經(jīng)驗(yàn)一次性整理出來希望你能少走點(diǎn)彎路。1. 運(yùn)鏡提示詞的本質(zhì)AI視頻不理解鏡頭感只理解運(yùn)動(dòng)方向1.1 AI視頻模型到底怎么解析運(yùn)鏡指令先得把底層邏輯掰開揉碎了說。現(xiàn)在的AI視頻生成模型不管是擴(kuò)散架構(gòu)還是基于Transformer的DiT路線本質(zhì)上都是根據(jù)文本描述去預(yù)測(cè)一幀幀像素之間的運(yùn)動(dòng)關(guān)系。你告訴它鏡頭推近它并不是真的理解推鏡頭這種電影語言而是在海量訓(xùn)練視頻里學(xué)到過類似的畫面主體逐漸變大、背景視差連續(xù)變化、景別從松到緊。它真正在做的事是把推近這個(gè)token和畫面里物體占比擴(kuò)大、背景發(fā)生透視壓縮這類像素變化特征關(guān)聯(lián)起來。所以運(yùn)鏡提示詞的核心寫作邏輯就浮出水面了你不能只寫我要一個(gè)推鏡頭而是要把鏡頭運(yùn)動(dòng)造成的畫面變化結(jié)果也描述出來。這兩者差別巨大。寫鏡頭推近模型收到的是物體變大、背景模糊的信號(hào)寫靠近她模型可能讓角色自己往前走了一步鏡頭紋絲不動(dòng)——因?yàn)樗X得靠近這個(gè)語義可以由主體運(yùn)動(dòng)來完成。不同運(yùn)鏡詞在不同模型上的響應(yīng)可靠度也不一樣。我長(zhǎng)期測(cè)試下來大致可以分成這么幾個(gè)梯隊(duì)運(yùn)鏡類型常用英文詞模型理解可靠度常見錯(cuò)誤表現(xiàn)推push in / dolly in / slow zoom in高把zoom in做成畫面硬裁切沒有透視變化拉pull back / dolly out中高主體突然縮小背景沒有跟著展開搖pan left/right / tilt up/down高誤加上位移變成相機(jī)在橫移移tracking shot / lateral move / truck中低鏡頭旋轉(zhuǎn)而非平移或者變成跟拍人物這個(gè)梯隊(duì)不是固定的不同平臺(tái)會(huì)有差異后面第7章我會(huì)專門講平臺(tái)差異。1.2 為什么同樣的運(yùn)鏡詞出來的效果天差地別我遇到過特別多這樣的困惑同一句提示詞在A平臺(tái)生成出來運(yùn)鏡絲滑拿到B平臺(tái)就完全不動(dòng)了。這里面有幾個(gè)被忽視的因素。第一是訓(xùn)練數(shù)據(jù)分布。電影感強(qiáng)的大場(chǎng)景、人物對(duì)話鏡頭訓(xùn)練素材多模型理解運(yùn)鏡自然就好而抽象的、純幾何的運(yùn)鏡比如貼著桌面橫移、從下水道井蓋視角拉起來素材少模型只能自由發(fā)揮運(yùn)鏡就容易飄。第二是提示詞的生效窗口。有些模型的文本條件只在生成的前幾幀起作用后面畫面就按圖像慣性自己演了有些模型則把文本權(quán)重均勻分配到每一幀。這就導(dǎo)致同樣的運(yùn)鏡詞視頻時(shí)長(zhǎng)一改效果就完全不同。短時(shí)長(zhǎng)的片段里運(yùn)鏡指令往往還沒來得及展開就結(jié)束了你以為是提示詞寫錯(cuò)了其實(shí)是你給的幀數(shù)不夠。第三是多義詞歧義。比如move這種詞模型可能理解為整個(gè)攝像機(jī)位置變化也可能理解為畫面內(nèi)容移動(dòng)。所以我在后面每個(gè)運(yùn)鏡類型里都會(huì)強(qiáng)調(diào)盡量用精確的術(shù)語少用模糊的通用詞。2. 推鏡頭提示詞寫逼近感而不是寫放大2.1 先搞清楚推鏡頭到底在推什么攝影技術(shù)里推鏡頭push in / dolly in意味著攝影機(jī)機(jī)身整體向被攝主體移動(dòng)畫面里主體變大背景因?yàn)橐暡畎l(fā)生連續(xù)變化透視會(huì)逐漸壓迫。而變焦推zoom in只是鏡頭焦距變化畫面放大但沒有真實(shí)的位移感。這兩種效果在情緒表達(dá)上完全不同真實(shí)的dolly in有走進(jìn)對(duì)方世界的沉浸感zoom in則更像眼睛聚焦。問題是在AI視頻里很多模型短時(shí)間內(nèi)根本分不清這兩者。如果你只寫zoom in它很可能直接把整個(gè)畫面等比放大生成結(jié)果就像相冊(cè)里放大照片邊緣信息被裁掉毫無空間感。我的寫法是但凡要拍推鏡頭一定加上背景透視的描述給它一個(gè)真實(shí)移動(dòng)的信號(hào)camera slowly pushes in toward the subject, dolly forward, background perspective shifting naturally這里background perspective shifting naturally就是關(guān)鍵的拐杖。它提醒模型這個(gè)鏡頭的運(yùn)動(dòng)伴隨著背景視差變化不是簡(jiǎn)單縮放。實(shí)測(cè)下來加了這個(gè)描述之后畫面像被硬裁剪的塑料感會(huì)大幅降低。2.2 速度修飾詞是推鏡頭的靈魂推鏡頭最怕的是勻速到底。真實(shí)電影語言里推進(jìn)有明確的節(jié)奏語義緩慢推進(jìn)very slow push in制造不安、壓抑、沉思觀眾會(huì)覺得有什么事正在發(fā)生中速推進(jìn)steady push自然敘事冷靜旁觀急推quick push in強(qiáng)調(diào)震驚、發(fā)現(xiàn)、戲劇爆點(diǎn)所以提示詞里一定要帶速度詞。我常用的三套寫法慢推extremely slow push-in, gradual approach over several seconds中速推steady push in, natural camera movement急推sudden quick push toward the face, rapid dolly in這里特別提醒一句急推在AI視頻里非常容易翻車。模型把quick理解成畫面快速跳動(dòng)結(jié)果生成出來一卡一卡的像是每秒換了一張圖。我自己解決的辦法是急推前加with smooth motion blur讓畫面帶上運(yùn)動(dòng)模糊急速推鏡就會(huì)有電影感而不是劣質(zhì)的頓挫感。2.3 一個(gè)可復(fù)用的推鏡頭提示詞模板我平時(shí)寫推鏡頭用的是一個(gè)三段式結(jié)構(gòu)畫面內(nèi)容 運(yùn)鏡指令 速度/光影修飾。舉例我一個(gè)很常用的雨天窗邊場(chǎng)景A girl sitting by the window watching the rain, camera slowly pushes in from a full shot to a close-up on her side profile, raindrops sliding on the glass, neon lights flickering softly outside the window, shallow depth of field, cinematic color grading這里有個(gè)細(xì)節(jié)值得注意我沒有只寫push in而是把from a full shot to a close-up這種景別變化直接寫進(jìn)去。因?yàn)锳I模型在token匹配時(shí)從全景到特寫這樣的景別變化描述比單純的push in更能精確限定鏡頭的運(yùn)動(dòng)范圍。它給了推鏡頭一個(gè)明確的起點(diǎn)和終點(diǎn)模型在中途的自由發(fā)揮空間就小了運(yùn)鏡自然更穩(wěn)。提示如果平臺(tái)支持中文提示詞比如部分國產(chǎn)工具我也試過鏡頭從全景緩慢推近至面部特寫。實(shí)測(cè)下來推近比推進(jìn)好用。寫推進(jìn)時(shí)模型容易理解成物理位置置換畫面會(huì)跳推近更接近景別變化的語義鏡頭過渡更順滑。3. 拉鏡頭提示詞寫揭示感讓空間自己說話3.1 拉鏡頭為什么容易翻車?yán)R頭pull back / dolly out是從近景抽離到遠(yuǎn)景。它的敘事動(dòng)能在于揭示reveal一開始是人物特寫拉出來才看到他在懸崖邊一開始是血跡特寫拉出來才看到倒下的獵手。AI模型在拉鏡頭上翻車的典型表現(xiàn)非常一致主體突然縮小但背景沒有跟著展開。生成結(jié)果看起來就像鏡頭沒動(dòng)是人物縮水了畫面四周露出一些模糊的空白。深挖原因還是模型把pull back和zoom out混為一談執(zhí)行成了畫面等比縮小而那些新露出來的背景區(qū)域沒有足夠的內(nèi)容信息模型只能生成模糊色塊。我自己反復(fù)測(cè)試下來最有效的修正辦法是在提示詞里明確寫出revealcamera pulls back to reveal the full environment, expanding the scene outward重點(diǎn)不是pull back這三個(gè)字而是reveal the full environment和expanding the scene outward。這兩個(gè)詞組在訓(xùn)練數(shù)據(jù)里經(jīng)常和真實(shí)的拉鏡頭同時(shí)出現(xiàn)模型更容易把它理解成一個(gè)視野逐漸展開的過程而不是畫面縮小裁切。3.2 從特寫到空鏡的拉法兩種典型寫法拉鏡頭在AI視頻里用得最多的其實(shí)是兩種。第一種是小范圍拉特寫到中景。用于情緒轉(zhuǎn)換。比如角色從痛哭到平靜鏡頭從淚水模糊的眼睛拉到整個(gè)人讓觀眾看到身體的顫抖。寫法上要給出小景別→中景別的明確暗示extreme close-up on teary eyes, then camera pulls back to a medium shot revealing the characters trembling shoulders, slow dolly out第二種是大范圍拉近景到極遠(yuǎn)景甚至空鏡。常用于環(huán)境交代營(yíng)造宿命感、孤獨(dú)感、史詩感。這類拉鏡頭在AI里很容易失控因?yàn)楫嬅嬉獜囊粋€(gè)具體物體變成一片大空間模型如果拿不準(zhǔn)空間邊界會(huì)四散模糊。我的經(jīng)驗(yàn)是必須給出范圍邊界a small figure standing in the vast desert, camera pulls back further and further, revealing endless sand dunes until the figure becomes a tiny dot, atmospheric haze on the horizonvast desertendless sand duneshorizon這些都是在劃定一個(gè)空間極限。你不給邊界模型就不知道拉到哪里停畫面就容易散掉。3.3 拉鏡頭很適合做故事性開場(chǎng)如果你的AI短片是帶敘事的我強(qiáng)烈建議把拉鏡頭放在開場(chǎng)。因?yàn)槔R頭天然攜帶從局部到整體的信息遞進(jìn)能在兩三秒內(nèi)把觀眾的好奇心勾出來——它先給你一個(gè)具體的細(xì)節(jié)再一點(diǎn)點(diǎn)揭示這個(gè)細(xì)節(jié)所處的世界。一個(gè)我反復(fù)打磨過的開場(chǎng)寫法A hand holding an old photograph, camera slowly pulls back to reveal a young man sitting alone in a messy study, photos scattered on the desk, dim warm light, shadowy atmosphere不同工具對(duì)reveal的理解不太一樣。像偏電影感的那類工具這個(gè)寫法效果就很好但有些比較吃畫面內(nèi)容的工具你得把hand → young man → study這樣的三級(jí)揭示關(guān)系都寫明確。原理也不復(fù)雜模型的注意力機(jī)制會(huì)把handyoung manstudy這幾個(gè)名詞當(dāng)成關(guān)鍵錨點(diǎn)為了把這些錨點(diǎn)依次裝進(jìn)畫面鏡頭就不得不形成真實(shí)的揭示序列——這恰好就是拉鏡頭的本質(zhì)。4. 搖鏡頭提示詞分清pan和tilt別讓AI亂轉(zhuǎn)4.1 水平搖pan誰在看誰比鏡頭本身更重要pan是攝影機(jī)固定在某個(gè)支點(diǎn)上鏡頭水平方向旋轉(zhuǎn)掃過場(chǎng)景。它和移鏡頭的本質(zhì)區(qū)別只有一條攝影機(jī)位置不動(dòng)只有鏡頭朝向在變。但AI模型經(jīng)常把pan理解成鏡頭往右走于是畫面里物體確實(shí)劃過了但機(jī)位也跟著橫移了出來一個(gè)不倫不類的搖移混合體。我寫pan鏡頭時(shí)一定會(huì)加上固定機(jī)位的說明camera pans from left to right across the room, stationary position, lens rotating horizontallystationary position是防呆設(shè)計(jì)。我早期在幾個(gè)平臺(tái)上寫pan經(jīng)常出現(xiàn)機(jī)位漂移畫面一邊掃一邊歪后來加上這組詞才穩(wěn)定下來。你要理解模型的邏輯pan這個(gè)token激活的是水平轉(zhuǎn)動(dòng)的概念但它不一定知道轉(zhuǎn)動(dòng)的軸心是固定的所以你必須在提示詞里替它排除掉移動(dòng)這個(gè)選項(xiàng)。4.2 垂直搖tilt從下到上、自上而下各有情緒tilt是鏡頭垂直旋轉(zhuǎn)從下往上叫tilt up從上往下叫tilt down。這兩種方向在敘事情緒上差異很大。tilt up有天然的揭示氣場(chǎng)作用很多角色登場(chǎng)鏡頭都用它先拍到靴子再搖上來拍到臉氣場(chǎng)是逐漸確立起來的。camera tilts up from the cowboys boots to his face, revealing his expression slowlytilt down則相反先給環(huán)境再落回到人身上常見于從上而下的審視感camera tilts down from the chandelier to a woman dancing alone in the ballroom用tilt的時(shí)候有個(gè)高頻翻車點(diǎn)camera moves up和camera tilts up在模型眼里不是一回事。moves up會(huì)被理解成整個(gè)攝影機(jī)往上升類似無人機(jī)升高tilts up才是鏡頭朝上旋轉(zhuǎn)。所以務(wù)必用tilts不要用moves。4.3 搖鏡頭的節(jié)奏控制pan和tilt最適合描述視線掃描因?yàn)樗举|(zhì)上就像一個(gè)人站在原地轉(zhuǎn)頭看東西。所以寫搖鏡頭時(shí)我建議順帶把視角的主體性也寫進(jìn)去讓掃描有個(gè)動(dòng)機(jī)快panquick pan常用于快速轉(zhuǎn)場(chǎng)、動(dòng)作片切換節(jié)奏緊張慢panslow pan用于空間建立、懸疑氛圍掃描觀眾會(huì)跟著鏡頭一起搜索畫面里的信息慢掃寫法示例slow panning across an empty corridor, as if someone is looking for something, dust particles floating in the air, eerie quietness注意as if someone is looking for something——這句是在給pan鏡頭提供動(dòng)機(jī)。有了動(dòng)機(jī)模型的運(yùn)動(dòng)節(jié)奏會(huì)綁定到視線搜索這個(gè)語義上出來的畫面更像一個(gè)活人在觀察環(huán)境而不是一個(gè)廣角全景錄像機(jī)在勻速轉(zhuǎn)動(dòng)。5. 移鏡頭提示詞橫向滑動(dòng)才是跟拍感的來源5.1 三個(gè)英文詞模型理解度完全不一樣移鏡頭在英文里有好幾個(gè)詞但它們的意思差得挺遠(yuǎn)模型的理解度也不一樣tracking shot泛指跟隨主體的移動(dòng)鏡頭范圍很寬??赡芨宋镒咭部赡苎剀壍阑衪ruck / lateral move專指攝影機(jī)橫向平移不跟隨主體朝向dolly沿軌道前后移動(dòng)和推拉相關(guān)crane / boom垂直升降移動(dòng)對(duì)于移的橫移效果我最常用的是lateral tracking shot或camera moves laterally to the right/left。這兩個(gè)詞在訓(xùn)練數(shù)據(jù)里出現(xiàn)頻率高響應(yīng)穩(wěn)定。單純寫tracking shot模型經(jīng)常理解成跟拍——鏡頭鎖著人物走而不是我要的平行滑動(dòng)。5.2 平行滑行要有動(dòng)機(jī)不然就是無人機(jī)側(cè)飛橫向移鏡頭最常見的翻車效果是無人機(jī)側(cè)飛感畫面確實(shí)在移動(dòng)但觀眾感覺不到任何敘事意圖就像純粹在展示場(chǎng)景。要解決這個(gè)問題最好在提示詞里給移鏡頭一個(gè)內(nèi)容上的理由比如跟隨某人走過街道沿著桌面上的餐具滑行。跟隨人物橫移的寫法camera moves laterally alongside the man walking down the street, maintaining a fixed distance, storefronts passing in the foreground, shallow depth of field這里的maintaining a fixed distance是整個(gè)句子的靈魂。它告訴模型鏡頭和人物之間的相對(duì)位置保持不變出來的跟拍才穩(wěn)不會(huì)出現(xiàn)人物越走越遠(yuǎn)或鏡頭越拉越遠(yuǎn)的問題。展示空間序列的寫法lateral tracking shot moving right, revealing a series of paintings hanging on the gallery wall, each frame passing smoothly這種寫法適合拍環(huán)境、拍陳列、拍一排建筑。它的運(yùn)動(dòng)目的不是跟著誰而是瀏覽。模型會(huì)理解成移動(dòng)鏡頭去發(fā)現(xiàn)空間里前后出現(xiàn)的物品出來的畫面有層次感。5.3 組合運(yùn)鏡與一鏡到底的寫法單個(gè)運(yùn)鏡寫熟練之后你會(huì)發(fā)現(xiàn)真正有電影感的是組合運(yùn)鏡。AI視頻里最常用、成功率也相對(duì)較高的組合是先移后推或搖推。示例camera starts with a slow lateral move to the right, then gradually pushes in toward the subject as she turns around, fluid one-take style, continuous motion組合運(yùn)鏡有一個(gè)核心規(guī)則每個(gè)運(yùn)鏡必須用逗號(hào)或順序詞分隔明確先后關(guān)系。我推薦thenafterbefore這些詞直接把順序?qū)懰?。同時(shí)一定帶上continuous motion或seamless one-take來提示模型不要硬切。我早前寫過一組三運(yùn)鏡組合的提示詞就是因?yàn)闆]用順序詞模型直接給我切了三段畫面出來像三個(gè)鏡頭硬拼在一起完全沒有一鏡到底的流暢感。再分享一個(gè)經(jīng)驗(yàn)組合運(yùn)鏡適合長(zhǎng)時(shí)長(zhǎng)的視頻。5秒以內(nèi)的短視頻模型沒有足夠的幀數(shù)完成兩次運(yùn)鏡變化結(jié)果往往只執(zhí)行了前半段提示詞后半段被直接吞掉。所以你的目標(biāo)如果是一鏡到底的組合鏡頭建議把生成時(shí)長(zhǎng)調(diào)長(zhǎng)10秒以上然后把運(yùn)鏡節(jié)奏放慢給模型充足的幀數(shù)去展開。6. 運(yùn)鏡提示詞的參數(shù)化控制時(shí)長(zhǎng)、速度、起幅落幅6.1 時(shí)長(zhǎng)和速度怎么量化AI視頻模型一般沒有直接的運(yùn)鏡速度參數(shù)但可以通過兩三類技巧間接控制。第一是時(shí)間副詞。推薦over 5 secondsgraduallyin one continuous take這類詞。gradually是我在所有模型上測(cè)試過響應(yīng)最穩(wěn)定的速度詞因?yàn)樗枋隽藵u進(jìn)的時(shí)間分布而suddenly這類突變的詞容易觸發(fā)畫面跳變慎用。第二是用幀數(shù)來間接控制速度。如果你生成的是8秒視頻想做一個(gè)完整推鏡頭可以寫camera slowly pushes in over the entire duration如果想讓推鏡頭在4秒內(nèi)完成其余時(shí)間畫面靜住就在提示詞里寫明push in finishes within the first 4 seconds, then hold still。第三是首尾幀配合文字?,F(xiàn)在不少視頻工具支持首幀圖和尾幀圖輸入把起始畫面和結(jié)束畫面作為硬的約束運(yùn)鏡提示詞只作為補(bǔ)充說明。這種方式能極大提升運(yùn)鏡可控性。比如首幀是人物全景尾幀是面部特寫提示詞寫camera push in出來的推鏡頭就非常穩(wěn)定——因?yàn)槟P陀辛嗣鞔_的起點(diǎn)和終點(diǎn)錨點(diǎn)中間過程哪怕有一些偏差也不會(huì)影響整體構(gòu)圖。6.2 起幅落幅讓鏡頭有頭有尾寫商業(yè)短片時(shí)我?guī)缀趺總€(gè)鏡頭都會(huì)在提示詞里說明起幅和落幅也就是鏡頭從哪里開始、到哪里結(jié)束。start with a wide establishing shot of the city skyline at dusk, end with a close-up of a lit window in the middle building, camera pushes in steadily這個(gè)寫法比只寫推鏡頭高明的地方在于你同時(shí)給出了景別起點(diǎn)、景別終點(diǎn)和運(yùn)動(dòng)方式三個(gè)維度的信息。模型既能確定從哪里開始也能確定到哪里結(jié)束中間過程就算自由發(fā)揮也不會(huì)跑出這個(gè)范圍。反過來只寫推鏡頭不給起幅落幅模型經(jīng)常在最后一幀把主體推到畫面邊緣之外構(gòu)圖全是歪的。6.3 負(fù)面提示詞保護(hù)運(yùn)鏡不被破壞很多AI視頻平臺(tái)現(xiàn)在都支持negative prompt負(fù)面提示詞。和運(yùn)鏡相關(guān)的我建議固定加這幾個(gè)warped, distorted防止物體形變sudden cut, jumpy motion防止鏡頭亂切static frame, no camera movement防止模型放棄運(yùn)鏡excessive zoom防止平臺(tái)默認(rèn)加變焦改變構(gòu)圖但這里有個(gè)反直覺的經(jīng)驗(yàn)負(fù)面提示詞不一定能阻止運(yùn)鏡翻車。因?yàn)檫\(yùn)鏡錯(cuò)誤往往源于模型對(duì)正向指令的誤解而不是它沒理解負(fù)面詞。比如模型把push in理解成畫面放大你在負(fù)面詞里寫no zoom幾乎沒用因?yàn)槟P驼J(rèn)為自己在執(zhí)行推進(jìn)任務(wù)并不認(rèn)為自己做了zoom。所以負(fù)面詞只能兜底核心還是把正向運(yùn)鏡指令寫精確。7. 實(shí)測(cè)踩坑記錄AI運(yùn)鏡提示詞的四個(gè)高頻翻車點(diǎn)7.1 翻車點(diǎn)一模型把zoom in當(dāng)成畫面硬裁切最典型的情況畫面內(nèi)容是一幅質(zhì)感很強(qiáng)的圖然后鏡頭推進(jìn)但畫面沒有視差、邊緣構(gòu)圖也沒有連續(xù)變化就像手機(jī)相冊(cè)在放大一張照片。原因我在文章開頭講過模型對(duì)zoom相關(guān)token的聯(lián)想主要是畫面比例變化而推鏡頭帶來的透視變化需要額外的背景描述才能觸發(fā)。解決方案就是正向提示詞里把perspective shiftbackground parallax這類詞寫進(jìn)去讓模型明確知道你在要求空間位移而不是單純的裁切。7.2 翻車點(diǎn)二對(duì)象動(dòng)了鏡頭沒動(dòng)常見的場(chǎng)景你想拍鏡頭橫移人物站在原地結(jié)果人物自己在畫面里走了幾步鏡頭紋絲不動(dòng)。模型把運(yùn)動(dòng)優(yōu)先級(jí)分配給了畫面主體完全忽略了運(yùn)鏡指令。根本原因是模型在訓(xùn)練時(shí)學(xué)到的原則是文本里的動(dòng)作優(yōu)先由主體來執(zhí)行——這也是它處理人跑、馬跑、風(fēng)吹樹葉這些指令的方式。要壓過這個(gè)慣性你得明說誰不動(dòng)、誰動(dòng)the man stands still, the camera moves laterally to the left, passing in front of him先錨定主體的靜止?fàn)顟B(tài)再說明鏡頭的運(yùn)動(dòng)模型就知道這兩個(gè)動(dòng)作不是一回事優(yōu)先級(jí)自然就分清了。這跟現(xiàn)場(chǎng)執(zhí)導(dǎo)其實(shí)是一個(gè)道理——每個(gè)人都有自己的活誰動(dòng)誰不動(dòng)你得先說清楚。7.3 翻車點(diǎn)三多個(gè)運(yùn)鏡詞互相打架見過不少朋友的提示詞里堆了一堆運(yùn)鏡詞push in, pan left, tilt up, tracking shot。這樣寫模型根本不知道該先執(zhí)行哪個(gè)最后要么挑一個(gè)順眼的執(zhí)行要么生成一個(gè)四不像的運(yùn)動(dòng)軌跡。我自己測(cè)試下來單鏡頭單向度里一個(gè)到兩個(gè)運(yùn)鏡詞已經(jīng)足夠。真正需要多運(yùn)鏡的時(shí)候用thenafter這樣的順序詞串起來并且限定one continuous take。組合運(yùn)鏡的寫法我在第5章講過核心就是主運(yùn)鏡一個(gè)詞輔以景別和速度描述多段運(yùn)鏡一定拆成start with... then...的結(jié)構(gòu)給模型一個(gè)清晰的執(zhí)行路徑。7.4 翻車點(diǎn)四同一段提示詞不同平臺(tái)效果完全不同這算不上翻車更多是認(rèn)知陷阱。各模型的訓(xùn)練數(shù)據(jù)和文本編碼器不同對(duì)運(yùn)鏡詞的理解自然有差異。有的平臺(tái)對(duì)中文運(yùn)鏡詞理解很好比如推近拉遠(yuǎn)有的平臺(tái)只認(rèn)英文術(shù)語有的平臺(tái)擅長(zhǎng)電影感鏡頭語言有的平臺(tái)則對(duì)長(zhǎng)句理解力偏弱。我做過一個(gè)小范圍的對(duì)比測(cè)試結(jié)論大致如下平臺(tái)類型越好用的運(yùn)鏡詞容易翻車的寫法偏英文生態(tài)的平臺(tái)dolly in / pull back / tilt up中文長(zhǎng)句運(yùn)鏡中文支持好的平臺(tái)鏡頭緩慢推近 / 鏡頭橫移純英文快速pan偏電影感調(diào)校的平臺(tái)tracking shot / one-take堆疊多個(gè)運(yùn)鏡詞偏寫實(shí)的平臺(tái)lateral move / steady push in抽象、情緒化的運(yùn)鏡描述所以換一個(gè)平臺(tái)不要直接復(fù)用舊的運(yùn)鏡提示詞?;◣追昼娔脙扇齻€(gè)測(cè)試鏡頭去試看看它對(duì)推拉搖移哪個(gè)響應(yīng)最穩(wěn)再?zèng)Q定鏡頭腳本怎么寫。這也是我每次換平臺(tái)必做的前置測(cè)試。最后一個(gè)我自己的經(jīng)驗(yàn)如果你拍的是偏敘事的AI短片運(yùn)鏡詞不需要多高級(jí)但一定要貼合情緒。推不一定比移好搖也不一定比拉弱關(guān)鍵是鏡頭語言要為你的故事服務(wù)。寫提示詞時(shí)多問自己一句這個(gè)鏡頭動(dòng)起來之后觀眾的注意力會(huì)被引向哪里想明白了這一點(diǎn)AI視頻運(yùn)鏡提示詞的水平才算是真正上了一個(gè)臺(tái)階。