AI 視覺大片風格 prompt 提示詞與鏡頭語言解析

concept%20visualization%20for%20AI%20%E8%A6%96%E8%...
發表時間:2026 年 09 月 20 日 | 更新日期:2026 年 09 月 20 日 | 編輯:雅寶社區編輯團隊
AI 視覺大片風格 prompt 提示詞與鏡頭語言解析 - 雅寶社區 · 頂客論壇

三層寫滿,畫面就完整了。只寫第一層,你得到插圖;寫到第二層,你得到攝影作品;三層齊備,你才得到所謂的「視覺大片」。

二、鏡頭語言核心詞彙庫:焦段、景別、機位、運鏡、構圖

接下來這一段是全文的重點。以下所有詞彙都是可以直接丟進提示詞的英文關鍵字,我會同時說明它的視覺效果與適用場景。建議你把這一節當成工具書,寫提示詞時反覆回來查。

2-1 焦段與透視:24mm 的張力 vs 85mm 的溫柔

焦段(Focal Length)是影響畫面「氣質」最劇烈的參數之一,因為它同時改變了透視關係與景深表現。

  • 14mm–24mm(超廣角):強烈的空間拉伸、邊緣變形、縱深感極強。適合拍壯闊風景、狹窄空間的壓迫感、建築的線條張力、或是刻意的心理扭曲。提示詞可寫:ultra wide angle, 16mm lens, exaggerated perspective, deep depth of field
  • 35mm(人文廣角):最接近人眼自然視野的電影焦段,帶有一點環境敘事感。適合街拍、紀實感場景、人物與環境並重的畫面。提示詞:35mm lens, documentary style, environmental portrait
  • 50mm(標準):中性、不失真、透視自然,是「看起來最像真實所見」的焦段。適合日常敘事、對話場景。
  • 85mm–135mm(中長焦人像):壓縮背景、強化主體分離,散景柔美。這是時尚與人像大片的標準配置。提示詞:85mm portrait lens, creamy bokeh, compressed background, subject isolation
  • 200mm 以上(長焦):極度壓縮空間,讓遠景與主體貼合,適合運動攝影、野生動物、或是營造「被凝視」的疏離感。
  • 微距(Macro):極近距離的細節放大,常見於質感特寫。提示詞:macro photography, extreme close-up, 100mm macro lens
  • 這裡有個實用技巧:焦段與景深要一起寫。只寫「85mm」AI 可能給你一張普通背景;寫「85mm lens, f/1.4, shallow depth of field, background blur」它才會把背景徹底化開。

    2-2 景別七階:情緒節奏的遙控器

    景別(Shot Size)決定觀眾與主體的距離感,進而決定情緒的親密程度。這套術語來自電影分鏡,AI 對它們的理解相當準確。

  • Extreme Wide Shot(大遠景):人物極小,環境壓倒性巨大。用於建立世界觀、傳達渺小與孤獨。extreme wide shot, tiny figure in vast landscape
  • Wide Shot(遠景/全景):人物全身入鏡,交代人物與空間的關係。full body shot, wide shot, environmental context
  • Medium Shot(中景):腰部以上,最接近日常對話的視角,訊息量與情緒兼具。medium shot, waist up
  • Medium Close-Up(中近景):胸口以上,開始強調表情。medium close-up, chest up
  • Close-Up(特寫):臉部填滿畫面,情緒濃度最高。close-up shot, face fills frameClose-up 建議搭配 85mm135mm
  • Extreme Close-Up(大特寫):只拍眼睛、嘴唇或單一細節,用於強烈衝擊。extreme close-up, eyes only, macro detail
  • Insert Shot(插入鏡頭):物件特寫,如手錶、信件、道具。insert shot, detail shot of hands
  • 高手用法是「混搭」:extreme wide shot with a tiny subject, shot on 200mm telephoto 這種矛盾組合,往往能生出極具電影感的孤獨畫面。

    2-3 機位與角度:仰角、俯角、荷蘭角的心理暗示

    機位(Camera Angle)是最容易被忽略、卻最影響「權力關係」的參數。

  • Low Angle(仰角):攝影機低於主體向上拍,主體顯得巨大、強勢、英雄化。low angle shot, looking up, heroic
  • High Angle(俯角):由上往下拍,主體顯得渺小、脆弱、被壓制。high angle shot, looking down, vulnerable
  • Bird's Eye View(鳥瞰):近乎垂直俯視,常用於圖形化構圖或宿命感。bird's eye view, top down
  • Worm's Eye View(蟲眼):極端仰角,誇張化主體。worm's eye view, extreme low angle
  • Dutch Angle(荷蘭角/傾斜鏡頭):畫面刻意傾斜,製造不安、混亂、心理失衡。dutch angle, tilted camera, unsettling
  • Eye Level(平視):中性、客觀、親近。eye level shot, neutral angle
  • Over-the-Shoulder(過肩):帶有前景遮擋,強化窺視與對話感。over-the-shoulder shot, foreground silhouette
  • 如果你要拍一個反派,用 low angle 加 24mm 加側逆光,幾乎不可能失敗。如果你要拍一個被命運壓垮的角色,high angle 加 35mm 加陰天散射光,氣氛立刻到位。

    2-4 運鏡動態:推、拉、搖、移、跟、升降

    靜態圖像要怎麼表現「運鏡」?答案是透過畫面的動態暗示。而在影片生成模型(如 Sora、Runway、Kling、Veo)中,運鏡詞彙則是直接影響輸出的核心指令。

  • Dolly In / Push In(推近):強調、聚焦、情緒升溫。slow dolly in, push in on subject
  • Dolly Out / Pull Back(拉遠):抽離、揭示、孤獨感。slow pull back, revealing the environment
  • Pan(水平搖):掃視環境。slow pan left to right
  • Tilt(垂直搖):由下而上揭示主體。tilt up revealing the figure
  • Tracking Shot(跟拍):跟隨主體移動。tracking shot following the subject
  • Crane / Boom(升降):大規模垂直運動,用於開場或結尾。crane shot rising above the city
  • Handheld(手持):晃動、紀實、臨場。handheld camera, slight shake, documentary feel
  • Steadicam(穩定器):流暢滑順的移動。smooth steadicam movement
  • 在影片生成裡,把運鏡寫進提示詞的效果非常直接。例如「slow dolly in on a lone samurai standing in the rain, 35mm, cinematic」,出來的動態幾乎就是你要的那種緩慢逼近的壓迫感。

    2-5 構圖法則:讓畫面「看起來很貴」的隱形結構

    構圖是專業與業餘最明顯的分水嶺。以下這些詞,AI 都能理解並執行:

  • Rule of Thirds(三分法):主體置於三分線交點。rule of thirds composition
  • Leading Lines(引導線):用線條把視線引向主體。leading lines, converging perspective
  • Symmetry(對稱):強迫症式的秩序感,常用於建築與權威題材。symmetrical composition, centered
  • Negative Space(留白):大量空白營造疏離與高級感。minimalist composition, large negative space
  • Framing(框景):用門框、樹枝、窗戶框住主體。framed composition, natural framing
  • Foreground / Midground / Background(前中後景):創造層次。layered composition with foreground elements
  • 記住一句話:留白是奢華的語言。當你寫下 lots of negative space,畫面立刻從「資訊爆炸」變成「設計感」。

    三、光影、色彩與材質:高級感的真正來源

    如果說鏡頭語言決定了畫面的骨架,那光影與色彩就是它的皮膚與血液。這一節會說明如何用提示詞精準控制這兩個維度。

    3-1 光線方向與類型:從倫勃朗光到輪廓光

    光線的方向決定了立體感,光的質地決定了情緒。

  • Front Light(順光):平光、少陰影、資訊清楚但無聊。flat frontal lighting
  • Side Light(側光):強化立體與質感。side lighting, dramatic shadows
  • Rembrandt Lighting(倫勃朗光):頰部出現倒三角光斑,經典肖像光。Rembrandt lighting
  • Backlight / Rim Light(逆光/輪廓光):主體邊緣發光,極度電影感。backlit, rim light on hair, glowing edges
  • Golden Hour(黃金時刻):日出日落前後的暖調柔光。golden hour, warm sunlight
  • Blue Hour(藍調時刻):日出前後的冷藍色。blue hour, twilight
  • Chiaroscuro(明暗對照):強烈明暗對比,戲劇張力極高。chiaroscuro, high contrast lighting
  • Soft Diffused Light(柔光):陰天或柔光箱,皮膚質感最佳。soft diffused light, overcast
  • Practical Light(實用光源):畫面內可見的燈具,如霓虹、檯燈。practical lights, neon glow, lamp light source
  • 要拍「大片」,最有效的組合通常是:逆光加輪廓光,再加一點環境散射光。提示詞寫成 backlit subject with strong rim light, soft ambient fill,效果立刻跳級。

    3-2 色彩分級與膠片模擬:LUT、Teal & Orange、Kodak 味

    色彩分級(Color Grading)是把「照片」變成「電影」的最後一哩路。

  • Teal and Orange(青橙對比):好萊塢動作片標準色調,膚色暖、背景冷。teal and orange color grading
  • Desaturated(低飽和):冷靜、嚴肅、寫實。desaturated color palette, muted tones
  • High Saturation(高飽和):夢幻、卡通、超現實。vivid saturated colors
  • Monochrome(單色):純粹、經典、強調形式。black and white, monochrome
  • Kodak Portra 400:柔和膚色、溫暖細膩的膠片感。

    Cinestill 800T:夜景霓虹、冷色調、帶光暈的膠片感。

    Fujifilm Superia:日系清透、青綠調。

    Bleach Bypass(漂白):高對比低飽和,戰爭片質感。

    實務上,直接寫膠片型號往往比寫「film look」更有效,因為模型學過這些型號對應的具體色彩分佈。例如 shot on Kodak Portra 400, medium format film grain,出來的質感通常比泛泛的「analog」好上不少。

    3-3 大氣與粒子:讓畫面「有呼吸」的細節

    這是很多人的盲區。畫面的「氛圍」往往來自那些不經意的小東西。

  • Volumetric Light / God Rays(體積光/耶穌光):光穿透霧氣形成光束。volumetric lighting, god rays, light shafts
  • Atmospheric Fog(大氣霧):拉開空間層次,降低背景對比。atmospheric haze, mist, fog
  • Dust Particles(塵埃粒子):讓光線「看得見」的功臣。floating dust particles in light beam
  • Rain / Wet Surfaces(雨與濕地):反射與光斑的製造機。rain, wet asphalt, reflections
  • Snow / Smoke / Sparks(雪、煙、火花):動態元素。smoke, embers, falling snow
  • Film Grain(膠片顆粒):去除數位感。35mm film grain, subtle noise
  • Chromatic Aberration(色差):鏡頭缺陷美,增加真實感。subtle chromatic aberration, lens flare
  • volumetric lightingatmospheric haze 加進任何提示詞,畫面的「電影感」幾乎是立刻提升一個檔次。這是投報率最高的一組關鍵詞。

    四、Prompt 實戰框架:從一句話到一部大片

    理論講完了,接下來是可直接複製的實戰方法。

    4-1 七段式萬用公式

    我建議所有提示詞都按照這個順序組裝,因為多數模型對前段的權重較高:

    1. 主體與動作(Subject + Action)

    1. 服裝與細節(Wardrobe + Details)
    2. 環境與時間(Environment + Time of Day)
    3. 鏡頭與構圖(Camera + Lens + Shot Size + Composition)
    4. 光線(Lighting Direction + Quality)
    5. 風格與調色(Style + Color Grading + Film Stock)
    6. 技術參數(Resolution + Aspect Ratio + Platform Flags)

    舉個例子,把「一個女孩站在雨中」擴寫成:

    a young woman standing alone in heavy rain, soaked hair clinging to her face,

    wearing a dark trench coat, empty neon-lit street in Tokyo at night,

    low angle shot, 35mm lens, medium shot, rule of thirds composition,

    backlit by neon signs with strong rim light, wet reflections on asphalt,

    cinematic color grading, teal and orange palette, shot on Cinestill 800T,

    volumetric light, atmospheric fog, film grain, 8k, 21:9 aspect ratio

    同樣的主體,兩者的差距不是一點半點。前者是素材,後者是電影。

    4-2 權重、否定提示詞與語法細節

    不同平台語法各異,但通用邏輯如下:

  • 權重強化:Midjourney 用 ::,例如 cinematic lighting::2;Stable Diffusion 用 (keyword:1.4)。適度使用即可,過度加權會讓畫面崩壞。
  • 否定提示詞:Stable Diffusion 支援 Negative Prompt,把 blurry, low quality, extra fingers, watermark, text 放進去能顯著提升成品率。
  • 順序即權重:多數模型對開頭詞彙反應更強烈。把最重要的元素放最前面。

  • 避免矛盾:寫 wide shot 又寫 extreme close-up,模型會混亂。每個維度只選一個主指令。
  • 長度控制:Midjourney 建議 40 到 80 字為宜;Stable Diffusion 可以更長,但超過一定長度後,後段詞彙的影響力會急遽衰減。
  • 4-3 三組完整範例拆解

    範例一:時尚人像大片

    editorial fashion portrait of a woman with sharp cheekbones,

    wearing an oversized beige wool coat, standing against a concrete wall,

    medium close-up, 85mm lens, f/1.4, shallow depth of field, centered composition,

    soft diffused window light from the left, subtle Rembrandt shadow,

    muted earth tone palette, shot on Kodak Portra 400, medium format,

    minimalist, high fashion magazine aesthetic, 4:5 aspect ratio

    拆解:主體清楚、服裝具體、背景極簡、85mm 加 f/1.4 製造奶油散景、柔光加倫勃朗光塑造立體、Portra 400 給出高級膚色。關鍵是「減法」——背景只有一面牆。

    範例二:史詩風景

    a lone hiker standing on a cliff edge overlooking an endless mountain range,

    extreme wide shot, tiny human figure for scale,

    16mm ultra wide angle, deep depth of field, leading lines from the ridge,

    golden hour backlight, sun flare, volumetric god rays through valley mist,

    epic scale, atmospheric haze creating depth layers,

    cinematic color grading, warm highlights and cool shadows,

    shot on Hasselblad, ultra detailed, 21:9 cinematic aspect ratio

    拆解:extreme wide shottiny human figure 立刻建立渺小感;16mm 撐開空間;god rayshaze 製造層次;暖高光冷陰影是好萊塢風景片標準配置。

    範例三:科幻電影感

    a cyberpunk samurai walking through a flooded alley,

    reflective wet ground, holographic advertisements flickering,

    low angle tracking shot, 24mm lens, medium shot, dutch angle slightly tilted,

    neon practical lights in magenta and cyan, strong rim light on armor,

    atmospheric fog, steam rising from vents, rain,

    Blade Runner aesthetic, teal and magenta color grading,

    shot on ARRI Alexa, anamorphic lens flare, film grain, 2.39:1

    拆解:dutch angle 製造不安;24mmlow angle 強化壓迫;霓虹實用光源加輪廓光是賽博龐克標配;anamorphic lens flare 是關鍵字,能觸發橫向藍色光暈,那個「電影感」立刻出來。

    五、常見錯誤與排查清單

    即使公式都對,成品還是可能不如預期。以下是五個最常見的翻車原因與對應解法。

    5-1 畫面「很平」:缺少光線方向與景深

    症狀是畫面清楚但沒有層次。解法是補上三樣東西:directional lighting(有方向的光)、shallow depth of field(淺景深)、foreground elements(前景元素)。這三者只要補兩樣,立體感就會回來。

    5-2 主體「不像大片」:缺少風格錨點

    如果畫面乾淨但廉價,通常是因為缺少風格參照。加上導演名、攝影師名、膠片型號或電影名稱作為風格錨點,例如 in the style of Roger DeakinsWes Anderson symmetryDenis Villeneuve atmosphere。注意:部分平台對人名有版權限制,可改用「風格描述」替代,例如 symmetrical pastel composition

    5-3 手部、文字、結構崩壞

    這是模型本身的限制。實務解法有三:把主體放小一點(降低手部權重)、避免讓畫面出現文字、或是用圖生圖(img2img)與 ControlNet 這類構圖控制工具補強。純文字提示詞很難根治這個問題。

    5-4 風格不一致:系列作品無法統一

    如果你要產出一組風格一致的圖,關鍵是固定「攝影層」與「質感層」,只變動「敘事層」。把鏡頭、光線、調色、膠片這幾段文字複製成模板,每次只換主體與場景。這樣出來的系列作才會有同一部片的感覺。

    5-5 提示詞越寫越長,效果反而變差

    這是很常見的陷阱。詞彙堆疊過多時,模型會開始「平均化」所有指令,導致每個元素都只實現一點點。解法是做減法:每個維度只留一個最強的關鍵詞,把總長度壓在合理範圍。寧可少而精準,不要多而模糊。

    六、平台差異:不同工具的提示詞策略

    同樣的鏡頭語言,在不同平台上要換個方式說。

  • Midjourney:偏好自然語言敘述句,對鏡頭與光線詞彙反應極佳,內建美學傾向強。適合快速產出高質感視覺。--ar--stylize--chaos 等參數是它的特色。
  • Stable Diffusion / Flux:偏好逗號分隔的關鍵詞堆疊,可控性最高,需要搭配 Negative Prompt 與 LoRA 才能發揮全力。適合需要精準控制與量產的工作流。
  • Sora / Runway / Kling / Veo(影片生成):鏡頭語言中的「運鏡」詞彙在這裡才真正生效。提示詞建議以「鏡頭運動 + 主體動作 + 環境變化」為核心順序撰寫,並在時間軸上描述動作的起承轉合。
  • 一句話總結:圖像模型吃「構圖與光線」,影片模型吃「運動與時間」。寫影片提示詞時,把 the camera slowly dollies in as... 這種句式放進句子裡,效果通常比純關鍵詞好。

    七、結語:建立你自己的視覺詞彙庫

    看完這一長篇,你可能會覺得要記的東西太多了。但其實真正有效的方法只有一個:建立你自己的提示詞模板庫。

    做法很簡單。每次你看到喜歡的電影畫面、攝影作品或廣告,停下來問自己三個問題:這是什麼鏡頭?光從哪裡來?色調是什麼走向?把答案記錄下來,累積成一份屬於你的詞彙表。三個月後,你會發現自己寫提示詞的速度與命中率都完全不同了。

    AI 工具會不斷迭代,模型會一直更新,但鏡頭語言這套邏輯不會過時。它是一百年來電影工業累積的視覺語法,AI 只是學會了它。當你掌握了這套語法,你就不再是「請 AI 幫你畫圖的人」,而是「用 AI 執行你腦中分鏡的導演」。

    差別,就在這裡。

    本文為「雅寶社區 · 頂客論壇」🎵 影音創作分類原創內容,歡迎轉載並註明出處。若你對特定平台的提示詞語法、或是某種類型的畫面風格有興趣,歡迎在討論區開帖交流,我們會持續產出更多實戰拆解。

    🏠 返回首頁