AI短影音腳本寫作指南:從黃金3秒標題到分鏡設計

concept%20visualization%20for%20AI%E7%9F%AD%E5%BD%...
發表時間:2026 年 09 月 20 日 | 更新日期:2026 年 09 月 20 日 | 編輯:雅寶社區編輯團隊
AI短影音腳本寫作指南:從黃金3秒標題到分鏡設計 - 雅寶社區 · 頂客論壇

我觀察到兩種極端。一種是完全不用 AI,覺得它寫出來的東西「沒有靈魂」;另一種是全交給 AI,貼一句「幫我寫一支爆紅的短影音腳本」,然後納悶為什麼成品很空洞。

比較好的用法是:你負責策略與觀點,AI 負責數量與結構。

具體來說,AI 最擅長三件事:

一次生成大量變體(例如同一支影片的 20 種開場)

把模糊的想法結構化(例如把你口述的內容整理成三幕劇)

補足你沒想到的細節(例如分鏡中的鏡位建議、音效提示)

而人最該負責的是:決定對誰說話、決定要留下什麼觀點、決定哪一句話聽起來像你。這三件事一旦外包出去,影片就會變成「誰都能拍的影片」,那在演算法的世界裡幾乎等於不存在。

二、黃金 3 秒:滑過與停留的分水嶺

如果你只能優化影片的一個地方,請選前 3 秒。平台數據後台會看「三秒留存率」,這個數字低了,後面拍得多好都傳不出去。

黃金 3 秒不是指「很精彩的 3 秒」,而是「讓人不確定接下來會發生什麼的 3 秒」。它的設計必須同時處理三件事:畫面、聲音、文字鉤子。

開場鉤子的七種高勝率公式

以下是我整理、實測後比較穩定的七種開場類型,你可以直接套用句型再改成自己的語氣:

1. 反直覺宣告型:「你越努力發片,帳號越不會起來。」——直接推翻觀眾的既有認知。風險是必須在後段給出合理解釋,不然會變成標題殺人。

2. 具體數字型:「我測了 47 種開場,只有這 3 種讓我破萬。」——數字帶來可信度與好奇心,但數字必須是真的,觀眾嗅覺很靈。

3. 痛點直擊型:「拍了三個月都沒人看?問題不在器材。」——直接點名一群人的困境,讓他自己對號入座。

4. 懸念中斷型:「這是我最後一次教你這件事。」——用敘事張力製造停留,適合有故事線的內容。

5. 視覺反差型:畫面先給結果(例如一桌混亂的成品),再用一句話說明原因。

6. 身分標籤型:「如果你是小團隊做行銷的,這支一定要看完。」——用身分篩選觀眾,雖然流量池變窄,但完播與互動通常更高。

7. 時間壓縮型:「60 秒講完我花兩年才搞懂的腳本結構。」——承諾高密度的資訊回報。

選擇時有一個判斷原則:你的選題是「解決問題」還是「製造好奇」?前者用痛點直擊與數字型,後者用懸念與反差型。用錯搭配,鉤子再強也留不住人。

標題、封面、第一句話的三角協同

很多人把標題和開場當成兩件事寫,結果第一句話把標題講完了,觀眾覺得「沒了」就滑走。正確的做法是讓三者形成接力:

標題(或字幕卡)負責給出「這是什麼」,讓人決定要不要點。

封面畫面負責給出「視覺承諾」,例如成品照、對比圖、人物表情。

  • 第一句話負責給出「為什麼現在要看」,也就是把標題的懸念往前推一步,而不是重複它。
  • 舉例:標題是「AI 寫腳本的 3 個致命錯誤」,封面是三個紅色叉叉,第一句話就不要說「今天要講 AI 寫腳本的三個錯誤」,而要說「上一次我照 AI 寫的腳本拍完,播放數掉了八成——兇手是第二點。」這樣觀眾才知道留下來有額外資訊。

    用 AI 一次生成 20 組開場:提示詞實戰

    這是 AI 最有價值的環節之一。與其自己想破頭,不如讓它大量產出,你再挑。關鍵在於提示詞要包含「角色、受眾、觀點、限制、輸出格式」五個元素。

    可以參考這個模板:

    「你是一位專做短影音的腳本編劇。我的影片主題是『___』,目標觀眾是『___』,他們最大的痛點是『___』,我想傳達的核心觀點是『___』。請給我 20 組不同的影片開場,每組包含:① 前 3 秒的畫面上會出現什麼;② 第一句口播台詞;③ 這組開場用了什麼心理鉤子。每組不超過 30 字,語氣要口語、不要書面語、不要用『大家好』開頭。」

    拿到 20 組之後,不要直接選「最好聽的」,而要選「最貼近你觀眾痛點的」。接著把選中的三組再丟回 AI,請它各寫三個變體,你就可以得到九個微調版本,從中挑一個最有把握的開拍。

    三、腳本骨架:把 60 秒切成可執行的節奏

    短影音最常見的死法是「頭重腳輕」——開場講太久,精華在最後五秒。觀眾根本沒看到。所以寫腳本時,請直接用時間軸思考,而不是用段落思考。

    時間軸拆解:0–3s、3–10s、10–45s、45–60s

    0–3 秒|鉤子段。任務只有一個:阻止滑動。不要自我介紹、不要客套、不要說「今天要跟大家分享」。畫面要有動作或變化,靜態畫面等於邀請人離開。

    3–10 秒|承諾段。告訴觀眾「看完會得到什麼」。這一段通常會出現一句類似「三個重點,第三個最多人做錯」的句子,作用是給一個心理上的完成契約。人一旦被承諾,就比較不容易中途離開。

    10–45 秒|主體段。這是資訊或劇情的核心。節奏原則是「每 8 到 12 秒一個小轉折」,可以是提出反例、換個場景、丟出一個數據、切換鏡位。目的不是塞資訊,而是維持新鮮感。

    45–60 秒|收束與行動段。給出結論或情緒落點,再給一個低門檻的行動呼籲。注意:不要說「記得按讚訂閱分享」,那對多數觀眾沒有意義。比較有效的說法是給出「下一個動作」,例如「把你的腳本貼在留言,我幫你看第一句」。

    三幕劇的短影音變體:鉤子、鋪陳、爆點、行動

    傳統三幕劇是鋪陳、衝突、解決。短影音因為時間太短,通常會壓縮成四拍:鉤子 → 鋪陳 → 爆點 → 行動。其中「爆點」是最容易被忽略的一拍。

    爆點可以是一個反轉(原來問題不是你想的那樣)、一個視覺驚喜(成品前後對比)、或一個情緒高點(一句讓人想截圖的話)。沒有爆點的影片,觀眾看完會有一種「嗯,然後呢」的空虛感,那就不會被分享。

    寫腳本時,我習慣先用一句話寫下爆點是什麼,再回頭安排前三拍怎麼把它推上去。這種「從高點回推」的寫法,比線性往下寫更容易做出結構。

    三種腳本類型的寫法差異:口播、劇情、圖文

    口播型:重點在語速與斷句。寫稿時要刻意加入「呼吸點」,例如在關鍵句前加一個短停頓標記。句子盡量控制在 15 字以內,超過就容易唸得含糊。

    劇情型:重點在衝突的可視化。你不能只在台詞裡說「他很生氣」,必須設計一個動作(摔門、沉默三秒)讓情緒被看見。所以劇情腳本通常會有兩個欄位:台詞與動作。

    圖文型(螢幕錄製、資訊卡):重點在視覺節奏。每一頁停留時間不要超過兩秒半,並在切換點安排一個小標題或顏色變化,讓眼睛有「重新聚焦」的機會。

    四、分鏡設計:從文字到畫面的翻譯工程

    腳本寫完之後,最常出現的斷層是:文字很美,但拍不出來。分鏡表就是補上這個斷層的工具。它的價值不只是給攝影師看,更是逼你自己確認「這句話到底要用什麼畫面承載」。

    分鏡表必備的八個欄位

    一份實用的短影音分鏡表,通常包含以下欄位。你不一定要全部用,但至少前六項建議保留:

    鏡號:方便對照與補拍。

    時間碼:例如 0:00–0:03,讓剪輯有節奏依據。

  • 畫面描述:誰、在哪、做什麼。寫具體動作,不要寫「感覺很溫暖」這種無法執行的描述。
  • 景別與運鏡:遠景、中景、特寫;固定、推、拉、橫移、手持。

    台詞或字幕:口播內容與螢幕文字要分開標示,因為兩者節奏不同。

    音效或配樂提示:尤其在轉場與爆點處,聲音是最便宜的節奏工具。

    道具與場地需求:避免拍到一半才發現少東西。

    備註:例如「此鏡可用素材替代」或「需補拍」。

    鏡頭語言速查:景別、角度、運鏡、轉場

    不需要變成電影攝影師,但幾個基本選擇會直接影響觀眾的感受:

    景別:特寫拉近情緒、建立親密感;中景適合口播與對話;遠景交代環境與規模。短影音因為多在手機上觀看,特寫與中景的比例通常要偏高,遠景容易被忽略細節。

    角度:平視最自然;低角度讓人顯得有力量;高角度帶有觀察或弱勢感。同一支影片裡角度不要跳太多,否則會暈。

    運鏡:固定鏡頭最穩,適合資訊型內容;緩慢推進能製造專注;手持帶有真實感與臨場感,適合 vlog 與劇情。切記:短影音裡的運鏡是為了帶出情緒,不是為了炫技。

    轉場:硬切最乾淨;跳接可以壓縮時間;遮罩轉場(例如手擋鏡頭)有節奏感;匹配剪輯(相似形狀或動作銜接)最高級但需要設計。原則是——轉場要服務內容,不是填滿空白。

    用 AI 產出可拍分鏡的提示詞模板

    AI 可以幫你把腳本轉成分鏡草稿,但前提是你要給它足夠的限制,否則它會寫出「鏡頭緩緩升起,陽光灑落」這種拍不出來的東西。

    建議模板:

    「以下是我的短影音腳本(貼上全文)。請幫我轉成拍攝分鏡表,規格如下:① 總長 60 秒;② 欄位包含鏡號、時間碼、景別、運鏡、畫面描述、台詞、音效提示;③ 場景限制在一個室內房間、自然光、只有我一個人和一張桌子;④ 每顆鏡頭不超過 5 秒;⑤ 畫面描述要具體到我可以照著拍,例如『手拿起手機,鏡頭從桌面平視拍』;⑥ 標記出你認為最需要特寫的兩顆鏡頭並說明原因。」

    拿到結果後,請務必自己走一遍流程:每一顆鏡頭問自己「這個我十分鐘內拍得出來嗎」。不能的,就改寫或刪掉。分鏡表不是藝術創作,是施工圖。

    五、AI 協作實戰流程:從零到可拍腳本的五個階段

    把前面所有東西串起來,我目前使用的流程大概是這樣:

    階段一:選題與受眾定位(人主導)

    先用一句話寫下:這支影片要給誰看、解決他什麼問題、看完他會產生什麼情緒。這三句話不要交給 AI,因為它不知道你的觀眾最近在煩什麼。

    階段二:鉤子量產(AI 主導)

    用前面介紹的提示詞生成 20 組開場,挑三組再各生成三個變體。這個階段求量不求質,你只在最後做選擇。

    階段三:結構生成(人機協作)

    把你選定的鉤子、核心觀點、想講的三個重點丟給 AI,請它排出 60 秒時間軸,並標示每一段的目的(鉤子/鋪陳/爆點/行動)。你負責檢查節奏是否合你的語速。

    階段四:口語化改寫(人主導)

    這是不能偷懶的一步。把 AI 寫的稿子念出來,凡是你念起來會卡、或你平常根本不會這樣講的句子,全部改掉。AI 的通病是句式太整齊、轉折太書面。念不順的句子,觀眾一定也聽不順。

    階段五:分鏡轉換(AI 輔助)

    用前面的分鏡提示詞模板,把定稿腳本轉成分鏡表,再依你的拍攝條件刪修。最後列出道具清單與拍攝順序(通常依場景分組拍,比照時間順序拍快得多)。

    常見的 AI 腳本五大毛病與修正方式

    毛病一:開場客套。出現「大家好,今天要跟大家分享」之類的句子。修正方式:在提示詞裡明確禁止,並要求第一句必須是斷言句。

    毛病二:資訊平均分配。每個點都講得一樣重,沒有爆點。修正方式:要求 AI 指定「哪一點是爆點」,並把最多時間給它。

    毛病三:形容詞太多。「非常震撼的畫面」「極度有效的技巧」。修正方式:要求全部改成具體動詞與數字。

    毛病四:結尾空虛。「希望大家喜歡」這種沒有資訊量的收尾。修正方式:要求結尾必須給出一個可執行的下一步。

    毛病五:語氣不像你。修正方式:提供三到五句你自己的口頭禪或過去影片的台詞,讓 AI 模仿你的語感。這一步效果非常明顯。

    六、案例拆解:同一支影片的三種腳本寫法

    假設主題是「新手如何挑選第一支麥克風」,我們來看看不同結構會帶出什麼結果。

    版本 A(失敗版):開場說「今天來介紹麥克風」,接著依序講預算、類型、品牌,結尾說「以上就是我的分享」。問題是:沒有懸念、沒有爆點、沒有承諾,觀眾在第三秒就走了。

    版本 B(堪用版):開場說「買麥克風前,先看這三個規格」,接著條列三點。結構清楚,但缺少情緒,能被看完但不容易被分享。

    版本 C(高互動版):開場是「我第一支麥克風花了六千塊,錄出來比手機還爛」,畫面是實物對比。接著說「問題不在價格,在一個你根本不會看的數字」,然後在爆點處放上規格截圖特寫,最後收在「預算三千以內,看這兩個數字就夠」。這版本的差別在於:它先給了一個失敗故事,讓觀眾產生共鳴,再用一個反直覺的結論製造爆點。

    三個版本的資訊量其實差不多,但版本 C 的前三秒決定了它的命運。這就是腳本結構的價值——它不是修辭技巧,而是注意力工程。

    七、結語:腳本是唯一可以「事先變強」的地方

    器材可以借、剪輯可以學、光線可以將就,但腳本的品質決定了你這支影片值得被多少人看見。而腳本最棒的地方在於,它是整條製作流程裡,唯一一個你可以在開拍前就做到最好的環節。

    AI 的出現,把「寫」的成本幾乎降到零。這意味著競爭門檻不再是「誰會寫」,而是「誰知道該寫什麼」。所以真正該練的能力,其實是三件事:你能不能精準描述你的觀眾、你能不能找到一個值得被記住的觀點、你能不能把這個觀點壓縮成 3 秒就能勾人的句子。

    下次打開 AI 之前,先花十分鐘想清楚這三件事。你會發現,工具還是同一個,但產出的東西完全不一樣。

    如果你照著這套流程寫了腳本,歡迎貼在留言區,我們可以一起看你的黃金 3 秒有沒有過關。

    🏠 返回首頁