2026 年 Suno AI 進階技巧:如何寫出高品質的 Prompt

musical%20instruments%2C%20vinyl%20record%2C%20war...
發表時間:2026 年 09 月 12 日 | 更新日期:2026 年 09 月 12 日 | 編輯:雅寶社區編輯團隊
2026 年 Suno AI 進階技巧:如何寫出高品質的 Prompt|[Mood] Melancholic, bittersweet, restrained - 雅寶社區 · 頂客論壇

[Vocal] Female, breathy, slight rasp, Korean lyrics, intimate close-mic

[Production] Wide reverb tail, tape saturation, 2010s analogue warmth

三個層次的理解:風格區、歌詞區、後設指令

在動手寫之前,你必須先搞清楚 Suno 的三個輸入區塊各自負責什麼:

  • 風格區(Style / Style of Music):決定「這首歌聽起來像什麼」。曲風、樂器、製作質感、年代感、人聲類型都在這裡。
  • 歌詞區(Lyrics):決定「這首歌怎麼唱」。除了歌詞本身,還包含結構標記([Verse]、[Chorus])與演唱指示([Whispered]、[Belted])。
  • 後設指令(Exclude Styles、歌名、自訂模式等):決定「這首歌不要什麼」。負面約束常常比正面描述更有效。
  • 很多人把三者的工作混在一起,例如把「female vocal」寫進歌詞區,或是把結構標記寫進風格區。模型不會報錯,但它會用一種你意想不到的方式解讀。分清楚職責,是進階的第一步。

    二、風格 Prompt 的六大模組拆解法

    接下來是我自己反覆驗證過的一套框架——把風格區拆成六個模組。你不一定要每次都寫滿六個,但當成果不如預期時,回頭檢查是哪個模組缺失,通常能立刻找到問題。

    模組一:曲風與子曲風(Genre)

    曲風是權重最高的一層,但「越大越好」是錯的。寫「Pop」等於沒寫,因為它涵蓋的範圍太廣。有效的做法是「主曲風+子曲風+一個參考座標」:

    主曲風:City Pop

    子曲風:Japanese 80s City Pop, AOR

    參考座標:80s Tokyo night drive(描述使用情境,比單純形容詞有效)

    另外提醒一件事:直接輸入知名歌手或樂團名字,在 2026 年的模型上通常會被過濾或弱化,而且生成的結果也常常只是「四不像的模仿」。更好的方式是拆解那位歌手的製作特徵——例如你想接近某個日本女聲的都會感,可以寫「clear female vocal, dense chorus stack, slap bass groove, gated reverb drums」,這比寫名字精準得多,也避開了版權爭議。

    模組二:情緒與氛圍(Mood & Atmosphere)

    情緒詞是最容易寫爛的一塊。因為「sad」對模型來說太抽象,它不知道你要的是「哭到崩潰」還是「淡淡的失落」。

    建議用「情緒+強度+音樂上的對應表現」三段式:

    [Mood] Nostalgic and bittersweet, medium intensity.

    Musically expressed through: minor key verse resolving to relative major chorus,

    descending melodic lines, unresolved suspended chords in the outro.

    把情緒翻譯成具體的音樂手法(和聲走向、旋律方向、結尾方式),模型的命中率會大幅上升。這也是新手跟老手最大的差距之一。

    模組三:樂器與編制(Instrumentation)

    這是最能拉開質感差距的模組。關鍵原則是:數量控制+出現時機。

    不要一次列出二十種樂器。模型在編制過載時,會把每種樂器都塞成薄薄一層,結果就是「很滿但很吵」。比較好的寫法是:

    [Instrumentation]

    Core: Fender Rhodes electric piano, fretless bass, soft brush drums

    Texture: Warm analog pad, subtle string swells underneath chorus

    Accent: Vibraphone motif in intro and bridge only

    把「什麼時候進來、什麼時候退出」寫清楚,成品的動態感會完全不同——這其實就是一個編曲師在做的事。

    模組四:人聲設定(Vocal)

    人聲要寫五件事:性別、音色、唱法、語言、錄音感。

  • 性別與年齡感:female / male / androgynous,young / mature
  • 音色:breathy(氣音)、raspy(沙啞)、clear(清亮)、husky(低沉沙磁)
  • 唱法:belted(強力)、falsetto(假音)、spoken-word(口白)、rap flow
  • 語言:Mandarin / Taiwanese Hokkien / English / Japanese,並註明是否有 accent
  • 錄音感:close-mic intimate / doubled / layered harmonies / live take with bleed
  • 語言這一項特別重要。如果你要的是台語歌,只寫「Taiwanese」有時會被理解成「台灣地區的中文」。建議明確寫「Taiwanese Hokkien lyrics, natural colloquial pronunciation」,並在歌詞區用對應的漢字或羅馬拼音來輔助。

    模組五:製作質感、年代與空間(Production)

    這個模組決定「這首歌是哪一年錄的、在哪裡錄的」。它包含:

  • 年代感:70s analogue warmth / 80s gated reverb / 90s tape hiss / 2020s hyper-clean
  • 空間:bedroom demo / small jazz club / stadium / cathedral reverb
  • 動態處理:heavily compressed / wide dynamic range / lo-fi bitcrush
  • 混音比例:vocal-forward / instrumental-focused / balanced
  • 一句「80s gated reverb drums」就能瞬間把你的歌從 2026 年拉回 1985 年,效果比寫一堆形容詞都好。

    模組六:速度、調性與節奏型態(Tempo & Key)

    最後一塊是技術參數。雖然模型不一定每次都精準命中,但寫上去能有效縮小它的隨機範圍:

    [Tempo] 102 BPM, straight 4/4 with slight swing on hi-hat

    [Key] F# minor, modal interchange with Dorian

    [Groove] Half-time chorus, driving eighth-note bass in verses

    如果你不希望某個參數太死,可以用範圍寫法:「around 95–105 BPM」。模型通常會落在這個區間內。

    三、歌詞區的進階操作:Meta Tags 全攻略

    風格區決定骨架,歌詞區決定血肉。而歌詞區最被低估的東西,就是那些方括號裡的字。

    標準結構標記與它們的實際效果

    標記

    作用

    使用建議

    [Intro]

    建立前奏氛圍

    可加上樂器指示,如 [Intro: solo piano]

    [Verse]

    主歌,敘事段

    建議不超過八行,情緒留白

    [Pre-Chorus]

    鋪陳,推向副歌

    加上 [Building] 可強化推進感

    [Chorus]

    副歌,記憶點

    歌詞要短、重複、好唱

    [Bridge]

    轉折段

    適合改變和聲或加入新樂器

    [Outro]

    收尾

    寫明要 fade out 還是 abrupt end

    進階一點的用法是組合式標記,例如 [Final Chorus: key change up a whole step, full band, ad-libs]。這種寫法能讓最後一段副歌真的做出「升級感」,而不是前兩段的複製貼上。

    演唱指示與動態標記

    這些標記會直接影響唱腔與編曲密度,是讓同一組歌詞產生不同版本的最快方法:

  • [Whispered][Belted][Falsetto]——控制唱法
  • [Softly][Powerful]——控制力度
  • [Stop][Silence]——留白,非常有效但常被忽略
  • [Instrumental Break][Guitar Solo]——指定純演奏段
  • [Ad-libs][Harmonies]——增加和聲層次
  • [Spoken Word]——口白段落

    我自己最愛用的是 [Silence]。在副歌前放零點五秒的空白,再讓全樂隊轟進來,那個人為製造的呼吸感是 AI 不會主動幫你做的,但只要你寫了,它就會照做。

    殺傷力最大的五個常見錯誤

  • 把風格描述寫進歌詞區:例如在歌詞中間插入「(with heavy bass)」。模型可能真的會把這句話唱出來。
  • 結構標記過多:一首三分鐘的歌塞十個 [Bridge],結果就是結構破碎、處處斷點。
  • 歌詞行數不平均:同一段裡兩行跟八行混在一起,模型會趕拍或拖拍。

    英文標記混中文歌詞時沒空格:建議標記與歌詞之間保持換行。

    副歌寫太長:超過八行的副歌很難形成記憶點,模型也容易唱得平。

    四、五個實戰完整範本

    以下範本都經過多次實測調整,你可以直接複製修改。注意每個範本都遵循了前面的六大模組邏輯。

    範本一:都會 City Pop

    [Genre] Japanese City Pop / AOR, 1980s Tokyo

    [Mood] Nostalgic, breezy, slightly wistful, medium energy

    [Instrumentation] Slap bass, Fender Rhodes, clean chorus guitar, gated reverb drums,

    saxophone solo in bridge, synth brass accents

    [Vocal] Female, clear and airy, doubled chorus harmonies, Japanese lyrics

    [Production] Warm analogue tape, wide stereo, punchy but soft, night-drive atmosphere

    [Tempo] 108 BPM, 4/4, key of D major

    歌詞區重點:副歌用短句堆疊,例如重複的都市夜景意象;Bridge 之後接 [Saxophone Solo],效果非常到位。

    範本二:台語抒情搖滾

    [Genre] Taiwanese Hokkien Ballad Rock

    [Mood] Heartbreaking but dignified, restrained intensity building to catharsis

    [Instrumentation] Clean arpeggiated electric guitar, piano, bass, drums entering at second verse,

    strings in final chorus

    [Vocal] Male, warm and slightly raspy, emotive, Taiwanese Hokkien lyrics, natural colloquial accent

    [Production] Live-band feel, roomy drums, analogue console warmth, wide dynamic range

    [Tempo] 74 BPM, 4/4, key of C minor

    歌詞區重點:台語歌的斷句要配合語氣,例如 [Verse] 用口語敘事,[Chorus] 用拉長音的旋律線。最後一段建議標 [Final Chorus: key change up a whole step, full band, strings]

    範本三:Lo-fi / Chillhop

    [Genre] Lo-fi Hip Hop / Chillhop

    [Mood] Calm, hazy, study-session comfortable

    [Instrumentation] Dusty piano sample, warm sub bass, soft boom-bap drums, vinyl crackle, rain ambience

    [Vocal] Mostly instrumental, occasional soft wordless humming

    [Production] Heavy tape saturation, low-pass filtered, intentional hiss, mono-ish width

    [Tempo] 82 BPM, swung 4/4, key of F minor

    歌詞區重點:直接留空或只放 [Instrumental];如果要加人聲,用 [Humming][Spoken Word] 少量點綴即可。

    範本四:史詩管弦

    [Genre] Epic Cinematic Orchestral / Trailer Music

    [Mood] Heroic, awe-inspiring, tense build to triumphant release

    [Instrumentation] Full string section, French horns, taiko drums, choir, brass stabs

    [Vocal] Wordless choir, epic and layered

    [Production] Wide cinematic reverb, huge dynamic range, sub-bass impacts, big hall

    [Tempo] 130 BPM, 4/4, key of D minor modulating to D major

    歌詞區重點:用 [Instrumental Build][Climax][Drop Out] 控制段落,不需要實際歌詞。

    範本五:K-Pop 女團舞曲

    [Genre] K-Pop Dance Pop / Girl Group

    [Mood] Confident, sassy, high energy, attitude-driven

    [Instrumentation] Punchy synth bass, trap hi-hats, brass stabs, layered group chants, EDM drop in chorus

    [Vocal] Female group, bright and powerful, rap verse, group harmonies, ad-libs

    [Production] Hyper-clean modern mix, heavy sidechain, pre-chorus filtered build

    [Tempo] 120 BPM, 4/4, key of B minor

    歌詞區重點:段落切換要快,[Verse] 可以短到四行,[Pre-Chorus] 用 build,[Chorus] 放 chant 式的重複句。加 [Dance Break] 段落會有奇效。

    五、迭代方法論:把 Prompt 當成實驗設計

    寫出好 Prompt 不是靈感問題,是流程問題。這是我目前穩定產出的做法。

    控制變數與 A/B 測試

    每次只改一個模組。例如你對第一版很滿意,但覺得人聲太尖——第二次只改「[Vocal] Female, clear → Female, warm and breathy with light rasp」,其他全部不動。這樣你才能知道是「哪個字」造成了變化。

    一次改五個地方,就算變好聽了,你也無法複製那個結果。這是很多人在 Suno 上卡關兩年的根本原因。

    加權與優先順序的寫法

    模型對「先出現的詞」通常給予較高權重。所以順序應該是:曲風 → 情緒 → 編制 → 人聲 → 製作 → 技術參數。把最重要的放前面,把修飾性的放後面。

    如果你有某個元素一定要出現,除了放在前面,還可以在風格區結尾再強調一次,例如:「... essential elements: slap bass groove, gated reverb drums」。

    建立自己的 Prompt 資料庫

    這是我最推薦的長期投資。用一份試算表記錄每一首的:風格區全文、歌詞區全文、生成結果評價(1–5 分)、備註(哪裡好、哪裡怪)。累積五十筆之後你會發現,你有一套只屬於自己的「風格語彙庫」,而且能看出某些詞彙組合的高勝率模式。

    雅寶社區的音樂創作版也常有朋友分享自己的 Prompt,建議可以互相交換資料庫,進步速度會快很多。

    六、常見誤區與除錯清單

    當成品不如預期時,請依序檢查這幾項:

  • 風格區是否超過合理長度?過長的描述會互相稀釋,建議控制在 60–120 個英文單字內。
  • 是否有互相矛盾的指令?例如同時寫「minimal arrangement」和「full orchestra」。
  • 人聲語言是否明確?要指定語言,不要只寫地區。

  • 結構標記是否和風格衝突?例如寫了 [Rap Verse] 卻指定純鋼琴民謠。
  • 是否忘記使用 Exclude Styles?負面約束能有效排除模型的口頭禪式編曲。
  • 是否只生成一次就下判斷?同一個 Prompt 生三次,往往第二次或第三次才是你要的。
  • 是否把「編曲」和「混音」混為一談?樂器是編曲,reverb、compression 是混音,分開寫效果更好。
  • 七、結語:Prompt 是樂器,不是咒語

    很多人把 Prompt 當成咒語,期待唸對一句話就能變出神曲。但在 2026 年,Suno 已經不是許願池,而是一間設備齊全的錄音室。你走進去,可以對製作團隊說「隨便來點開心的」,也可以遞出一份完整的編曲規格書。前者偶爾會有驚喜,後者才能穩定交件。

    六大模組不是要你每次寫滿,而是給你一張檢查表;Meta Tags 不是裝飾,而是你唯一能直接控制演唱與編曲結構的手段;迭代方法論則是讓你把「運氣」換成「手感」的過程。

    最後想說的是:真正讓作品好聽的,永遠是你腦中那個「想要的聲音」。Prompt 只是把它翻譯出來的工具。當你能清楚說出自己要什麼,AI 就只是幫你省下錄音室時數的那雙手。

    如果你照著這篇的方法做出滿意的作品,歡迎回到雅寶社區 · 頂客論壇的 🎵 音樂創作版分享你的 Prompt 與成品,讓大家一起把這套方法論磨得更利。

    ```

    🏠 返回首頁