很多人寫提示詞時,一開始就堆滿形容詞,最後畫面還是很難控制。FLUX.2比較適合用清楚的自然語言,把最重要的內容放前面,再逐步補細節。記住下面這個順序,寫起來會簡單很多。
先搭好四要素骨架
一段提示詞可以先依「主體、動作、風格、場景」來寫。主體說明畫面中心是誰或什麼,動作交代它在做什麼,風格決定媒介和美感,場景補上環境、光線、時間和氛圍。
詞序也會影響結果。建議依核心主體、關鍵動作、核心風格、必要場景、次要細節排列。真正不能少的內容放最前面,不要讓裝飾詞把重點推到後面。

提示詞不是越長越好
10到30個詞適合快速試想法,30到80個詞能應付多數創作,80個詞以上適合複雜場景和細部規格。剛開始先寫中等長度,畫面方向穩定後,再補鏡頭、材質、色彩和環境細節。
不同場景要換寫法
寫實畫面
只寫「專業照片」通常太籠統。想要年代感或特定攝影效果,可以補相機、鏡頭、底片和拍攝方式,例如 Shot on Fujifilm X-T5, 35mm f/1.4,或寫明 early digital camera, slight noise, flash photography, candid。
畫面中的文字
要生成文字時,用英文引號標出內容,再說明位置、字體風格和字級。比如:The text 'OPEN' appears in red neon letters above the door。品牌字樣也可以綁定十六進位色號,例如 the logo text 'ACME' in color #FF5733。
顏色和資訊圖表
色號要和具體物件綁在一起。a vintage illustration of an apple in color #0047AB會比「使用藍色」清楚。漸層要寫明起點、終點和方向;資訊圖表則要交代圖表類型、標題、分欄、資料、圖示、配色和整體風格。元素很多時,可以用 JSON 分別寫主體、顏色、位置、風格和光線。
多語言和連續畫面
有地域文化的場景,盡量用當地語言寫提示詞,建築、街道和生活細節會更符合語境。漫畫分鏡或連續藝術要逐鏡生成,並固定人物年齡、膚色、髮型、五官、服裝和標誌元素。每個分鏡都重複這些核心描述,角色才不容易越畫越不一樣。

複雜需求再用進階方法
JSON 適合多元素畫面、批量生成和需要精準控制的專案。融合多張參考圖時,要說清楚每張圖負責什麼,例如主體來自圖1、風格來自圖2、背景來自圖3。想快速擴寫時,可以開啟 prompt_upsampling,讓模型在保留原意的基礎上補充畫面細節。
別忽略畫幅和參數
尺寸要依使用情境選擇,而且輸出寬高應為16的倍數。1:1適合社群媒體和產品圖,16:9適合風景和電影感畫面,9:16適合行動端和人像,4:3適合雜誌和簡報,21:9適合全景。最低解析度64×64,最高4MP,日常創作通常控制在2MP以內比較方便。
想重現結果,可以寫 seed: 42。Flex 版本可設定 guidance: 4.5 和 steps: 50,guidance常用範圍為1.5到10,steps最多50步,仍要在速度和品質之間取捨。

最後記住三個避坑點
- FLUX.2不使用負面提示詞,直接用正向語言描述想要的結果。
- 想要清楚畫面,寫
sharp focus throughout,不要只寫no blur。 - 想要空場景,寫
empty scene,不要寫no people。
提示詞的重點不是把句子寫得玄,而是讓模型知道畫面有什麼、元素怎麼排列、整體要呈現什麼感覺。先用簡單結構跑通,再逐步增加控制項,通常比一開始寫滿一整頁更容易得到穩定結果。需要批量製作商業圖片時,也可以了解AI圖像生成服務的實際交付方式。