上週想幫一款新收納袋做網站封面圖,我在 ChatGPT 裡打了一句「幫我做一張質感一點的產品情境圖」,送出、等、看結果——圖是漂亮,但尺寸是正方形,我要的是網站橫幅。重新生成一次,比例對了,構圖卻把包包擠在畫面最角落。再生成一次,構圖對了,我想加的標題文字變成一團看不懂的符號。
前後花了快 20 分鐘,換來三張都不能用的圖。
那次之後我才發現,自己每次寫提示詞都是憑感覺硬湊,難怪結果一直不穩定。回頭整理那些失敗的提示詞,問題幾乎都出在同樣四個地方:尺寸、構圖、文字、風格。把這四件事依序講清楚之後,出圖的穩定度差很多。
以下是我整理出來的公式。
一、為什麼提示詞會一直失敗?
提示詞失敗,通常不是因為描述不夠美,而是漏講了 AI 需要的四個基本資訊。
- 尺寸沒講清楚——AI 自己猜比例
- 構圖只講主體——AI 自己決定角度與位置
- 文字沒有特別處理——AI 把文字當成圖案畫進去
- 風格沒有寫成規則——每張圖各自發揮
這四個問題背後有個共通原因:提示詞寫得越隨性、越像在跟朋友聊天,AI 需要猜的地方就越多;猜的地方一多,出圖自然越不穩定。
二、公式第一步:先講清楚尺寸,不要讓 AI 用猜的
尺寸要放進提示詞的第一句,而不是等圖生成完,才想到補一句「順便用網站的比例」。
常見的幾種比例,各自對應不同用途:
- 16:9——網站橫幅、文章封面、簡報
- 4:5——Instagram 貼文
- 1:1——一般社群圖、產品縮圖
- 3:4 或直式——手機版主視覺、限時動態
例如:「請製作一張16:9的網站文章封面」,把比例寫在句首,AI 才會用這個框架去安排後面的構圖,而不是生成完一張正方形圖之後再幫你硬裁。
三、公式第二步:構圖要拆成主體、細節、環境三層,不要塞成一句話
把「幫我做一張質感產品照」拆開來看,AI 其實收到的資訊只有「產品」兩個字,其他全部靠猜。構圖要拆成三層分開講:主體、細節、環境。
- 主體:這張圖的重點是什麼(收納袋放在畫面中央偏右)
- 細節:主體上不能被改掉的部分(顏色、材質、五金、車縫)
- 環境:背景、光線、角度(米白背景、自然側光、平視角度)
三層分開寫,AI 需要猜的空間就變小,構圖也比較會落在你想要的位置,而不是隨機塞在畫面某個角落。
四、公式第三步:圖片文字要當成設計需求,用引號單獨處理
圖片裡的文字常常變成亂碼或看不懂的符號,多半是因為文字被當成「順便寫一下」的裝飾,而不是明確的設計需求。
比較穩定的做法,是把要出現的文字放進引號,單獨一句交代,而不是混在構圖描述裡:
「圖片中的文字內容為『夏日出遊必備』,放在畫面左上角,字體簡潔好讀。」
如果要放的文字比較長、比較正式,我還是建議先讓 AI 只處理圖片和構圖,文字不要生成,之後再用 Canva 之類的工具排版——這樣不會因為一個錯字,整張圖又要重新生成一次。
五、公式第四步:風格一致靠「規則」,不是靠「同一句提示詞」
很多人以為,只要每次都貼上同一句提示詞,出來的圖就會是同一種風格。實際上每次生成都是獨立的,同一句話丟兩次,兩張圖的色調、光線都可能不一樣。
比較穩定的做法,是把風格寫成一組規則,而不是一句固定咒語:
- 固定的色彩範圍(溫暖米白、淺灰、炭黑)
- 固定的光線調性(自然側光、無強烈陰影)
- 固定的留白比例與構圖密度
- 允許改變的部分(每張圖可以換場景、換物件)
把「不能變」和「可以變」分開寫清楚,同一系列的圖片才會看起來像同一個人做的,而不是每張各做各的。
六、完整公式套用範例
把前面四步驟合在一起,就是一組可以直接修改套用的提示詞模板:
請製作一張[比例]的[用途]圖。主體是[主體描述],需保留[必須保留的細節]。背景與環境:[環境描述]。圖片中的文字內容為「[確切文字]」,[文字位置與風格要求]。整體風格:[色彩、光線、氛圍規則],構圖簡潔、留白適中。
套用到我自己的收納袋封面圖,會變成:
請製作一張16:9的網站文章封面圖。主體是米白色四格收納袋,需保留提把、拉鍊、車縫細節與原本比例。背景與環境:淺灰色桌面,自然側光,平視角度。圖片中不要生成任何文字,我會後續自行加入標題。整體風格:溫暖米白、淺灰、炭黑色調,構圖簡潔、留白適中,適合網站與社群分享。
七、這套公式如何改變我後續做圖的方式
用這套公式重新生成那張收納袋封面圖,第一次出來的比例、構圖就是我要的,只調整了一次背景亮度,前後不到 5 分鐘。跟一開始那 20 分鐘、三張都不能用的經驗比起來,差別不是圖變漂亮了,而是我不用再靠運氣。
如果你也在用 AI 處理網站的圖片或文字,可以參考我另外兩篇:ChatGPT Images 2.0 有什麼不同,以及用 AI 規劃一個網站的完整流程。
常見問題
為什麼同一句提示詞,AI 每次生成的圖都不一樣?
每次生成都是獨立的,不是延續上一次的結果。想要風格接近,要把「不能變」的規則寫清楚,而不是重複貼同一句話。
提示詞裡要不要寫「不要什麼」這種負面詞?
盡量少用。與其寫「不要太暗」,不如直接寫「柔和自然光線」;正向、具體的描述比否定句更容易讓 AI 理解。
為什麼 AI 生成的圖片文字常常是亂碼?
因為文字被當成裝飾的一部分,跟其他構圖描述混在一起。把文字內容放進引號單獨處理,短標題效果會明顯提升;文字量大時建議另外用排版工具處理。
系列圖片要怎麼維持一致的風格?
整理一段共用的風格規則(色彩、光線、留白比例),每次只替換主題和場景,而不是每次重新想一句新的提示詞。
提示詞是不是寫得越詳細越好?
不是。提示詞太長、太多矛盾的形容詞,AI 遇到衝突訊號會取折中,生出「什麼都沾一點、什麼都不像」的圖。結構清楚的短提示詞,通常比又長又亂的提示詞穩定。
一次生成不滿意,要整句重寫還是局部修改?
建議先局部修改,一次只調整一個問題(例如先處理比例,再處理背景),比一次要求大幅修改更容易得到穩定結果。
結論:公式不是限制創意,是減少猜測
提示詞公式的作用,不是把創意綁死,而是先把 AI 需要的基本資訊——尺寸、構圖、文字、風格——講清楚,讓它不用用猜的。
下次要生成圖片時,可以先用這四個問題檢查自己的提示詞:尺寸講了嗎?主體、細節、環境分開了嗎?文字放進引號了嗎?風格寫成規則了嗎?四個都講清楚,通常一兩次就能拿到堪用的圖,不用再靠運氣。
