ChatGPT 圖片提示詞怎麼寫?一套公式解決尺寸、構圖、文字與風格問題

從一次花 20 分鐘卻換來三張不能用的圖開始,整理出尺寸、構圖、文字、風格四步驟提示詞公式,讓 AI 出圖更穩定。

ChatGPT 圖片提示詞怎麼寫?一套公式解決尺寸、構圖、文字與風格問題
目錄 Contents
ChatGPT 圖片提示詞公式:把尺寸、構圖、文字、風格四個變數依序寫清楚的提示詞架構,用來降低 AI 生成圖片的隨機性,提高一次到位的機率。

上週想幫一款新收納袋做網站封面圖,我在 ChatGPT 裡打了一句「幫我做一張質感一點的產品情境圖」,送出、等、看結果——圖是漂亮,但尺寸是正方形,我要的是網站橫幅。重新生成一次,比例對了,構圖卻把包包擠在畫面最角落。再生成一次,構圖對了,我想加的標題文字變成一團看不懂的符號。

前後花了快 20 分鐘,換來三張都不能用的圖。

那次之後我才發現,自己每次寫提示詞都是憑感覺硬湊,難怪結果一直不穩定。回頭整理那些失敗的提示詞,問題幾乎都出在同樣四個地方:尺寸、構圖、文字、風格。把這四件事依序講清楚之後,出圖的穩定度差很多。

以下是我整理出來的公式。

一、為什麼提示詞會一直失敗?

提示詞失敗,通常不是因為描述不夠美,而是漏講了 AI 需要的四個基本資訊。

  • 尺寸沒講清楚——AI 自己猜比例
  • 構圖只講主體——AI 自己決定角度與位置
  • 文字沒有特別處理——AI 把文字當成圖案畫進去
  • 風格沒有寫成規則——每張圖各自發揮

這四個問題背後有個共通原因:提示詞寫得越隨性、越像在跟朋友聊天,AI 需要猜的地方就越多;猜的地方一多,出圖自然越不穩定。

二、公式第一步:先講清楚尺寸,不要讓 AI 用猜的

尺寸要放進提示詞的第一句,而不是等圖生成完,才想到補一句「順便用網站的比例」。

常見的幾種比例,各自對應不同用途:

  • 16:9——網站橫幅、文章封面、簡報
  • 4:5——Instagram 貼文
  • 1:1——一般社群圖、產品縮圖
  • 3:4 或直式——手機版主視覺、限時動態

例如:「請製作一張16:9的網站文章封面」,把比例寫在句首,AI 才會用這個框架去安排後面的構圖,而不是生成完一張正方形圖之後再幫你硬裁。

三、公式第二步:構圖要拆成主體、細節、環境三層,不要塞成一句話

把「幫我做一張質感產品照」拆開來看,AI 其實收到的資訊只有「產品」兩個字,其他全部靠猜。構圖要拆成三層分開講:主體、細節、環境。

  • 主體:這張圖的重點是什麼(收納袋放在畫面中央偏右)
  • 細節:主體上不能被改掉的部分(顏色、材質、五金、車縫)
  • 環境:背景、光線、角度(米白背景、自然側光、平視角度)

三層分開寫,AI 需要猜的空間就變小,構圖也比較會落在你想要的位置,而不是隨機塞在畫面某個角落。

四、公式第三步:圖片文字要當成設計需求,用引號單獨處理

圖片裡的文字常常變成亂碼或看不懂的符號,多半是因為文字被當成「順便寫一下」的裝飾,而不是明確的設計需求。

比較穩定的做法,是把要出現的文字放進引號,單獨一句交代,而不是混在構圖描述裡:

「圖片中的文字內容為『夏日出遊必備』,放在畫面左上角,字體簡潔好讀。」

如果要放的文字比較長、比較正式,我還是建議先讓 AI 只處理圖片和構圖,文字不要生成,之後再用 Canva 之類的工具排版——這樣不會因為一個錯字,整張圖又要重新生成一次。

五、公式第四步:風格一致靠「規則」,不是靠「同一句提示詞」

很多人以為,只要每次都貼上同一句提示詞,出來的圖就會是同一種風格。實際上每次生成都是獨立的,同一句話丟兩次,兩張圖的色調、光線都可能不一樣。

比較穩定的做法,是把風格寫成一組規則,而不是一句固定咒語:

  • 固定的色彩範圍(溫暖米白、淺灰、炭黑)
  • 固定的光線調性(自然側光、無強烈陰影)
  • 固定的留白比例與構圖密度
  • 允許改變的部分(每張圖可以換場景、換物件)

把「不能變」和「可以變」分開寫清楚,同一系列的圖片才會看起來像同一個人做的,而不是每張各做各的。

六、完整公式套用範例

把前面四步驟合在一起,就是一組可以直接修改套用的提示詞模板:

請製作一張[比例]的[用途]圖。主體是[主體描述],需保留[必須保留的細節]。背景與環境:[環境描述]。圖片中的文字內容為「[確切文字]」,[文字位置與風格要求]。整體風格:[色彩、光線、氛圍規則],構圖簡潔、留白適中。

套用到我自己的收納袋封面圖,會變成:

請製作一張16:9的網站文章封面圖。主體是米白色四格收納袋,需保留提把、拉鍊、車縫細節與原本比例。背景與環境:淺灰色桌面,自然側光,平視角度。圖片中不要生成任何文字,我會後續自行加入標題。整體風格:溫暖米白、淺灰、炭黑色調,構圖簡潔、留白適中,適合網站與社群分享。

七、這套公式如何改變我後續做圖的方式

用這套公式重新生成那張收納袋封面圖,第一次出來的比例、構圖就是我要的,只調整了一次背景亮度,前後不到 5 分鐘。跟一開始那 20 分鐘、三張都不能用的經驗比起來,差別不是圖變漂亮了,而是我不用再靠運氣。

如果你也在用 AI 處理網站的圖片或文字,可以參考我另外兩篇:ChatGPT Images 2.0 有什麼不同,以及用 AI 規劃一個網站的完整流程

常見問題

為什麼同一句提示詞,AI 每次生成的圖都不一樣?

每次生成都是獨立的,不是延續上一次的結果。想要風格接近,要把「不能變」的規則寫清楚,而不是重複貼同一句話。

提示詞裡要不要寫「不要什麼」這種負面詞?

盡量少用。與其寫「不要太暗」,不如直接寫「柔和自然光線」;正向、具體的描述比否定句更容易讓 AI 理解。

為什麼 AI 生成的圖片文字常常是亂碼?

因為文字被當成裝飾的一部分,跟其他構圖描述混在一起。把文字內容放進引號單獨處理,短標題效果會明顯提升;文字量大時建議另外用排版工具處理。

系列圖片要怎麼維持一致的風格?

整理一段共用的風格規則(色彩、光線、留白比例),每次只替換主題和場景,而不是每次重新想一句新的提示詞。

提示詞是不是寫得越詳細越好?

不是。提示詞太長、太多矛盾的形容詞,AI 遇到衝突訊號會取折中,生出「什麼都沾一點、什麼都不像」的圖。結構清楚的短提示詞,通常比又長又亂的提示詞穩定。

一次生成不滿意,要整句重寫還是局部修改?

建議先局部修改,一次只調整一個問題(例如先處理比例,再處理背景),比一次要求大幅修改更容易得到穩定結果。

結論:公式不是限制創意,是減少猜測

提示詞公式的作用,不是把創意綁死,而是先把 AI 需要的基本資訊——尺寸、構圖、文字、風格——講清楚,讓它不用用猜的。

下次要生成圖片時,可以先用這四個問題檢查自己的提示詞:尺寸講了嗎?主體、細節、環境分開了嗎?文字放進引號了嗎?風格寫成規則了嗎?四個都講清楚,通常一兩次就能拿到堪用的圖,不用再靠運氣。

← 回架站筆記