用ChatGPT生成圖片時,很多人可能還是會輸入:「幫我畫一張○○風格的圖片。」

不過,OpenAI近期推出GPT Image 2.5後,強化了圖片生成與編輯能力,速度還提升近50%,更能理解複雜指令、保留人物特徵,並處理光線、材質與透明背景等需求。

修圖時,模型也更能控制修改範圍。使用者只要明確指定要改的部分,其他細節通常會盡量維持不變,即使連續修改,也較不容易覆蓋先前成果或降低畫質。

因此,若想控制人物長相、構圖、圖片文字,或只修改照片中的一張椅子,提示詞不能只描述「畫什麼」,還要交代主體、構圖、光線、材質、文字,以及哪些部分必須保留。

《數位時代》以下整理OpenAI官方發布的GPT Image 2.5提示詞指南,包括提示詞寫法,以及22組Prompt範例,範例涵蓋寫實攝影、資訊圖、Logo、科學教材等多種情境,讀者可依據自己的圖片、參考素材與實際需求進行調整。

第一,先定義最終成果。與其籠統地說「畫一張圖」,更該具體指出要做的是商品照片、廣告、流程圖、簡報,或其他明確成品。需求較複雜時,也可以把提示詞拆成場景、主體、細節與限制等區塊。

第二,格式沒有標準答案。簡短句子、完整段落、類JSON結構、標籤式寫法都可以採用,重點在於資訊是否容易閱讀與修改。

第三,描述真正看得見的細節。材質、光線、顏色、畫面媒介都可以明確指定。如果要寫實照片,就直接說真實攝影;如果想營造夜景、雨天或霓虹環境,也應該交代光線、尺度、色彩和氣氛,而不是只有「電影感」三個字。

第四,人物動作也要具體。例如全身入鏡、腳部完整可見、低頭看著書本,或雙手自然握住車把,都比「自然一點」更容易得到預期結果。

第五,需要正確文字就直接指定。把必須出現的文字放進引號,再描述位置、字體與排版;不希望AI自己多加內容,也可以明確要求「不要有其他文字」。

第六,修改內容和保留內容分開寫。例如「只更換衣服」,同時列出臉部、姿勢、背景、光線與構圖不得修改。

第七,多張參考圖片要分配角色。例如圖片1提供人物、圖片2提供服裝、圖片3提供背景,避免一次提供大量圖片、任由AI自行揣測用途。

第八,一次改一件事。先看上一張生成結果,再針對一項條件進行修改。如果某些細節非常重要,即使前面已經說過,後續編輯時仍應再次強調。

Images 2.5的提示詞真正重要的,是讓AI清楚知道你要什麼、畫面該長什麼樣,以及哪些地方不能自作主張;篇幅長短只是其次。

以下提示詞與圖片是編輯部根據OpenAI官方英文範例,以繁體中文重新整理並生成的版本,方便讀者閱讀;實際使用時,讀者也可以依照自己的需求再調整用詞與細節。

第一組範例示範如何控制照片風格與光線,提示詞重點在於把抽象的「我要有質感的照片」拆成可視化條件。

#0 ChatGPT Image 2.5生圖 圖/ChatGPT
#0 ChatGPT Image 2.5生圖 圖/ChatGPT

第二組案例是自動咖啡機資訊圖。製作流程圖或資訊圖時,重點在於說明流程、受眾,以及圖片需要傳達哪些資訊,如果只寫「做一張好看的資訊圖」,效果通常有限。

#1 ChatGPT Image 2.5生圖 圖/ChatGPT
#1 ChatGPT Image 2.5生圖 圖/ChatGPT

Images 2.5的其中一個重點能力是文字呈現。官方範例替一個名為Thread的街頭品牌製作廣告,並明確要求標語只能出現一次、必須清楚可讀,以及禁止額外文字。

#2 ChatGPT Image 2.5生圖 圖/ChatGPT
#2 ChatGPT Image 2.5生圖 圖/ChatGPT

設計Logo時,盡量要求乾淨、接近向量的形狀、明確輪廓與留白,而且必須在大、小尺寸下都保持辨識度。

#3 ChatGPT Image 2.5生圖 圖/ChatGPT
#3 ChatGPT Image 2.5生圖 圖/ChatGPT

提示詞建立列出明確的日期、地點與歷史準確性要求,這是因為模型可以根據真實世界背景推導部分情境,當模型本身具有足夠世界知識時,明確的時間、地點與準確性要求,就可能比一大串形容詞更有效。

#4 ChatGPT Image 2.5生圖 圖/ChatGPT
#4 ChatGPT Image 2.5生圖 圖/ChatGPT

故事轉漫畫時,官方建議將劇情拆成清楚的視覺節點,一格對應一個具體事件。這種寫法其實也可以延伸到分鏡、短影音腳本甚至廣告Storyboards,重點在於直接告訴AI每一幕要發生什麼。

#5 ChatGPT Image 2.5生圖 圖/ChatGPT
#5 ChatGPT Image 2.5生圖 圖/ChatGPT

官方建議,在生成介面預覽時,應該描述成一款真正存在、可以使用的產品,而不是模糊地要求「未來感App概念設計」。排版、資訊層級、間距與實際UI元素都值得寫進Prompt。

#6 ChatGPT Image 2.5生圖 圖/ChatGPT
#6 ChatGPT Image 2.5生圖 圖/ChatGPT

製作科學與教育類圖片時,建議把提示詞當成一份教學設計說明:說清楚受眾是誰、想達成什麼學習目標、畫面上必須出現哪些標籤,以及有哪些科學限制不能違背。這類圖的資訊精準度遠比畫面好不好看更重要。圖片完整後,化學式、流程箭頭與概念關係都需要人工另外檢查。

#7 ChatGPT Image 2.5生圖 圖/ChatGPT
#7 ChatGPT Image 2.5生圖 圖/ChatGPT

做簡報、圖表或流程圖時,官方建議提示詞應該像一份成品規格書(artifact spec),而不是一句「幫我畫一張專業簡報」。標題、實際數據、視覺階層、版面和不希望出現的設計都要直接指定。

#8 ChatGPT Image 2.5生圖 圖/ChatGPT
#8 ChatGPT Image 2.5生圖 圖/ChatGPT

前面介紹的是從零生成圖片,接下來則是修改既有圖片。

這類需求的提示詞,重點不只是告訴AI「要改什麼」,還要明確說明「哪些內容不能改」。OpenAI官方範例大多採用相同邏輯:先指定修改範圍,再列出需要保留的人物、背景、構圖、光線或物件細節。

以下案例使用OpenAI官方指南中的示範圖片與提示詞,整理成繁體中文版本。這一段不另外進行圖片實測,主要觀察官方如何描述修改範圍,以及如何透過限制條件降低圖片被過度改動的機率。

官方要求將圖片中的文字翻譯成西班牙文,同時保留圖片其他部分。這是最簡單的局部編輯指令之一,也很適合用來理解「只改文字、不改版面」的寫法。

#0 ChatGPT Image 2.5用法 圖/數位時代
#0 ChatGPT Image 2.5用法 圖/數位時代

官方用一張像素風圖片作為風格參考,再要求生成新的摩托車騎士。這類提示詞的重點,是讓AI知道參考圖片是用來提供視覺風格,而不是直接複製其中的主體或構圖。

#1 ChatGPT Image 2.5用法 圖/數位時代
#1 ChatGPT Image 2.5用法 圖/數位時代

這一組是官方範例中最完整的局部修改案例之一。除了要求人物換上參考圖片中的服裝,也逐一列出臉部、五官、膚色、身形、姿勢、表情、髮型與身體比例不得改變。同時,背景、攝影角度與構圖也必須保留。

#2 ChatGPT Image 2.5用法 圖/數位時代
#2 ChatGPT Image 2.5用法 圖/數位時代

當需要合併兩張或多張圖片時,不要只寫「把這些圖片融合在一起」,而是要說清楚每張圖片分別提供什麼內容。

官方範例是以第一張圖片作為主要場景,再把第二張圖片中的狗放到第一張圖片的女人旁邊。

如果希望進一步控制合成效果,也可以補充狗的比例、陰影與視線方向:

#3 ChatGPT Image 2.5用法 圖/數位時代
#3 ChatGPT Image 2.5用法 圖/數位時代

官方範例要求將商品從原始圖片中擷取出來,並放在完全透明的背景上。

這裡需要注意,透明背景不等於畫面中出現灰白棋盤格。棋盤格只是許多影像軟體用來表示透明區域的預覽方式,並不是圖片本身的背景。

ChatGPT Image 2.5用法 圖/數位時代
ChatGPT Image 2.5用法 圖/數位時代

官方的Sketch-to-render範例,是將草圖轉換成寫實圖片,但保留原本的配置、比例與透視關係。這類Prompt的關鍵,是把「轉換風格」和「保留結構」分開寫。否則AI可能會把草圖當成靈感來源,重新設計整個場景,而不是單純將它寫實化。

#4 ChatGPT Image 2.5用法 圖/數位時代
#4 ChatGPT Image 2.5用法 圖/數位時代

如果只需要移除一個物件,提示詞不一定要寫得很長。

這組指令的重點,是把修改範圍鎖定在單一物件,同時要求保留人物、姿勢、光線與構圖。

#5 ChatGPT Image 2.5用法 圖/數位時代
#5 ChatGPT Image 2.5用法 圖/數位時代

最後一組官方編輯範例,是將原本博物館裡的女性放進被棕熊攻擊的露營地。

這類需求不只是更換背景,還涉及人物動作、服裝、表情、環境、時間與光線。因此Prompt需要同時描述人物和新場景,並說明希望呈現的真實感。

#6 ChatGPT Image 2.5用法 圖/數位時代
#6 ChatGPT Image 2.5用法 圖/數位時代

OpenAI另外用一個章節示範,當第一張圖片已經接近需求時,如何沿用既有成果,在後續對話中逐步調整同一張圖片。

這一段我們同樣不另外生成圖片,而是直接依照官方提供的圖片與對話流程,整理並將提示詞翻譯成繁體中文跟。重點不在比較實際生成效果,而是觀察官方如何拆分每一輪修改:哪些資訊可以沿用上一輪、哪些條件需要再次強調,以及如何透過一次只修改一項內容,盡量維持原本的人物、商品或畫面設定。

第一步先把洗髮精做成夕陽公路旁的廣告看板。這組Prompt同時結合了商品參考圖、場景和精確文字要求。

接著,官方沒有重新描述整張廣告看板,只下一句:

目的就是測試在維持上一張場景內容的情況下,只修改天氣與時間。

這種修改方式的好處是,如果生成結果突然走鐘,比較容易知道是哪一個新指令造成的。

#7 ChatGPT Image 2.5用法 圖/數位時代
#7 ChatGPT Image 2.5用法 圖/數位時代

先創造一張清楚的角色參考圖,把角色的服裝、五官氣質、比例與色彩定義下來。

官方的做法並不是單純要求「幫我做一個可愛角色」,而是先建立一份能重複使用的人物設定。

這裡有一個很好用的細節:官方即使已經寫了「same character」,還是再次列出綠色服裝、相同五官比例與相同配色。

所以如果某個細節真的不能跑掉,不要只相信一句「跟上一張一樣」;重要特徵再寫一次比較保險。

#8 ChatGPT Image 2.5用法 圖/數位時代
#8 ChatGPT Image 2.5用法 圖/數位時代

官方最後還補上三種實際工作流程:室內家具替換、節慶賀卡與收藏商品設計。

#9 ChatGPT Image 2.5用法 圖/數位時代
#9 ChatGPT Image 2.5用法 圖/數位時代
#0 ChatGPT Image 2.5用法 圖/ChatGPT生成
#0 ChatGPT Image 2.5用法 圖/ChatGPT生成

這裡值得注意的是,Prompt不只在描述「產品長什麼樣」,也交代了塑膠、金屬、印刷、棚拍與零售包裝等材質與呈現方式。

#1 ChatGPT Image 2.5用法 圖/ChatGPT生成
#1 ChatGPT Image 2.5用法 圖/ChatGPT生成

把前面22組Prompt看完,會發現OpenAI其實一直在重複同一套方法。

看完上面的案例可以觀察到:生圖提示詞的長度差異非常大。例如換衣服、募資簡報、賀卡這類複雜任務,官方會詳細交代大量條件;但刪掉手中的花,只需要一句「移除花,不要改其他東西」。歷史場景也只用了兩句話。

因此下提示詞真正重要的是需求的資訊密度。需要控制的事情多,就明確寫出來;需求只有一件事,就不要為了看起來很會Prompt而硬加形容詞。

OpenAI在指南最後也提醒,生成完成後仍然需要檢查:指定文字是否正確、流程圖標示是否合理、人物與商品細節有沒有被改掉、修改是否真的只影響指定區域,以及透明素材是不是真的包含透明通道。

所以Images 2.5提示詞真正的使用邏輯,或許可以濃縮成一句話:需求越具體,它越知道哪些地方可以發揮;限制越清楚,也越不容易在你沒要求的地方自行加工。