怎麼用 ChatGPT 把生活照變成手繪插畫:人留著,只把周圍的雜物重畫掉
先講這件事
Reddit 的 r/ChatGPT 版上,帳號 Fun_Walk_4965 貼了一段圖片編輯的指令:把照片裡真實的人或寵物保留下來,只把周圍重建成比較簡單的編輯風插畫。他特別寫了一句,它不會把人整個重畫。這句是整段指令的重點。
市面上「照片變插畫」的濾鏡多得是,但那些是整張重畫,人也一起被畫掉,最後你得到一張很像那個人但不是那個人的圖。這段指令反過來做:主角維持照片的樣子,只有環境變成畫。
他還說,這招特別適合照片裡本來就有一點故事在發生的那種,例如家庭時刻、小孩跟寵物、旅行照。成品的感覺,他形容介於生活雜誌的一頁、獨立藝術書的封面,跟手繪日記之間。
我自己跑了一次來看看是不是真的。
輸入的照片是我另外做的示範圖:一個人盤腿坐在小客廳地板上,膝上一隻橘貓,旁邊是滿出來的洗衣籃、拆一半的紙箱、亂成一團的充電線、曬衣架。就是那種拍完會想「畫面好亂喔」但捨不得刪的照片。
成品裡那個人跟那隻貓完全沒變。散落的髮髻、毛衣的針織紋路、手指按在貓下巴上的姿勢、貓瞇著眼的表情,全部還是照片。變的是周圍:洗衣籃、紙箱、電線整批不見,換成暖象牙色紙上的幾根細墨線,一扇窗、一盆植物、一杯還在冒煙的咖啡,其餘大片留白。
兩張照片都只跑一次就拿到能用的結果,一張大約一分半。
另外講清楚:那則貼文的按讚數我抓不到,網頁版跳人機驗證牆,所以這篇不會出現任何 Reddit 的數字。這件事的根據是我把指令跑過,不是那則貼文紅不紅。
以前要一張這種圖,你得找插畫家或設計師畫。現在是貼一段字。
如果你也想試試看
前提只有一個:你的 ChatGPT 要能上傳圖片。手機 App 跟網頁版都可以,照片丟進對話框,再把下面這段貼上去。
這是原 po 貼出來的英文原文,我一個字沒改:
use my uploaded photo as the only visual reference. Preserve the main photographic subject and their identity, expression, clothing, pose and relationships as faithfully as possible. Remove unnecessary background clutter and redesign the surrounding environment as minimal hand-drawn doodles on warm ivory textured art paper. Keep the subject photorealistic, use delicate imperfect ink lines, restrained flat colors and lots of negative space. The final image should feel quiet, warm, refined and editorial, like an independent lifestyle magazine illustration. Output only the redesigned final artwork, not a before/after comparison.
英文看不順的話,下面這段是我把它翻成中文之後、一樣拿同一張照片跑過的版本:
用我上傳的這張照片當唯一的參考。照片裡的人和寵物保持原樣,身分、表情、衣服、姿勢,還有他們之間的關係都不要改,也不要重畫。把背景的雜物清掉,周圍的環境重新畫成暖象牙色紙上的極簡手繪線條,人和寵物維持照片的寫實感,線條細一點、不要太工整,顏色少一點,留白多一點。整張的感覺要安靜、溫暖、耐看,像獨立生活雜誌裡的一頁插畫。只輸出重畫後的成品,不要做前後對照。
中文版跑得動,人跟貓一樣沒被重畫。但兩張擺一起比,中文版的留白少很多,整個房間被畫滿,線條也比較像鉛筆稿。想要那個雜誌內頁的味道,英文原文比較準;想省事,中文版夠用。
挑照片有一個原則:主角要夠大,五官跟姿勢才留得住。整群人擠在遠處那種團體照,主角本身就小,能保的東西也少。
出來不滿意不用重貼一次長指令,直接跟它講就好。背景再簡單一點、線條再細一點,它會重畫一張。
還有一件事。這招要你把照片傳上去,所以只丟你自己願意給出去的那一張。照片裡有別人的臉、門牌、小孩的制服、車牌,先想一下要不要遮掉再上傳。傳上去就是離開你手上了,判斷自己做,不要為了省事整批直接丟。
玩進階一點
這段指令好玩的地方是每一句都在管一件事,換掉其中一兩個詞,整張的感覺就跟著換。我跑過兩個變化,都成功。
第一個是換紙、換顏色。把 warm ivory textured art paper 換成 cool pale blue-grey textured art paper,再把 restrained flat colors 換成 monochrome ink only, almost no color,其他不動。整張的溫度就變了,從暖米白變成冷灰藍,周圍的線條只剩黑白。中文的話:紙換成冷灰藍色的,周圍只用線條、不要上色。
還有一個沒預期到的副作用:它連旁邊擺的東西都換了一批,原本的花瓶跟相框變成植物、蠟燭跟書。所以這不是濾鏡,它每次都重新配一次場景,同一張照片跑兩次不會一模一樣。想要哪一版,多跑幾次挑就好。
第二個是換周圍的畫法。把 minimal hand-drawn doodles 換成 loose watercolor washes with soft bleeding edges,其他一樣不動。周圍就從細墨線變成水彩暈開的色塊,人跟貓照樣一動也沒動。中文的話:周圍改成水彩暈開的感覺,人跟寵物一樣保持原樣。
規則抓到了就好辦:紙材看 paper 那段,線條看 ink lines,顏色多寡看 colors,留白看 negative space。一次只換一個,才知道是哪句在起作用。
關於「它會把什麼一起清掉」,這段請一定要看
第二張我故意挑難的:夜市的全家福,爸媽跟中間抱著的小孩對著鏡頭笑,後面是整條街的攤販、燈籠、機車、電線跟一堆路人。
臉的部分比我預期好,三張臉都認得出來,連小孩笑起來嘴巴張開的樣子都在。
但那條街沒了。攤販、人潮、路燈的暖光、整個夜市的夜色,全部被當成雜物清掉,只剩兩顆燈籠跟一個攤子的線稿貼在米白色的紙上。原本是晚上拍的,成品看起來像白天。
這不是做壞了,這正是指令要它做的事。指令寫的是「清掉不必要的背景雜物」,可是哪些算不必要,是它自己劃的線。對它來說,主角以外的都是雜物,包括你當初就是為了它才按下快門的那個地方。
所以照做之前,三件事:
第一,先問自己這張照片你要留的是人,還是那個當下的場所。要留人很好用;要留的是那條街、那間老房子、那個海邊,它會把你真正想留的拿走。
第二,原檔留著。它給的是一張新的圖,不是修過的照片。
第三,不要把成品當紀錄用。周圍是重新畫的,擺設可能跟現實對不上。當賀卡、當頭像、當一頁紀念都好,當「我們那天在那裡」的證據就不對。
AI 不會幫你判斷你想留的是什麼,它只會照字面做事。決定權在你。
這系列只做一件事:讓你看到 AI 現在可以做到什麼。做不做得到你想要的那樣,自己試最準。
資料來源
- Reddit r/ChatGPT,作者 Fun_Walk_4965,〈Been using this prompt to turn photos into minimal lifestyle illustrations〉,2026 年 9 月 4 日。指令原文照抄自該貼文:https://www.reddit.com/r/ChatGPT/comments/1w6v3zg/been_using_this_prompt_to_turn_photos_into/
- 本文所有成品與示範照片,皆為 2026 年 9 月 5 日以 gpt-image-2 自行產出的 AI 生成示意圖,非本人,也非任何真實人物。輸入用的「原始照片」同樣是生成的,不是真實照片。
- 實測條件:gpt-image-2 的圖片編輯功能,輸出 1024x1536、品質 high,共跑五次(英文原文兩張、中文版一次、換紙換色一次、換水彩一次)。