OpenAI 在今(21)晨宣布,GPT-Image-2 開放透明背景生成預覽,開發者把 background 設成 transparent 就能直接拿到帶 alpha 通道的素材。
(前情提要:OpenAI 祭出 GPT-Image-2:視覺生成迎來碾壓,設計師這次真的要失業了)
(背景補充:OpenAI 推出 ChatGPT Images 2.0:文字渲染大進化、支援多圖生成,但「中文生成」仍卡關)
透明背景聽起來只是個小功能。但對每天要產出上百張素材的團隊來說,它決定了一張圖能不能直接拿去用,還是得再進一次後製。OpenAI 在今(21)晨宣布,GPT-Image-2 的透明背景生成進入預覽階段。
開發者只要在 API 請求裡把 background 設成 transparent,模型就會輸出帶 alpha 通道的圖片。簡單來說就是,主體以外的區域是真的透明的,而不是一片白色,可以直接疊在任何底色上。
Transparent backgrounds are now available in preview for GPT-Image-2 in the API.
Generate reusable assets you can place on any background—for product imagery, graphic design, website mockups, and marketing campaigns. pic.twitter.com/yRhBIYh8uP
— OpenAI Developers (@OpenAIDevs) August 20, 2026
一個開關,缺席了四個月
GPT-Image-2 在 4 月 21 日發布,5 月初開放給開發者。它在文字渲染與多圖生成上都比上一代進步,唯獨少了一格:background 只吃 auto 與 opaque 兩個值,傳 transparent 進去會被 API 直接打回。OpenAI 自己在 開發者說明頁上當時寫得很清楚,這個模型不支援透明背景。
尷尬的地方在於,上一代的 gpt-image-1 從 2025 年 4 月上線就有這個能力。開發者升級到新模型,等於用更好的畫質與排版,換掉了一項本來就有的舊功能。
後製工具鏈的成本,藏在每一張圖裡
沒有原生透明,開發者只能自己補。這四個月被記錄下來的解法有四種,每一種都要付代價。
第一種是降級,改用 gpt-image-1.5 或 sora_image 這些還保留透明背景的舊模型,用畫質換功能。
第二種是在 GPT-Image-2 後面串一個去背模型,RemBG、BiRefNet 或 851-labs 的 background-remover 都有人用,代價是每張圖多 1 到 3 秒。
第三種是綠幕:叫模型畫純綠色背景,再用色彩門檻把綠色挖掉,但主體邊緣一有綠色反光就破功。
第四種最暴力,同一張圖在兩種底色各生一次,相減算出透明度,生成成本直接翻倍。
把數字攤開會更清楚。GPT-Image-2 依解析度計價,1K 約 0.03 美元、2K 約 0.05 美元、4K 約 0.08 美元;換算到 token,一張 1024×1024 的圖從低品質的 272 個 token 到高品質的 4,160 個 token,輸出端每百萬 token 收 30 美元。一天要出一千張素材的團隊,光是每張多兩秒的去背等待,就是三十多分鐘的純耗損;改走雙圖相減,等於把當天的生圖預算乘以二。
OpenAI 這次的說法也很直白:這些素材是拿來重複使用的,商品圖、平面設計、網站 mockup、行銷素材,共同點是它們最後都要被放進別人的版面裡。一張帶白底的圖在這些場景幾乎沒有用,因為版面的底色不會永遠是白的。去背之所以能長成一門生意,賣的從來不是技術難度,而是替設計師省下的那幾秒鐘。
預覽版補的是及格線
不過要注意的是目前還是「預覽」版本。第一批測試者在開發者社群回報,輸出圖片的 alpha 值停在 253 到 254 之間,而不是完全不透明的 255;透明區與主體的交界處會出現一圈淡灰色光暈;更麻煩的是 edit 端點在處理本來就帶透明度的圖片時,可能不會保留原有的透明資訊。
格式也有限制,要透明就只能選 PNG 或 WebP,JPEG 出局。OpenAI 沒有說明預覽期的計價差異與用量上限。
📍相關報導📍
OpenAI 要 KYC 了?上傳身分證件與個人大頭照才可使用 gpt-image-1 新生圖模型 API
OpenClaw 最新更新》GPT-image2 走 OAuth 免 API key、子代理三層巢狀上線
OpenAI 發布 GPT-5.4 Mini 與 Nano:速度翻倍、專為 AI 子代理時代設計,最低每百萬 token 僅 $0.2

