超大杯實測Image 2.5!穩紮穩打地小小進步了。
整理版優先睇
Image 2.5 係一次穩紮穩打嘅小升級:局部編輯、透明底素材同系列化輸出最實用,但風格化、複雜材質同角色一致性仍未算大突破。
呢篇係阿真實測 Image 2.5 嘅整理。佢根據 9 月 8 日官方發佈說明,今次升級主打參考圖保真、精準局部編輯同多輪修改,同時改善光影、材質同複雜指令理解,仲加入草圖、模板同圖片評論編輯等入口。作者想知呢啲改動落到日常做圖、改圖流程,係咪真係幫到手。
佢用咗好多案例去試,包括改蛋撻焦斑、行李箱輪轂、小字替換、一次生成 8 張滾動序列、Logo 材質 GIF、品牌海報、照片精修、參考圖保真、多輪場景切換、跨格漫畫、草圖鎖構圖、透明底 PNG、資訊圖同 PPT 版式,最後仲試產品反推 VI 同原產品保真合成。整體結論係:局部修改更聽話,透明底素材同系列化輸出最實用,做海報、換場景、日常修圖都慳到功夫。
但佢覺得風格化冇乜驚喜,複雜材質同部分風格化畫面仍然有噪點雜質,多輪改圖會出現面部偽影,角色一致性進步唔大。官方都講明複雜提示詞可能要等 2 分鐘、文字位置同清晰度仍可能出錯、多次生成角色同品牌元素可能變化。速度體感快咗,但 API 要驗證,作者提醒大家謹慎消費、理性課金。
- 結論:局部編輯、透明底 PNG、系列海報同產品換場景最實用,對日常做圖流程有實際幫助。
- 方法:用參考圖保真、多輪修改、固定場景文字帶同每張獨立輸出,去驗證一致性同批量生成。
- 差異:2.5 比 2.0 喺去白邊、局部聽話同版式穩定有改善,但風格化同複雜材質進步有限。
- 啟發:角色一致性、半邊面同全身結構仍然係高風險位,多人合成海報更容易崩。
- 可行動點:提示詞要寫明限制、每張獨立輸出、預留 retry;API 要驗證,課金前先計成本。
透明底毛絨微縮場景 Prompt
用參考圖角色生成宇航員主題透明底 PNG,明確要求 Alpha 透明、無背景、無白邊,適合做貼紙同視覺素材。
產品反推品牌 VI Prompt
以產品圖為唯一參考,提取配色、造型、表情同品牌文字,一次生成 8 張 16:9 獨立品牌系統圖。
Visual Style PPT Skill
作者置頂文章提到嘅 PPT 風格 Skill,配合 Image 2.5 做 6 頁 16:9 PPT,保留頁眉、頁腳同風格一致。
8 張圖做滾動動畫流程
固定場景同文字帶,每張只向左移銀幕寬度 25%,首尾接成循環;提示詞要禁止重新居中、縮放或改寫。
實測背景:Image 2.5 想解決乜嘢?
阿真今次係實測 Image 2.5,即大家口中嘅新版本圖像模型。佢引用 9 月 8 日官方發佈說明,今次升級主要圍繞參考圖保真、精準局部編輯同多輪修改,同時改善光影、材質同複雜指令理解。
唔係單次生成靚圖,而係要改得準、改得穩
官方仲加入草圖、模板同圖片評論編輯等入口,所以作者唔係只睇「一 take 過」效果,而係集中試日常做圖、改圖流程入面,邊啲位真係慳到時間。
實測範圍橫跨 A 到 J 十個場景
- A 精準局部編輯:改蛋撻焦斑、行李箱輪轂、最後一行文字。
- B 照片精修:用參考圖幫其他圖統一修圖。
- C 參考圖保真:保留本人五官、貓咪外形,套入唔同年代同場景。
- D 多輪編輯:同一原圖切換多個場景,睇光影同角色會唔會飄。
- E 跨格跨頁一致:四格漫畫連續故事嘅角色一致性。
- F 草圖鎖構圖:塗鴉變成海報。
- G 透明底資產:Alpha PNG 去白邊。
- H 精確文字與版式:資訊圖、陣營圖。
局部編輯、多圖序列同動畫玩法
作者先用蛋撻、行李箱同小字替換試精準局部編輯。佢話只改指定位置時,周邊紋理、光澤同其他細節大多保持得住,呢點係今次最明顯嘅進步之一。
只改指定位置,其餘細節盡量保持原樣
之後佢用同一張圖一次生成 8 張,令字母同笑臉由左滾到右,驗證多圖一致性。結果文字同表情符號穩定性算唔錯,但光影仍會有一點點起伏。
一次生成 8 張,再串成滾動動畫
固定場景同文字帶,每張左移 25%
- 結論:局部修改比以前聽話,簡單使用冇問題。
- 方法:固定場景同文字帶,每張向左移 25%,首尾接成循環。
- 差異:文字同表情穩定,但光影仍會有起伏。
- 啟發:同一張 Logo 可以生成 8 種材質,拼成 GIF,可玩性高。
- 可行動點:提示詞要寫清固定背景、固定文字位置、每張只平移,禁止重新居中或縮放。
參考圖保真、多輪編輯同漫畫角色一致
作者同貓咪做參考圖,試 90 年代深圳世界之窗、夏爾袋底洞、埃及貓神、藍緞宮廷肖像、F1 賽車手同未來宇航員。佢覺得年代、場景同材質還原已經做得幾好,例如 90 年代相會有淺淺膠片感。
人物多輪編輯後,仍然保持到一定似本人
不過缺點都好明顯:金屬、刺繡等複雜細緻材質會出現碎碎嘅感覺;只露半邊面、全身照或者人體結構複雜時,出錯機率會高好多,呢個問題 2.0 未解決,2.5 依然未解決。
半邊面、全身照同複雜人體結構仍然容易出事
- 可用:年代還原、場景切換、光影跟環境變化。
- 風險:複雜材質有噪點雜質,多輪編輯會累積面部偽影。
- 限制:只露半邊面、全身照、多人同框最容易出結構問題。
- 方法:提供動作參考圖,或明確要求姿勢、道具同位置。
- 可行動點:重要角色圖要預留 retry,唔好一次過塞太多人。
草圖、透明底、文字版式同 PPT 實戰
作者試草圖鎖構圖,塗鴉都可以直接變成海報,不過佢覺得呢個功能偏好玩。透明底 PNG 就實用好多,2.5 喺深灰背景下白邊問題明顯少過 2.0,佢形容「精細到頭髮絲,摳圖拜拜」。
透明底 PNG 白邊問題明顯改善
文字同版式方面,官方話有提升,作者實測複雜資訊圖同 PPT 都見到方向感,做 PPT 時後面幾頁可以穩穩保留頁眉、頁腳同風格。不過小字仍然會有出錯。
PPT 後面幾頁可以保留頁眉、頁腳同風格
以參考圖中的女孩為唯一角色原型,生成一張宇航員主題的透明底毛絨微縮場景。保留深藍色星光長捲髮、藍色大眼睛、圓臉、腮紅和大頭小身體比例,只出現一個全身角色。女孩穿奶白色與深藍色拼接的軟絨宇航服,戴敞開面罩的圓形頭盔,露出完整臉部和捲髮,一隻手揮手,另一隻手抱着小星球。身後左側放一艘矮胖的小火箭,右側放兩塊月球石和一面無文字小旗,腳下是一小塊不規則月面墊。道具圍繞人物形成緊湊、有前後層次的獨立小景,人物始終最突出。人物、服裝、火箭、石頭和月面墊統一使用參考圖中的細密短絨、羊毛氈與軟布材質,輪廓圓潤,柔和棚拍光,精緻立體玩偶效果。豎版3:4,完整展示人物與全部道具,四周留白。輸出帶真實Alpha透明通道的PNG,場景外部及道具間隙完全透明,無天空、無背景牆、無大面積地面、無白底、無棋盤格、無文字水印。
產品 VI、速度、官方侷限同課金提醒
作者最後試產品合成同品牌物料:由產品圖反推完整 VI,一次生成 8 張 16:9;亦做原產品保真合成廣告圖,一次 4 張 2:3。佢提醒提示詞一定要限制清楚「每張獨立輸出」,唔係模型會拼成一張。
一定要寫明每張圖獨立輸出,唔好拼成一張
速度方面,網頁版體感快咗,官方口徑係延遲最多降低 50%,但實際睇任務。多圖生成平均速度可能仲快過單張。不過官方文件都列明侷限:複雜提示詞可能要等 2 分鐘,文字位置同清晰度可能出錯,多次生成角色同品牌元素可能變化。
複雜提示詞可能要等 2 分鐘
- 結論:對模型本身係小進步,但落到日常做圖、改圖流程已經好實用。
- 方法:用局部編輯、透明底、系列海報、產品換場景同 PPT 版式去慳時間。
- 差異:2.5 比 2.0 喺白邊、局部聽話同版式穩定有改善。
- 啟發:風格化唔係今次賣點,追求獨特美感要配合 Midjourney 等工具。
- 可行動點:試新功能前先寫清限制、每張獨立輸出、預留 retry,同埋謹慎課金。

嗨,大家好,我係阿真!
朝早發現大家都喺度催 Image 2.5,你哋咁積極,我真係有啲驚咗哈哈。

好,嚟喇嚟喇~
今次係 Image 2.5。當然佢個全稱唔係呢個,大家心照啦。
根據 9 月 8 日嘅官方發佈說明,今次升級主要圍繞參考圖保真、精準局部編輯同多輪修改,同時改善光影、材質同複雜指令理解,仲加入咗草圖、模板同圖片評論編輯等入口。
接落嚟大家可以跟我一齊睇嚇今日嘅案例。
A 精準局部編輯
做局部修改嗰陣,其他細節大多都保持得住。例如修一修個蛋撻嘅小細節。👇

改一個車輪嘅輪轂。類似嘅精準要求,效果都仲幾唔錯。👇

改小字,其他嘢都冇變,只係改最後一行嘅文字。👇

一致性真係好強,呢個時候我諗到個主意:如果一次過跑多張圖,咁佢咪好似動畫咁?用呢個方式,都可以驗證佢嘅一致性係咪真係咁好。
於是我叫佢一次過生成 8 張圖片,圖片會逐張將一張圖由左推到右。咁如果將 8 張圖連埋一齊,我哋就可以見到個字母同表情符號好似字幕咁,由左滾到右。

朋友們,估嚇,我成功咗未?👇

只保留第 3 張到第 6 張,咁咪可以循環囉。當然都睇得到,其實除咗圖片之外,仲會有一點點光影起伏嘅變化。文字同表情符號嘅穩定性都算幾唔錯。當然如果非常嚴格咁講,目前都仲未做到百分百隻改變編輯區域。🤔

但係簡單用就完全冇問題,例如叫佢基於一張 logo 生成 8 張唔同材質嘅圖,組埋一齊就係 GIF 圖喇。可玩性好強啊。

仲係上面嗰個 Logo,幫品牌做系列品牌宣傳海報,一次 6 張。呢個都參考咗官方案例,親測的確幾實用。👇


B 照片精修
都可以用嚟精修照片。我手頭冇乜比較好嘅參考圖,大家可以去試嚇呢個功能。喺場景差不多嘅情況下,可能修一張圖,其他嗰啲直接參考呢張去做就得。之後都係直接畀圖。👇

以後線下見到阿真,唔好再話冇見過本人喇。👇


C 參考圖保真
接落嚟呢兩張圖係參考圖,呢個係我同我隻貓。👇

喺根據唔同年代、時代同真實場景嘅還原上,佢已經可以做得非常好,包括對一啲材質同質感嘅控制,好似 90 年代嘅照片,佢出嚟嘅圖會有嗰種淡淡嘅膠片感。
呢度要注意,我測試得比較粗糙,冇過度要求佢改動作,所以大家可能會覺得動作比較拘謹。大家其實都可以提供動作參考圖,或者具體要求點樣改姿勢、加道具之類。
深圳世界之窗 / 夏爾袋底洞

大家之前應該都有體會:人物圖片,外國嘅圖片模型經常還原唔好人像細節,容易令人覺得亞洲人都係同一個樣,尤其係編輯多兩輪就唔似本人。
但而家佢喺多輪編輯之後,依然可以保持到比較好嘅效果。接落嚟嘅圖片係按順序一路做多輪編輯咗好多次,當然大家之後都會發現,佢嘅細節的確有咗啲變化。
下面已經去到第九輪同第十輪嘅編輯,可以見到面部細節都仲幾唔錯,冇出現明顯嘅面部偽影、噪點、斑駁等。但缺點都好明顯,尤其係喺金屬或者刺繡等複雜細緻材質嘅表現上,嗰種碎碎嘅感覺又好似鬼魂咁追咗上嚟(左一)。
埃及貓與人肖像 / 藍緞宮廷肖像

如果只係露出人物半邊面,出錯嘅機會會高好多。
下面呢兩組圖像就睇得到:一個係人物容易出現一啲不明結構;另一個係人物喺全身照嗰陣,頭部同身體都出現咗明顯嘅人體結構問題。簡單嚟講,條頸同身體好似對唔上。呢個問題 2.0 冇解決,2.5 依然冇解決。👇
09 F1 賽車手 / 10 未來太空人

測試上限,咁我就直接加難度喇。呢度我叫佢將我前面測試過嘅所有圖片全部放埋喺一張海報入面。當然,崩得好犀利。
今次將咁多人像放埋一齊,的確有啲頂唔住。👇

D 多輪編輯
再睇嚇多輪編輯嘅表現。呢度我換咗另一種風格,用咗一張原圖,然後要求切換其他場景,並且叫佢根據環境去調整人物嘅光影。
整體表現係唔錯嘅,有個別圖片佢會基於場景移動位置。如果強制要求唔好改變兩個主體嘅位置,應該都做到。
但係喺多輪編輯嘅過程中,有啲圖片可以明顯見到臉上已經有咗啲偽影同噪點,呢個始終都係無可避免。
全部場景快速切換

部分生成圖片



E 跨格跨頁角色一致
角色一致性進步唔大。畀咗參考圖,偶爾都仲會有雙馬尾變單馬尾嘅情況。👇


風格鎖定
風格鎖定兼遷移,都仲係比較精細。做批量圖有幾方便就有幾方便。👇


F 草圖鎖構圖
塗鴉,就可以直接畫畫、作圖、做海報。不過呢個純粹係好玩。
下面揀【繪圖】👇



畫成點都會幫你變靚哎嘿。其實呢個功能,Seedream 5.0 Pro 推出嗰陣都已經支援咗。大家可以試嚇睇嚇。

G 透明底素材
前排我好鍾意野獸派對,仲幫自己整咗呢種 Q 彈材質嘅造型。👇

基於呢個材質,叫 image 2.5 延伸生成帶有 Alpha 透明通道嘅 PNG 圖,基本可以保持背景完全透明,非常好用。如果大家有做視覺相關需求,呢個功能會好正。
呢個其實都的確有進步,可以畀大家對比嚇。精細到頭髮絲,退地拜拜。
2.0 嗰陣,就算叫佢出透明 PNG,同樣經常會有白邊、處理得唔好嘅情況,喺深灰色背景下可以明顯睇得出。2.5 就好好多。下面第一排係 2.5 生成嘅圖,第二排係 2.0 嘅圖。👇


H 精確文字與版式
官方都有提到,文字資訊同版式方面有提升。版式我哋已經睇得到,喺設計相關方面確實有提升。
咁我哋再睇嚇比較複雜嘅版式呈現。呢種資訊圖大家可能今年以嚟已經睇到厭,呢度就唔多放喇,簡簡單單測試嚇。文字細節上仔細睇,都仲會有啲字出錯。小字部分嗰度會有一點點問題,但係整體版面都幾清晰,第一眼睇都幾唬人。有出錯嘅地方咩?如果有邊度出錯,大家喺評論區留言講嚇。👇

I 資訊圖與複雜排版
有方向感喇,更識得精細修改喇。
做 PPT,後面頁面嘅格式可以穩穩定定保留,可以保存好頁眉、頁腳格式同風格哎嘿。感覺我置頂嗰篇文章 Visual Style PPT Skill 大家又可以用得著喇。👇




每次都有朋友話圖片內容資訊太多,唔鍾意繁瑣,要求佢簡單啲都冇問題。如果都仲係覺得太密,就分多幾頁。



J 產品合成與品牌物料
之前我大多都係基於一個 logo 去延展相關周邊。今日我哋試個唔同嘅:基於已有產品去反推 VI,嚟睇嚇效果。
圖一係參考圖,後面係一次性生成嘅圖。不過呢個偶爾都會出現直接一張圖將全部輸出內容拼埋一齊嘅情況,所以大家喺提示詞裏面一定要限制清楚,每一張圖要點樣單獨輸出。👇





再嚟一組原產品保真合成圖,都係一次輸出。呢度第二張圖,之前生成嗰陣只有三隻杯,所以我叫佢重新生成過。仔細睇細節嘅話,感覺佢都仲有一點點質量上嘅損失。👇


Templates 同熱門呢度,撳一下就直接出相關周邊都好方便,大家可以多試嚇,非常有趣。
例如上載圖片,撳表情,直接出貼紙。👇

小結
整體嚟講,局部修改更加聽話,透明底素材都非常好用。喺做系列海報、產品換場景同日常修圖嗰陣,呢啲功能都會非常實用。
但係喺風格化呢一部分,我感覺就冇咁驚喜。
喺今日呢啲嘗試裏面,複雜材質同部分風格化畫面依然有噪點同雜質。喺多輪改圖嘅過程中,佢冇延伸出更多、更加有亮點嘅全新風格。
佢嘅風格都係比較常規,來來去去都係一啲大眾熟悉嘅風格,冇好似 Midjourney 咁有更多美感。呢度多嘴講一句,Midjourney V8.2 最近嗰個對話編輯功能其實都幾好用。
速度方面,我喺網頁版嘅體感係快咗啲。官方講法係相比 2.0,生成延遲最多降低咗 50%,但我感覺具體都要睇任務。
不過喺多圖生成嗰陣,反而會發現佢嘅平均速度可能仲快過單張圖生成。
官方開發文件都寫咗限制:複雜提示詞可能需要成 2 分鐘,文字位置同清晰度依然有可能出錯;多次生成嗰陣,角色同品牌元素可能會有變化;複雜版式裏面嘅元素都可能放唔準。
官方話會向 ChatGPT、ChatGPT Work 同 Codex 用戶開放,API 亦已經發佈咗 Flare 同 Sunburst 兩個版本,分別側重速度同更精細嘅編輯,後者耗時更長。
我本來想從 API 去跑,但係充完錢之後,被提示話需要驗證(個人驗證或者組織驗證),基本上都好難搞。大家謹慎消費,理性充值呀。
返到標題講嘅「小小進步」,對模型本身嚟講,今次提升幅度或者唔算大,但落到我哋日常做圖、改圖嘅流程入面,已經可以帶嚟唔少實用嘅幫助。大家都可以多試嚇唔同用法,睇嚇呢啲細節上嘅進步,可以幫自己省卻邊啲功夫。
最後,今日嘅分享就到呢度喇。如果你係半夜碌到呢篇,睇嚟你真係真愛粉。咁喺呢度多謝你睇到最後~!
如果大家覺得內容有趣或者有用,請猛猛咁畀阿真猛猛三連,非常感謝~~
下期見,朋友們!

嗨大家好,我是阿真!
早上發現大家都催 Image 2.5,你們這麼積極我真的有點害怕了哈哈哈。

好的,來了來了~
這一次是 Image 2.5。當然它的全稱不是這個,大家懂的都懂。
根據 9 月 8 日的官方發佈說明,這次升級主要圍繞參考圖保真、精準局部編輯和多輪修改,同時改善光影、材質與複雜指令理解,還加入了草圖、模板和圖片評論編輯等入口。
接下來大家可以跟我一起來看看今天的案例。
A 精準局部編輯
局部修改時,其他細節大多能保持住。比如,修一修蛋撻的小細節。👇

修改一個輪子的輪轂。類似的去精準要求,效果都還不錯的。👇

小字修改,其他都沒有變化,只改最後一行的文字。👇

一致性真的很強,這時候我想到了一個主意:如果是多張圖跑起來,那它豈不是就像動畫一樣?通過這樣的方式,也可以去驗證它的一致性是不是真的有那麼好。
於是我讓它一次生成 8 張圖片,圖片會依次把一張圖從左推到右。這樣如果把 8 張圖連續起來,我們就可以看到這個字母和表情像字幕一樣,從左滾到右了。

朋友們,猜猜看,我成功了嗎?👇

只保留第3張到第6張豈不循環了。當然也可以看到,其實除了圖片以外,還是會有一點點光影起伏的變化。文字和表情符號的穩定性還算是挺不錯的了。當然如果非常嚴格來說的話,目前還是沒有達到百分之百隻改變編輯區域。🤔

但是簡單使用絲毫不成問題,比如讓它基於一張 logo 生成 8 張不同材質的圖,組在一起就是 GIF 圖了。可玩性很強啊。

還是上面的Logo,給品牌做系列品牌宣傳海報,一次6張。這個也參考了官方的案例,親測確實是挺實用的。👇


B 照片精修
也可以用來精修照片了。我手頭沒什麼比較好的參考圖,大家可以去試一下這個功能。在場景差不多的情況下,可能修一張圖,讓其他的直接參考這個去做就行了。後續也是直接給圖。👇

以後不能線下看到阿真還說沒見過本人了奧。👇


C 參考圖保真
接下來這兩張圖是參考圖,這是我和我的貓。👇

在根據不同的年代、時代以及真實場景的還原上,它已經可以做得非常好了,包括對於一些材質和質感的控制,像是 90 年代的照片,它的圖片會有那種淺淺的膠片感。
這裏注意,我測試比較粗糙,沒有去過度要求動作的改變,所以大家可能覺得動作比較拘謹。大家實際上也可以提供動作參考圖,或者是具體要求怎麼改變姿勢、增加道具之類的。
深圳世界之窗 / 夏爾袋底洞

大家之前應該也有體會:人物圖片,國外的圖片模型經常還原不好人像細節,容易讓人覺得亞洲人都長得一樣,尤其是多編輯兩輪就不像本人。
但現在它在多輪編輯後,依然能夠保持比較好的效果。接下來的圖片是按順序往下多輪編輯了很多次的,當然大家也可以在後面發現,它的細節確實有了一些變化。
下面已經到了第九輪和第十輪的編輯,可以看到面部細節上還是挺不錯的,沒有出現明顯的面部偽影和噪點、斑駁等。但是缺點也很明顯,尤其是在對於金屬或者是刺繡等複雜細緻的材質的表現上時,那種碎碎的感覺又像鬼魂一樣追了上來(左一)。
埃及貓與人肖像 / 藍緞宮廷肖像

如果只露出人物的一半面孔,出錯的幾率會高很多。
下面這兩組圖像中就可以看到:一個是人物容易出現一些不明的結構;另一個是人物在全身照時,頭部和身體也出現了明顯的人體結構問題。簡單來說,脖子和身體感覺對不上。這個問題 2.0 沒有解決,2.5 依然沒有解決。👇
09 F1賽車手 / 10 未來宇航員

測試上限,那我就上強度了。這裏我讓他把我前面測試過的所有的圖片全部放到一張海報裏。當然,崩得很厲害。
這次把這麼多人像放在一起,確實有點頂不住了。👇

D 多輪編輯
再看看多輪編輯的表現。這裏我換了一種風格,用了一張原圖,然後要求切換其他的場景,並且讓它根據環境去調整人物的光影。
整體表現上是不錯的,有個別圖片它會基於場景挪動位置。如果強制要求不要改變兩個主體的位置,應該也是可以的。
但是在多輪編輯的過程中,有的圖片可以明顯看到臉上已經有了一些偽影和噪點,這個還是不可避免的。
全部場景快速切換

部分生成圖片



E 跨格跨頁角色一致
角色一致性進步不大。給了參考圖,偶爾還是會有雙馬尾變成單馬尾的情況。👇


風格鎖定
風格鎖定並遷移,也還是比較精細的。做批量的圖要多方便有多方便了。👇


F 草圖鎖構圖
塗鴉,就能直接作畫作圖做海報了。不過這個屬於純好玩。
下方選擇【繪圖】👇



畫成什麼樣都給你變成好的哎嘿。其實這個功能,Seedream 5.0 Pro 上新的時候也已經支持了。大家可以嘗試一下看看。

G 透明底資產
前一陣子我很喜歡野獸派對,還給自己做了這種Q彈材質的造型。👇

基於這個材質讓image 2.5延伸生成帶有 Alpha 透明通道的 PNG 圖,基本能夠保持背景完全透明,非常好用。如果大家有做視覺相關需求的,這個功能會很棒。
這個其實也確實有進步了,可以給大家對比一下。精細到頭髮絲了,摳圖拜拜。
2.0 的時候,哪怕是讓它出透明的 PNG,同樣經常會出現有白邊、處理不好的情況,在深灰色背景下可以明顯看出來。2.5就好很多。下面第一排是 2.5 生成的圖,第二排是 2.0 的圖。👇


H 精確文字與版式
官方也有提到,文字信息和版式方面有提升。版式我們已經可以看見,在設計相關方面確實是有提升了。
那我們再看一下比較複雜的版式呈現。這種信息圖大家可能今年以來已經看得要煩了,這裏就不多放了,簡簡單單測試一下。文字細節上仔細看,還是會有一些字出錯。小字部分那裏會有一點點問題,但是整個陣營挺清晰,猛一看還是挺唬人的。有出錯的地方嗎?有出錯的話,大家在評論區留言說一下。👇

I 信息圖與複雜排版
有方向感了,更懂精細修改了。
做PPT,後面的頁面的格式可以穩穩保留了,可以保存好頁眉、頁腳格式以及風格哎嘿。感覺我置頂的那篇文章 Visual Style PPT Skill 大家又可以用上了。👇




每次都有朋友說圖片內容信息太多,不喜歡繁瑣,要求讓它簡單點也行。如果還是覺得太密了,就多分一些頁。



J 產品合成與品牌物料
之前我大多做的都是基於一個 logo 去延展相關的周邊。今天我們嘗試一個不一樣的:基於已有的產品去反推 VI,來看一下效果。
圖一是參考圖,後面是一次性生成的圖。不過這個偶爾也會出現直接一張圖全部輸出內容拼在一起的情況,所以大家在提示詞裏面一定要限制清楚,每一張圖是怎樣的去單獨輸出。👇





再來一組原產品保真合成圖,也是一次輸出。這裏第二張圖,之前生成的時候只有三個杯子,所以我讓它重新生成了。仔細看細節的話,感覺它還是有一點點質量上的損失。👇


Templates 和熱門這裏,點擊直接出相關周邊也很方便的,大家可以多嘗試一下,非常有趣。
比如上傳圖片,點擊表情,直出貼紙。👇

小結
整體來說,局部修改更聽話了,透明底素材也非常好用。在做系列海報、產品換場景以及日常修圖時,這些功能都會非常實用。
但是在風格化這一部分,我的感覺是並沒有那麼驚喜。
在今天的這些嘗試裏面,複雜材質和部分的風格化畫面依然有噪點和雜質。在多輪的改圖過程中,它並沒有延伸出更多、更加有亮點的全新風格。
它的風格還是比較常規,都是一些大眾所熟悉的風格,並沒有像 Midjourney 那樣具備更多的美感。這裏多嘴一句,Midjourney V8.2 最近的那個對話編輯功能其實也挺好用的。
速度方面,我在網頁版的體感上是快了一些。官方給出的口徑是相比於 2.0 生成的延遲最多降低了 50%,但我感覺具體還是要看任務。
不過在多圖生成的時候,反而會發現它的平均速度可能還會快過單張圖的生成。
官方開發文檔也寫了侷限:複雜提示詞可能需要長達 2 分鐘,文字的位置和清晰度仍然有可能出錯;多次生成時,角色與品牌元素可能變化;複雜版式裏的元素也可能放不準。
官方說會向 ChatGPT、ChatGPT Work 和 Codex 用戶開放,API 也已發佈 Flare 和 Sunburst 兩個版本,分別側重速度與更精細的編輯,後者耗時更長。
我本來想從 API 去跑,但是充完錢之後,被提示說需要驗證(個人驗證或者組織驗證),基本上都很難搞。大家謹慎消費,理性充值哦。
回到標題說的“小小進步”,對模型本身來說,這次提升的幅度或許不算大,但落到我們日常做圖、改圖的流程中,已經能帶來不少實用的幫助。大家也可以多試試不同的用法,看看這些細節上的進步,能幫自己省下哪些事。
最後,今天的分享就到這裏了。如果你是半夜刷到的,看來是真愛粉了。那麼在這裏感謝你看到最後~!
如果大家覺得內容有趣或者有用,請猛猛給阿真猛猛三連,非常感謝~~
下期見朋友們!
