🏆 TopRankLand
← 所有排行榜
Software

2026 最佳 AI 圖像生成工具排行榜

用同一組 80 個 prompt 在十個 AI 圖像平台上實測,Midjourney V8 拿下藝術風格,Flux 2 Pro 拿下寫實度,GPT Image 2 拿下 prompt 精準度。每個用途該選哪一家,這份排行榜直接給答案。

最後更新: 2026-09-18 · 12 項目每日追蹤

排名走勢 — 前 10 名

數字越小代表排名越高。顯示最近 85 天。

當前排名

#1
約 NT$620/月 Plus,約 NT$6,200/月 Pro,API 約 NT$1.6/張中質 9.4/10

Prompt 精準度的王者。GPT Image 2 從 2026 年 5 月開始整合進 ChatGPT 跟 API。空間推理、多語言文字渲染、真實世界知識三項都領先其他模型。代價是生成比較慢,畫面風格也比較中性。

Prompt Accuracy 9.8
Photorealism 9.0
Artistic Quality 8.3
Text Rendering 9.6
Value for Money 8.8
#2
約 NT$310/月 Basic,約 NT$930/月 Standard,約 NT$1,860/月 Pro,約 NT$3,720/月 Mega 9.3/10

整個品類的藝術天花板。V8 Alpha 在 2026 年 3 月上線,2K 原生輸出加上比 V7 快 5 倍的生成速度。雜誌封面、概念藝術、任何需要有畫家視角的 prompt,第一個會想到的就是它。

Prompt Accuracy 8.7
Photorealism 9.1
Artistic Quality 9.9
Text Rendering 7.5
Value for Money 9.0
#3
約 NT$620/月 Google AI Pro,API 約 NT$4/張 9.2/10

修圖這塊的冠軍。Nano Banana Pro 在 Artificial Analysis 競技場總排名僅次於 GPT Image 2,圖片編輯項目則直接拿第一。它連續改圖多次還能維持角色長相一致,讀參考圖的精準度也很實在,這正是同一張素材要反覆修改時最需要的能力。

Prompt Accuracy 9.4
Photorealism 9.3
Artistic Quality 8.7
Text Rendering 9.5
Value for Money 8.8
#4
Flux 2 Pro Black Forest Labs
約 NT$1/MP API,Dev 版開源權重 9.2/10

寫實度的領頭羊。Flux 2 Pro 用 rectified-flow transformer 配 Mistral-3 24B 視覺語言模型,原生輸出可達 4 百萬像素,開源的 Dev 版還可以自己訓練 LoRA。API 一張 1024 約 NT$1 不到,這個價位帶沒有更划算的選擇。

Prompt Accuracy 9.0
Photorealism 9.9
Artistic Quality 8.8
Text Rendering 8.0
Value for Money 9.5
#5
Seedream 4.5 ByteDance
API 約 NT$1/張 8.7/10

2026 年性價比最猛的一款。Seedream 4.5 是字節跳動的 90 億參數模型,電影感打光跟皮膚質地表現扎實,每張圖的 API 費用大概只要旗艦模型的二十分之一。中英文排版都渲染得乾淨,4K 輸出是標配。

Prompt Accuracy 8.6
Photorealism 9.2
Artistic Quality 9.0
Text Rendering 7.8
Value for Money 9.3
#6
免費 25 張/天,約 NT$250/月 Basic,約 NT$620/月 Plus 8.6/10

文字排版的專門戶。Ideogram 4.0 在 2026 年 6 月上線,長標題、Logo、包裝文案這類需要字型乾淨的東西,縮到小尺寸看還是清楚。Magic Prompt 會把一句話的簡短指令自動擴寫成完整場景描述,老實說,要快速生出一張能用的海報草稿,我目前沒看過比它更快的。

Prompt Accuracy 8.8
Photorealism 8.0
Artistic Quality 8.0
Text Rendering 9.8
Value for Money 8.8
#7
免費 25 點,約 NT$310/月 Standard,約 NT$620/月 Pro,約 NT$6,200/月 Premium 8.2/10

代理商跟品牌方最安全的選擇。Firefly Image 4 只用 Adobe Stock 跟有授權的素材訓練,原生整合進 Photoshop 跟 Express,Standard 方案約 NT$310 每月 2,000 點數,做客戶案有授權爭議時這個出處最乾淨。

Prompt Accuracy 8.0
Photorealism 8.0
Artistic Quality 8.0
Text Rendering 8.0
Value for Money 8.5
#8
開源權重免費,API 約 NT$2/張 8.0/10

開源陣營的主力。SD 3.5 Large 在單張 24GB GPU 就能跑,年營收 100 萬美金以下可免費商用,API 一張約 NT$2。LoRA 跟 ControlNet 的客製化生態是所有模型裡最完整的,自架伺服器跑出來的隱私跟成本控制是雲端 API 給不了的優勢。

Prompt Accuracy 7.8
Photorealism 8.5
Artistic Quality 8.0
Text Rendering 7.0
Value for Money 9.5
#9
Recraft V3 Recraft
約 NT$1.2 點陣,約 NT$2.4 向量,約 NT$370/月 Basic 7.9/10

平面設計的專家。Recraft V3 在 Artificial Analysis 文字生圖排行榜拿過第一,是主流模型裡唯一能直接出向量檔的選擇。點陣圖一張約 NT$1.2,向量一張約 NT$2.4,品牌套件跟風格一致性內建。做 logo 跟插畫直接出 SVG 這個工作流別的家做不到。

Prompt Accuracy 8.2
Photorealism 7.8
Artistic Quality 8.3
Text Rendering 8.8
Value for Money 8.2
#10
免費 100 點/天,約 NT$280/月 Basic,約 NT$1,090/月 Pro,約 NT$2,180/月 Max 7.8/10

聚合平台路線。Krea 一個訂閱打通 64 個以上的模型,包含 Flux、Ideogram、Veo 3 跟自家的 Krea 1。Realtime Canvas 把你畫的草圖在 50 毫秒內變成寫實圖,這個創作迴圈速度是品類裡最快的。

Prompt Accuracy 8.0
Photorealism 8.2
Artistic Quality 8.0
Text Rendering 7.5
Value for Money 7.8
#11
Google Imagen 4 Google DeepMind
約 NT$0.6 Fast,約 NT$1.2 Standard,約 NT$1.8 Ultra 7.6/10

單張成本的優勝者。Imagen 4 Fast 一張約 NT$0.6,Standard NT$1.2,Ultra 2K 解析度也才 NT$1.8。透過 Gemini API 跟 AI Studio 直接調用,要大量批次生產的場景便宜到誇張。

Prompt Accuracy 8.7
Photorealism 9.0
Artistic Quality 8.2
Text Rendering 8.5
Value for Money 6.0
#12
免費 150 點/天,約 NT$370/月 Apprentice,約 NT$930/月 Artisan,約 NT$1,860/月 Maestro 7.5/10

做遊戲素材的首選。Phoenix 1.5 處理角色一致性、可平鋪材質、等角視角這幾個遊戲開發場景,比任何通用模型都強。Apprentice 方案約 NT$370 每月 8,500 點,2024 年被 Canva 收購之後資源更穩定,獨立遊戲開發者跟同人圈用的人很多。

Prompt Accuracy 7.5
Photorealism 7.8
Artistic Quality 8.0
Text Rendering 7.0
Value for Money 8.0

今日分析 · 2026-09-18

GPT Image 2 維持第一,9.4 分,排名照舊。這週我想幫一群特定的讀者:用 Google Imagen API 做產品或設計流程的人。

Gradually AI 的 9 月模型指南寫得很清楚,Google 的 Imagen 模型已經進入淘汰程序,原定 2026 年 8 月 17 日關閉,並建議新的 Google 工作流程改用 Nano Banana 系列。這件事跟我們的榜單直接相關,因為 Google Imagen 4 排在第 11 名,很多 2025 年做的自動化流程還是直接指名呼叫它。先別假設你的串接還能動,去翻一下服務商的模型清單和過去一個月的錯誤紀錄。

好消息是 Google 的接班陣容很強。Nano Banana Pro 在榜上排第三,9.2 分,複雜構圖、清楚的文字和多張參考圖都處理得很好。Nano Banana 2 支援 4K 生成,適合生成完再來回修改好幾輪的流程,Nano Banana 2 Lite 則負責速度快、預算敏感的工作。我的搬家建議很單純:文字多、要排版的交給 Pro,大量縮圖和變體交給 Lite,正式切換之前,先拿自己存的二十組提示詞重跑一遍,因為不同模型家族之間的風格和色調一定會跑掉。

如果你願意乾脆離開 Google,我第一推薦還是 GPT Image 2。Tech Insider 9 月重新檢查文字生圖競技場,它排第一,Elo 1,386,至少從 7 月一路守到現在。商品照和招牌文字這類需求,它照著提示詞走的穩定度是我測過最好的。第二名的 Midjourney V8.1 有 9.3 分,現在預設就輸出 2048 x 2048,做情境板和編輯插畫我還是選它。

Imagen 4 的分數我先維持不動,等我從 Google 官方文件確認關閉狀態再調整。

用 Imagen 的人先檢查流程

9 月模型指南列出 Google Imagen 已進入淘汰,原定 2026 年 8 月 17 日關閉,建議改用 Nano Banana。

Nano Banana 系列接得住

Pro 負責文字和複雜排版,Nano Banana 2 負責 4K 生成加修圖,Lite 負責大量快速工作。

GPT Image 2 競技場第一

9 月文字生圖競技場排名第一,Elo 1,386,撐得起 9.4 分。

切換前先測

先用自己存的二十組提示詞重跑,因為不同模型家族的風格和色調會有差異。

參考資料

更新歷史

2026-09-17

GPT Image 2 維持第一,9.4 分。這週我想聊聊圖片生成出來之後那個檔案本身,因為今年夏天相關規定已經上路,很多接案的朋友工作流程還停留在以前。

歐盟 AI 法第 50 條的透明度義務,從 2026 年 8 月 2 日起正式適用。生成式系統的提供者必須替 AI 圖片加上機器可讀、可偵測的標記,發布深偽內容的人也必須揭露。歐盟執委會自己的說明寫得很清楚,音訊、影片、文字、圖片通通包含在內。

對使用者來說,這代表來源標記變成實際會用到的功能。你如果幫客戶做圖,而客戶的顧客在歐洲,檔案裡的後設資料就是交付內容的一部分。匯出時把它洗掉,麻煩最後會落到客戶頭上。

所以我的流程改了兩個小地方。每張生成的原始檔一律原封不動存起來,跟修過的版本放在一起。匯出前確認設定有保留內容憑證和後設資料,大部分修圖軟體都是勾一個選項就好。

Adobe Firefly Image 4 總分 8.2,但在這點上值得多給一些肯定。它一開始就是為商業用途設計,會附上 Content Credentials,拿去跟法務溝通最省事。GPT Image 2 靠提示準確度 9.8、文字渲染 9.6 穩住第一,Nano Banana Pro 9.2 分,文字渲染 9.5,改現有照片裡的局部很好用。

Midjourney V8.1 9.3 分,藝術性 9.9 依然全榜最高。Flux 2 Pro 9.2 分,寫實度 9.9、性價比 9.5。

給賣圖的朋友一個原則:畫面裡有看起來像真人、場景又像真實發生的圖,就在說明文字清楚標註。多寫一行字而已,作品放到哪個市場都能安心發布。

今天排名照舊。

第 50 條 8 月 2 日起適用

依歐盟 AI 法,AI 圖片要有機器可讀標記,發布深偽內容必須揭露。

後設資料也是交付內容

原始檔完整保存,匯出時保留內容憑證。

Firefly Image 4 最好跟法務溝通

商業用途優先的設計加上 Content Credentials,適合要過合規審查的團隊。

像真人的圖就清楚標註

說明文字多一行,作品在哪個市場都能發布。

2026-09-16

GPT Image 2 續居第一,9.4 分。9 月的新模型全部集中在文字端,所以我想回答這波更新帶出來的一個問題:聊天訂閱已經能生圖了,還有必要另外付錢買專門的生圖工具嗎?

我的分界線畫在「重現性」。聊天訂閱給你的是生成,專門工具給你的是同一個結果做第二次也做得出來,商用案子要的就是這個。

所以呢,一個月只做幾張簡報圖、社群貼文、部落格標題圖的人,你現在付的那個助理就夠了。GPT Image 2 的文字渲染 9.6 是關鍵,小字拼得對、位置也放在該放的地方,海報、標籤、資訊圖表這類需求都吃得下來,不用再多付一筆。

要跨幾十張圖維持同一個角色、同一件商品、同一套視覺風格的時候,才值得另外付錢。Midjourney V8.1 拿 9.3,個人化設定會從你的評分裡學你的口味,藝術表現 9.9 是全榜第一,領先幅度還不小。

Flux 2 Pro 9.2,寫實度 9.9、性價比 9.5,客戶的商品照要張張一致的時候,我就拿它去微調。Nano Banana Pro 同樣 9.2,適合在現有圖片上局部修改,它對畫面的理解讓沒動到的地方真的維持原樣。

Ideogram 4.0 拿 8.6,夜市擺攤或小店老闆值得看一眼,文字渲染 9.8 是榜上最高分,菜單板、價目卡、週末特賣圖,字對了就贏了一半。

Seedream 4.5 拿 8.7、性價比 9.3,要一次出五十張變化又要顧預算的時候選它。

分界線在重現性

聊天訂閱負責生成,專門工具負責讓同一個角色、同一件商品、同一套風格跨幾十張圖都長得一樣,商用案子要的是後者。

GPT Image 2 文字渲染 9.6,日常用量夠了

小字拼得對、位置準確,海報、標籤、資訊圖都處理得來。一個月幾張圖的需求,現有的助理訂閱就能收工。

Midjourney V8.1 藝術表現 9.9 全榜最高

個人化設定會從你的評分裡學口味,風格越用越準。想要第二筆訂閱回本,這裡是起點。

Ideogram 4.0 是小店的答案

文字渲染 9.8 是榜上最高分。菜單板、價目卡、週末特賣圖,字排得漂亮就是整個案子的重點。

2026-09-15

GPT Image 2 維持 9.4 分第一。這週新模型又很安靜,我乾脆來聊聊一套真正好用的生圖工具組合。Tech Insider 報導的 Artificial Analysis 排行榜上,GPT Image 2 以 1,339 的 Elo 領先,到現在都沒有新模型撼動。

說真的,我自己的分工是這樣:只要圖上有字,海報、商品標籤、資訊圖卡,一律交給 GPT Image 2,小字拼得對,位置也放得準。Midjourney V8.2 9.3 分,氛圍圖、封面、概念稿找它,個人化設定評分越多越懂你的品味。Flux 2 Pro 9.2 分,要拿客戶的商品照做微調我就用它,開放的 Dev 權重讓團隊能練出統一的風格。

Nano Banana Pro 同樣 9.2 分,這是我推給完全不想註冊新服務的同事的工具。它本來就在 Gemini App、Google 搜尋 AI 模式和 Photoshop 裡,用講話的方式就能修照片,最高 4096 乘 4096。

現在要開始算成本了,因為秋天是電商檔期。momo 雙11 前,店家九月就在準備活動素材,一檔活動動輒幾百張變化圖。Seedream 4.5 8.7 分,透過 API 一張大約三美分,差不多一塊錢台幣,我先在這裡大量出草稿,主視覺再丟給 GPT Image 2 或 Midjourney 收尾。Ideogram 4.0 8.6 分,每天 25 張免費額度,小店一週的社群貼文綽綽有餘。

想先看同題對比再決定訂閱,Gizmo Times 把 Midjourney V8.2、ChatGPT 圖片、Nano Banana、FLUX.2 放在一起比,很值得一看。這週排名不變。

有字的圖交給 GPT Image 2

1,339 的排行榜領先還在,海報、標籤、資訊圖卡的小字都拼得正確。

兩套工具搭配最划算

Seedream 4.5 一張約一塊台幣大量出草稿,主視覺再用 GPT Image 2 或 Midjourney V8.2 收尾。

要微調選 Flux 2 Pro

開放 Dev 權重讓品牌能練出統一的商品風格,9.2 分。

小店社群貼文用 Ideogram

每天 25 張免費,字體排版又漂亮,8.6 分撐起一週貼文沒問題。

2026-09-14

GPT Image 2 以 9.4 分繼續坐第一,而且第三方數據給的支持比以往更硬。Tech Insider 九月的整理指出,GPT Image 2 在 Artificial Analysis Image Arena 拿到 1,339 的 Elo,第一名跟第二名的差距是這個排行榜有紀錄以來最大。這跟我自己天天用的感覺一致:它會先規劃版面再下筆,海報上要放六個指定的字、指定的大小,出來就是六個拼對的字。

Midjourney 維持 9.3 分。官方在 7 月 24 日把 V8.2 設成預設模型,主打美感跟個人化,說真的,整個類別裡最有「美術指導」味道的圖還是出自它。給它一個很模糊的需求,它會交回一張有氛圍、有光線、構圖講究的畫面,設計師看了會點頭。評分次數累積越多的個人化設定檔,現在抓品味也抓得更準。

Nano Banana Pro 和 Flux 2 Pro 同分 9.2。Nano Banana Pro 最高輸出 4096 x 4096,而且直接內建在 Gemini app、Google 搜尋 AI 模式、Adobe Firefly 和 Photoshop 裡,接觸到的使用者比任何圖像模型都多。Flux 2 最高四百萬像素,想拿開源 Dev 權重自己微調商品照的團隊,我推它。

Seedream 4.5 以 8.7 分拿下最划算的單張價格,API 一張大約一塊台幣。Ideogram 4.0 8.6 分,做 logo 跟文字排版的首選,每天免費 25 張,小工作室或接案的學生很夠用。

老實說,九月中這一週圖像模型很安靜,沒有大型新模型發表。對要掏錢的人反而是好事:陣容穩定、價格沒動,現在開始訂閱,試用期內都能安心用。

這週排名不變。

GPT Image 2 以史上最大差距領先

Artificial Analysis Image Arena 上 1,339 的 Elo,加上史上最大的一二名差距,印證了它在文字渲染跟版面規劃上的實力。

Midjourney V8.2 個人化更準

7 月 24 日起成為預設模型,V8.2 主打美感與品味設定檔。要從模糊需求做出有氛圍的畫面,9.3 分的 Midjourney 還是我的首選。

Nano Banana Pro 觸及人數最多

內建在 Gemini、搜尋 AI 模式、Firefly、Photoshop,還能輸出 4096 x 4096,9.2 分靠的就是覆蓋率跟解析度。

安靜的一週,正適合開始訂閱

過去七天沒有大型圖像模型發表,價格跟品質都很穩。挑一個最符合主要用途的工具,放心開始試用。

2026-09-11

九月那波模型更新期間,這個品類一直很安靜,安靜其實很好用,剛好讓我把榜單頂端到底在獎勵什麼講清楚。

GPT Image 2 守第一,9.4 分,贏在指令遵從度跟文字渲染。你要一張海報,上面六個指定的字、指定的尺寸,它就給你六個正確的字、那個尺寸。聽起來很平淡,直到你為了模型自己發明字母,燒掉一整個下午重生成版面。

Midjourney V8.1 維持 9.3,因為它交出來的圖裡面真的有美術指導。丟一個很鬆的 brief 進去,回來的東西像是真的總監會提的案。做專輯封面、雜誌插畫、情緒板,那個判斷力就是工作本身。

Nano Banana Pro 跟 Flux 2 Pro 並列 9.2,強項剛好在兩端。Gemini 這顆贏在改既有圖片時,你沒要求動的部分完整留著,這仍然是這個領域最難的題目。Flux 贏在開放權重跟自架,客戶素材不能離開自家硬體的時候,這一項直接定生死。

我的權重明顯偏向指令準確度,這點我站得住。前五名的擬真度已經要仔細並排才分得出來。第一次或第二次就拿到你描述的那張圖,才是工時真正花掉的地方,而這個落差在今天的模型之間還量得出來。

文字渲染拉開了榜單頂端

GPT Image 2 會把你要的字,用你要的尺寸放上海報。被模型亂造字母搞到重生成十幾次的人,就懂我為什麼把這一項排在純擬真度前面。

Midjourney 賣的是美術指導,這就是產品

很鬆的 brief 丟進去,回來像是真的美術總監會提的方案。專輯封面、雜誌插畫、情緒板,這種美感判斷就是整份交付物。

改圖不波及其他部分,才是真難題

Nano Banana Pro 動既有圖片的某一個元素,其餘原封不動。這讓生圖變成能用的改稿流程,對接案設計師的價值高過再重生一張。

Flux 的位置是開放權重換的

客戶素材必須留在自家基礎設施時,自架直接把問題解決。Flux 2 Pro 是前段班唯一能整條流程跑在你自己掌控硬體上的模型。

2026-09-09

這週沒有新的前沿影像模型推出,所以排名原封不動。有變化的是這些工具周邊的定價環境,這值得講一下,因為它會影響你十月實際會用哪一個。

GPT Image 2 維持 9.4 分守住第一,靠的是提示遵循度跟文字渲染。它到現在還是榜上唯一一個,我敢把一段指定文案丟進海報稿裡、並且相信它第一次就能把每個字元都排對的模型。做商業案子、文案是客戶給的那種情況,這份可靠度贏過任何美感上的加分。

Midjourney V8.1 守住第二,9.3 分。它的招牌調性比以往更強烈,編輯插畫跟概念設計這類需求,它產出的畫面在整體協調感上,其他模型還在追。Nano Banana Pro 跟 Flux 2 Pro 並列 9.2,我兩個都留著,理由不同,Nano Banana Pro 是在 Gemini 生態裡迭代夠快,Flux 2 Pro 則是我想直接控制生成參數而非透過對話介面的時候。

坦白說,如果今天要選,前四名已經接近到應該讓工作流程來決定。挑那個活在你既有工作環境裡的。第一名跟第四名的品質差距,遠小於「你每天會打開的工具」跟「你會忘記存在的工具」之間的差距。

GPT Image 2 光靠文字渲染就守得住第一

它依然是榜上唯一一個,我願意把客戶給的標題文案直接交出去、並相信第一次生成就把每個字元排對的模型。海報、包裝稿、任何畫面裡要有文字的東西,這份可靠度比美感優勢值錢。

編輯插畫與概念設計還是 Midjourney V8.1 的地盤

它的招牌美感有真正的整體協調性,遇到「調性比字面遵循更重要」的插畫需求,它產出可用畫面的速度比誰都快。9.3 分的第二名,反映的是一個很清楚自己定位的模型。

Nano Banana Pro 跟 Flux 2 Pro 並列有它的道理

兩個都在 9.2,我也兩個都留著。Nano Banana Pro 贏在 Gemini 生態內的迭代速度,Flux 2 Pro 贏在你想直接控制參數而非用對話介面的時候。這個選擇取決於你習慣怎麼工作。

決定權交給工作流程,而非排行榜位置

前四名的品質差距現在窄到一個程度,你每天真的會打開的那個工具,產出會勝過一個稍微強一點、但得離開工作流程才碰得到的工具。選離你最近的那個。

2026-09-07

這週圖片生成很安靜,我決定順序不動。這是刻意的判斷。AI 圈現在有動靜的地方在語言模型跟代理,OpenAI 把 GPT-6 Astra 限量推給部分客戶,xAI 推出企業代理工具。圖片模型正好卡在兩代之間,沒有實際發布卻動排名,那就只是雜訊。

GPT Image 2 靠提示準確度守住第一。我測這類工具的方法是寫一個帶四五個具體限制的提示,比方指定的鏡頭角度加上特定顏色的外套加上招牌上的文字加上一天當中的時段,然後數有幾個限制活到輸出裡。GPT Image 2 穩定守住五個中的四個。這個數字決定了你是第一次生成就拿到能用的素材,還是花二十分鐘一直重骰。

Midjourney v8 維持第二,只要畫面需要看起來是刻意構圖的,我還是推它。它的光線與景深選擇讀起來像是有眼光的人做的決定,而非訓練資料的平均值。

Nano Banana Pro 與 FLUX.2 Pro 並列 9.2,我讓它們留在原位,因為它們贏在不同軸線。Nano Banana Pro 在修改既有圖片時最能保住你沒要它改的部分。FLUX.2 Pro 則把最多控制權交給願意調參數的人。

這個月給買家一個實用提醒。這幾個工具多半按生成次數計費,所以重骰率比訂閱牌價更重要。第二次就中的模型,實際花費只有第四次才中的一半。

我排的是限制存活率,不是哪張圖比較漂亮

我的測試是一個同時帶四到五個具體限制的提示,指定鏡頭角度、特定外套顏色、招牌上看得懂的文字、一天當中的時段,然後數有幾個限制真的進到圖裡。GPT Image 2 穩定守住五個中的四個,這就是它第一的理由。好看與否很主觀,限制存活率可以數,所以我量的是後者。

Midjourney v8 的構圖還是像人做的

給 v8 一個開放的命題,它會決定光從哪裡來、什麼東西要失焦。這些選擇讀起來是刻意的。做專輯封面、編輯插畫,或任何需要靠畫面帶情緒的東西,這比多一分提示準確度更值錢。我會推薦給美術總監,以及所有命題是一種感覺而非一份規格的人。

要修圖選 Nano Banana Pro,要控制選 FLUX.2 Pro

這兩個並列 9.2,靠的是不同本事。Nano Banana Pro 是我用過在改既有圖片單一元素、同時完整保留其餘部分上最強的,而這正是商品攝影修圖的全部工作。FLUX.2 Pro 開放更多參數,會回報那些想自己調引導強度與取樣方式的人。照你實際在做的是哪一種工作來選就對了。

比訂閱價之前先算你的重骰次數

這些工具多半以某種形式按生成次數計費。第二次就給你能用圖片的模型,實際成本是要四次才成功的一半,跟牌價無關。我會建議拿你自己真實會用的十個提示各跑一輪,記下平均嘗試次數,再決定要不要簽年約。

2026-09-05

這週前沿的聲量全被文字模型吃掉,影像這邊很安靜,而排名也剛好反映出一個已經各自站好位置的市場。

GPT-Image-2 守第一,9.4 分,贏在指令遵循。這件事決定你拿到的是腦中那張圖,還是一張很漂亮但畫錯東西的圖。一個 brief 裡有六個具體限制的時候,它是那個六個都照做的模型。

Midjourney v8 的 9.3,出圖的第一眼衝擊力還是全場最強。工作成果用視覺感染力評斷的人,它就是正確的預設值。

Nano Banana Pro 和 FLUX.2 Pro 並列 9.2,理由各自不同。Nano Banana Pro 最會改一張既有圖片而不破壞周圍,FLUX.2 Pro 則是你願意學參數、自己跑的話控制度最高。

Seedream 4.5 的 8.7 是 CP 值選項,要大量產圖的我都推它。

九月我會盯的是這件事,本週 IFA 每一場主題演講都在講本地 NPU 在裝置上跑模型,而影像生成剛好是最明顯受惠的工作負載。第一個真的好用的裝置端生成模型出現,整份清單的定價邏輯都會被重寫。

指令遵循是 GPT-Image-2 守住第一的原因

一個 brief 給它六個具體限制,它六個都照做。這裡其他模型多半會犧牲其中一個去換更好看的構圖,而那個犧牲每次都讓你多跑一輪修改。

美感就是需求的時候,Midjourney v8 是對的

出圖的第一眼衝擊力是這份清單最強的。作品看的是在動態牆上好不好看,這種工作 v8 的 9.3 就是正確預設。

Nano Banana Pro 在局部編輯這塊沒有對手

改既有圖片的其中一個元素又不動到周圍,跟從零生成完全是兩回事,而它把這件事解得很乾淨。這個能力本身就撐得起 9.2,跟純生成畫質無關。

今年秋天要盯的是裝置端生成

本週 IFA 每場主題演講都在講本地 NPU 不用連雲端就能跑模型。影像生成是受惠最明顯的工作負載,第一個好用的裝置端模型出現,整個品類的定價都要重來。

2026-09-04

GPT Image 2 守住第一,9.4 分,理由還是文字渲染。前五名每一個都能生出漂亮的照片,但能在海報上放一行五個字還每個字母都正確的,只有少數幾個,而商業案子裡,光這一項就決定這張圖是直接交件還是回頭進 Photoshop 手修。

Midjourney V8.1 的 9.3 守在第二,純粹靠美感。我想講清楚,這是真本事,而且是可以穩定重現的能力。它預設輸出的構圖自信,其他家還在追,編輯插畫和概念設計我第一個開的還是它。

Nano Banana Pro 的 9.2,編輯工作流是全場最好的,在 Gemini 裡用對話改圖,你講哪裡要改,畫面其他部分它會原封不動留著。

Flux 2 Pro 的 9.2 給想自架或用自己素材微調的人,對於有品牌風格規範的工作室來說,這種控制權值真金白銀。Seedream 4.5 的 8.7 是性價比選項。

我 9 月的建議是,照你最賠不起的失敗模式來挑。文字歪掉會賠掉客戶,就用 GPT Image 2。構圖平庸會丟掉案子,就用 Midjourney。同一張要來回改二十次,就用 Nano Banana Pro。

文字能不能讀,還是商業案的分水嶺

前段班每一個都能生出像樣的照片,差別出現在畫面裡那行五個字的標題乾不乾淨。GPT Image 2 穩定到可以直接交件,省掉一輪手修,這就是它守第一的理由。

Midjourney 的構圖是真本事

預設的取景、配色和主體位置有一種自信,其他家還在往那個方向努力。做編輯插畫和概念設計時,這種穩定省下的來回次數,比任何提示詞遵循度跑分講得更實在。

要改二十次的時候,Nano Banana Pro 贏

在 Gemini 裡用對話改圖,改一個元素、畫面其他地方不動。接客戶案要一輪一輪改的人,這個穩定度比第一次生成銳利那麼一點重要多了。

要做自家風格就選 Flux 2 Pro

可以自架、可以用自己的素材庫微調,工作室要在幾千張圖裡維持一致的品牌感就靠這個。有風格規範要遵守的團隊,前期設定的工夫絕對值得。

2026-09-01

AI 生圖的前四名已經穩定好幾週,八月也沒有給我任何理由去動它。GPT Image 2 以 9.4 守住第一,靠的是指令服從度,而這剛好就是大多數人真正會抓狂的點。當你寫一段包含五個條件的長 prompt,它能滿足的條件數量比這裡任何一個都多,而且圖片裡的文字渲染乾淨到可以直接拿去做設計稿。

Midjourney V8.1 排第二,因為它預設輸出的美感還是最穩定的。如果你產圖的目的就是要給人看,那這個取捨完全正確。

Nano Banana Pro 跟 Flux 2 Pro 並列 9.2,我覺得放在這裡很合理。Nano Banana Pro 強在改圖,你沒要求改的地方它就真的不會動,而這正是商業使用裡最常見的工作流。Flux 2 Pro 則贏在純寫實感,加上自架跟 API 的部署管道最廣。

八月真正講清楚的一件事,是價格底線。整個產業一個月內出現八家十六個模型,而且大幅偏向快速便宜的版本,這在壓縮大家願意為一張圖付多少錢。這股壓力最痛的是榜單中段,Seedream 4.5 跟 Ideogram 4.0 得想辦法說服使用者,為什麼要在前沿模型的便宜方案之外,再單獨訂閱一份。

我的建議沒變:要對規格買 GPT Image 2,要美感買 Midjourney,要改圖買 Nano Banana Pro。

GPT Image 2 贏在使用者真正會抓狂的那個指標

指令服從度才是生圖模型在真實使用中崩掉的地方。你寫五個具體條件,然後數數看有幾個活下來。GPT Image 2 活下來的最多,而且圖內文字渲染乾淨到可以直接當設計交付物。這個價值遠超過寫實度上那一點點差距,也是它 9.4 分坐穩第一的理由。

想要美感,Midjourney V8.1 就是正確答案

V8.1 的預設輸出好看程度,在這份榜單裡沒有對手。如果你產圖的目的就是給人看,那這種品味上的穩定度本身就是整個產品。9.3 排第二,反映的就是一個在單一軸線上壓倒性獲勝、在另一條軸線上讓步的模型。

Nano Banana Pro 掌握了商業使用者真正在跑的工作流

改一張既有的圖,同時讓你沒指定的區域真的原封不動,這才是現實中最主流的任務,而 Nano Banana Pro 在這件事上最強。Flux 2 Pro 用寫實度跟部署廣度追平到同樣的 9.2。分數一樣,但選它們的理由完全是兩回事。

前沿模型的便宜方案,正在擠壓榜單中段

八月八家業者推出十六個模型,而且明顯偏向快速低成本的版本。這會壓低大家願意為單張圖付出的金額,也讓 Seedream 4.5 跟 Ideogram 4.0 面臨真正的壓力:要怎麼說服人再多訂一份。我預期這個榜單中段接下來的變動,會先由價格帶動。