大模型評測

我們用同一套測試集實測每個主流圖像模型:指令遵循、文字渲染、圖像編輯與照片真實感。

更新於 2026-07-02

#模型綜合指令遵循文字渲染圖像編輯照片真實感速度單圖價格適用場景
1
GPT-Image-2
OpenAI
9.2
9.59.49.08.818s$0.07Posters, layered exports, text-heavy design work
2
Nano Banana Pro
Google
9.0
9.29.19.38.912s$0.05Image editing, character consistency, multi-image fusion
3
FLUX.2
Black Forest Labs
8.6
8.47.88.29.38s$0.03Photorealism, open-weights workflows, ComfyUI pipelines
4
Midjourney v8
Midjourney
8.4
7.97.27.59.030sSubArt direction, stylized illustration, mood boards
5
Seedream 4.0
ByteDance
8.2
8.38.68.08.410s$0.03CJK text rendering, e-commerce assets at volume

評測方法

每個模型都運行同一套 60 條提示詞的測試集,覆蓋四個維度。分數為 0–10 分,取三位編輯的平均值。速度為生成時間中位數,價格為官方公佈的 API 價格。