為 Qwen-Image-2.1 對上 Ideogram 4.5 的文章產生的主視覺卡片,標題為 Qwen-Image-2.1 vs Ideogram 4.5,副標為「一個你租用,一個你可能不得販售」,兩個標籤寫著 Qwen Elo:1,034 與 1,074,以及 Ideogram Elo:1,014 與 1,064,頁腳為「排名依據 Artificial Analysis,2026 年 9 月」,OrcaRouter 標誌合成於右下角
Guides & Insights

Qwen-Image-2.1 對決 Ideogram 4.5:一個是租來的,一個你可能賣不得

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

無論是 Qwen-Image-2.1還是 Ideogram 4.5,都同時登上 Artificial Analysis 的兩張圖像排行榜,而在這兩張榜上,已發布、可下載的 Qwen-Image-2.1 都領先。文字生圖:1,034 Elo,排名第 18,對手是排名第 34、1,014 的 Ideogram 4.5(High)。圖像編輯:1,074,排名第 18,對手是排名第 23、1,064 的它。這在計分板上是徹底完勝,卻對多數人真正想問的問題給出毫無用處的答案,因為它拿一個能在非商業研究授權下載的模型,去比一個可以按張租用、商業出貨的模型。阿里巴巴的 Qwen 團隊於 2026 年 9 月 20 日以開放權重發布 Qwen-Image-2.1;Ideogram 4.5 則在 2026 年 9 月 30 日上線,是託管、封閉的模型,附帶點數計費表。

Elo 欄位不會讓你看見的另一件事是:Ideogram 那一列所依據的票數只有 Qwe​n 的一半,而且 Ideogram 自家上一代才是實際隨權重一起推出的版本。這兩點都比那 20 分的差距更重要。

取樣本的一半,以及這對比較有何影響

請看分數之前的票數。在文生圖方面,Qwen-Image-2.1 的那一列是由 5,286 次盲測比較構成,而 Ideogram 4.5 (High) 則是 2,247 次。在圖像編輯方面,則是 5,536 對 2,382。在同一榜單上,Ideogram 的各列大約是 Qwen 的 40% 到 43% 規模,而其中一部分純粹是因為時間差——這個榜單多了十二天來累積 Qwen 模型的票數。

信賴區間也印證了同一點。Ideogram 4.5(High)在文字轉圖像上帶有 ±11 的 Elo 區間,在編輯上則為 ±11,而 Qwen-Image-2.1 則是 ±10 和 ±9。而在編輯排行榜上,原始各列的數值接近到值得逐列說明:

• 文字轉圖像 — Qwen-Image-2.1 為 1,034(區間 1,024 至 1,044),相較於 Ideogram 4.5(High)的 1,014(區間 1,003 至 1,025)。在僅恰好相接的區間上相差二十點。具方向性,但非決定性。

• 圖像編輯 —— Qwen-Image-2.1 為 1,074(1,065 至 1,083),對上 Ideogram 4.5(High)的 1,064(1,053 至 1,075)。十分之差,區間卻重疊了大約兩個 Elo。這一項不過是披著排名外衣的擲硬幣。

• 標籤 — Qwen-Image-2.1 在兩個榜單上都帶有 Open Weights 標記。Ideogram 4.5(High)則在兩者上都沒有。

Screenshot of the Artificial Analysis text-to-image leaderboard, AA-Image-T2I v2.0, captured in English and cropped from the top row down through the Ideogram 4.5 row, showing GPT Image 2.5 Sunburst (max) first at 1,107 Elo from 14,023 samples, the Qwen-Image-2.1 row at rank 18 with 1,034 Elo from 5,286 samples, and the Ideogram 4.5 (High) row at rank 34 with 1,014 Elo from 2,247 samples

較舊的 Ideogram 才是有權重的那個

這是一個重新定義整場對決的細節。Ideogram 宣布計劃發布 4.5 的開放權重,但並未這麼做。如今能從 Ideogram 下載的是前一代,而它卻與新一代並列計分:

• Ideogram 4.0(品質)——文字生成圖像獲得 1,011 Elo,排名第 38,來自 12,176 次比較,並帶有 Open Weights 標記。在超過兩倍的樣本量下,這比 Qwen-Image-2.1 低了 23 Elo。

• {{1}}Ideogram 4.0{{/1}} — {{2}}1,004{{/2}} Elo,排名第 40,來自 10,921 次比較,開放權重標記。

• Ideogram 4.0 Fast(品質)與 Ideogram 4.0 Fast — Elo 分數分別為 984 與 968,兩者皆標示為開放權重。

• Ideogram 4.0 Instant — 982 Elo,排名第 64,亦為開放權重。

所以,誠實的開放權重比較,並不是把 Qwen-Image-2.1 拿去對比某個封閉的託管模型。而是研究專用授權下得分 1,034 的 Qwen-Image-2.1,對上在那些權重所附帶的任何授權下得分 1,011 的 Ideogram 4.0(Quality)——這是排行榜上兩款最強可下載圖像模型之間 23 分的差距,也是一對授權問題,而非一個。Ideogram 4.5 是更好的模型,而它正是你無法下載的那一個。這正是這兩列會並列在同一張表裡的唯一原因。

$0.22 能買到什麼

Ideogram 4.5 的價格是一道階梯,而非單一數字,而排行榜的價格欄位選的是最頂端的那一階。這項服務提供四種渲染速度——Turbo、Balanced、Quality 與 High——在原生 2K、2,048 像素的輸出下,Low、Medium 與 High 等級分別以每張影像 $0.03、$0.06 與 $0.22 計費。Artificial Analysis 欄位記錄的是每 1,000 張影像 $220.0,這正是 High 等級,也與每張 $0.22 的說法相符。排行榜引用的是該模型所提供最昂貴的配置,而非典型帳單。

Qwen-Image-2.1 完全沒有價格欄位——它在排行榜上的兩列資料都帶有一則明確的 無可用 API 註記。你並不是向它購買一張圖片。你下載權重檔案,在你自己付費的硬體上執行,再依你產出的圖片數量來攤提這筆成本。在高用量下,這通常比 $0.22 便宜,而且永遠更費工;在低用量下,則永遠更不划算。這兩者都是說得通的答案,但兩者都不是每張圖片的價格。

對於想要取得託管那一半、又不想再簽一份合約的人來說,路由的問題最終就落在這裡。OrcaRouter 以單一相容 OpenAI 的端點,把 200 多個模型放在前端,並以零加成的方式原樣傳遞供應商的定價,當某個供應商效能退化時,自動跨供應商容錯移轉,還有一套路由 DSL,能把多個模型組合進單一次呼叫。Qwen-Image-2.1 和 Ideogram 4.5 都不在其列——我們所提供的影像產品線是 Google 的 Imagen 各級方案與 Gemini 影像預覽、xAI 的 Grok Imagine 影像端點,以及 OpenAI 的 GPT-Image 系列。如果現在的需求是可呼叫、具商業授權的影像模型,那份清單就是答案,而上面的計分板並不是用來挑選它的工具。

董事會無法回答的問題

Generated comparison scoreboard for Qwen-Image-2.1 and Ideogram 4.5, listing editing Elo 1,074 against 1,064, editing samples 5,536 against 2,382, text-to-image Elo 1,034 against 1,014, text-to-image samples 5,286 against 2,247, and the closing pair Weights: downloadable with Licence: none for commercial use against Weights: never downloadable with Price: 220 dollars per 1,000 images

授權條款是那個已有定論的軸向,而它指向與排名相反的方向。Qwen-Image-2.1 依 2026 年 9 月 20 日的 Qwen Research License Agreement 發布:僅限非商業用途,商業使用需向供應商另行申請授權。這與較早的 Qwen-Image 系列相比是一項改變,該系列原本以 Apache 2.0 發布,而阿里巴巴自家的 Hugging Face 儲存庫則將授權條款列為 其他。兩列排行榜上的 Open Weights 標記就可下載性而言是準確的,但對此則隻字未提。

Ideogram 4.5 則恰恰相反,屬於商業服務。你是租用它的產出,並擁有使用該產出的權利——信用計量機制正是為此而存在——而你永遠不會持有權重。若交付成果是本身含有圖像功能的產品,那與「這裡有一個檔案,你不得將它的產出用於商業用途」相比,是實質上不同的立場。

還有第三條路,是那兩欄都沒有顯示的,而它正是多數團隊最後走上的路:內部作業與評估時跑可下載的模型,因為研究授權在此不會擋路;而任何會接觸到客戶的用途,就租用託管版本。排行榜讓你各有理由偏好其一,而偏好 Qwen-Image-2.1 的理由,是它在只限於你自己筆電的授權上,領先二十分的 Elo。那不是把它放進產品的理由,而任何計分板也永遠不會這樣告訴你。

真正該關注的範圍比表面上看起來更窄。如果 Ideogram 發布它承諾的 4.5 權重,那麼與 1,034 分的 Qwen-Image-2.1 進行的開放權重比較,就會變成一場真正的較量,而不是對 Ideogram 4.0 的 23 分替代指標。在那之前,排名和授權條款指向相反的方向,而能在第一次合約審查中存活下來的是授權條款。