
Qwen-Image-2.1 對決 Ideogram 4.5:一個是租來的,一個你可能賣不得
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 223 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
無論是 Qwen-Image-2.1還是 Ideogram 4.5,都同時登上 Artificial Analysis 的兩張圖像排行榜,而在這兩張榜上,已發布、可下載的 Qwen-Image-2.1 都領先。文字生圖:1,034 Elo,排名第 18,對手是排名第 34、1,014 的 Ideogram 4.5(High)。圖像編輯:1,074,排名第 18,對手是排名第 23、1,064 的它。這在計分板上是徹底完勝,卻對多數人真正想問的問題給出毫無用處的答案,因為它拿一個能在非商業研究授權下載的模型,去比一個可以按張租用、商業出貨的模型。阿里巴巴的 Qwen 團隊於 2026 年 9 月 20 日以開放權重發布 Qwen-Image-2.1;Ideogram 4.5 則在 2026 年 9 月 30 日上線,是託管、封閉的模型,附帶點數計費表。
Elo 欄位不會讓你看見的另一件事是:Ideogram 那一列所依據的票數只有 Qwen 的一半,而且 Ideogram 自家上一代才是實際隨權重一起推出的版本。這兩點都比那 20 分的差距更重要。
取樣本的一半,以及這對比較有何影響
請看分數之前的票數。在文生圖方面,Qwen-Image-2.1 的那一列是由 5,286 次盲測比較構成,而 Ideogram 4.5 (High) 則是 2,247 次。在圖像編輯方面,則是 5,536 對 2,382。在同一榜單上,Ideogram 的各列大約是 Qwen 的 40% 到 43% 規模,而其中一部分純粹是因為時間差——這個榜單多了十二天來累積 Qwen 模型的票數。
信賴區間也印證了同一點。Ideogram 4.5(High)在文字轉圖像上帶有 ±11 的 Elo 區間,在編輯上則為 ±11,而 Qwen-Image-2.1 則是 ±10 和 ±9。而在編輯排行榜上,原始各列的數值接近到值得逐列說明:
• 文字轉圖像 — Qwen-Image-2.1 為 1,034(區間 1,024 至 1,044),相較於 Ideogram 4.5(High)的 1,014(區間 1,003 至 1,025)。在僅恰好相接的區間上相差二十點。具方向性,但非決定性。
• 圖像編輯 —— Qwen-Image-2.1 為 1,074(1,065 至 1,083),對上 Ideogram 4.5(High)的 1,064(1,053 至 1,075)。十分之差,區間卻重疊了大約兩個 Elo。這一項不過是披著排名外衣的擲硬幣。
• 標籤 — Qwen-Image-2.1 在兩個榜單上都帶有 Open Weights 標記。Ideogram 4.5(High)則在兩者上都沒有。

較舊的 Ideogram 才是有權重的那個
這是一個重新定義整場對決的細節。Ideogram 宣布計劃發布 4.5 的開放權重,但並未這麼做。如今能從 Ideogram 下載的是前一代,而它卻與新一代並列計分:
• Ideogram 4.0(品質)——文字生成圖像獲得 1,011 Elo,排名第 38,來自 12,176 次比較,並帶有 Open Weights 標記。在超過兩倍的樣本量下,這比 Qwen-Image-2.1 低了 23 Elo。
• {{1}}Ideogram 4.0{{/1}} — {{2}}1,004{{/2}} Elo,排名第 40,來自 10,921 次比較,開放權重標記。
• Ideogram 4.0 Fast(品質)與 Ideogram 4.0 Fast — Elo 分數分別為 984 與 968,兩者皆標示為開放權重。
• Ideogram 4.0 Instant — 982 Elo,排名第 64,亦為開放權重。
所以,誠實的開放權重比較,並不是把 Qwen-Image-2.1 拿去對比某個封閉的託管模型。而是研究專用授權下得分 1,034 的 Qwen-Image-2.1,對上在那些權重所附帶的任何授權下得分 1,011 的 Ideogram 4.0(Quality)——這是排行榜上兩款最強可下載圖像模型之間 23 分的差距,也是一對授權問題,而非一個。Ideogram 4.5 是更好的模型,而它正是你無法下載的那一個。這正是這兩列會並列在同一張表裡的唯一原因。
$0.22 能買到什麼
Ideogram 4.5 的價格是一道階梯,而非單一數字,而排行榜的價格欄位選的是最頂端的那一階。這項服務提供四種渲染速度——Turbo、Balanced、Quality 與 High——在原生 2K、2,048 像素的輸出下,Low、Medium 與 High 等級分別以每張影像 $0.03、$0.06 與 $0.22 計費。Artificial Analysis 欄位記錄的是每 1,000 張影像 $220.0,這正是 High 等級,也與每張 $0.22 的說法相符。排行榜引用的是該模型所提供最昂貴的配置,而非典型帳單。
Qwen-Image-2.1 完全沒有價格欄位——它在排行榜上的兩列資料都帶有一則明確的 無可用 API 註記。你並不是向它購買一張圖片。你下載權重檔案,在你自己付費的硬體上執行,再依你產出的圖片數量來攤提這筆成本。在高用量下,這通常比 $0.22 便宜,而且永遠更費工;在低用量下,則永遠更不划算。這兩者都是說得通的答案,但兩者都不是每張圖片的價格。
對於想要取得託管那一半、又不想再簽一份合約的人來說,路由的問題最終就落在這裡。OrcaRouter 以單一相容 OpenAI 的端點,把 200 多個模型放在前端,並以零加成的方式原樣傳遞供應商的定價,當某個供應商效能退化時,自動跨供應商容錯移轉,還有一套路由 DSL,能把多個模型組合進單一次呼叫。Qwen-Image-2.1 和 Ideogram 4.5 都不在其列——我們所提供的影像產品線是 Google 的 Imagen 各級方案與 Gemini 影像預覽、xAI 的 Grok Imagine 影像端點,以及 OpenAI 的 GPT-Image 系列。如果現在的需求是可呼叫、具商業授權的影像模型,那份清單就是答案,而上面的計分板並不是用來挑選它的工具。
董事會無法回答的問題

授權條款是那個已有定論的軸向,而它指向與排名相反的方向。Qwen-Image-2.1 依 2026 年 9 月 20 日的 Qwen Research License Agreement 發布:僅限非商業用途,商業使用需向供應商另行申請授權。這與較早的 Qwen-Image 系列相比是一項改變,該系列原本以 Apache 2.0 發布,而阿里巴巴自家的 Hugging Face 儲存庫則將授權條款列為 其他。兩列排行榜上的 Open Weights 標記就可下載性而言是準確的,但對此則隻字未提。
Ideogram 4.5 則恰恰相反,屬於商業服務。你是租用它的產出,並擁有使用該產出的權利——信用計量機制正是為此而存在——而你永遠不會持有權重。若交付成果是本身含有圖像功能的產品,那與「這裡有一個檔案,你不得將它的產出用於商業用途」相比,是實質上不同的立場。
還有第三條路,是那兩欄都沒有顯示的,而它正是多數團隊最後走上的路:內部作業與評估時跑可下載的模型,因為研究授權在此不會擋路;而任何會接觸到客戶的用途,就租用託管版本。排行榜讓你各有理由偏好其一,而偏好 Qwen-Image-2.1 的理由,是它在只限於你自己筆電的授權上,領先二十分的 Elo。那不是把它放進產品的理由,而任何計分板也永遠不會這樣告訴你。
真正該關注的範圍比表面上看起來更窄。如果 Ideogram 發布它承諾的 4.5 權重,那麼與 1,034 分的 Qwen-Image-2.1 進行的開放權重比較,就會變成一場真正的較量,而不是對 Ideogram 4.0 的 23 分替代指標。在那之前,排名和授權條款指向相反的方向,而能在第一次合約審查中存活下來的是授權條款。
