英雄卡片上寫著「Mona Lisa 1」,副標題為「Arena 上的神秘模型——目前已知的資訊」,描述行為「匿名影像模型 · 可能是 gpt-image-2 的後繼者 · 未經驗證」。
Guides & Insights

Mona Lisa 1:Arena 上那個看起來像 OpenAI 下一代 GPT 圖像的神秘模型

作者

Jim Song

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

2026年8月9日深夜,一個名為 mona-lisa-1 的匿名影像模型開始出現在 {{1}}LMArena 的 Image Arena{{/1}} 上的盲測文生圖測試中。幾小時內,測試者便將其輸出送入 {{2}}OpenAI 的官方影像驗證工具{{/2}} 檢測——而工具的檢測結果呈陽性。沒有任何公告、沒有開發者署名,{{3}}OpenAI 的網站{{/3}} 上也沒有任何內容。只有一個代號、一次浮水印命中,以及一群認為自己正目睹 {{4}}OpenAI 的 gpt-image-2{{/4}} 後繼模型接受公開測試的社群。這是一篇「目前已知資訊」的彙整:mona-lisa-1 尚未經證實、未經宣布,也還沒登上任何排行榜;以下每項說法都標註了所依據的證據。

mona-lisa-1 實際上是什麼

Arena 讓模型提供者以匿名別名測試預發佈系統,讓真實使用者可以對輸出結果投票,而 mona-lisa-1 就是其中一個別名。「-1」後綴暗示提供者正在分批部署檢查點,而這是第一個。這個代號本身完全無法透露它是誰打造的——任何在 Arena 上運行模型的實驗室都可以自行挑選別名,這正是社群過去一整天都在試圖辨識其來源的原因。

指向 OpenAI 的證據

最有力的線索是浮水印。OpenAI 生成的圖片透過其與 Google 的合作帶有 SynthID 浮水印,而 OpenAI 自家的公開驗證工具正是專門檢查該特徵。首位回報這起目擊事件的是 X 平台上的 @AiBattle_,他將 mona-lisa-1 的輸出結果送進該工具檢驗,並回報命中。這能將圖片與 OpenAI 的工具鏈關聯起來——但無法確認產品名稱、確切型號,或 mona-lisa-1 是否真的會發布。第二條證據線索來自中國 AI 社群的測試者,他們回報該模型在被問及時會自稱是 GPT,而且其 tokenizer 與 GPT 家族模型相符。兩者都只是指紋特徵訊號,並非確證。

另一個數據點,來自 X(推特)上的一位早期測試者(@chetaslua):透過「Charlie Kirk 測試」來探查模型的知識——這是一種用來找出 LLM 知識截止日期的提示模式——該測試者回報,mona-lisa-1 對於截至 2025 年 5 月 22 日前後的事件都能正確回答(它能準確描述 Claude Opus 4),且對該日期之後的事情一無所知。若此說法屬實,這個截止日期比人們對 2026 年 8 月正在測試的先進模型所預期的還要更早,這也讓我們更有理由將這個身分視為一個懸而未決的問題,而非既定的事實。

測試人員實際看到的

這些圖像正是讓種種猜測化為具體的地方。AI創作者Riccardo Wolf(@WolfRiccardo)發布了原始輸出,並明確將其定位為傳聞,用一個刻意高難度的提示詞進行測試:一條當代紐約街道,有真實的汽車標誌、車牌、店面、招牌和人行道——這種場景最會暴露文字渲染薄弱、物體不連貫的問題。他的看法是:真實感有明顯提升,尤其是那些讓AI照片一眼就被看出是AI的光澤合成皮膚與表面。而這是大多數測試者意見最一致的一項主張。

除此之外,相關評價相對平淡。@synthwavedd 全天進行了對比測試,稱其在真實感和雜訊方面比 gpt-image-2 略有改進,並非大幅躍進,並將「-1」後綴解讀為未來會有更多檢查點——並以此類比 2026 年 4 月,當時三個磁帶主題的代號在 Arena 上運行,之後 gpt-image-2 於 4 月 21 日發布。在 Reddit 上,評價更為直接:看起來沒有本質上的不同。中國測試者的評價最具體:2D/動漫角色一致性有大幅改進,真人一致性明顯優於 gpt-image-2,而且雜訊偽影更少——但指令遵循和泛化能力僅屬一般,整體一致性則有一位測試者認為遜於 Google 最新的圖像模型,該模型在該討論串中被稱為「big banana」。

排行榜橫條必須清除。

脈絡在此至關重要。gpt-image-2 自 4 月推出以來就一直稱霸 Image Arena:據報導,它在推出時便以破紀錄的差距奪下榜首——領先先前的霸主、Google 的 Nano Banana 2 達 242 個 Elo 分——而且始終保持至今。在目前 arena.ai 的文生圖排行榜上,gpt-image-2 medium 以 1,381 Elo 位居榜首;在 OrcaRouter 的模型頁面上,gpt-image-2 的文生圖 Elo 為 1,393,圖像編輯 Elo 為 1,467(最後評測於 2026 年 5 月)。兩者之間的差異僅在於快照日期。mona-lisa-1 完全沒有出現在公開的排行榜上。因此,後繼者實際要達到的門檻不是『肌膚稍微好一點』——而是要以人們願意轉換的價格,匹敵 gpt-image-2 的編輯穩定性、指令遵循能力與速度。少數幾個沒有種子控制的樣本,無法證明其中任何一點。

A two-column scoreboard titled 'mona-lisa-1 vs gpt-image-2 — the scoreboard'. Left column 'mona-lisa-1 (unverified)': Developer presumed OpenAI — watermark hit, unconfirmed; Status Arena codename, Aug 9; Text-to-Image Elo not on leaderboard yet; Image Edit Elo unknown; Reported strengths realism and anime consistency; Price no API, not priced. Right column 'gpt-image-2 (shipped)': Developer OpenAI — live in API since Apr 21; Status #1 on Image Arena; Text-to-Image Elo 1,393; Image Edit Elo 1,467; Strengths text rendering and edits; Price $8 in / $30 out per 1M tokens. Footer: 'mona-lisa-1 per community testing, unverified; gpt-image-2 per the OrcaRouter model page.'

什麼仍未經證實

說實話,幾乎所有方面都是如此。mona-lisa-1 背後的開發者尚未獲得證實;競爭對手的實驗室會使用隨意的代號,沒有什麼能阻止 Google、Meta、ByteDance 或 Microsoft 的模型以「mona-lisa-1」這個名稱出現。浮水印命中僅確認這些圖片來自 OpenAI 的工具,而非確認這個特定代號屬於 OpenAI。目前沒有使用匹配種子(matched seeds)的對照比較——迄今為止的每一項印象都來自不同的人使用不同提示詞所執行的結果。而且因為沒有 API,所以也沒有任何關於定價、速度或 API 可用性的報導。如果你正在決定今天是否要在 mona-lisa-1 上建置任何東西:不要。它是一個「即將到來」的信號,而不是一個「已經在此」的東西。

為什麼這對你的影像管線很重要

即使 mona-lisa-1 尚未被證實,這個類別依然非常活躍。影像生成已經是普通的 API 呼叫,你今天就可以做到,完全沒有那些紛擾:gpt-image-2、Nano Banana 2、Imagen 4.0 系列以及 gpt-image-1.5 全都位於 OrcaRouter 上的同一個 API 之後,以供應商列表價格提供,零加價——所以當 OpenAI(或任何人)為後續版本定價時,新的價格數字當天就會在此上線。這種轉嫁模式之所以重要,是因為一旦真正的後續版本推出,定價問題就成為你決定是否轉換的關鍵。

The OrcaRouter model page for openai/gpt-image-2, showing it as a live image-generation model at $8 input / $30 output per 1M tokens, with a 1,393 text-to-image Elo and 1,467 image-edit Elo, a P50 TTFT of 12.16s, and an OpenAI-compatible code sample pointing at api.orcarouter.ai.

而當一個未經驗證的模型確實以 API 形式出現時——無論是 mona-lisa-1 還是下一個代號——安全嘗試它的方式是透過具備自動故障轉移(failover)的路由器。你可以將一部分生產流量路由到新模型;如果它在你的實際提示詞(prompts)上表現變差,路由器就會無需變更任何程式碼,自動回退到 gpt-image-2 或其他你目前使用的模型。這就是路由層存在的全部意義:你可以評估有風險的新事物,而不必拿生產路徑作為賭注。

接下來要看什麼

最值得觀察的高訊號指標:mona-lisa-1 是否會出現在公開的 Image Arena 排行榜上(那代表它已累積足夠票數進入排名)、是否會出現更多「-N」檢查點(「-1」後綴暗示它們即將到來),以及是否有任何實驗室確認或否認該代號。先例頗具參考價值:四月的 tape 代號在 gpt-image-2 發布前持續了約兩週。如果這個節奏維持不變,「Mona Lisa」的正式揭露時間點將落在八月下半月。請將其視為依據規律推斷出的時間推測,而非日期的謠言。

The arena.ai Text-to-Image leaderboard, dated August 3, 2026, showing OpenAI's gpt-image-2 (medium) at #1 with a 1,381 Elo rating — the ranking that mona-lisa-1 would have to climb to appear on.

常見問題

mona-lisa-1 是 OpenAI 的模型嗎?

未確認。其輸出命中了OpenAI的驗證工具,測試者回報它自我識別為GPT,且其分詞器與GPT系列模型相符——但該代號可能屬於任何實驗室,而浮水印確認的是生成影像的工具,而非擁有此代號的實驗室。

mona-lisa-1 何時發布?

沒人知道,也沒有任何官方公告。「-1」後綴和2026年4月的先例——磁帶代號在gpt-image-2於4月21日發布前大約運行了兩週——是僅有的線索,而這些只是模式,不是日期。

我現在可以在生產影像管線中使用 mona-lisa-1 嗎?

不——它沒有 API、沒有定價,甚至不在已發布的排行榜上。你今天可以調用的是已推出的圖像產品陣容:gpt-image-2、Nano Banana 2、Imagen 4.0 系列,以及 gpt-image-1.5,全部透過 OrcaRouter 上的一個金鑰即可使用,按供應商列表價格計費,無任何加價。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

聯絡我們

加入我們的社區

DiscordEmailXGitHubYouTube