一張名為「LUNA-LISA-ALPHA — GPT-image 檢查點洩漏」的主視覺標題卡,顯示一個畫板與畫筆的扁平線條圖示、一個帶有綠色「FRESH」徽章的時鐘、一個文字型勾選圖示,以及一條底部橫幅寫著「LUNA-LISA-ALPHA · UNRELEASED · WHAT WE KNOW SO FAR」,右下角有 OrcaRouter 標誌。
Guides & Insights

Luna-Lisa-Alpha:OpenAI 下一個 GPT-image 檢查點洩漏,具備全新的知識截止日期

作者

Magnus Corvin

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

將 mona-lisa-1 的知識截止日期釘在 2025 年 5 月的那位測試者,現在又有新代號要分享:luna-lisa-alpha——看起來與 Open​AI 影像模型系出同源的下一檢查點,而且據稱這個版本達到了上一個版本沒過的標準:近期知識截止、強大文字渲染,以及「超逼真」的輸出。這項說法來自 X 上的一篇貼文(@chetaslua,8月19日),並非 Open​AI 官方消息,也沒有附帶任何 API、Arena 列表或公告。但這是第一個具體跡象,顯示出繼本月初接管 LMArena 的 Image Arena 的匿名模型之後,以及目前仍位居影像排行榜首位的現行旗艦模型 gpt-image-2 之後,接下來會是什麼。

如果這個說法成立,重點並不在於真實感——這個系列每次的檢查點洩漏都號稱皮膚表現更好、更少「塑膠感」。重點在於知識截止日期。mona-lisa-1 過時的訓練資料,是它在實際應用上最令人詬病的缺點;而更新的截止日期,則是讓後繼者真正值得等待的唯一事實。以下是洩漏內容、讓它更容易被理解的背景脈絡,以及截至今日仍未被證實的部分。

洩漏的真正內容

這項信號是來自 X 帳號 @chetaslua 的一則訊息,也就是那位曾對 mona-lisa-1 進行「Charlie Kirk 測試」的測試者;該測試在八月初被中國科技媒體引用,作為該模型訓練截止日期的證據。轉述貼文內容:一個名為 luna-lisa-alpha 的新 GPT-image 檢查點正在測試中;它是一個新的檢查點,前一個是 monalisa;它接受了同樣的 Charlie Kirk 測試來檢驗知識截止日期;這個新檢查點的知識截止日期較新;文字渲染極佳;且非常逼真。貼文附有一張圖片,顯示測試輸出結果。

這些說法每一項都只是單一帳號的報告。沒有任何內容被獨立重現,Open​AI 並未承認該代號,也沒有附帶任何浮水印分析、分詞器指紋或 Arena 出現紀錄——這三種證據正是最初將 mona-lisa-1 與 Open​AI 連結起來的依據。請將此視為線索,而非定論。

為何知識截止日期是破綻

「Charlie Kirk 測試」是一種衡量影像模型訓練資料截止時間的粗略工具:要求它推理某個已知日期之後發生的事情,看看它是否具備相關知識。針對 mona-lisa-1,這項測試產生了明顯過時的答案。重複的日期探測讓模型把年份寫成 2025,而當被問及保守派評論員 Charlie Kirk 在 2025 年 9 月去世一事時,它認為該事件並未發生——這與約 2025 年 5 月的訓練截止時間一致。測試者也指出,該版本模型沒有網路搜尋能力,因此過時的截止時間並未透過即時檢索來掩蓋。

這之所以重要,有其特定原因。影像模型中的知識截止日期,是該模型視覺與語言主幹網絡完成訓練時間的代理指標——而一個出現在2026年8月的模型,其截止日期卻標註為2025年5月,這意味著該檢查點 largely 來自一次較早的訓練,無論影像品質看起來多麼新穎。luna-lisa-alpha 上若真有「近期知識截止日期」,則傳達了相反的訊息:該檢查點訓練自更新的世界模型,而這正是「知道2026年智慧型手機、介面或名人長相」與「不知道」之間的差異。對影像生成產品而言,這並非小事——它決定了模型能否正確呈現當前的品牌、產品與文化參照。

有一個值得點出的注意事項:影像模型的知識截止日期與聊天機器人並不相同,而洩漏者的測試是啟發式的,而非精確測量。但作為 Open​AI 已將訓練窗口向前推進的信號,這是該貼文中最有力的單一數據點。

它後面的檢查點蹤跡

luna-lisa-alpha 並非憑空出現。它的前身 mona-lisa-1 於 2026 年 8 月 9 日至 10 日夜間出現在 LMArena 的 Image Arena 上,作為一個沒有署名的匿名條目。將它與 Open​AI 聯繫起來的證據雖然間接,但層層相扣:測試者將其輸出輸入 Open​AI 的官方圖像驗證工具,並在 SynthID 浮水印上得到了命中,而該浮水印是 Open​AI 透過與 Go​gle 的合作所套用的;該模型在被詢問時自稱是 G​PT;其 tokenizer 也與 G​PT 系列模型匹配。「-1」後綴讀起來像是一個暫存標籤,而且 Open​AI 有記錄在案的模式,即在發布前以代號測試圖像檢查點——gpt-image-2 本身在 Arena 上以 Maskingtape、Gaffertape 和 Packingtape 的名稱運行了約兩週,然後於 2026 年 4 月 21 日發布。

測試人員在 mona-lisa-1 上實際所見,與新洩漏的說法密切吻合,只差截止日期這一點。大多數評測者都同意,「塑膠皮膚」感確實減少了——紋理更自然、毛孔、飛散髮絲、相機雜訊——@WolfRiccardo 稱其「在真實感上有明顯進步,尤其是光澤感、合成皮膚的部分。」中國測試者回報,在 2D/動漫和真人角色一致性方面有大幅提升。但該模型仍會在某些地方出現雜訊和方塊狀偽影;其指令遵循能力僅被評為一般;而且——就這次洩漏而言很重要——它有在影像中加上過多文字的習慣。最持平的測試者 @synthwavedd 的結論是:「相較於 gpt-image-2 略有進步,但並非大幅躍進。」

在這樣的背景下,luna-lisa-alpha 洩漏中重要的兩個形容詞不是「超逼真」——那也是 mona-lisa-1 的賣點——而是「近期知識截止」和「卓越的文字渲染」。如果後續的檢查點修復了評論者對 mona-lisa-1 指出的兩點,Open​AI 正好以正確的順序進行迭代。

A timeline infographic titled 'The GPT-image checkpoint trail' with three milestone cards: Apr 21 2026 (gpt-image-2 ships, tested on Arena as tape codenames), Aug 9-10 2026 (mona-lisa-1 appears on LMArena Image Arena, May 2025 knowledge cutoff), Aug 19 2026 (luna-lisa-alpha leak: recent cutoff, better text, more realistic). Footer: 'gpt-image-2 launch per OpenAI; mona-lisa-1 and luna-lisa-alpha unconfirmed.' OrcaRouter logo in the bottom-right corner.

繼任者實際上必須跨越的門檻

mona-lisa-1 和 luna-lisa-alpha 都沒有登上任何排行榜,因此參考點仍然是 gpt-image-2——OpenAI 在四月推出的模型,也是目前影像競技場上的第一名。其地位與其經濟效益都有公開紀錄:

• LMArena 上的 gpt-image-2 — 文生圖 Elo 1,393 與圖像編輯 Elo 1,467,Artificial Analysis Image Arena Elo 為 1,338(依據其 OrcaRouter 頁面上顯示的 2026 年 5 月 15 日評測)。

• gpt-image-2 的文字與解析度——知識截止日期為 2025 年 12 月、2K 輸出、彈性長寬比,以及 OpenAI 在推出時新增的「Thinking」推理模式。

• gpt-image-2 價格 — 每百萬個 token 輸入 $8.00 / 輸出 $30.00,透過 OrcaRouter 以供應商牌價計費,零加價;p50 首個 token 回應時間為 10.16 秒。

務實的解讀是:後繼者必須勝過一個在文本處理上已表現出色、編輯能力優於市場上任何其他產品、且成本低廉足以大規模運行的模型。單靠「超逼真」並不會扭轉局面。新的知識截止日期和實質上更好的圖像內文字,才是真正會產生影響的兩項宣稱——這正是這些宣稱值得關注的原因。

A two-column scoreboard titled 'luna-lisa-alpha vs gpt-image-2 — the scoreboard'. Left column luna-lisa-alpha (unreleased): Status unreleased leak, Knowledge cutoff reported recent (unverified), Text rendering reportedly strong, Realism reportedly super realistic, Arena spot not yet seen, Price n/a. Right column gpt-image-2 (live): Status shipping API, Knowledge cutoff Dec 2025, Text rendering strong 2K output, Realism AA Arena Elo 1,338, Arena spot #1 text-to-image 1,393, Price $8.00 / $30.00 per M. Footer: 'luna-lisa-alpha figures unverified (leak, 2026-08-19); gpt-image-2 per OrcaRouter model page.' OrcaRouter logo in the bottom-right corner.

什麼仍未經證實

幾乎所有事物,而且關於不確定性的形態,值得精確說明:

• Open​AI 連結。luna-lisa-alpha 沒有 mona-lisa-1 所擁有的任何證據——沒有浮水印命中、沒有分詞器匹配、也沒有 Arena 來源。其譜系是從洩漏者自己的框架(「上一個是 monalisa」)和檢查點命名主題推斷出來的,而不是來自任何技術指紋。

知識截止日期。「近期」是一個方向,而非一個日期。在有人執行帶有日期的探測集之前,我們無從得知截止日期是從 2025 年 5 月移到 2025 年底、2026 年上半年,還是介於兩者之間的某個時間點。

• 文字渲染與真實感。這些宣稱是定性的,且僅來自單一來源。mona-lisa-1 自身對「改善的真實感」的報告,後來定調為「輕微改善」,因此早期形容詞已展現出誇大的傾向。

• 它是否真的會成為產品。檢查點隨時可能洩漏、被取消,或是以不同名稱出貨。以「alpha」結尾的代號聽起來像是系列階段的早期候選版本,而非已完成的正式發佈。

如何處理這樣的洩漏

有用的心智模型是適用於 mona-lisa-1 的那一種:這代表某事物即將到來,而非已經存在。luna-lisa-alpha 目前無法從任何 API 呼叫,也無法將真實流量導向它。合理的做法是為後續版本做準備——並讓它在正式推出時,測試成本為零。

路由的情況正是如此。gpt-image-2 目前已在 OrcaRouter 上線,每百萬個 token 定價為 8.00 / 30.00 美元——這是 Open​AI 自身的牌價,以零加價直接轉傳——因此,任何評估影像路線圖的開發者都已經擁有一個單一金鑰、一個與 Open​AI 相容的端點,以及自動故障轉移至可用模型的能力。當後繼版本真正問世時,同樣的設定可讓你在真實流量下與 gpt-image-2 進行 A/B 測試,而非只相信一則推文:如果新的檢查點表現不佳,故障轉移機制會接手處理;如果它勝出,你早已知道遷移成本為零,因為切換只是一個模型字串,而非重新協商。任一模型的供應商價格變動皆於變動當日即時生效,因為 OrcaRouter 會原封不動地轉傳供應商的牌價。

在那之前,實際的產品仍是已出貨的模型。如果你今天正在基於圖像生成進行開發,關鍵的決定不是要等待哪個未發布的代號——而是目前排名第一的產品,以定價且不加價的價格,是否已經涵蓋了你的使用案例。

Screen capture of the OrcaRouter model page for openai/gpt-image-2, showing the token-billed image model's pricing ($8.00 input / $30.00 output per million tokens), a p50 time-to-first-token of 10.16 seconds, and an LM Arena Image Edit Elo of 1467.

接下來要看什麼

• 無論 luna-lisa-alpha 是否出現在競技場上。mona-lisa-1 在數天內就從匿名的 Arena 條目演變成由洩漏驅動的報導。如果名為 luna-lisa 的檢查點出現在盲測中,單一來源的洩漏就會成為一條相互印證的線索。

• 是否會出現浮水印或分詞器指紋。那正是能將 luna-lisa-alpha 與 OpenAI 聯繫起來的證據,就像它當初將 mona-lisa-1 聯繫起來那樣——或者無法聯繫。

命名系列。OpenAI 以磁帶主題代號分階段發布 gpt-image-2,接著是 mona-lisa-1,現在則是 luna-lisa-alpha。「alpha」後綴暗示在正式發布前可能還會有更多候選版本,因此可以預期代號清單會繼續增加。

• 任何帶有日期的探測集。第一個實際執行截止測量的人,會把「近期」變成一個具體數字,而那個數字將決定這個檢查點是否為有意義的進展。

老實說:luna-lisa-alpha 只是某位測試者對某個 checkpoint 系列下一步發展的報告,而這個系列從八月初以來一直在悄悄醞釀。其中最引人注目的主張——全新的知識截止日期——也是最需要獨立驗證的。在那之前,留意 Arena 上的亮相和指紋特徵,把那些形容詞當作行銷話術。如果後繼版本真的推出,想了解它的真正價值,方法就是將一小部分真實流量導向它,與目前的第一名對比。這正是 checkpoint 存在的意義。

常見問題

luna-lisa-alpha 是 OpenAI 的官方模型嗎?

尚未確認。唯一來源是單一爆料者的 X 貼文,Open​AI 迄今未置一詞。其被回報的行為與檢查點來源雖指向 Open​AI,但「暗示」並非「證實」——支持 mona-lisa-1 的 SynthID 與 tokenizer 證據,並未在此次模型中出現。

luna-lisa-alpha 何時發布?

目前沒有日期,也未確認該 checkpoint 是否會以那個名稱推出。如果模式成立——gpt-image-2 在 4月21日 正式發布前以代號公開運行了約兩週——那麼公開測試會在任何發布之前出現,但這只是模式推測,並非時程安排。

我今天可以通過 API 使用 luna-lisa-alpha 嗎?

不。它不在任何 API 或排行榜上。目前唯一可以實際呼叫的 Open​AI 影像模型是 gpt-image-2,它已在 OrcaRouter 上線,以每百萬個 token 8.00 / 30.00 美元的供應商定價提供,零加價。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

providers@orcarouter.ai

加入我們的社區

Discordsupport@orcarouter.aiXGitHubYouTube