英雄卡片上写着“Mona Lisa 1”,副标题为“Arena 上的神秘模型——我们目前所知”,描述行为“匿名图像模型 · 可能是 gpt-image-2 的继任者 · 未经证实”。
Guides & Insights

蒙娜丽莎 1:Arena 上那个看起来像 OpenAI 下一代 GPT 图像的神秘模型

作者

Jim Song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

2026年8月9日深夜,一个名为mona-lisa-1的匿名图像模型开始出现在LMArena图像竞技场的盲测文生图测试中。数小时内,测试者们将其输出送入OpenAI官方图像验证工具进行检测——结果呈阳性。没有任何公告,没有开发者署名,OpenAI官网也没有任何内容。只有一个代号、一次水印命中,以及一个认为自己正在目睹OpenAI gpt-image-2继任者在公开环境下接受测试的社区。这是一篇“目前已知信息”盘点:mona-lisa-1未经证实、未经公布,也尚未登上任何排行榜,以下每一项说法都标注了其背后的证据。

mona-lisa-1 实际上是什么

Arena 允许模型提供商在匿名别名下测试预发布系统,以便真实用户对输出进行投票,而 mona-lisa-1 就是这些别名之一。"-1" 后缀表明提供商正在分阶段部署检查点,而这是第一个。这个代号本身并不能告诉你它是谁构建的——任何在 Arena 上运行模型的实验室都会选择自己的别名,这正是社区在过去一天里试图对其进行指纹识别的原因。

指向OpenAI的证据

最强的线索是水印。OpenAI 的图像通过其与 Google 的合作带有 SynthID 水印,而 OpenAI 自己的公开验证工具专门针对该签名进行检查。第一个报告这一目击事件的人 @AiBattle_ 在 X 平台上,用该工具检测了 mona-lisa-1 的输出,并报告检测命中。这只能将图像与 OpenAI 的工具关联起来——并不能确认产品名称、具体型号,也不能确认 mona-lisa-1 是否会正式发布。第二条证据来自中国 AI 社区的测试者,他们报告称该模型在被询问时会自我识别为 GPT,且其分词器与 GPT 系列模型一致。这两者都只是指纹识别信号,而非确凿证据。

还有一个来自 X 平台早期测试者(@chetaslua)的数据点:通过“Charlie Kirk 测试”——一种用于探测 LLM 知识截止日期的提示模式——来检验模型知识时,该测试者报告称,mona-lisa-1 能正确回答截至 2025 年 5 月 22 日前后的事件(它能准确描述 Claude Opus 4),而对此日期之后的事情一无所知。如果这一说法准确,那么这个截止日期对于一款在 2026 年 8 月接受测试的前沿模型来说,比预期的要更早;这也是又一个理由,让我们应将这一身份视为一个开放问题,而非既定事实。

测试人员实际所见

这些图片正是猜测变得具体的地方。AI创作者Riccardo Wolf(@WolfRiccardo)发布了原始输出,并明确将其标注为传闻,用一个刻意刁钻的提示词进行测试:一条当代纽约市街道,配有真实汽车标志、车牌、店面、招牌和人行道——这种场景最能暴露孱弱的文字渲染和混乱的物体。他的看法是:真实感有了显著提升,尤其是那些让AI照片一眼看上去就像AI的光滑合成皮肤和表面。这也是大多数测试者 converging 的唯一共识。

除此之外,相关报道较为平淡。@synthwavedd 全天进行了对比测试,称其在真实感和噪声方面比 gpt-image-2 略有改进,而非重大飞跃,并将“-1”后缀解读为未来还会有更多检查点的承诺——这与 2026 年 4 月的情况类似,当时在 gpt-image-2 于 4 月 21 日发布之前,有三个磁带主题的代号在 Arena 上运行。Reddit 上的评价更为直率:看起来没有本质区别。中国测试者的评价最为具体:在 2D/动漫角色一致性方面有大幅改进,真人一致性明显优于 gpt-image-2,噪声伪影更少——但指令遵循和泛化能力只能算一般,且有一名测试者认为整体一致性弱于谷歌最新的图像模型(该模型在那个帖子里被称为“big banana”)。

排行榜栏必须清除。

这里背景很重要。gpt-image-2 自四月发布以来一直占据着 Image Arena 的榜首:据报道,它上线时就以创纪录的优势拿下第一名——领先此前的榜首、谷歌的 Nano Banana 2 达 242 Elo——并且一直保持至今。在当前的 arena.ai 文生图排行榜上,gpt-image-2 medium 以 1,381 Elo 高居首位;在 OrcaRouter 的模型页面上,gpt-image-2 的文生图 Elo 为 1,393,图像编辑 Elo 为 1,467(最近一次评估是在 2026 年 5 月)。两者之间的差异只是快照日期不同。mona-lisa-1 完全没有出现在公开榜单上。因此,后继产品实际要跨越的门槛不是"皮肤稍微好一点"——而是要在编辑稳定性、指令遵循和速度上与 gpt-image-2 对标,并且定价要让人愿意为此切换。仅凭几份没有种子控制的样本,根本无法证明其中任何一点。

A two-column scoreboard titled 'mona-lisa-1 vs gpt-image-2 — the scoreboard'. Left column 'mona-lisa-1 (unverified)': Developer presumed OpenAI — watermark hit, unconfirmed; Status Arena codename, Aug 9; Text-to-Image Elo not on leaderboard yet; Image Edit Elo unknown; Reported strengths realism and anime consistency; Price no API, not priced. Right column 'gpt-image-2 (shipped)': Developer OpenAI — live in API since Apr 21; Status #1 on Image Arena; Text-to-Image Elo 1,393; Image Edit Elo 1,467; Strengths text rendering and edits; Price $8 in / $30 out per 1M tokens. Footer: 'mona-lisa-1 per community testing, unverified; gpt-image-2 per the OrcaRouter model page.'

什么仍然未经验证

说实话,几乎全部都是。mona-lisa-1 的开发者尚未得到确认;竞争对手实验室会使用随意的代号,没有什么能阻止 Google、Meta、ByteDance 或 Microsoft 的模型以“mona-lisa-1”的名义出现。水印命中证实了这些图像来自 OpenAI 的工具,但并不能证明这个特定代号属于 OpenAI。目前还没有使用匹配种子的受控对比——迄今为止的所有印象都来自不同人运行的不同提示词。而且没有关于定价、速度或 API 可用性的报告,因为根本没有 API。如果你今天正在决定是否要在 mona-lisa-1 上构建任何东西:不要。它是一个信号,表明有东西即将到来,而不是已经在这里的东西。

为什么这对你的图像流水线很重要

即使 mona-lisa-1 尚未得到验证,这个品类依然充满了活力。图像生成早已是常规的 API 调用,你今天就能毫无障碍地用上:gpt-image-2、Nano Banana 2、Imagen 4.0 系列和 gpt-image-1.5 全都位于 OrcaRouter 的同一个 API 之后,按服务商目录价提供,零加价——所以当 OpenAI(或任何人)为后续版本定价时,新价格当天就会在这里上线。这种价格直通之所以重要,是因为一旦真正的后续版本发布,定价问题就是决定你是否切换的关键。

The OrcaRouter model page for openai/gpt-image-2, showing it as a live image-generation model at $8 input / $30 output per 1M tokens, with a 1,393 text-to-image Elo and 1,467 image-edit Elo, a P50 TTFT of 12.16s, and an OpenAI-compatible code sample pointing at api.orcarouter.ai.

当一个未经证实的模型确实以 API 形式出现时——无论是 mona-lisa-1 还是下一个代号——安全试用它的方式是通过具有自动故障转移功能的路由器。你将一部分生产流量路由到新模型,如果它在你的实际提示词上表现下降,路由器会回退到 gpt-image-2 或你现有的任何模型,而无需更改代码。这就是路由层的全部意义:你可以在不把生产路径押注在上面的情况下评估这个有风险的新事物。

接下来看什么

最值得关注的高信号指标:mona-lisa-1 是否出现在已发布的 Image Arena 排行榜上(那意味着它已积累足够票数进入排名)、是否出现更多“-N”检查点(“-1”后缀暗示后续还会陆续推出),以及是否有实验室确认或否认这个代号。先例很有参考价值:4 月的磁带代号大约运行了两周后才发布 gpt-image-2。如果保持这个节奏,那么“Mona Lisa”的公开亮相大概会落在 8 月下半月。请把这当作基于规律得出的日历猜测,而非某个日期的传闻。

The arena.ai Text-to-Image leaderboard, dated August 3, 2026, showing OpenAI's gpt-image-2 (medium) at #1 with a 1,381 Elo rating — the ranking that mona-lisa-1 would have to climb to appear on.

常见问题

mona-lisa-1 是 OpenAI 模型吗?

未经证实。其输出命中了OpenAI的验证工具,测试人员报告称其自我标识为GPT,且其分词器与GPT系列模型匹配——但该代号可能属于任何实验室,水印只能确认生成图像的工具,而非拥有该代号的实验室。

mona-lisa-1 什么时候发布?

没有人知道,也没有任何官方消息。“-1”后缀和2026年4月的先例——tape代号在gpt-image-2于4月21日发布前大约运行了两周——是仅有的线索,而这些都是规律,不是日期。

我现在可以在生产环境的图像处理流水线中使用 mona-lisa-1 吗?

不——它没有API,没有定价,甚至不在已公布的排行榜上。你今天能调用的,是已推出的图像产品线:gpt-image-2、Nano Banana 2、Imagen 4.0系列和gpt-image-1.5,全部通过OrcaRouter上的一个密钥即可访问,按提供商列表价格,无加价。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube