生成的
Guides & Insights

Claude Sonnet 5.5 与 GLM-5.5:没有 GLM-5.5 可供对比

作者

Magnus Corvin

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

搜索这场对决,你会找到不少把两个模型放在一起比较的页面。而其中只有一个是真的。Claude Sonnet 5.5有模型卡、有 API 标识符、有价格条目、有已公布的退役时间下限,也在独立排行榜上占有一席;它于 2026 年 9 月 28 日发布,是该厂商 5.5 代中的第二个模型。GLM-5.5则这些统统没有。截至 2026 年 9 月 29 日,Z.ai 的 Hugging Face 组织下没有任何 GLM-5.5检查点,Z.ai 自家的模型列表里没有它的页面,厂商文档里没有它的条目,没有价格,也没有 Artificial Analysis 条目。这个名字本是一个预测,后来凝固成了名词。

这让本文的诚实版本比标题所承诺的更短,却比一份规格表更有用:这个名称指的是什么、最接近的真实模型是什么、两个潜在对手实际得分如何,以及必须出现哪些具体证据,才能让“GLM-5.5”成为你能叫得出的东西。比较本身并非不可获得——只是它不是搜索框所要求的那一种。

那里实际有什么,今天已核实

五个地方将会上架已发布的 Z.ai 旗舰产品,而这五个地方都已在 2026 年 9 月 29 日核查过:

Z.ai 自家的模型列表恰好只有三张卡片:GLM-5.3,标记为该公司最新旗舰;GLM-5.3-FlashX,标记为新品;以及 GLM-5.2。没有 5.4,也没有 5.5。

• 厂商文档的推荐模型列表从 GLM-5.3 开始,然后是 GLM-5.3-Flash、GLM-5.3-FlashX 和 GLM-5.2。在任何文档路径下都不存在 GLM-5.5 页面。

• Hugging Face 上的 Z.ai 组织将其最新仓库列为 GLM-5.3 系列,创建于 2026 年 8 月 25 日。对该组织仓库的搜索未返回任何规模的 GLM-5.5,也没有任何量化版本或变体

• Artificial Analysis 没有可打开的 GLM-5.5 模型页面。其 GLM 覆盖范围止步于 5.3 代

• OrcaRouter 的目录中完全没有 GLM-5.5 条目,因此我们既无从路由,也无从报价

真正存在的是 GLM-5.3:2026 年 8 月 14 日发布,约 8 月 18 日在 API 上线,8 月 25 日公布权重。它是文本输入、文本输出,拥有 1,000,000 token 的上下文窗口和 128,000 token 的输出上限,总参数 7,530 亿,其中约 400 亿处于激活状态,在 Z.ai 的价目表上,每百万输入 token 收费 1.40 美元,每百万输出 token 收费 4.40 美元。它的思考始终开启——不再允许将其关闭——深度则通过 reasoning_effort设为low、high或max,默认值为max。

这个名字不断从何而来

Artificial Analysis model page for GLM-5.3 at max effort, released August 2026, showing an Intelligence Index of 45, an output speed of 86.8 tokens per second, a price of $1.40 per million input tokens and $4.40 per million output tokens, $2.01 per Intelligence Index task, 210M output tokens generated during the Index evaluation, a 1M-token context window, and 753 billion total parameters with 40 billion active.

这个名字开始流传时,是附在一个发布窗口上,而非一款产品。6月下旬转述的一份分析师预测,将 Z.ai 的下一款旗舰定在 2026年8月之内,编号也由此被假定为向上递增。8月最终出货的却是 GLM-5.3,而此后有两件事让“GLM-5.5”的可能性不增反减。

第一个是厂商自己的表述。在 Z.ai 8 月 31 日的财报电话会议上,下一代基础模型被命名为 GLM-6.0——这是一个新一代模型,而非小版本更新,而且其编号完全跳过了 5.4 和 5.5。第二个是节奏。分析人士根据 Z.ai 的发布节奏——大约每 54 到 70 天推出一款旗舰模型——现在将下一次发布预计在 2026 年 10 月 8 日至 11 月 9 日之间的一个窗口内,而且其中大多数人预计其编号会是 GLM-5.4。

上周有一个真正新鲜的信号,值得精确描述,因为正是这类事情会变成一则虚假的发布传闻。2026年9月25日,在第三方编程工具的公开数据页面上发现了写着“GLM 5.5 Flash”和“GLM-5.4”的预注册字符串——这些字符串背后没有用户、没有厂商确认,也没有关联任何模型。9月29日重新核查时,这两个字符串都已不在该页面上。这是别人产品内部的一次命名苗头,而不是一次发布,并且这就是近期证据的全部。

你能真正运行的对比

如果换成让 Claude Sonnet 5.5 对阵 GLM-5.3,这场对决就是真实存在、紧跟当下且格外有趣的——但它会是一篇与本页标题所暗示的文章不同的文章,所以这里只给出简短版本,而不是重新刊发我们已经发布过的那篇对比。

• 价格 — Claude Sonnet 5.5 每 100 万 $2.00 / $10.00,对比 GLM-5.3 的标价 $1.40 / $4.40,而我们的目录目前标价为 $1.26 / $3.96

• 智能指数,v4.3.2 — Claude Sonnet 5.5 56 对比 GLM-5.3 45,两者均处于最高努力设置下

• 每项 Index 任务的成本 — Claude Sonnet 5.5 为 $7.60,GLM-5.3 为 $2.01,在 2.1× 的费率差距下形成了 3.8× 的成本差距

• 输出速度 — Claude Sonnet 5.5 142 tokens/秒 对比 GLM-5.3 86.8 tokens/秒

• 索引上的冗长程度 — Claude Sonnet 5.5 输出 410M 词元,对比 GLM-5.3 的 210M

• 模态 — Claude Sonnet 5.5 接受文本、图像和文件;GLM-5.3 为文本输入、文本输出

• 权重 — GLM-5.3 可在 Z.ai 的 Hugging Face 组织下根据厂商自有许可协议下载;Claude Sonnet 5.5 则没有

这种形态似曾相识,其背后的机制与每一场 Sonnet 5.5 的对决如出一辙:费率差与任务量差之所以不一致,是因为 token 数量不同。一个模型输出 4.1 亿 token,而其对手只输出 2.1 亿,就会把 2.1 倍的价格差放大成 3.8 倍的账单。GLM-5.3 在当前修订版本上的排名也值得直说,因为一些较早的报道仍引用已被取代的 Index 修订版,称其为 60:在 v4.3.2 上它得分 45,在开源权重模型中位列第二,落后于 46 分的 MiMo-V2.6-Pro,略高于 44 分的 Kimi K3。如果你看到这个模型被标为 60,那说的是另一份榜单。

真正一对的两侧在一个键上

同时持有 Anthropic 模型和 Z.ai 模型的原因在于,它们的失效方式各不相同,而同时运行两者通常要付出两份合同的代价。GLM-5.3 已收录于 OrcaRouter 目录,即z-ai/glm-5.3,按提供商价格提供,不额外加价——它是单一 OpenAI 兼容端点背后 200 多个模型之一,支持提供商之间的自动故障转移,并提供用于组合调用的路由 DSL。由于该目录原样透传提供商的标价,Z.ai 的价格变动在到达他们那边的同一天,就会落到我们这边。Claude Sonnet 5 自 6 月 30 日起即可在此路由,价格为 Anthropic 的 2 美元和 10 美元,并且仍然是承载最多 Claude API 流量的模型。

Claude Sonnet 5.5 尚未收录进我们的目录,所以如今通往它的途径就是 Anthropic 自家的 API——而这恰恰也是此处路由建议诚实的局限所在:只有当两个模型都位于你能从同一个地方访问到的位置时,故障转移技巧才会奏效。

需要出现什么

把“GLM-5.5”从一个名称变成一个模型,大约需要厂商一天的工作量,而当它落地时,证据很容易辨认。一张带有参数量和上下文窗口的模型卡。Z.ai 自家模型列表上的一个 API 标识符。一行价格。如果权重开放,Z.ai 组织下会有一个 Hugging Face 仓库,并附带许可证文件。还有 Artificial Analysis 上的一个页面,因为一个没人测量过的模型,就不是你能拿来比较的模型。在这五项中多数存在之前,任何刊出 GLM-5.5 规格表的文章,都只是在刊出某个人的推测。

下一个检查点是 10 月 8 日至 11 月 9 日这个窗口,而值得关注的数字是 5.4,而不是 5.5。如果 Z.ai 按自己财报电话会议上的说法行事,那么更有意思的问题是,下一次发布到底是一次小版本升级,还是该公司点名的 GLM-6.0 代。无论如何,本页上的对比都会在其发生的那一周重新进行——而且那将是对两个拥有模型卡的模型的对比。

OrcaRouter model page for z-ai/glm-5.3, dated 2026-08-18, showing the Tools, JSON and Reasoning badges, a 1M-token context window, 128K max output, text-only input, an input price of $1.26 and output price of $3.96 per million tokens, a p50 time to first token of 3.88 seconds, and 1.81 billion tokens of recent traffic.

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新