
GLM 5.5:发布日期、已报道内容及预期展望
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百万 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75代码
- obsidian新Qwen3.8 27B2026-08-1552智能68代码
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
智谱AI(现以Z.ai为品牌)拥有AI领域最受关注的开源权重路线图之一,下一步——被广泛称为GLM 5.5——正引发真正的期待。但有一个重要的前提说明:截至2026年7月下旬,Z.ai 尚未正式宣布 GLM 5.5。没有模型卡、没有基准测试、没有定价,甚至没有确认的名称。我们掌握的是关于2026年8月发布窗口的可信报道,以及在GLM-5.2上的一个非常强大且记录详实的基线。本指南将实际报道与猜测区分开来,并以GLM-5.2为基础设定切合实际的预期。
以下每个数据都标明了来源。GLM 5.5 尚未公布官方规格;此处具体数字属于其前代版本 GLM-5.2,除特别注明外均为供应商报告。关于 GLM 5.5 的报道来自分析师预测和媒体报道,而非 Z.ai。具体细节可能会发生变化——请以发布时为准。
TL;DR。GLM 5.5 预计将于 2026 年 8 月左右发布,这一时间窗口由摩根大通分析师报道,并被路透社和中国环球电视网(CGTN)转载——并非 Z.ai 的承诺。泄露信息指向一个万亿参数级别、聚焦编码代理的开源权重模型,该模型基于 GLM-5.2 的 100 万 token 上下文构建,但均未得到证实(甚至最终名称可能是 GLM-5.3 或 GLM-6)。目前最可靠的是 GLM-5.2:一个 753B 参数的 MoE 模型,采用 MIT 许可,支持 100 万上下文,在编码领域的开源权重系统中已名列前茅。现在就用 GLM-5.2;后续迁移至 GLM 5.5 在供应商无关的端点上将轻而易举。
关键要点
• 尚未正式发布。截至2026年7月底,Z.ai尚未发布任何GLM 5.5模型卡、规格或定价——也未确认名称。
• 报告窗口:2026年8月。信息来源为路透社和CGTN(2026年6月下旬)援引摩根大通分析师——这是一个“观察窗口”,并非供应商日期。
• 传闻中的规格(未确认):1T+参数,从GLM-5.2继承的100万token上下文,开放权重,以及专注于长时间运行的编码智能体。
• 唯一直接信号:智谱的唐杰在中文媒体中将一款即将发布的模型描述为“epic plus”——令人鼓舞,但并非规格表。
• 坚实的基线:GLM-5.2(753B MoE,1M上下文,MIT许可证)是当前可以使用的顶级开放权重编码模型。
实际上报告了什么(以及由谁报告)
2026年8月的发布时间源自一条清晰的来源链条:据报道,摩根大通分析师预测Z.ai将在2026年8月推出另一款模型,路透社对此进行了报道,CGTN于2026年6月底转载了该报道。这是一篇可信的报道,但它是分析师预测,而非Z.ai的官方发布说明——因此,应将8月视为一个关注窗口,而非承诺。来自公司方面的唯一直接信号是智谱联合创始人唐杰在中文媒体中的评论,他将即将进行的改进描述为“史诗级加强”。这暗示着有实质性的工作正在进行,但并未指明具体模型、确认时间或透露技术规格。
传闻是什么——以及为何要淡然处之
{{1}}2026年7月中旬流传的社区泄密消息描述了一个拥有超过一万亿总参数、延续自GLM-5.2的百万token上下文窗口、开放权重且重点聚焦长时运行编码代理的模型。{{/1}}{{2}}这些描述基于智谱的技术路线来看确实合理——但尚未得到证实,分析人士也提醒称,像"1T+参数"这样的数据尚不能用于硬件规划、定价或能力宣称。{{/2}}{{3}}甚至连品牌命名都存在不确定性:报道中曾出现GLM-5.3、GLM 5.5和GLM-6等可能名称。{{/3}}{{4}}今天任何引用GLM 5.5基准测试硬数据的说法都只是猜测。{{/4}}
真正的基线:GLM-5.2的真实面貌
由于GLM 5.5将直接构建在GLM-5.2之上,因此GLM-5.2是设定预期的最佳方式。GLM-5.2于2026年6月以MIT许可证发布,是一款混合专家模型,总参数量约为7530亿(每token活跃参数约400亿),拥有100万token的上下文窗口,最多可输出131,072个token,并采用智谱的"IndexShare"稀疏注意力设计。该模型完全开源权重,支持自行部署。

在厂商报告的基准测试中,GLM-5.2 表现出色,尤其在编程方面:SWE-bench Pro 约 62.1%,Terminal-Bench 2.1 达 81.0%,GPQA Diamond 达 91.2%,AIME 2026 接近饱和的 99.2%,以及 SWE-bench Verified 的 77.8%(开源模型中最高)。它还很便宜——每百万输入代币约 1.20 美元,每百万输出约 4.10 美元——智谱声称它在多个长周期编程基准上以极低的成本超越了 GPT-5.5。诚实的对照:独立综合评分往往低于厂商数据,在最难的通用推理任务上,GLM-5.2 落后于封闭前沿模型甚至一些开源同行。尽管如此,作为一款开源权重的编程利器,它今天依然是真正的顶级选择。
合理期待GLM 5.5能带来什么(标注为“期望”)
在没有任何官方规格的情况下,一切预期都只是推断。但基于GLM-5.1到GLM-5.2的演进路径以及泄露信息,可以做出以下有依据的推断:GLM 5.5将进一步推动自主性和长周期编程能力(这显然是智谱的优先方向),很可能保持100万token的上下文长度,极有可能继续开源权重(GLM-5.2采用MIT许可,但后续版本许可并非铁定不变),参数规模可能进一步扩大——或许达到万亿级别以上。而我们应该不假设的内容包括:具体的基准测试分数、确认的定价、原生视觉能力,甚至最终名称。请将“更大、更自主、仍开源、仍低价”视为发布时需要验证的假设,而非既定事实。
如何准备——以及今天使用什么
不要因为等待一个尚未发布的模型而搁置项目。GLM-5.2 现已可用,是一个优秀的开放权重编码模型;如果你基于供应商中立、兼容 OpenAI 的端点进行构建,那么当 GLM 5.5 发布时,采用它只是配置更改,而非重新集成。OrcaRouter 今天通过一个统一的 OpenAI 兼容端点提供 GLM-5.2,同时还提供许多其他模型,因此你可以立即基于 GLM-5.2 交付,并在 GLM 5.5 上线的那一刻进行 A/B 测试——然后让独立基准测试和你自己的测试来决定是否切换。

发射发生时如何读取
当GLM 5.5(或最终称之为任何名称)到来时,有几件事值得关注而非仅看表面。检查许可证首先——开放权重是GLM吸引力的核心,后继版本的条款并不保证。关注独立编码和智能体指标(SWE-bench Pro/Verified、Terminal-Bench)而非仅看供应商的幻灯片,因为智谱自己的数据往往偏高。确认上下文窗口和定价,这两者都塑造实际价值。并且,一如既往,运行你自己代表性的编码任务:排行榜位置是起始假设,而非对你工作负载的保证。

常见问题
GLM 5.5 什么时候发布?
报道(摩根大通分析师通过路透社和CGTN,2026年6月下旬)指向2026年8月的一个窗口期,但Z.ai尚未确认具体日期。将其视为观察窗口。
是否有官方的 GLM 5.5 规格或基准测试?
不。截至2026年7月下旬,还没有官方模型卡、基准测试、定价,甚至没有确认的名称。现在流传的具体数字只是猜测。
GLM 5.5 会开放权重吗?
可能性很大,因为GLM-5.2是在MIT许可证下发布的——但后续版本的许可证在发布前从未得到保证。请在发布时查看条款。
GLM 5.5 会有多少个参数?
泄露信息表明总参数超过一万亿,高于GLM-5.2的约753B,但这是未经证实的分析师/社区数据。
GLM-5.2的前身是什么?
智谱2026年6月的开源权重旗舰模型:约753B参数的MoE(约40B激活),100万tokens上下文,MIT许可,编码能力强(例如,约62.1% SWE-bench Pro,81.0% Terminal-Bench 2.1,供应商报告),每百万tokens约$1.20/$4.10。
我现在可以使用GLM 5.5吗?
尚未——它还未发布。今天使用GLM-5.2,包括通过OrcaRouter的OpenAI兼容端点,并在GLM 5.5推出时切换。
底线
{{1}}GLM 5.5 是 2026 年最受期待的开源权重模型之一,但尚未面世——2026 年 8 月的时间节点来源于分析师报道,万亿参数和百万上下文规格均为未经证实的泄露信息,甚至连名称都未最终确定。真正稳固的是其技术路线和基础:{{/1}}{{2}}GLM-5.2 已是顶级开源权重编码模型,采用 MIT 许可且成本低廉,而 GLM 5.5 预计将进一步推动智能体编码能力的发展。{{/2}}{{3}}现在即可通过 OrcaRouter 等供应商中立端点基于 GLM-5.2 进行开发,留意官方模型发布卡片,并让独立基准测试及您自己的实测来决定一旦 GLM 5.5 正式发布后的采用速度。{{/3}}{{4}}我们将在此模型发布后更新本文。{{/4}}
本文中的对比3
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
