
Claude Haiku 5.5 与 MiniMax M3.1 Flash Preview 对比:一个有价格,另一个有 Token 套餐
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
MiniMax M3.1 Flash Preview 没有公布按 token 计价的价格。不是高价,也不是促销价——根本就没有。它只能通过厂商的 Token Plan 及其 Code 入口获取,开发者文档也明确这样写了。Claude Haiku 5.5 于 2026 年 10 月 7 日发布,在提示词最高 100,000 token 的情况下,每百万输入 token 收费 $0.10,每百万输出 token 收费 $0.50。因此,关于这场对比,首先要说的是:这不是一场价格对比,因为两个模型中只有一个有价格。它实际上是一场按量计费 API 与订阅制之间的对比——而这一差异对你成本的决定作用,比任何基准测试都大。
第二点要说的是,MiniMax M3.1 Flash Preview 没有模型卡、没有公开的基准测试、没有权重,我们也找不到任何独立评分。它于 2026 年 9 月 27 日出现,而且按照厂商自己的标注,它是一个通过订阅而非 API 获取的预览版。这不是对该模型的批评,而是对你能够知道什么、无法知道什么的描述。下文所有内容都会让这条界线保持可见。
每一个到底是什么
Claude Haiku 5.5 — Anthropic,ID claude-haiku-5-5,于 2026 年 10 月 7 日发布。输入文本和图像,输出文本。100 万 token 上下文窗口,最大输出 128,000 token(在 Batch API 上通过 beta 标头可达 300,000),训练数据截止于 2026 年 6 月,退役时间不早于 2027 年 10 月 7 日。可在 Low、Medium、High、Xhigh 和 Max 之间调整努力程度,默认值为 Medium,自适应思考默认开启。按 token 计量计费,缓存读取每百万 $0.01,Batch 半价。
MiniMax M3.1 Flash Preview——MiniMax,自 2026 年 9 月 27 日起上线。100 万 token 的上下文窗口。输入支持文本、图像和视频,输出为文本。思考功能始终开启,并提供从低到最高的努力程度控制。该 API 兼容 Anthropic、OpenAI 以及 OpenAI Responses,因此几乎可以直接替换其中任一种 SDK。仅可通过 Token Plan 和 MiniMax Code 访问;没有按量付费的途径,也没有公布费率。

• 逐维度的比较
• 价格 — Claude Haiku 5.5 每百万输入 $0.10、输出 $0.50,适用于 100K tokens 以内,之后分别为 $0.50 和 $2.50;MiniMax M3.1 Flash Preview 未公布按 token 计费的费率,仅有 Token Plan 订阅。
• 上下文窗口 — 每个 1,000,000 个 token。这是它们真正持平的唯一一个维度。
• 最大输出 — Claude Haiku 5.5 为 128,000 token,在 Batch 上提供 300,000 token 的 Beta 通道;MiniMax M3.1 Flash Preview 未公布。
• 输入模态 —— 文本和图像,对比文本、图像和视频。视频输入是一个真正的差异化优势,MiniMax 在这方面胜出。
• 努力程度控制 — 五档可选,在 Claude Haiku 5.5 上默认为中等;在 MiniMax M3.1 Flash Preview 上,从低到最高,且思考始终开启。
• 独立评分——Artificial Analysis Intelligence Index 43,Max 配置 43.40,Claude Haiku 5.5 在 182 个模型中排名第二;MiniMax M3.1 Flash Preview 暂无公布评分。
• 每完成一项任务的成本——Claude Haiku 5.5 每完成一项 Artificial Analysis 指数任务为 0.21 美元;而 MiniMax M3.1 Flash Preview 在缺少分数和费率的情况下则无法计算。
• 输出速度 — Claude Haiku 5.5 为每秒 243.4 个 token;MiniMax M3.1 Flash Preview 未报告。
• 开放权重——两者都不是。Claude Haiku 5.5 是专有模型;MiniMax 尚未发布 M3.1 Flash Preview 的权重。
为什么订阅比听起来更不合适
这场对比中存在一种情况,即 Token Plan 是更划算的选择,值得对它给予公正的评价。如果你是以交互方式使用 MiniMax Code 的人,订阅会把你的成本限制在一个已知的月度金额上,无论你使用多少,而按 token 计价则没有同等的上限。对于重度交互用户来说,固定套餐几乎每次都能胜过按量计费。
一旦工作负载变成程序化的,这套逻辑就立刻颠倒过来。订阅制的定价依据的是人的使用模式——突发、交互、有自我节制。而智能体、批处理作业或生产端点没有这种模式:队列要求它跑多少,它就跑多少。把这类流量塞进按交互式使用定价的套餐,要么是撞上一个你看不见的上限,要么是在你需要吞吐量的时候却为一个席位买单。而二阶问题更糟:没有公布的每 token 费率,就无法在用量增长时预测成本,无法在价格上与其他任何模型比较,也无法判断一个更便宜的模型是否本就能胜任。算不出来的价格,就是你无法为之辩护的预算。
Claude Haiku 5.5 以最好的方式体现了相反的问题。费率是公开的,档位是公开的,缓存折扣也是公开的,唯一的陷阱是结构性的,而不是隐藏的:提示词一旦超过 100,000 个 token,两项费率都会乘以五。那是一道你可以围绕它做设计的悬崖。未公开的费率则是一片你无法围绕它做设计的迷雾。
1M token 平局,以及为什么它并非表面看起来那样
两款模型都宣称拥有 100 万 token 的上下文窗口,而这正是两家厂商主打的头条卖点。这也恰恰是二者看似旗鼓相当最具误导性的维度,因为上下文窗口并不等同于可用上下文。Claude Haiku 5.5 在公布窗口的同时,也公布了 128,000 token 的最大输出,并对超过 100,000 输入 token 的部分收取基础费率的五倍——这种定价设计明确告诉你,长提示词是允许的,但并非预期的默认用法。MiniMax 没有公布 M3.1 Flash Preview 的最大输出,也完全没有公布长上下文定价,因为它根本没有公布任何定价。
长上下文恰恰是两种架构之间成本差异最明显的地方,也恰恰是其中一种架构给不出任何数字的地方。如果你的工作负载确实是长上下文的,那么这一数字的缺失才是决定性的事实,而不是那个共有的 1M 数字。

如果你真正想要的是 MiniMax M3
MiniMax M3.1 Flash Preview 是一个预览版,需订阅套餐才能使用,且未评分。MiniMax M3 则完全不是这样。它是 MiniMax 于 2026 年 5 月 31 日发布的开放权重旗舰模型:100 万 token 上下文窗口,原生多模态,可接收文本、图像和视频输入并返回文本,基于 MiniMax Sparse Attention 构建,定价为每百万输入 token $0.30、每百万输出 token $1.20。Artificial Analysis 给它打出 Intelligence Index 29,每个索引任务成本为 $0.51,输出速度为每秒 91.7 个 token,首 token 时间为 2.16 秒,并享有 80% 缓存折扣。它如今已在 OrcaRouter 的目录中,型号为 minimax/minimax-m3。
这就具体说明了这场对比中规格表所隐藏的一个要点。你按 token 实际能买到的 MiniMax 模型比预览版落后一代,在独立指数上得分为 29,而 Claude Haiku 5.5 为 43;每完成一个任务的花费约为后者的两倍,为 $0.51 对 $0.21;输出速度约为后者的三分之一。预览版很可能在这些方面全都胜出。MiniMax 之外没人知道,而订阅页面也无从查明。

从一个地方调用这两个
MiniMax M3.1 Flash Preview 可通过 MiniMax 的 Token Plan 和 MiniMax Code 获取。Claude Haiku 5.5 可通过 Anthropic 自家 API 获取,并由此可在任何转售 Anthropic 模型的地方获取。两者均不在 OrcaRouter 的目录中——我们从这一组合中路由的是 minimax/minimax-m3,以及 anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5 和 anthropic/claude-fable-5.1,我们不会暗示我们提供本文所讨论的这两个模型。
路由层在这里真正提供的,是一条摆脱两种计费形态难题的出路。 minimax/minimax-m3按量计费,并且已列入我们的目录;Claude Haiku 5.5 也按量计费,列在 Anthropic 的目录中。两者都采用与 OpenAI 兼容的接口,因此它们之间的 A/B 测试不过是换一个模型字符串,而非重写代码;而 OrcaRouter 以 0% 加价透传提供商的标价,这意味着 MiniMax 的价格一变,当天就会反映到你的账单上。Token Plan 模式是唯一无法照此标准化的一环——订阅没有可供透传的按 token 单价,而这从计费侧来看是同一个问题。
如何在没有分数的情况下做决定
如果你需要视频输入,MiniMax M3.1 Flash Preview 是这两者中唯一支持它的;如果你的工作负载是交互式的,而不是程序化的,那么 Token Plan 是值得购买的合理选择。如果你需要一个能放进预算的数字、一个能核对的评分,以及一个能定价的窗口,Claude Haiku 5.5 是这两者中唯一能提供其中任何一项的。而如果你想通过按量计费的 API 使用 MiniMax 系列,并附带独立评分,那么诚实的建议是:使用那个真正可以按 token 购买的那一代,而不是去等待一个条款尚未公布的预览版。
两者都使用 OpenAI 兼容接口,因此它们之间的 A/B 测试只需更换模型字符串,而无需重写代码,并且 OrcaRouter 按0% 加价透传提供商的标价,这意味着 MiniMax 的价格一旦变动,当天就会反映到你的账单上。
