
Union Alpha 对决 DeepSeek V4.1 Flash:一周免费试用对阵开放权重
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Union Alpha 今天免费。DeepSeek V4.1 Flash 每百万输入 token 收费 0.15 美元——而且到了 12 月它依然会在那里。这种不对称就是整个对比的全部:这两个模型中,一个是匿名预览版,明确只开放一周,且未公开权重;另一个是 MIT 许可的专家混合检查点,你可以下载、审计并自行托管。如果你是在挑选一个用来在其上构建的模型,而不是拿来玩玩的模型,那么免费的那个并不是更稳妥的选择。
Union Alpha 究竟是什么
Union Alpha 于 2026 年 9 月 16 日出现在第三方模型目录中,现已在OrcaRouter 的免费层级上提供服务。其运营方匿名——提供商字段字面上写着“Stealth”——也没有任何实验室认领它。这并不是对该模型的贬低;这是关于它的最重要事实,因为你能说的一切都由此衍生。
可验证的是端点的形态,因为你可以调用它并读取元数据:
• 上下文窗口 — 262,144 个 token(256K),最大输出为 131,072 个 token。
• 输入与输出 — 接受文本和图像,仅输出文本。无视频输入,无音频。
• API 接口范围——tools、tool_choice、response_format、temperature、top_p 和 max_tokens。结构化 JSON 输出可用;严格的 JSON schema 强制执行不可用。实际使用中,tool_choice 仅支持 "auto"。
• 推理控制项——未暴露任何内容。既没有强度调节旋钮,也没有思考预算,更没有可见的推理通道。
• 来源 — 没有权重、没有许可证、没有参数数量、没有架构说明、没有声明知识截止日期。分词器被归类为“其他”。
• 价格 — 在预览期间,每百万输入和输出 token 为 $0,受速率限制,一旦达到您计划的配额上限,将返回 HTTP 429。
与之相关的唯一一项性能声明——“在广泛通用任务上达到前沿水平的表现”——来自运营方,且从未被独立复现。其背后没有排行榜条目,没有厂商基准测试表,也没有模型卡。
DeepSeek V4.1 Flash 究竟是什么
DeepSeek V4.1 Flash 于 2026 年 9 月 10 日发布,比 Union Alpha 出现早六天,而它属于截然相反的一类对象。它是一个基于全新因果编码器-解码器架构构建的稀疏混合专家模型,主干参数为 552B(输出端激活 16B,输入端激活 8B),另有 196B Engram 条件记忆参数——总计约 763B——在 45T token 上训练,并以 MIT 许可证发布。
有两个工程细节比参数量更重要。Compressed Sparse Attention 2 与 FP4 KV 缓存相结合,将缓存降至每 token 约 890 字节,约为 DeepSeek V4 Flash 所用量的四分之一,这才让 100 万 token 的上下文在经济上变得合理。而且 DeepSeek 正将自家产品线整合进其中:旧版 V4 Flash 和 V4 Pro 的请求正被路由到 V4.1 Flash,并按 Flash 的价格计费。
• 上下文窗口 — 1,000,000 个 token,相比之下 Union Alpha 为 262,144。
• 最大输出 — 每次响应 384,000 个 token,相比之下为 131,072。
• 输入 — 文本和图像(原生视觉);仅输出文本。
• 价格 — 非高峰时段:输入 $0.15/百万,输出 $0.60/百万,缓存输入 $0.003/百万;高峰时段(周一至周五,UTC 01:00–04:00 和 06:00–10:00)翻倍至 $0.30/$1.20/$0.006。周末始终为非高峰时段。
• 权重 — MIT 许可,可下载,可自行托管。
• 实测速度 — 每秒 215 个输出 token,首 token 时间 p50 为 842 毫秒,p95 为 2.40 秒,错误率 1.2%。
基准测试的图景是失衡的,而且不是你可能猜想到的那种方式。
DeepSeek 发布。Union Alpha 不发布。仅此而已。
V4.1 Flash 随附一份完整的表格,不过其中主要是 DeepSeek 自家的报告加上聚合站点的条目,而非一次独立的审计:GPQA Diamond 90.9,HLE 带工具 63.9、不带工具 36.8,Terminal-Bench 2.1 为 90.6,DeepSWE v1.1 为 74.2,CyberGym 88.1,MathArena Apex 65.6,Artificial Analysis 智能指数为 40。注意表格内部的落差——Terminal-Bench 4.0 只有 31.2,远低于 2.1 的分数,这提醒人们,厂商的头条数字总是聚集在那些最能美化该模型的测试套件上。
对于 Union Alpha,目前恰好存在一项独立测量。SMF Clearinghouse 在关闭推理的情况下,让它跑完了 Official A 套件的 157 项测试,得分为 136/157——86.6%,零错误,在二十六个条目中排名第十。推理 30/30,工具 2/2,编码 26/30,数学 24/30,而写作套件尤其薄弱,仅为 2/5。这是一个真实的数据点,而且是唯一的一个。
所以诚实的总结是:V4.1 Flash 有很多数字,其中大多数带有厂商色彩,但至少是可见且有日期的。Union Alpha 只有一个数字,而且是一个相当不错的数字。

价格是 Union Alpha 唯一取胜的维度——而且它赢得毫无悬念
免费胜过 $0.15/$0.60。没有任何巧妙的说法能改变这一点。无论是为期一周的评估工作、批量实验,还是你想运行上百次的一次性 agent 循环,Union Alpha 都不花一分钱,而 V4.1 Flash 在大规模使用时则要付出真金白银。
但“免费”在这里承载着不同寻常的分量。预览版有速率限制,因此吞吐量受你的套餐限制,而不是受模型限制。其背后只有一个端点,这意味着如果该端点出现波动,就没有提供商可作后备。而且免费窗口何时关闭由供应商说了算——预览期后的价格尚未公布。
这也正是路由改变算账逻辑的地方。OrcaRouter 以 0% 加价率透传提供商的标价,因此当 DeepSeek 调整其非高峰费率时,这一变化当天就会在我们这边生效,而无需等待重新定价周期。两个模型都共用同一个密钥,这意味着你可以把上面的比较作为一次配置变更来运行,而不是两套集成——并且无需第二份合同,就能在免费层级以 $0 获得 Union Alpha,并在付费路径上获得 V4.1 Flash。
你实际上应该调用哪一个?
决定性的问题不在于能力,而在于你是否需要这个答案能撑到下个月。

如果这项工作要投入生产,就调用 DeepSeek V4.1 Flash。100 万 token 的上下文、384K 的输出上限、MIT 权重、带日期的基准测试表,以及 DeepSeek 正将自己的历史流量整合到它之上这一事实,全都指向同一个方向:这是一款有未来、也有可查记录的模型。按每百万缓存输入 token 0.003 美元计算,高度缓存的长上下文工作负载无论如何都几乎等于免费。
如果你们正在探索、对标某个模型,或者只是单纯好奇——它可能是某个体量大得多的东西里的一个快速档位——那就联系 Union Alpha。它的视觉输入和 256K 窗口对处理文档和截图确实有用,而 Official A 的结果表明它算是称职,而不是让人难堪。只要别把它放在任何一条会因突然冒出个 429 或未经通知就关停而让你付出代价的路径上就行。
如果你想要在不重新搭建任何底层管道的情况下同时完成这两件事,那就适合采用路由层,而不是直接集成。
什么会改变这一裁决?
三件事,按可能性从高到低排列。
一家具名实验室声称 Union Alpha 属于自己。先例表明这可信:该系列此前的匿名条目 Ox Alpha,在以智谱的 GLM-5.3-Flash 出现六天后被揭晓。揭晓会带来许可证、参数量,而且几乎可以肯定还有价格。
一个独立排行榜为其评分。目前,单一的 157 项测试套件就是全部公开记录。一条带有注明日期方法论的 Artificial Analysis 条目,将让 Union Alpha 从轶事变为数据。
免费窗口悄然关闭。这是隐蔽预览的默认结局——Ox Alpha 在预览结束后就被从目录中撤下。如果 Union Alpha 在没有预览后定价的情况下消失,那么“免费”的代价恰好是一周的集成工作,这就是为什么将其与自动故障转移搭配使用,才是如今使用它的审慎方式。

付费路径只差一个密钥:DeepSeek V4.1 Flash 模型页面列出了非高峰时段的 $0.15/$0.60 费率,没有添加按 token 计的加价,而高峰时段翻倍收费也在同一页面逐项列出。
