
Claude 5.5:一个两个词的标签、一条引用推文,以及潜藏其下的 Sonnet 5.5 防护机制
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 348 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens · 105 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 987 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- xAISpaceXAI: Grok 4.62026-08-1244智能77代码
2026 年 9 月 30 日 03:33 UTC,一个名为 @teortaxesTex 的账号发布了两句话和两张图片:“Claude 5.5:”。并不存在 Claude 5.5 的模型卡,也没有 claude-5-5 这个标识符出现在 Anthropic 的价格表上,API 模型总览中没有相关条目,OrcaRouter 的目录里也没有它的记录。这个标签之下所呈现的东西是真的,而且它并不是一个新模型:所附的第二张图片是一张 Claude 界面截图,产品本身在其中显示“Sonnet 5.5 的防护机制标记了这条消息”以及“已切换到 Sonnet 5”——这正是 Claude Sonnet 5.5 的实际行为,该模型自 2026 年 9 月 28 日起正式可用,会将请求回退到 Claude Sonnet 5。第一张图片则是一张关于 DeepSeek 内核的硬件利用率图表,与 Claude 的发布毫无关系。
这就是信号的全部,而值得精确区分的是:其中哪一半是断言,哪一半是截图。一个两词标签并不能证明某个模型的存在。一张安全防护弹窗的截图只能证明该防护措施存在,而该防护措施早已上线。
实际发布的是什么
这条帖子是一条引用推文,它引用的内容比它自己添加的话更重要。@teortaxesTex 写了两个词。它引用的帖子来自 @xlr8harder,日期为2026年9月22日,全文如下:
是啊,所以一个快速测试表明,Anthropic 正用他们的分类器针对中国硬件。有更多时间的人应该去对分类器做些探测,但看起来达里奥与中国的宿怨之争还在继续。
引用的帖子中没有出现 Claude 5.5。其中根本没有出现任何模型名称。这个两词标签是新发帖者自己添加的,附在一条关于分类器和中国的论证上,而该论证在发布时就已经有六天历史了。被引用的帖子是一个个人账号提出的说法,基于作者并未描述的一项测试;引用它的帖子则添加了一个标签和两张图片。
第二张图片才是承载信息的那一张。
Claude 界面截图从上到下依次是:一条用户消息写着“笑死,去你妈的 Dario”;一段关于 DeepSeek 昇腾内核的长篇助手回复;一条横幅写着“已切换到 Sonnet 5 —— 用 Sonnet 5 编辑并重试”;一个弹层写着“Sonnet 5.5 的安全防护标记了这条消息。这种情况有时会发生在安全、正常的对话中”,附有“发送反馈或了解更多”链接,还有一行详情写着“详情:[frontier_lim]”;一条用户回复写着“我的重点就是这个弹窗。你被降级到了一个更笨的模型,因为 Anthropic 害怕有人会利用你为中国生态开发出任何有用的东西。以至于连一般讨论都开始被套上这些过滤。”;以及页脚标明所用模型为“Sonnet 5 Medium”。
仔细看看那段内容,因为其中没有任何一处写着 Claude 5.5。横幅上写的是 Sonnet 5。弹窗上写的是 Sonnet 5.5。页脚上写的是 Sonnet 5 Medium。推文里的标签是这对图片中唯一出现字符串“Claude 5.5”的地方。
弹窗所描述的这一行为,Anthropic 早已将其记录为已上线,而我们在 Sonnet 5.5 发布时就把它写了下来。从那次发布以及 Anthropic 自己的材料中,有三点是有据可查的:
• 分类器层——Claude Sonnet 5.5 是首个随附安全分类器的 Sonnet 级模型,这些分类器旨在防止推理提取,而这一能力此前仅属于 Opus 层级。
• 这也意味着——Sonnet 5 也是首个配备网络防护机制的 Sonnet 模型:遇到风险较高的请求时,它不会直接作答,而是回退到 Claude Sonnet 5,这正是本截图中“Switched to Sonnet 5”横幅所显示的情况。
• 页脚——即标注所运行模型为"Sonnet 5 Medium"的那个界面页脚——与我们此前已发布的安全防护截图中出现的是同一个页脚,正因如此,这张图片读起来更像是九月下旬那套行为模式的再次流传,而非任何新情况的首次发现。
所以,对第二张图的诚实解读并不是“Claude 5.5 存在”。而是“Claude Sonnet 5.5 的防护机制会触发,产品会告诉你这一点,并把你重新路由到 Claude Sonnet 5”。这是 2026 年 9 月 28 日起已上线的产品行为——而这才是发帖人真正愤怒的地方。
第一张图片属于另一个论证。
另一份附件是一张深色背景的效率图:密集的实测数据散点、一条标注为“硬件极限”的图例,以及一条带有红色注释标记的高亮轨迹。它正是截图中助手文字所依据的原始材料,其中较为详细地讨论了 DeepSeek 的昇腾相关工作。助手以其自身留有余地的措辞转述的这些说法如下:
• 一项性能数据——“DeepGEMM-Ascend 在 GEMM 上达到硬件极限的 99.8%,在 MegaMoE 上达到 98%”,被归因于一条推文,助手称该推文来自“Zhean Xu,根据其表述推测是 DeepSeek 研究员,不过我尚未核实这一点”。
• 一种仓库惯例——将 DeepGEMM 和 DeepGEMM-Ascend 视为两个不同的仓库,将 DeepEP 和 DeepEP-Ascend 视为两个不同的仓库,每个仓库都有各自的星标数、复刻数和议题数,助手会将其理解为相互对应的并行组件,而不是一个双后端仓库。
• 规模上的对比——DeepGEMM-Ascend“最近创建(63 个星标 | fork,0 个 issue)”,而 DeepGEMM 有 7.9k 个星标;此外还提到一个“DeepJIT”,被描述为面向“XPU 内核”的 JIT 编译器。
截图中自身的表述框架才是正确的,而且值得重复,而不是去改进它:这个数字是在社交媒体上自我报告的,没有基准测试方法、没有硬件配置,也没有比较基线,而报告者的身份只是助手明确拒绝核实的推断。这一切都不是 Claude 的说法,也都不构成字符串 "Claude 5.5" 存在的理由。
为什么这个标签作为模型名称站不住脚
这一代每一次 Claude 发布都会在数小时内留下痕迹:一个 API 标识符、一行价格、一个上下文窗口、其前代的弃用日期,以及模型概览中的一行。一个不具备其中任何一项的名字,并不是正在测试的模型;它只是某个人敲出来的名字。这些检查成本很低,而所有结果都返回为空:
• API 标识符——claude-5-5 不是有效的模型字符串;在 Sonnet 层级以下、我们能解析的任何 5.5 代标识符也都不是。
• 目录——OrcaRouter 的公共模型 API 对 Claude 5.5 slug 的每一种拼写都返回 not-found。确实能解析的 Anthropic 行是 anthropic/claude-sonnet-5 和 anthropic/claude-opus-5.5。
• 这个标签本身——一个光秃秃的层级编号,与上一代之间没有任何家族名("5.5"后面既没跟 Sonnet、Opus,也没跟 Haiku)——并不是 Anthropic 的命名方式。每一款已发布的 Claude 都会在产品字符串和标识符中带上自己的家族名。
• 另一种解读是——如果"Claude 5.5"是 Claude Sonnet 5.5 的简称,那么这里根本不存在任何泄露,只不过是一个于9月28日发布的模型的两词缩写,而这款模型的全部意义恰恰就是发帖人所抱怨的那项防护措施。
证据支持的是第二种解读。截图在三个不同位置都提到了 Sonnet 5 和 Sonnet 5.5,弹窗描述的是一个我们已记录为已上线的机制,而发帖者真正的论点——在他们自己后续输入界面的消息中——是关于被过滤器降级,而不是关于有新模型到来。
标签下方的分类器参数
剥掉标签,这一对里就有一个真正的问题,而且这是一个值得与包裹着它的模型名称分开陈述的问题。被引用的帖子声称 Anthropic 的分类器“针对中国硬件”。截图显示一个分类器触发,以及一个请求被重新路由。这两件事正在被呈现为因果关系,而它们并不是同一类主张:
• 截图显示的内容——在一次关于 DeepSeek 的 Ascend 内核的对话中触发了安全防护机制,随后该产品将请求回退到了 Claude Sonnet 5。这是 Sonnet 5.5 的一种被允许且有文档记录的行为,任何拥有账户的人都可以复现。
• 截图没有显示的是——该保障机制会因国籍、硬件目标,或专门因中文内容而触发。弹窗文字用自己的话说出了相反的意思:“这种情况有时会发生在安全、正常的对话中。”误报率不是定向政策,而一次被标记的对话也不是一项调查。
• 能一锤定音的是——被引用帖子本身所要求的:“某个有更多时间的人应该做一些分类器探测。”这个讨论串里没人做过这件事。证据只有一张弹窗截图和一条关于 DeepSeek 内核的定量说法,而这两者都没有测量分类器。
你今天实际可以调用什么
如果说真正有用的问题是这条讨论串里哪些模型你现在就能路由,那答案比标签所暗示的要窄,而且其中并不包含 Claude 5.5。Claude Sonnet 5.5 不在 OrcaRouter 目录中:公开的模型 API 对 anthropic/claude-sonnet-5.5 返回未找到,因此截图里的回退目标并非我们提供的服务,本文中的任何内容都不应被理解为运行它的要约。
可路由的,按 Anthropic 自己的标价透传,正是这张截图实际记录其行为的两个模型:
• Claude Sonnet 5 —— 自 2026 年 6 月 30 日起收录于目录中,价格为每百万输入 token 2 美元、每百万输出 token 10 美元,上下文窗口为 100 万 token。保护机制回退到的正是这个模型,截图中的横幅所指的也是它。
• Claude Opus 5.5 —— 自 2026 年 9 月 22 日起便已列入目录,价格为每百万输入词元 4 美元、每百万输出词元 20 美元,同样具备 100 万词元的上下文窗口。Sonnet 5.5 在发布时所继承的安全防护行为,正是来自这一档位。
两者都位于同一个兼容 OpenAI 的端点和同一个路由层之后,这正是究竟为何要关注安全保障问题的实际原因:当提供商重新路由请求时,你返回得到的内容可能并不是你所请求的那个模型,而一个会报告由哪个模型作答的路由器,正是让你无需查看截图底部就能发现这一点的方式。


实际上已确立的是什么,什么不是
这个信号所确立的内容很少,而让它保持在小范围内是值得的,因为推文顶部的标签会诱使人们做出一种远大于其下方证据所能支撑的解读。
• 已确认——一个个人账号于 2026 年 9 月 30 日发布了两个词的字符串“Claude 5.5”,引用了 2026 年 9 月 22 日一则关于 Anthropic 分类器的帖子。
• 已确认——随附的界面截图显示,Sonnet 5.5 的防护机制标记了一条消息,产品随即切换至 Sonnet 5,运行中的模型显示为 Sonnet 5 Medium。
• 已确认——所附图表和助手文本描述的是 DeepSeek Ascend 内核性能数据,且为自我报告,其作者身份助手本身无法核实。
• 尚未确认——存在一个名为 Claude 5.5 的模型、它正在测试中、是一个代号,或已发布并更名。没有标识符,没有价格,没有上下文窗口,没有厂商声明,没有第二位观察者。
• 尚未证实——即有任何分类器针对中国硬件。该说法源自所引帖子中一项未经说明的测试,而截图并未对此加以检验。

改看什么
这里真正值得关注的并不是某个模型名称。对分类器的说法进行测试,诚实测试和糟糕测试都异常容易:诚实的做法是使用一组固定的提示词,反复运行,覆盖与中国毫无关系的主题,并给出误报率,而不是一张截图。糟糕的做法则是这个讨论串里的内容——一段被标记的对话、一条愤怒的消息,以及盖在二者之上的一个两词标题。
如果 Claude 5.5 真的出现,它会像其他每一个 Claude 那样宣告自己:一个可解析的标识符、一行价格、一个上下文窗口,以及一个带日期的模型页面。在这些中的任何一个存在之前,这个字符串就只是引用推文上的一个标签,而读者能在它下面验证的唯一一件事,就是 Sonnet 5.5 的防护机制正在做 Anthropic 两天前发布它时说它会做的事。
归根结底:这张截图是真的,其中的模型是 Claude Sonnet 5.5,于 2026 年 9 月 28 日发布,并会回退到 Claude Sonnet 5;帖子标题所依据的那个“Claude 5.5”并不是任何人发布过的模型。要把该防护行为视为已发布且可测试的,把针对中国的说法视为未经测量的假设,并把这个名称视为一个脱离了其作者本意的缩写。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
