
Claude Opus 5.5 유출: "claude-wafer-eap"라는 체크포인트와 화요일 출시설
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
이번 주말에 떠도는 주장은 검증하기에 충분히 구체적이면서도, 검증 앞에서는 무너질 만큼 빈약하다. 차기 Opus 업데이트를 위한 새로운 체크포인트가 — 이제 Claude Opus 5.5로 불리는 — 이미 확보된 것으로 전해지며, 내부 코드네임은 "claude-wafer-eap"이고, 출시는 빠르면 9월 22일 화요일에 이루어질 수 있다는 것이다. 출처는 Lyra라는 유출자의 말을 중계한 X 계정 @kimmonismus다. 모델 카드도, API 식별자도, 가격표도, 벤치마크도, 같은 체크포인트 문자열을 보도하는 두 번째 매체도 없다. 그 주장 밑에 실제로 깔려 있는 것은, 실제로 잘 문서화된 사건이다: Claude Opus 5.2, 즉 9월 중순까지 변경되지 않은 "Opus 5" 라벨 아래 일부 트래픽에 제공되던 미출시 Opus 빌드이며, 벤더가 9월 17일 밤에 잠시 차단했던 것이다. 이 부분은 여러 매체에서 교차 확인된다. 그 위에 얹힌 모든 것은 한 계정의 말일 뿐이다. 그리고 눈여겨볼 만한 세 번째 사항이 있는데, 그것은 이 유출이 버전 번호 자체에 가하는 영향이다: Claude Opus 5는 7월 24일에 백만 토큰당 $5.00/$25.00로 출시되었고 여전히 벤더의 최상위 일반 제공 Opus이며, Claude Fable 5.1은 9월 1일에 등장했다. 차기 Opus가 정말 5.5라면, 명명은 5.3과 5.4를 건너뛰어 버린 것이며 — 이 이야기에서 그 숫자는 어떤 벤치마크보다도 더 많은 일을 하고 있다.
유출이 실제로 주장하는 것
포장을 벗기면 네 가지 주장이 나온다. 첫째, 체크포인트가 존재한다는 것 — 훈련되고 저장되어 어딘가에 스테이징되고 있는 모델. 둘째, 그 버전 번호가 5.2나 5.3이 아니라 5.5라는 것. 셋째, 그것이 코드명 "claude-wafer-eap"를 달고 있으며, "eap"가 일반적인 벤더 약어로 얼리 액세스 프로그램(early-access program)으로 읽힌다는 것. 넷째, 출시가 임박했으며, 어쩌면 화요일일 수 있다는 것.
그 각각은 서로 다른 종류의 주장이며, 똑같이 뒷받침되는 것은 아니다. 네 번째는 외부 증거가 뒷받침하는 것이고, 그 증거는 코드명이 아니라 날짜를 가리킨다. 다음 Claude Opus 출시를 둘러싼 예측 시장은 9월 16일에 열렸고, 내재 확률의 대부분을 9월 21일부터 24일 사이에 몰아주었으며, 상당한 비중의 거래량은 여전히 '9월 30일까지 출시 없음'을 지지했다. 그 시장의 정산 규칙은 좁다: 모델이 공개적으로 접근 가능해야 하고, 명시적으로 Opus라고 이름 붙여져야 한다. Fable, Mythos, Sonnet, Haiku 출시는 포함되지 않는다. 'Claude Opus 5.5'는 그 시장 자체의 적격 이름 목록에 등장하는데 — 이 문자열이 가장 그럴듯하게 유통에 들어간 곳이 바로 여기이며, 이는 목격 보고가 아니라 가능성 목록이다.
코드명은 가장 약한 고리다. "claude-wafer-eap"는 시그널 텍스트에 나타나며, 우리가 확인할 수 있는 바로는 다른 어디에도 없다: 저장소 참조도, API 슬러그도, 구성 유출도, 이를 뒷받침하는 계정도 없다. 코드명은 검증 가능하게 들리기 때문에 퍼지는 바로 그런 종류의 세부 정보다. 두 번째의 독립적인 출처가 같은 문자열을 내놓을 때까지 이것은 미검증으로 취급하라. "Lyra" 귀속에도 마찬가지다 — 우리가 대조해 확인할 수 있는 이력이 없는 유출자 핸들이다.
실제로 검증되는 것은 무엇인가
검증된 기준선은 Claude Opus 5이며, 유난히 문서화가 잘 되어 있어 척도로 유용하다. Anthropic은 2026년 7월 24일에 이를 출시했고 — 그 사이에 5.1은 없었다 — 1M 토큰 컨텍스트 창, 최대 128K 출력 토큰(Batch API에서는 베타 헤더를 통해 300K), 기본적으로 켜져 있는 적응형 사고, 그리고 low부터 max까지 다섯 가지 추론 노력 수준을 갖췄다. 가격은 모든 프롬프트 길이에서 백만 입력 토큰당 $5.00, 백만 출력 토큰당 $25.00으로 동일하며, 이전 Opus 4.8과 같고, Batch API는 그 절반이다. Artificial Analysis는 이를 자사의 Intelligence Index 최상위에 올려놓았는데, 정확한 점수는 어떤 노력 변형을 보느냐에 따라 달라진다 — "5.5" 점수판은 노력 설정이 일치하지 않으면 "5" 점수판과 비교할 수 없으므로 붙잡아 둘 만한 세부 사항이다.

그 위에 확증된 9월 사건이 놓인다. 대략 9월 14일부터 15일까지, 개발자들은 명목상 Opus 5로 향한 요청 중 확률적으로 일부가 다른 백엔드 모델에 의해 응답되고 있다고 보고했으며, 요청 메타데이터는 미공개claude-opus-5.2를 가리켰다 — 5.1을 완전히 건너뛰는 버전 번호다. 보고된 동작에는 더 간결해진 출력과 스스로 반복하는 행동이 포함되었다. 코드를 작성하고, 테스트를 실행하고, 실패를 고치고, 테스트가 통과할 때까지 반복하는 것 — 미완성인 채로 멈추지 않는 것이다. 이와 함께 퍼진 탐지 기법 — 검색과 메모리를 비활성화한 상태에서, 모델이 알 수 없어야 할 특정 인물에 대해 특정 질문을 던지는 것 — 은 어느 백엔드가 응답했는지 판별하는 방법이었다. 9월 17일 밤, Anthropic은 예고 없이 그 채널을 차단했고, 개발자 커뮤니티는 이 사건을 "midnight shock(자정 충격)"이라 불렀다. 채널은 약 하루 뒤에 복구되었으며, 그 보고들에 따르면 Claude Code에서 채팅 및 cowork 표면으로 확대되었다. 모델 카드도, 가격표도, API 식별자도, 공식 성명도 그 어느 것도 이와 함께 제공되지 않았다.
버전 번호가 곧 이야기다
여기 유출이 모든 세부 사항은 틀렸더라도 구조적으로는 맞게 짚은 부분이 있다. Anthropic은 올해 두 번이나 이미 입증했다. 출시 이벤트 없이 Opus 등급을 반복 개선한다는 것을 — 5월 말의 4.8, 7월 24일의 5(5.1은 건너뜀), 그리고 공개적으로 존재한 적 없이 프로덕션에는 존재했던 5.2가 그렇다. 백엔드 라우팅을 통해 배포하고 롤아웃 비율을 통제하는 공급업체는 상자에 어떤 숫자를 인쇄할지도 마지막 순간에 결정할 수 있다. 다음 Opus가 5.2가 아니라 5.5로 발표된다면, 그것은 기술 작업 이후에 내려진 마케팅 결정이며, 유출자가 늦게 그리고 부정확하게 듣는 종류의 결정이다.
이는 이 글을 읽는 누구에게나 양날의 검이다. 유출된 버전 번호는 성능에 관한 약한 증거이고, 포지셔닝에 관한 강한 증거다. 그 숫자가 정말 5.5라면, 5.2였을 때보다 더 큰 도약을 시사하며, Anthropic이 11월로 미뤘다고 보도된 IPO를 앞두고 시장이 그렇게 읽어주기를 바란다는 의미이기도 하다. 로이터는 9월 18일 세 소스를 인용해, Anthropic이 GPT-6 Astra의 기업 부문 모멘텀에 맞서기 위해 특별히 새 모델을 출시할지 저울질하고 있다고 보도했다. 한편 그 최고경영자는 공개적으로 업계에 속도를 늦추라고 요구하고 있다. 같은 체크포인트에 더 큰 숫자를 붙이는 것은 비용도 들지 않고 헤드라인을 얻어낸다. 그렇다고 해서 그 유출을 믿지 말아야 할 이유는 아니다. 그것은 그 숫자를 의사결정에 반영하지 말아야 할 이유다.
화요일에 무엇이 사실이어야 할까?
9월 22일 발표는 약 5분이면 확인할 수 있을 것이며, 그 발표가 — 나온다면 — 그저 받아들여지기보다 읽힐 수 있도록 지금 점검 항목들을 정해 두는 것이 좋다.
• 가용성 — 공개 모델 카드, 완성 응답을 반환하는 API 모델 식별자, 또는 공개 상시 대기 명단. 비공개 베타는 해당하지 않으며, 예측 시장은 일반적으로 이를 충족하지 않는 쪽으로 정산됩니다. 이것이 “출시됨”과 “일부 계정에서 테스트됨”을 가르는 기준선입니다.
• 가격 — 새로운 Opus가 $5.00/$25.00 티어를 유지할지, 이를 변경할지, 아니면 프로모션 요금으로 출시될지. Opus 5는 Opus 4.8의 가격을 정확히 그대로 유지했는데, 이는 예상되는 패턴이므로 확인해야 할 사항이다.
• 컨텍스트 및 출력 제한 — Opus 5의 1M 컨텍스트와 128K 출력(Batch에서는 300K)이 현재 최저 기준입니다. 그보다 적게 출시되는 새로운 Opus는 출시로 위장한 다운그레이드일 뿐입니다.
• 독립적 평가 — 명시된 노력 수준에서의 Artificial Analysis 항목이며, 벤더 차트가 아닙니다. 유출 자료에 담긴 모든 역량 주장은 현재 재현되지 않았으며, 모델 카드만으로는 이를 바꾸지 못합니다.
• 라우팅 동작 — 그레이 테스트 계정에서 보고된 그 간결하고 스스로 반복하는 동작이 공개 빌드에도 여전히 존재하는지, 아니면 그것이 테스트 아티팩트였는지의 여부. 그 동작 변화는 개발자들이 실제로 관찰한 가장 구체적인 사항이며, 출시 전에 조용히 조정되어 사라질 가능성이 가장 큰 사항이다.

프로덕션 경로를 걸지 않은 채 검증되지 않은 Claude를 시험해 보기
이번 주 같은 시기의 어색한 공백은 모두가 평가하고 싶어 하는 모델이 아무도 호출할 수 없는 모델이라는 점입니다. 오늘 호출할 수 있는 것은 Claude Opus 5이며, 만약 5.5가 등장한다면 실질적인 질문은 통합을 다시 작성하거나 독립적인 벤치마크가 없는 모델에 핵심 경로를 맡기지 않고도 실제 트래픽의 일부를 그것으로 돌리는 방법이 됩니다.
바로 이런 경우를 위해 라우팅이 만들어진 것입니다. OrcaRouter는 현재 Claude 라인업을 하나의 API 키 뒤에서 공급사 정가 그대로, 0% 마진으로 제공합니다 — Claude Opus 5는 Anthropic 자체의 $5.00/$25.00, 즉 벤더가 공개하는 것과 동일한 숫자이므로, 벤더의 가격 변경은 동기화를 거친 뒤가 아니라 같은 날 우리 쪽에도 반영됩니다. 새로운 Opus가 실제로 출시되면, 그것은 두 번째 계약이 아니라 경로가 하나 더 늘어나는 것일 뿐입니다. 트래픽의 일정 비율을 그쪽으로 보낼 수 있고, 자동 장애 조치를 이미 특성을 파악해 둔 모델로 향하도록 유지하며, 유출된 벤치마크가 아니라 여러분 자신의 프롬프트로 출력을 비교할 수 있습니다. 여러 모델에 걸쳐 하나의 호출을 구성하는 것 — 한 모델에서 초안을, 다른 모델에서 검증 패스를 — 은 새로운 서비스가 아니라 라우팅 DSL 한 줄입니다.

분명히 말하자면, 우리가 말하지 않는 것은 다음과 같습니다. OrcaRouter에는 Claude Opus 5.5가 없습니다. 라우팅할 Claude Opus 5.5가 없기 때문입니다. Anthropic이 출시하기 전까지 우리에게도 없을 것이며, 이 글은 제품 페이지의 미리보기가 아닙니다. 5.5에 관한 이 글의 모든 내용은 보고에 대한 보고입니다.
무엇을 주시하고, 무엇을 무시할 것인가
모델 식별자를 주시하세요. 작동하는 API 슬러그는 출시와 소문을 가르는 차이이며, 유출이 오랫동안 위조할 수 없는 단 하나의 산출물입니다. 가격표를 주시하세요. Anthropic이 해당 모델이 어느 등급에 속한다고 생각하는지 알려주는 곳이기 때문입니다. 발표 전에 그레이 테스트 라우팅이 재개되는지 주시하세요 — 다시 넓어진 채널은 트윗보다 훨씬 강력한 신호이며, 9월 17일의 차단 후 복구는 그 채널이 외부에서 어떻게 보이는지를 이미 보여주었습니다.
지금은 코드명을 무시하세요. "claude-wafer-eap"는 뒷받침할 근거가 없는 단일 출처 문자열이며, 그 배후의 "Lyra" 귀속도 마찬가지입니다. 버전 번호는 포지셔닝 외에는 무엇의 증거로도 여기지 마세요. 그리고 처음 48시간 안에 나타나는 스코어보드, 즉 공개된 Opus 5를 아무도 독립적으로 실행해 본 적 없는 5.5와 비교하는 모든 스코어보드도 무시하세요 — 우리가 하나 만든다면 우리 것까지 포함해서, 비교 대상 양쪽 모두에 실체 있는 무언가가 생기기 전까지는요.
화요일이 출시 없이 지나가더라도, 그렇다고 해서 유출이 반증되는 것은 아니다. 9월 Opus 5.2 사건 자체가 한 모델이 며칠 동안 프로덕션에 존재했지만 아무도 그것에 이름을 붙일 수 없었던 사례였다. 그때까지의 정직한 입장은 증거가 뒷받침하는 입장이다. 일주일 전 실제 미출시 Opus 빌드가 조용히 제공되고 있었고, 이번 주 실제 출시 시점이 시장에 반영되어 있으며, 한 계정이 다른 누구도 확인하지 않은 번호와 코드명, 날짜를 여기에 붙였다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
