
Claude Opus 5.5 데모 비용은 $3에서 $26: 빌드 초기 며칠을 읽는 방법
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 495 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 186 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
의 첫 주에 나온 두 숫자는Claude Opus 5.5같은 모델을 가리키면서도 자릿수가 한 자리만큼 어긋난다. 한 개발자는 완성된 인터랙티브 렌즈 랩 — 포커스 링을 드래그하면 빛나는 초점면이 계곡을 훑고 지나가는 페이지 — 을 $25.66의 API 비용과 1시간 26분의 실제 소요 시간으로 완성했다고 보고한다. 출시 데모를 모은 널리 공유된 정리 글은 폭죽과 호수 반사까지 갖춘, 절차적으로 제작된 Blender 성 애니메이션의 값을 $13.30, 35분으로 매긴다. r/ClaudeAI 프런트 페이지에 오른 한 스레드는 $3.21이라고 말한다. 벤더는 Claude Opus 5.5를 2026년 9월 22일에 백만 입력 토큰당 $4, 백만 출력 토큰당 $20에 출시했고, 이 세 수치 중 틀린 것은 하나도 없다. 그것들은 서로 다른 것을 재고 있으며, 그것들을 기준으로 예산을 잡으려면 어느 쪽인지 알아야 한다.
이 격차는 노이즈가 아니다. 그것은 에이전트 실행이 생산하는 것과 그것이 소비하는 것 사이의 차이이며, 지난 나흘은 후자에 해당하는 것을 놀랄 만큼 많이 만들어냈지만, 그에 대한 설명은 거의 없었다. 그래서 데모 옆에 아무도 올리지 않은 산수가 여기 있다. 그다음은 출시에서 실제로 요율표에 올라 있고 확인할 수 있는 부분이다.
$25.66로 실제로 산 것
범위에서 비싼 쪽이 가장 유용한 쪽인데, 그 이유는 제작자가 산출물과 청구서를 모두 공개했기 때문이다.
Ryan Sael의 렌즈 랩, "초점의 평면"이라는 제목의 이 작품은 하나의 프롬프트로 한 세션에서 만든 단일 인터랙티브 페이지입니다. 화면에 카메라 렌즈를 띄우고, 초점 링을 드래그할 수 있게 하며, 모든 사진작가가 알고 있지만 거의 아무도 본 적 없는 것을 보여줍니다: 사진이 실제로 선명해지는, 세상 속의 얇은 판입니다. 링을 돌리면 그 판이 움직이고, 유리 요소들이 경통 안에서 앞뒤로 미끄러지며 그 이유를 보여주고, 콘솔에는 거리와 조리개, 선명 영역이 표시됩니다 — 페이지가 열릴 때의 설정인 60 cm, f/2, 1.9 cm 심도에서. 조리개를 f/2에서 f/16으로 조이면 빛의 원뿔이 좁아지면서 선명 영역이 넓어집니다. 분해도가 유리 요소들을 분리해 보여줍니다. 파이프라인 어디에도 이미지 모델이 없고, 다운로드한 에셋도 없습니다: 모든 요소는 코드로 그려지고 애니메이션됩니다. 그래서 착란원에 대한 전체 시연이 도표가 아니라 실시간 시뮬레이션입니다.
그건 정말 잘 만든 해설이고, 거기에 딸린 주장은 이례적으로 정밀하다: 한 번의 시도, 1시간 26분, API 사용료 25.66달러, 그리고 내가 읽었을 때 페이지는 lens.lab.sael.net에서 라이브 상태였다. 이 수치는 자기 보고식이라 검증할 수 없지만, 나눠 볼 세션 길이가 함께 제공되는, 회자되는 유일한 데모 비용이기도 하다.
요금표로 계산을 해보세요. Claude Opus 5.5의 공개된 백만 입력당 $4, 백만 출력당 $20 기준으로, $25.66은 조합에 따라 128만 토큰에서 640만 토큰 사이입니다 — 실행이 전부 입력이라면 상한에, 전부 출력이라면 하한에 해당합니다. 이와 같은 에이전트 방식 빌드는 중간 어딘가에 위치하는데, 하한에 더 가까운 이유는 대부분의 사람들이 건너뛰는 항목 때문입니다: Claude Opus 5.5의 캐시 읽기는 백만당 $0.20으로 입력 요금의 40분의 1이므로, 계속해서 같은 성장하는 코드베이스를 다시 읽는 긴 세션은 그 트래픽에 거의 아무것도 지불하지 않습니다. 천만 개의 캐시된 입력 토큰은 $2입니다. 출력 측은 모델이 코드를 작성하고, 생각하고, 다시 작성하는 한 시간 반이 누적되는 곳입니다: 백만당 $20에서 백만 출력 토큰은 $20이고, 사고 토큰은 출력으로 청구됩니다. Sael의 숫자는 대규모의 저렴한 캐시된 입력 측에 대해 약 백만 개의 출력 토큰을 생성한 실행과 일치합니다 — 이는 무인 86분 빌드가 보이는 모습과 정확히 같습니다.
두 가지가 따릅니다. 첫째, 출시일 주목을 받았던 정가 인하, 즉 $5/$25에서 $4/$20로의 변경은 토큰당 20% 변화이며 그 자체만으로는 이번 실행을 저렴하게 만들지 못했을 것입니다. 90분 루프를 감당할 수 있게 만든 항목은 캐시 읽기를 $0.50에서 $0.20로 내린 부분입니다. 둘째, 그리고 덜 편안한 점은 $25.66 보고서 어디에도 실행이 잘 진행되었는지는 알려주지 않는다는 것입니다. 잘 실행된 원샷과 한 시간 반 동안 헤매다가 성공한 세션은 같은 청구서를 만들어냅니다.
$13.30이라는 수치는 그 자체의 계산을 견디지 못한다
범위의 중간은 다른 이유에서 시사하는 바가 크다. 9월 23일 게재된 출시 데모 모음은 Claude Opus 5.5가 하나의 프롬프트—성, 호수 반사, 불꽃놀이—로 수동 편집 없이 10초짜리 Blender 애니메이션을 절차적으로 제작하도록 요청받은 GPT-6 Astra와의 맞대결을 다루며, 약 13.30달러로 35분과 199,600개의 출력 토큰을 기록한 반면 GPT-6 Astra는 약 14.50달러로 28분을 기록했다고 전한다. 흥미로운 부분은 토큰 수인데, 이는 가격과 맞아떨어지지 않기 때문이다.
Claude Opus 5.5의 백만 개당 $20 기준으로 199,600개의 출력 토큰은 $3.99이며, $13.30이 아닙니다. 출력만으로 $13.30에 도달하려면 665,000개의 토큰이 필요합니다. 빠진 금액은 다른 열에 있습니다: 입력은 백만 개당 $4, 5분 브레이크포인트의 캐시 쓰기는 백만 개당 $5, 1시간의 경우 백만 개당 $8, 그리고 모든 재시도 비용입니다. 그것은 보고서의 모순이 아니라, 한 가지를 세는 토큰 수와 네 가지를 세는 청구서에 대해 보고서가 솔직하다는 것입니다. 이는 출시 주간 비용 이야기에서 가장 흔한 혼동입니다. 공개된 데모에서 숫자 하나를 가져온다면, 달러 수치를 택하고, 옆에 있는 토큰 수는 실행에 대한 부분적인 설명으로 취급하십시오.
저렴한 쪽에서는 셈이 더욱 허술해진다. 완성된 빌드에 API 사용료가 $3.21 들었다고 보고하는 r/ClaudeAI 스레드는 이런 유형의 전형이다. 제목, 영상, 그리고 세부 내역은 없다. 더 짧은 세션이었거나, 더 작은 결과물이었거나, 캐시된 입력이 많았을 법하다. 그것을 근거로 예산을 짤 수 있는 게 아니며, 나는 그중 단 1달러도 검증할 수 없었다.
왜 이 숫자들 각각이 하한인가
여기서의 실패 방식은 제작자들이 속이는 것이 아니다. 그것은 선택이다. 유통되는 데모는 성공한 데모들이며, 그 데모가 일해 준 사람들이 게시한 것이다. 그리고 깨진 페이지를 만들어낸 네 번의 시도는 그렇지 않은 한 번의 시도와 비용이 같다. Blender 비교를 정리한 라운드업은 이를 노골적으로 말한다 — 아무도 실패작을 게시하지 않는다고 — 그리고 그 자체의 가장 상세한 항목이 바로 대표적인 예다: 한 시계 브랜드 사이트는 브리프를 놓쳤고 첫 시도에서 읽을 수 없는 글꼴을 사용했으며, 공개된 버전이 되기까지 두 번째 시도가 필요했다.
"One shot"은 그 용어 체계 안에서도 조용히 중요한 역할을 하고 있다. 그것은 단일 시도가 아니라 단일 세션을 가리키며, 세션은 모델이 생성할 수 있는 만큼의 자기 수정을 포함할 수 있다 — 86분짜리 실행이라면 그 양은 상당하다. 모델이 하나의 컨텍스트 윈도우 안에서 자신의 코드를 두 번 다시 작성하는 것은 one shot이자 두 번의 시도다.
그래서 처음 나흘을 정직하게 읽으면 세 단계의 증거가 되며, 그것들을 평균 내서는 안 된다:
• 세션 길이가 함께 있는 자기 보고 비용 — 대략적인 규모를 가늠하는 데는 쓸 수 있지만 검증할 수는 없다. 1시간 26분에 걸친 Sael의 $25.66은 이 등급에서 가장 강력한 항목이다.
• 토큰 수가 함께 있는 자기 보고 비용 — $13.30 수치가 보여주듯, 내부적으로 일관되지 않은 경우가 대개 더 많다.
• 아무 근거도 없는 달러 수치 — 누군가 무언가를 만들었다는 신호일 뿐, 그 이상은 아니다.
출시 중 요율표에 있는 부분
데모 주장을 걷어내면 검증 가능한 실상은 좁고 명확하다. 아래의 모든 수치는 Anthropic이 공개한 요금으로, 2026년 9월 25일 회사 자체 모델 문서와 발표에서 읽은 것이다:
• 입력 — 백만 토큰당 $4. 출력 — 백만 토큰당 $20이며, 사고 토큰은 출력으로 청구되고, Claude Opus 5.5의 적응형 사고는 항상 켜져 있으며 끌 수 없습니다.
• 캐시 읽기 — 백만 토큰당 $0.20, 0.05x 배수. 캐시 쓰기 — 5분 지점에서 백만 토큰당 $5, 1시간에서 백만 토큰당 $8. Batch API — 양방향 모두 50% 할인, $2 및 $10.
• Fast 모드 — 백만 토큰당 입력 $8, 출력 $40, 최대 2.5배 속도, 그리고 Anthropic은 여전히 이를 연구 미리보기라고 표시합니다.
• 범위 — 1M 토큰 컨텍스트, 동기식 128K 출력 토큰 및 베타 헤더가 있는 Batch API에서 300K, 신뢰할 수 있는 지식 컷오프 2026년 6월, 기본 노력은 Claude Opus 5가 기본으로 했던 high가 아닌 medium.
• 가용성 — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform, 그리고 서비스 종료는 2027년 9월 22일 이전에는 이뤄지지 않도록 약속되어 있습니다.
공급업체 스스로의 성능 주장은 주장이라고 표시되어 있다: Claude Opus 5.5는 대부분의 작업에서 Claude Fable 5.1 수준의 성능을 내고, 실행 비용은 Claude Opus 5보다 약 40% 저렴하며, 출력을 30% 이상 더 빠르게 생성한다. 그 40%는 공급업체가 선택한 워크로드 평균이지 요금표상의 숫자가 아니며, 이 둘을 마치 같은 종류의 사실인 것처럼 인용해서는 안 된다.
독립적인 검증은 벤더 표보다 규모가 작고, 더 작은 격차로 같은 방향을 가리킨다. Artificial Analysis는 Claude Opus 5.5에 대해 Intelligence Index에서 57.6점을 주며, 모델 페이지에 실린 수치에서 Humanity's Last Exam 61.4점, SciCode 66.9점, 장문맥 회상 84.7점을 함께 기록한다. 같은 매체의 코딩 에이전트 측정에서는 토큰당 비용이 아니라 작업당 비용을 보고하는데, 숫자는 반대 방향으로 움직인다. 최대 노력에서 작업당 비용은 약 $13.04로 올라가며, 같은 하네스에서 Claude Opus 5의 $10.79와 대조된다. 모델이 더 많이 소비하는 더 저렴한 토큰이 더 저렴한 작업은 아니다. 그것은 데모 청구서가 가르치고 있는 것과 같은 교훈이며, 제3자로부터 도착한 것이다.
2주 차에는 무엇을 다르게 해야 할까
만약 $25.66라는 숫자가 당신이 이것을 시도해 보고 싶게 만든 숫자라면, 유용한 방법은 $25.66을 예산으로 잡는 것이 아니라, 직접 실행해서 당신이 설명할 수 있는 숫자를 만들어 내는 것입니다.
기본값을 받아들이지 말고 effort를 명시적으로 설정하세요. effort는 모델 선택보다 작업당 토큰 수를 더 크게 좌우하는 조절 다이얼이고, 이 모델의 기본값은 Claude Opus 5에서 바뀌었기 때문입니다. 안정적인 프리픽스를 의도적으로 캐시하세요. Claude Opus 5.5에서 캐시 가능한 최소 프롬프트는 1,024개에서 512개 토큰으로 줄었으므로, 이전에는 결코 캐시되지 않던 짧은 공유 프리픽스도 이제 캐시됩니다. 장기 실행 작업에는 max_tokens에 여유를 두세요. 사고가 그 예산의 일부이며 더 이상 끌 수 없기 때문입니다. Anthropic 자체의 마이그레이션 지침에서는 최고 effort 수준의 작업에는 64K에서 시작해 거기서부터 조정하라고 제안합니다. 그리고 실행은 시작이 아니라 끝에서 계측하세요. 모든 응답에서 최상위 model 필드를 읽으세요. Anthropic의 분류기가 플래그를 지정하는 프롬프트에서는 Anthropic이 동일한 호출 내에서 요청을 다시 라우팅하며, 보낸 모델 문자열이 실제로 응답한 모델을 나타내지 않기 때문입니다.
마지막 요점은 라우터가 더 이상 편의 기능에 머물지 않는 지점이다. 안전장치 경계를 넘어 한 시간 반 동안 무인으로 실행된 빌드는 더 작은 모델에서 일부 턴을 조용히 마친 채 돌아올 수 있고, 이를 알아내는 유일한 방법은 직접 확인하는 것이다. Claude Opus 5.5는 Anthropic 자체 정가로 OrcaRouter에서 0% 마크업으로 제공되며 — 공급업체 요율이 그대로 전달되므로, 공급업체의 가격 변경은 발표되는 당일 바로 여기에 반영된다 — 이는 여기서 라우팅이 하는 일 중 가장 흥미롭지 않은 부분이다. 흥미로운 점은 200개 이상의 모델을 위한 하나의 API가 전체 실험을 단 하나의 키 위에 올려놓는다는 것이다. 그래서 "프런티어 모델에서 실행하고, 실패하느니 폴백하라"는 두 번째 계약과 재작성이 아니라 설정 한 줄이 된다. 자동 페일오버는 익숙하지 않은 모델을 신경 쓰는 경로에 안심하고 투입할 수 있게 해주며, 우회할 수 있는 거부는 70분에 실행을 끝내지 않는 거부다.
다음에 움직일 숫자
Anthropic은 Claude Sonnet 5.5와 Claude Haiku 5.5가 "앞으로 몇 주 안에" 뒤따를 것이라고 밝혔으며, 이는 이 데모들 각각의 형태는 바꾸지 않은 채 가격을 다시 책정할 것입니다: 아무도 미리 예측할 수 없는 토큰 수에 대한 더 저렴한 토큰당 요율. 첫 주의 수치를 쓸모없게 만든 바로 그 불확실성이 다음 세대의 수치에도 적용될 것이며, 이것이 가격 인하가 다시 적용된 뒤가 아니라 지금 습관을 들여야 하는 이유입니다.
당장은 솔직한 요약이 짧다. Claude Opus 5.5는 실제로 출시되었고 일반적으로 이용 가능하며, 가격은 $4와 $20이고, 이 제품 라인이 지금까지 제공한 것 중 가장 저렴한 캐시 읽기를 갖추고 있다. 출시 첫 4일 동안 이 모델이 만들어낸 데모들은 놀랍고, 그 가격표들은 일화일 뿐이다. 자신의 워크로드에 대한 비용을 알고 싶다면, 그것을 측정할 수 있는 유일한 도구는 상한을 둔 자신의 실행이며, 청구서는 그 뒤에 확인하는 것이다.



이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
