
GPT-5.6 Sol Ultrafast: Ultrafast가 표준 가격의 6배로 출시되었지만, 이 모델은 아직 프리뷰 전용입니다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
티어에 대한 기다림은 끝났지만, 이 모델에 대한 기다림은 끝나지 않았습니다. 2026년 9월 29일 DevDay에서 벤더는 Ultrafast를 구매할 수 있는 것으로 만들었습니다. 월 $500의 새 ChatGPT Pro 500 플랜에 이것이 포함되며, API는 이제 표준 요금의 6배에 달하는 Ultrafast 요금표를 게시합니다 — GPT-6 Astra에서 백만 토큰당 입력 $60.00 / 출력 $300.00 — 그리고 벤더의 Codex 문서는 Pro 티어에 5시간 사용 제한이 전혀 없음을 확인해 줍니다. 이 5시간 창은 Plus에 적용됩니다. 이 모든 것은 벤더가 밝힌 내용으로, 벤더 자체의 DevDay 요약, 도움말 페이지 및 개발자 문서에 게시되어 있습니다. 움직이지 않은 것은 이 페이지가 다루는 모델입니다.GPT-5.6 Sol Ultrafast는 2026년 8월 13일 GPT-5.6 Sol을 위한 Cerebras 가속 서빙 티어로 발표되었으며, 최대 14배의 표준 처리량과 초당 출력 토큰 750개를 제공하고, 여전히 미리보기 액세스 전용입니다 — 벤더의 계정 팀을 통해 마련됩니다 — 그리고 자체적으로 공개된 가격은 없습니다. 티어는 출시되었습니다. Sol 변형은 여전히 기다리고 있습니다.
우리가 이 글을 처음 작성한 이후 두 가지 가격 변동이 있었고, 이들은 서로 반대 방향을 가리킨다. 기반 모델은 더 저렴해졌다: 표준 GPT-5.6 Sol은 이제 백만 입력 토큰당 $4.00, 백만 출력 토큰당 $20.00으로 청구된다 — OpenAI의 프로모션 요금으로, 공급사는 최소 2026년 11월 21일까지 제공된다고 말한다 — 8월 당시의 $5.00 / $30.00이 아니다. 그 위에 얹힌 속도 티어는 처음으로 가격이 매겨졌는데, 결코 저렴하지 않다: GPT-6 Astra의 Ultrafast는 백만 토큰당 $60.00 / $300.00으로 청구된다. 이 글의 모든 수치는 2026-09-30에 OpenAI의 공개 요금표, API 레퍼런스, Codex 가격 문서와 대조하여 재확인했다.
Ultrafast 모드가 실제로 무엇인지
Ultrafast는 새로운 모델이 아니라 서빙 티어입니다. OpenAI는 2026년 8월 13일, 칩 제조사 Cerebras와 2026년 1월에 맺은 컴퓨팅 파트너십의 첫 번째 제품으로 이를 발표했습니다. 이 계약은 3년간 약 100억 달러 규모로 보도되었습니다. 표준 GPT-5.6 Sol 추론이 GPU 클러스터에서 실행되며 대부분의 시간을 메모리와 연산 장치 사이에서 가중치를 옮기는 데 소비하는 반면, Ultrafast는 모델의 가중치를 Cerebras의 웨이퍼 스케일 칩에 있는 44GB 온칩 SRAM에 로드합니다. Sol 규모의 모델은 여러 웨이퍼에 걸쳐 레이어 단위로 펼쳐져 있으므로, 가중치는 연산이 이루어지는 곳에 자리합니다. 그 결과 처리량의 상한은 메모리 대역폭이 아니라 실리콘에 의해 결정됩니다.
하드웨어 스토리는 2026-08-18에 새 국면을 맞았다. Cerebras는 Supernova 이벤트에서 차세대 랙스케일 시스템인 CS-4를 공개했다. Nexus 플랫폼을 기반으로 구축된 이 시스템은 랙당 Wafer-Scale Engine 칩 3개를 탑재하며, 이전 CS-3 대비 토큰 생성 속도가 최대 2배 빠르고, Cerebras에 따르면 10조 개 이상의 파라미터를 가진 모델에서 초당 1,000개 이상의 토큰을 처리한다. 이는 아직 일반에 공개되지 않은, 얼리 액세스 단계의 시스템에 대한 Cerebras의 주장이다. 공개 이후, X의 한 게시물은 CS-4가 이미 GPT-5.6 Sol을 초당 약 1,300개 토큰의 속도로 서비스하고 있다고 주장했다. 이는 방향성이 Cerebras 자체 수치와 일치하지만, 지금까지 누구도 확인하지 못했다. 이를 초기 신호로 취급하라: 그럴듯하고, 검증되지 않았으며, 이를 기준으로 용량을 계획하기 전에 다시 확인할 가치가 있다.
코드에 중요한 부분은 다음과 같습니다: 모델 ID, 가중치, 추론 동작, 출력이 표준 GPT-5.6 Sol과 동일합니다. OpenAI는 Ultrafast를 품질 등급이 아니라 "초당 더 유용한 작업"으로 규정하며, 프리뷰는 전체 플래그십을 실행합니다. 속도는 더 저렴한 모델로 교체해서 얻는 것이 아닙니다. 변하는 것은 토큰이 나오는 속도뿐입니다.
Ultrafast를 Fast mode와 혼동하지 마세요. Fast mode는 표준 하드웨어에서 별도로 구매할 수 있는 등급으로, 토큰당 2배의 추가 요금을 내면 출력 속도가 최대 약 2.5배 빨라지며 품질 변화는 없습니다. 2026년 7월 30일에 Priority Processing에서 이름이 바뀌었고, GPT-5.6 Sol에서는 100만 토큰당 입력 $8.00 / 출력 $40.00입니다. Ultrafast는 다른 것입니다. Cerebras 하드웨어를 사용하며 GPT-5.6 Sol에서는 최대 14배, GPT-6 Astra에서는 최대 8배이고, Astra에서는 표준 요금의 6배를 청구하지만 Sol에서는 아직 가격이 책정되지 않았습니다. 이제 두 이름이 같은 모델 선택기에서 나란히 자리 잡고 있는데, 이는 이번 릴리스에서 가장 혼란스러운 점으로 남아 있습니다.
얼마나 빠른가 — 중요한 수치들

헤드라인 수치는 14배이며, 이에 대한 정의가 필요합니다. OpenAI는 Ultrafast가 표준 GPT-5.6 Sol 처리 대비 초당 최대 750개의 출력 토큰을 생성한다고 밝혔습니다. 이는 출력 토큰에 대한 처리량 수치이지, '모든 것이 14배 더 빠르게 실행된다'는 단순한 주장이 아닙니다 — 엔드투엔드 요청 시간에는 입력 처리와 모델 자체의 추론도 포함되므로, 14배는 최대치로 표시된 것입니다.
• 최대 출력 처리량 — OpenAI 발표(2026-08-13)에 따르면 초당 최대 750 출력 토큰.
• 표준 처리 대비 — 동일 발표에 따르면 최대 14배 빠름; 실제 향상 폭은 입력 길이와 작업 유형에 따라 다릅니다.
• Humanity's Last Exam, 질문 2,500개 — OpenAI/Cerebras가 보고한 바에 따르면 GPT-5.6 Sol Ultrafast는 11시간 11분에 완료했고 Claude Fable 5는 78시간 27분이 걸렸으며, 정확도는 비슷했습니다. 벤더가 보고한 내용이며, 이 비교는 두 벤더의 하드웨어 스택에 걸쳐 있으므로 — 판정이 아니라 방향성으로 읽으세요.
• GDP-Val, 엔드투엔드 — Cerebras는 측정 가능한 품질 손실 없이 전반적으로 5.6배 더 빠르다고 보고합니다. 또한 벤더 보고입니다.
• Fast 모드와 Ultrafast 비교 — Fast 모드는 약 2.5배의 출력 속도가 최대치이며 2배의 가격 프리미엄이 있고, 표준 가격과 동일한 약 272K 토큰 경계에서 제한됩니다. Ultrafast는 더 큰 도약입니다: 8월 발표에 따르면 GPT-5.6 Sol에서 14배, OpenAI의 현재 문서에 따르면 Codex의 GPT-6 Astra에서 최대 8배이며, 출시 당시 보도에서는 이를 초당 최대 300 출력 토큰으로 제시했습니다.
• CS-4, 차세대 하드웨어 — Cerebras는 CS-4 랙이 10조 개 이상의 파라미터를 가진 모델에서 초당 1,000개 이상의 토큰을 제공하며, 이는 CS-3 토큰 생성 속도의 최대 2배라고 주장합니다. 확인되지 않은 커뮤니티 보고에 따르면 CS-4에서 GPT-5.6 Sol이 초당 약 1,300개의 토큰을 생성한다고 합니다 — 같은 방향이지만 아직 OpenAI나 Cerebras가 확인하지 않았습니다.
14×를 인용하기 전에 한 가지 주의점이 있습니다. 그것은 한 공급업체 하드웨어의 출력 처리량 상한이며, 8월 출시에 대한 독립적 비교는 워크로드의 어느 부분을 측정했는지에 따라 대략 7×에서 11× 범위였습니다. 같은 원칙이 CS-4 속도 신호에도 적용됩니다. CS-4에서 GPT-5.6 Sol의 초당 약 1,300토큰이라는 수치는 단일 X 게시물에서 시작되었고, OpenAI도 Cerebras도 이를 확인하지 않았습니다. 이 모든 것을 벤치마크 판정이 아니라 공급업체와 커뮤니티의 주장으로 취급하십시오.
Ultrafast의 현재 비용 — 그리고 그것이 여전히 Sol의 가격을 정하지 못하는 이유

2026-09-30 기준 가격 질문의 현황을 분명히 밝히면 다음과 같습니다. Ultrafast에는 공개된 요금이 있습니다 — GPT-6 Astra용이며, 오직 GPT-6 Astra만 해당합니다. OpenAI의 가격 페이지에는 이제 Standard, Batch, Flex, Fast와 나란히 Ultrafast 열이 있습니다: 짧은 컨텍스트에서 백만 토큰당 입력 $60.00 / 캐시된 입력 $6.00 / 캐시 쓰기 $75.00 / 출력 $300.00이며, 약 272K 토큰을 넘으면 $120.00 / $12.00 / $150.00 / $450.00로 두 배가 됩니다. 이는 표준 Astra 요금의 6배이고, Fast 모드는 2배입니다 — 그리고 이는 OpenAI가 해당 등급에 제시한 첫 번째 확정 수치입니다. 위의 카드는 우리 자체의 2026-08-18 스냅샷이며, 그 달러 수치는 표준 요금 인하와 이제 이 Ultrafast 행에 의해 두 번이나 대체되었습니다. 그 표에서 여전히 빠져 있는 것은 GPT-5.6 Sol의 Ultrafast 요금입니다: Ultrafast 열에는 정확히 한 모델, gpt-6-astra만 나열되어 있습니다. 등급에는 가격이 매겨졌지만, 이 모델에는 매겨지지 않았습니다.
오늘 가격을 책정할 수 있는 항목을 모델별로:
• 표준 GPT-5.6 Sol — 최대 약 272K 토큰의 프롬프트 기준으로 1M 토큰당 입력 $4.00 / 출력 $20.00입니다. OpenAI는 이를 최소 2026년 11월 21일까지 제공되는 프로모션 가격으로 명시하고 있습니다. 이는 지금 바로 호출할 수 있는 기준선입니다.
• 패스트 모드 — GPT-5.6 Sol에서 짧은 컨텍스트 기준 $8.00 / $40.00이며, 약 272K 토큰을 넘으면 $16.00 / $60.00으로 두 배가 됩니다. 최대 약 2.5배의 출력 속도를 위해 표준 요금의 두 배를 지불하는 셈이며, Sol에서는 여전히 실제로 구매할 수 있는 가장 빠른 옵션입니다.
• 프롬프트 캐시 — 캐시 읽기는 1M당 $0.40로 청구되며(새 입력 대비 90% 할인), 캐시 쓰기는 1M당 $5.00로 청구됩니다.
• 롱 컨텍스트 등급 — 약 272K 토큰을 초과하는 입력은 표준 처리 시 $8.00 / $30.00으로 청구되며, 모델의 약 1.05M 토큰 윈도우와 128K 토큰 최대 출력 범위 내에 있습니다.
• Batch API — 숏 컨텍스트 $2.00 / $10.00, 롱 컨텍스트 $4.00 / $15.00, 약 24시간 처리로 50% 할인.
GPT-5.6 Sol의 경우, Astra 수치는 이용 가능한 최선의 단서일 뿐 그 이상은 아닙니다. OpenAI는 Ultrafast를 기반 모델의 표준 요금의 6배로 책정합니다. 그 배수를 Sol의 $4 / $20에 적용하면 백만당 $24 / $120이 됩니다. 이는 산술일 뿐, 공표된 가격이 아닙니다 — OpenAI는 Sol Ultrafast 요금에 대해 아무것도 밝히지 않았으며, 8월 프리뷰 코호트는 애초에 티어 요금으로 청구되지도 않았습니다. 공급업체가 해당 요금 항목을 공표할 때까지는 표준 Sol의 $4 / $20 또는 패스트 모드의 $8 / $40을 기준으로 계획하십시오.
사용 방법 — Astra에서는 폭넓게 사용할 수 있지만, Sol에서는 아직 요청이 필요합니다
접근 권한은 9월 29일에 두 갈래로 나뉘었고, 그 분할은 이 페이지에서 다루는 모델에 불리하게 작용합니다. Ultrafast는 이제 GPT-6 Astra에서 폭넓게 사용할 수 있습니다. OpenAI의 API 문서에 따르면 모든 API 사용자에게 낮은 속도 제한으로 개방되어 있으며 — 사용 등급 1–3에서는 분당 500,000 토큰, 등급 4에서는 100만, 등급 5에서는 500만 — 또한 새로운 Pro 500 요금제와 자격을 갖춘 Enterprise 및 Edu 요금제에서 ChatGPT Work와 Codex 안에 포함되어 제공됩니다. 여기서는 워크스페이스 소유자가 이를 직접 켜야 하며, 미국 외 지역에서 추론을 필요로 하는 워크스페이스에서는 지원되지 않습니다. GPT-5.6 Sol Ultrafast는 이 변경에 따라가지 않았습니다. 같은 문서는 여전히 이를 OpenAI 계정 팀을 통한 프리뷰 액세스로 설명하고 있으며, API 스키마에서 해당 매개변수의 설명 자체는 여전히 "currently available for gpt-5.6-sol"이라고 표시되어 있습니다 — 이 문구는 이제 문서의 나머지 부분을 이끄는 것이 아니라 뒤처져 있습니다. 오늘 이 등급을 이용하고 싶다면, Astra에서 이용해야 합니다.
인터페이스 문제도 정리됐다. TestingCatalog는 2026-09-26에 Standard, Fast, Ultrafast를 제공하는 속도 선택기가 Responses API Playground에 미공개로 남아 있다고 보도했다. 3일 후 OpenAI는 바로 그것의 소비자용 버전을 출시했으며, 이제 Ultrafast가 Pro 500의 ChatGPT Work와 Codex 모델 선택기에서 옵션으로 제공된다. 우리는 그 목격을 한 매체의 미출시 UI 해석으로 표시했고, OpenAI가 그중 어느 것도 확인하지 않았다고 말했다. 그것은 방향상 맞았고, 그것이 가리킨 롤아웃은 그 이후가 아니라 DevDay에 도착했다.
OpenAI가 8월에 이름을 밝힌 프리뷰 코호트는 코딩, 커머스, 금융 리서치, 지원, 그리고 기타 상호작용형 워크로드였습니다. 즉 요청당 에이전트가 많은 호출을 수행하고 응답 지연 시간이 병목인 팀들이었습니다. Jane Street, Rogo, Podium이 이름이 공개된 초기 테스터에 포함되었습니다. 여러분의 워크로드가 단일 턴 채팅이라면, 속도 티어의 중요성은 40회 호출 에이전트 루프에 비해 훨씬 떨어집니다. 이제 실질적인 답은 어떤 모델을 묻느냐에 달려 있습니다. GPT-6 Astra에서는 오늘 오후에 service_tier: "ultrafast"를 설정할 수 있지만, GPT-5.6 Sol에서는 여전히 설정할 수 없습니다.
오늘 할 수 있는 일 — 실용적인 답변

GPT-5.6 Sol Ultrafast는 아직 프리뷰 단계에 머물러 있지만, 두 플래그십 모델 모두 OrcaRouter에서 제공사 요율 그대로, 토큰당 마크업 $0으로 라이브 상태입니다 — 모델 ID openai/gpt-5.6-sol은 api.orcarouter.ai/v1의 OpenAI 호환 엔드포인트를 통해, 그리고 그 옆에 GPT-6 Astra는 표준 $10.00 / $50.00에 제공됩니다. OpenAI가 여기에 Ultrafast 티어를 새로 얹은 모델이며, 저희는 그 티어로는 라우팅하지 않습니다. 아래 캡처는 2026년 8월 기준으로 당시의 $5.00 / $30.00 라인을 그대로 보여주고 있습니다. 오늘의 Sol 요율은 $4.00 / $20.00이며, 저희가 그대로 전달하는 가격입니다. 이러한 패스스루 덕분에 벤더 가격 변동이 같은 날 저희 쪽에도 반영됩니다: 입력 $4.00 / 출력 $20.00, OpenAI가 공표하는 것과 동일한 수치이며 토큰당 마크업은 전혀 더해지지 않습니다. 이미 OpenAI 클라이언트를 사용 중이라면 마이그레이션은 base-URL과 모델 ID 변경뿐이고, 그 외에는 아무것도 없습니다. 동일한 키와 엔드포인트로 200개 이상의 모델을 사용할 수 있으므로, Sol은 자체 형제 모델들 옆에 자리합니다 — $2.00의 GPT-5.6 Terra / $12.00, 그리고 $0.20 / $1.20의 GPT-5.6 Luna — 그리고 비교 대상이 될 오픈 웨이트 모델들까지 나란히 있으니, 각각을 다시 통합할 필요 없이 난이도에 따라 라우팅할 수 있습니다.
속도 페이지에서 꼭 언급할 만한 OrcaRouter만의 두 가지 특성이 있습니다. BYOK: 자신의 OpenAI 키를 가져오면 OpenAI가 자체 요율로 직접 청구합니다 — OrcaRouter는 토큰당 $0을 추가하고 제공자의 속도 제한과 크레딧을 그대로 유지합니다. 가드레일: PII Shield와 콘텐츠 정책은 청구 전에 실행되므로, 차단된 요청은 깔끔한 400을 반환하고 절대 청구되지 않으며, Agent Firewall은 도구 및 MCP 호출을 실행 전에 평가합니다. Ultrafast 자체는 GPT-6 Astra에서 폭넓게 사용할 수 있지만 라우팅 가능한 조건이 아니며 Sol에는 제공되지 않습니다 — 이는 표준 요금의 6배로 청구되는 접근 제어 등급이며, 저희는 이를 제공하지 않습니다. OpenAI가 언젠가 이를 표준 조건으로 제공한다면, 동일한 엔드포인트에 연결하는 것은 모델 ID 변경에 불과합니다. 오늘 구축한 설정은 그대로 이어집니다.
정직한 경계 — Ultrafast가 답이 아닐 때
속도 이야기가 절반쯤 정리된 지금, 여전히 그 이야기가 통하지 않는 다섯 가지 지점:
사용 가능하다는 것은 여러분에게 사용 가능하다는 것과 다릅니다. Ultrafast는 GPT-6 Astra에서 모든 API 사용자에게 개방되었지만, 낮은 레이트 리밋으로 개방되었고, OpenAI의 스키마에서는 여전히 접근 제어됨으로 설명되며, EU 또는 기타 미국 외 지역 처리를 지원하지 않고, Enterprise 워크스페이스에서는 소유자가 활성화하기 전까지는 꺼져 있습니다. GPT-5.6 Sol에서는 아무것도 전혀 개방되지 않았습니다. 둘 중 어느 쪽을 기반으로 설계하기 전에 자신의 접근 권한을 확인하세요.
14×는 최대치일 뿐 보장이 아닙니다. 이는 Cerebras 하드웨어에서의 출력 처리량 상한입니다. 종단 간 지연 시간에는 여전히 입력 처리, 모델의 추론 시간, 그리고 사용자의 네트워크가 포함됩니다. 추론 비중이 높은 프롬프트는 실제 소요 시간의 대부분을 생각하는 데 쓸 수 있으며, 그러면 대표 수치로 내세운 속도 향상은 줄어듭니다.
한 모델에는 가격이 있고 다른 모델에는 없습니다. Astra Ultrafast 요금은 공개되어 있으며 표준의 6배입니다. 그리고 GPT-5.6 Sol에 대한 Ultrafast 행은 어디에도 없습니다. 예산은 표준 Sol의 $4 / $20 또는 패스트 모드의 $8 / $40을 기준으로 잡고, 위의 $24 / $120 외삽값을 포함해 보게 되는 모든 "GPT-5.6 Sol Ultrafast cost" 수치는 요금표가 아니라 산술 계산으로 취급하세요.
벤치마크는 벤더가 보고한 수치다. 11시간 HLE 실행과 5.6배 GDP-Val 수치는 8월 발표에서 나온 OpenAI/Cerebras 수치이며, 속도 향상에 대한 독립적 추정치는 무엇을 측정하느냐에 따라 대략 7배에서 11배 범위다. 그 목록에 CS-4 신호도 추가하자: CS-4에서 GPT-5.6 Sol의 약 1,300토큰/s 수치는 단일 X 게시물에서 나온 것으로 독립적 확인이 없다. 새로운 Astra Ultrafast 수치 — Codex에서 8배, 가격은 6배 — 역시 OpenAI 자체 수치다.
그리고 시간이 아니라 돈이 드는 쪽은, 당신에게 없는 병목을 해결해 주지 않습니다. 에이전트가 느린 이유가 자체 오케스트레이션, 도구 지연 시간, 입력이 많은 프롬프트 때문이라면, 더 빠른 출력 경로는 꼬리 부분을 아주 조금만 개선합니다. 티어 매칭 결정 — GPT-5.6 Sol은 $4 / $20, GPT-5.6 Terra는 $2 / $12, GPT-5.6 Luna는 $0.20 / $1.20 — 은 여전히 어떤 속도 티어보다도 청구서에 더 큰 영향을 미칩니다.
결론부터. Ultrafast는 더 이상 읽기만 할 수 있는 대기자 명단 등급이 아니다. 2026년 9월 29일부로 OpenAI가 이를 판매한다: Work와 Codex의 월 $500 ChatGPT Pro 500 플랜에 포함되고, GPT-6 Astra의 모든 API 사용자에게 낮은 속도 제한으로 개방되며, 가격은 표준 요금의 6배 — 백만 숏컨텍스트당 $60 / $300이다. GPT-5.6 Sol Ultrafast, 이 페이지가 중심으로 삼았던 8월 프리뷰는 변하지 않았다: 여전히 접근이 통제되고, API 스키마에서 여전히 gpt-5.6-sol로 제한되며, 여전히 가격이 책정되지 않았고, Cerebras의 CS-4에서 Sol에 대해 보고된 초당 약 1,300토큰이라는 수치는 여전히 검증되지 않은 단일 X 게시물에 불과하다. 표준 GPT-5.6 Sol은 $4 / $20으로 오늘 OrcaRouter에서 마크업 0으로 호출할 수 있고; GPT-6 Astra는 $10 / $50으로 Ultrafast 행을 받은 모델을 원한다면 호출할 수 있다.
Ultrafast는 이제 GPT-6 Astra에서 실제 비용이 발생합니다 — 표준의 6배이거나, $500 Pro 500 플랜에 번들로 포함됩니다 — 반면 GPT-5.6 Sol Ultrafast는 프리뷰 상태로 남아 있습니다. 전체 GPT-5.6 Sol은 OrcaRouter에서 백만 토큰당 $4 / $20에 마크업 없이 제공되며, 자체 키로 바로 사용할 수 있습니다.
이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
