GPT-6 Astra 가격 책정을 위한 생성된 타이틀 카드로, 세 개의 스탯 칩에는 '정가: 1M당 입력 $10.00 / 캐시 $1.00 / 출력 $50.00', '배치: $5.00 / $25.00 - 고속 모드: $20.00 / $100.00', 'GPT-5.6 Sol 대비 손익분기점: 토큰의 40%'라고 적혀 있으며, 각주에는 '모델은 2026년 9월 3일에 출시되었습니다. 요율은 2026년 9월 16일 OpenAI 자체 가격 페이지에서 확인했습니다.'라고 되어 있습니다.
Guides & Insights

GPT-6 Astra 가격 책정: 세 가지 다른 가격이 모두 맞는 이유, 그리고 작업에 실제로 드는 비용

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

결론부터 말하자면: GPT-6 Astra의 비용은 백만 입력 토큰당 $10.00, 백만 캐시 입력당 $1.00, 백만 출력 토큰당 $50.00이며, Ope​nAI의 표준 티어 기준입니다. 이는 Ope​nAI 자체의 정가로, Ope​nAI 자체 가격 페이지에서 2026년 9월 16일에 확인한 값입니다 — 그리고 날짜가 중요합니다. 왜냐하면 이 모델은 시점에 따라 가격이 다르게 책정되어 왔고, 독자들이 계속 그 다른 숫자들을 발견하고 있기 때문입니다. GPT-6 Astra 자체는 2026년 9월 3일에 출시되었습니다. 이 페이지보다 13일 전입니다. 이것은 출시 글이나 발표 글이 아닙니다. 이는 이제 일반 제공되고, 이번 주 기준으로 일반 배포된 모델에 대한 참조 페이지입니다. GPT-5.6 Sol은 아래에 Astra가 그 위에 판매되는 가격 기준선으로 나오며, 주제로 다뤄지는 것은 아닙니다.

요금표에 한 페이지 전체가 필요한 이유는 유통되는 숫자들이 서로 엇갈리기 때문이다. 이 모델의 가격을 검색해 보면 OpenAI의 $10/$50, $5/$25 배치 요금, Azure가 $10/$50과 $11/$55를 모두 제시하는 것, 그리고 적어도 하나의 엔드포인트가 $20/$100으로 등록된 것을 찾을 수 있다. 그중 어느 것도 오타가 아니고, 어느 것도 정가가 조용히 바뀐 것이 아니다. 그것들은 서로 다른 서비스 등급과 서로 다른 재판매업체이며, 이를 구분하는 것이 예산과 추측의 차이다.

모든 항목에 라벨과 날짜가 표시된 요금표

이 섹션의 모든 내용은 Open​AI 자체의 API 가격 및 모델 문서에서 2026년 9월 16일수치가 다른 출처에서 온 경우에는 그 수치를 담은 문장에서 그 사실을 밝힙니다.

표준, 입력 토큰 272,000 이하의 요청 — 입력 100만 토큰당 $10.00, 캐시된 입력 100만 토큰당 $1.00, 캐시 쓰기 100만 토큰당 $12.50, 출력 100만 토큰당 $50.00 (Ope​nAI 자체 가격표, 2026-09-16 확인).

캐시 쓰기 항목은 실제로 존재하는데 사람들은 이를 놓친다 — 프리픽스를 처음 보낼 때 그것은 1M당 $1.00의 읽기가 아니라 $12.50의 쓰기입니다. 캐시 쓰기는 표준 입력 요율의 1.25배로 청구됩니다.

표준, 입력 토큰 272,000개 초과 요청 — 1M당 입력 $20.00, 캐시된 입력 $2.00, 캐시 쓰기 $25.00, 출력 $75.00. 기준을 넘긴 토큰만이 아니라 요청 전체의 가격이 다시 책정됩니다 (Ope​nAI 자체 가격표, 2026-09-16 확인).

Batch and Flex — 표준의 절반: 100만 토큰당 입력 $5.00, 캐시된 입력 $0.50, 캐시 쓰기 $6.25, 출력 $25.00 (OpenAI 자체 가격표, 2026-09-16 확인). 입력이 272K를 초과하는 경우 배치 요금은 $10.00 / $1.00 / $12.50 / $37.50입니다.

빠른 모드 — 이중 기준: 1M당 입력 $20.00, 캐시 입력 $2.00, 캐시 쓰기 $25.00, 출력 $100.00 (Ope​nAI 자체 가격표, 2026-09-16 확인).

요금을 결정하는 모델 사양 — 컨텍스트 윈도우 1,050,000 토큰, 최대 입력 922,000, 최대 출력 128,000, 지식 컷오프 2026-04-30, 추론 토큰 지원 예, 추론 강도 값 low / medium / high / xhigh / max (Ope​nAI 자체 모델 문서, 2026-09-16 확인).

한 문장 버전을 원한다면: 표준 티어에서 입력 토큰 272K 미만인 요청은 입력 100만 개당 $10, 출력 100만 개당 $50이며, 캐시 읽기는 입력 요금의 10분의 1이고, 이 글의 나머지 모든 내용은 더 느린 처리를 받아들이는 데 따른 할인이나 임계값을 넘는 데 따른 추가 요금입니다.

왜 다른 숫자가 보이는지, 그리고 어느 것이 어느 것인지

$10/$50이 아닌 견적을 만들어내는 다섯 가지 별개의 요인이 있습니다. 그중 네 가지는 문서로 연결할 수 있지만, 하나는 그럴 수 없으며, 추측하기보다는 그렇다고 말하겠습니다.

$5/$25는 배치 티어이며, 이는 OpenAI 자체의 가격입니다. 이것은 리셀러 할인이나 협상된 엔터프라이즈 요율이 아닙니다. OpenAI의 가격 페이지에는 배치 처리가 표준 요율의 절반으로 명시되어 있으며, Astra 배치 행은 입력 $5.00, 출력 $25.00으로 표기되어 있습니다. 어떤 출처에서 $5/$25를 마치 다른 모델인 것처럼 인용하더라도, 그것은 동일한 모델, 동일한 가중치를 더 느린 큐에서 처리하는 것입니다. 배치는 야간 평가 실행에는 정답이고, 대화형 작업에는 오답입니다.

$11/$55는 정가 대비 정확히 10% 인상이며, Ope​nAI는 레지던시 엔드포인트에 대해 10% 인상을 문서화하고 있습니다. Ope​nAI의 가격 페이지에는 2026년 3월 5일 이후에 출시된 모델의 레지던시 엔드포인트에 10% 인상이 부과된다고 명시되어 있습니다. GPT-6 Astra는 2026년 9월 3일에 출시되었으므로 해당됩니다. 정가에 1.1을 곱하면 $11.00과 $55.00이 센트 단위까지 정확히 나옵니다. 이는 더 높은 Azure 스타일 견적이 어디서 나오는지에 대한 강력한 설명입니다 — 리셀러가 마진을 만들어낸 것이 아니라, 레지던시에 묶인 엔드포인트가 문서화된 인상을 적용받는 것입니다. 다만 그 주장의 한계에 대해서는 정확해야 합니다: 인상은 Ope​nAI에 의해 문서화되어 있고 산술도 정확히 일치하지만, 우리가 본 특정 Azure 리스팅 자체는 그것이 레지던시 엔드포인트라고 명시하지는 않습니다. 이를 확인된 설명이 아니라 유력한 설명으로 취급하십시오.

$20/$100은 이 모델에 대한 OpenAI의 Fast 모드 요금입니다. 이것은 가장 가짜 숫자처럼 보이면서도 가장 가짜가 아닌 것입니다. Fast 모드는 모든 항목을 두 배로 하며, Astra의 표준 Fast 행은 100만 토큰당 입력 $20.00, 출력 $100.00입니다. $20/$100을 제시하는 엔드포인트는 다른 서비스 등급, 즉 우선 처리를 제시하는 것이지 다른 정가나 다른 모델을 제시하는 것이 아닙니다. Astra 이름 옆에서 그 수치를 본다면, 물어야 할 질문은 어느 벤더인지가 아니라 어느 처리 등급인지입니다.

정가 이하의 가격은 존재하며, 그것은 다른 누군가의 마진입니다. 서드파티 게이트웨이와 리셀러는 Astra를 정가 이하로 광고합니다. 한 게이트웨이는 Ope​nAI의 요금보다 약 20% 낮은 가격을 공개적으로 명시하고 있습니다. 그것은 해당 운영자의 상업적 결정이지 Ope​nAI의 가격 변경이 아니며, 그 운영자가 적용하는 데이터 처리 및 안정성 약관이 그대로 따릅니다. 우리는 그들의 이름을 밝히거나 그들의 할인을 이 모델의 가격에 대한 근거로 계산하지 않을 것입니다. 왜냐하면 그것은 Ope​nAI의 요금표가 아니라 그들의 비즈니스에 대한 근거이기 때문입니다.

우리가 검증할 수 없었던 것. 우리는 라우터 목록에서 모델이 gpt-6-astra로 표시되고, 배치 등급이 $5/$25이며, 이동하는 별칭이 ~openai/gpt-astra-latest 형태인 것을 보았습니다. 배치 수치는 Ope​nAI 자체 페이지와 일치합니다. 그 별칭은 게이트웨이 구성물입니다: Ope​nAI의 모델 문서에는 snapshots 아래에 정확히 하나의 항목만 나열되어 있으며 그것은 날짜가 붙지 않은 순수한 gpt-6-astra이고, -latest 별칭은 없습니다. 공급업체가 공개한 것인 양 게이트웨이 별칭을 구성에 넣지 마십시오. 별도로, 우리는 별도 가격이 책정된 "Astra Pro", "Astra-Medium" 또는 이와 유사한 등급에 대한 Ope​nAI 문서를 찾지 못했습니다. "Pro"는 API 요금표가 아니라 ChatGPT 요금제 이름에 나타나며, 라우터 목록은 공급업체 문서가 아닙니다. 등급을 확인해야 한다면, Ope​nAI 자체 페이지에서 확인하십시오.

A single-column rate-card graphic for GPT-6 Astra listing Input $10.00 per 1M, Cached input $1.00 per 1M, Cache writes $12.50 per 1M, Output $50.00 per 1M, Over 272K input $20.00 / $75.00 per 1M, and Batch tier $5.00 / $25.00 per 1M, footnoted 'OpenAI standard rates read September 16, 2026. Batch is half the standard rate.'

나머지 Open​AI 요금표 옆에 있는 Astra

가격은 같은 카드에 있는 대안 옆에 놓일 때에만 의미가 있습니다. 이는 모두 OpenAI 자체의 표준 요금이며, 모두 2026년 9월 16일에 확인한 값이고, 모두 백만 토큰당이며, 모두 272K 입력 이하입니다.

GPT-6 Astra — 입력 $10.00 / 캐시 $1.00 / 쓰기 $12.50 / 출력 $50.00.

GPT-5.6 Sol — 입력 $4.00 / 캐시 $0.40 / 쓰기 $5.00 / 출력 $20.00.

GPT-5.6 Terra — 입력 $2.00 / 캐시 $0.20 / 쓰기 $2.50 / 출력 $12.00.

GPT-5.6 Luna — 입력 $0.20 / 캐시 $0.02 / 쓰기 $0.25 / 출력 $1.20.

롱 컨텍스트 버전 — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.

저 표 아래에서는 프로모션이 진행 중이고, 그것이 모두가 논쟁하는 배수를 결정한다. Ope​nAI의 가격 페이지에 따르면 GPT-5.6 Sol의 프로모션 가격은 적어도 2026년 11월 21일까지 제공된다. 오늘 실제 적용되는 프로모션 요금과 견주어 보면, Astra는 모든 항목에서 Sol의 2.5배다 — 입력 2.5배, 캐시된 입력 2.5배, 출력 2.5배. Sol의 비프로모션 요금인 입력 $5.00, 출력 $30.00과 견주어 보면, Astra는 입력에서 2배, 출력에서 약 1.67배다. 두 배수 모두 산술적으로 정확하며, 같은 날의 동일한 두 모델을 설명한다. 차이는 전적으로 어떤 Sol 요금을 분모로 삼는지에 달려 있으며, "Astra는 Sol의 2.5배인가?"에 대한 솔직한 답은 이렇다: 그렇다, 2026년 11월 21일까지, 또는 Ope​nAI가 프로모션을 끝낼 때까지, 둘 중 먼저 오는 때까지.

우리가 이 점을 길게 강조하는 것은, 이 블로그에서도 그렇듯, 이 모델에 대한 보도에서 이것이 가장 흔한 오류가 되기 때문입니다. 하나의 Sol 요율을 조용히 선택하면서 그것을 명시하지 않는 토큰당 배수는 Astra에 관한 사실이 아닙니다. 그것은 그 문장이 언제 쓰였는지에 관한 사실입니다.

A screenshot of OpenAI's own API pricing page, captured September 16, 2026, showing short-context and long-context rates per 1M tokens for gpt-6-astra ($10.00 input, $1.00 cached input, $12.50 cache writes, $50.00 output; long context $20.00 / $2.00 / $25.00 / $75.00) alongside gpt-5.6-sol, gpt-5.6-terra and gpt-5.6-luna, with the page's notes that data-residency endpoints carry a 10% uplift for models released on or after March 5, 2026 and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

작업당 비용, 토큰당 비용이 아닌

OpenAI의 자체적인 설명에 따르면, 이 모델의 토큰 가격을 비교하는 것은 잘못된 비교입니다. Astra는 더 적은 토큰과 더 적은 재시도로 장기적인 작업을 완수하도록 설계되었기 때문입니다. 그 주장은 그저 되풀이하기보다는 실제로 계산해 볼 가치가 충분히 있습니다. 그래서 여기에 가정을 먼저 명시한 계산 예시를 제시합니다. 여러분의 워크로드에 맞게 가정을 바꿔 보세요.

워크로드: 200회 호출로 구성된 에이전트 실행으로, 야간 마이그레이션의 형태입니다. 각 호출은 10,000개의 입력 토큰을 가지며, 그중 8,000개는 캐시 읽기이고 2,000개는 신규 토큰이며, 500개의 출력 토큰을 생성합니다. 실행 전체를 합치면 400,000개의 신규 입력 토큰, 1,600,000개의 캐시된 입력 토큰, 100,000개의 출력 토큰에 더해 접두사를 시드하기 위한 단일 10,000토큰 캐시 쓰기가 있습니다. 표준 티어이며 요청당 272K 미만이므로 장문 컨텍스트 할증은 적용되지 않습니다.

GPT-6 Astra — 신규 0.4M x $10.00 = $4.00; 캐시 1.6M x $1.00 = $1.60; 쓰기 0.01M x $12.50 = $0.13; 출력 0.1M x $50.00 = $5.00. 합계 $10.73.

GPT-5.6 Sol 프로모션 요금 적용 — 신규 $1.60; 캐시 $0.64; 쓰기 $0.05; 출력 $2.00. 합계 $4.29.

프로모션 미적용 요율 기준 GPT-5.6 Sol — 신규 $2.00, 캐시 $0.80, 쓰기 $0.06, 출력 $3.00. 합계 $5.86.

GPT-5.6 Terra — 신규 $0.80; 캐시 $0.32; 쓰기 $0.03; 출력 $1.20. 합계 $2.35.

GPT-5.6 Luna — 신규 $0.08; 캐시 $0.03; 쓰기 $0.00; 출력 $0.12. 합계 $0.23.

동일한 토큰 수라면, Astra는 Luna의 약 46배, Terra의 4.6배다. 아무도 Astra 규모의 작업을 하려고 Luna를 사지는 않으며, 그 각주야말로 그 두 모델 간의 토큰당 비용 비교가 연극일 뿐인 이유의 전부다. Sol 비교는 무언가를 판가름하는 비교이니, 중요한 숫자는 이것이다.

손익분기점은 40%입니다. Sol의 프로모션 요율에서는 Astra가 모든 항목에서 Sol의 정확히 2.5배이므로, Astra는 동일한 작업에서 Sol 토큰의 최대 40%를 소비하고도 같은 청구 금액에 도달할 수 있습니다. 그리고 비율이 일정하기 때문에 이는 신규 입력, 캐시 입력, 출력의 어떤 조합에서도 성립합니다. Astra가 Sol 토큰의 3분의 1을 사용하면 더 저렴해지고, 절반을 사용하면 더 비싸집니다. Sol의 비프로모션 요율과 비교하면 이 캐시 비중이 높은 조합에서 손익분기점은 약 55%로 완화되는데, Astra의 출력 배수는 1.67배로, 입력 배수는 2배로 떨어지기 때문입니다.

유용한 숫자는 바로 그 하나이며, 바로 그 지점에서 벤더의 주장과 독립적 측정이 더 이상 일치하지 않는다. OpenAI는 Terminal-Bench 4.0에서 Astra가 57.9%인 반면 GPT-5.6 Sol은 37.3%라고 보고하며, 작업당 추정 API 비용은 약 9% 더 낮다고 한다 — 벤더 보고 기준. Artificial Analysis는 2026년 9월 9일에 발표된 독립 평가에서 자사의 Coding Agent Index에서 Astra가 작업당 Sol 토큰의 약 3분의 1을 사용하는 것으로 측정했고, 그럼에도 최대 노력에서 Astra가 작업당 $7.09로 — Sol (max)보다 약 15% 더 높은 비용 — 7점 더 높은 점수를 기록했다고 밝혔다. 같은 평가의 Intelligence Index에서 Astra는 노력 수준 전반에 걸쳐 작업당 $0.82에서 $3.26 사이였으며, 이는 최대 노력에서 Sol보다 약 60% 더 비쌌다.

그 두 가지는 동시에 사실일 수 있으며, 그 사이의 간극이 정직한 헤드라인이다. 토큰 절감은 실재하고 크다 — 3분의 1은 40% 손익분기점을 넘기는 바로 그런 숫자다 — 하지만 출력 토큰에서 측정한 절감은 긴 에이전트 세션을 지배하는 캐시 읽기와 신규 입력 항목을 줄여 주지 않는다. Astra가 작업당 Sol보다 저렴한지는 여러분의 구성에 달려 있으며, 그 방향은 워크로드에 따라 뒤집힌다. 그것이 단순히 더 저렴하다거나 단순히 2.5배 더 비싸다고 말하는 사람은 청구서의 한 항목을 마치 전체인 양 인용하는 것이다.

이 모델에서 실제로 청구서를 좌우하는 것은 무엇인가요?

세 가지가 두드러지는데, 그 세 가지 모두 Astra가 어떻게 사용되도록 의도되었는지에 특유한 것들입니다.

추론 토큰은 출력 토큰입니다. 백만 개당 $50.00로 청구되며, 이는 표시되는 출력과 동일합니다. Ope​nAI의 모델 페이지에는 지원되는 effort 값이 low, medium, high, xhigh, max로 나열되어 있으며, 비활성화 설정은 없습니다. 즉, 최저 수준이 이전 모델보다 높아졌습니다. 독립적인 Intelligence Index 측정에서 low와 max effort 간의 격차는 작업당 $0.82에서 $3.26으로, 동일한 작업에 대해 4배 차이였습니다. Effort 수준은 여러분이 통제할 수 있는 가장 큰 단일 비용 변수이며, 전역적으로 설정하기보다 호출별로 설정할 가치가 있습니다.

재시도는 모든 것을 배로 불립니다. 실패한 에이전트가 다시 실행되면 전체 프리픽스 비용을 처음부터 다시 지불합니다. 이것이 OpenAI의 "재시도 감소" 주장을 뒷받침하는 메커니즘이며, 토큰당 비용 계산이 양방향으로 오해를 낳는 이유이기도 합니다. 토큰당 2.5배 비용이 들더라도 한 번에 완료하는 모델이 세 번이 필요한 더 저렴한 모델을 이길 수 있습니다. Astra를 무엇과 비교해 평가하든, 토큰당 달러가 아니라 달러당 완료된 작업을 측정하세요.

긴 컨텍스트는 설계된 모드이며, 추가 요금이 부과됩니다. 윈도우는 1,050,000 토큰입니다. 단일 요청에서 입력 토큰 272,000개를 넘기면 초과분만이 아니라 요청 전체가 백만 토큰당 입력 $20.00, 출력 $75.00로 재산정됩니다. 280,000 토큰 요청은 약 4% 더 많은 입력으로 270,000 토큰 요청보다 대략 두 배의 비용이 듭니다. 장기 작업을 위해 만들어진 모델에서 이것은 예산을 눈치채지 못한 채 날려버리는 가장 손쉬운 방법이며, 모델이 전체를 통째로 받을 수 있는데도 장기 작업을 272K 미만의 요청으로 청킹하는 편이 통째로 보내는 것보다 대개 더 저렴한 이유이기도 합니다.

이를 상쇄하는 것은 캐싱이며, 긴 에이전트 세션이 실제로 비용을 절감하는 지점이 바로 여기입니다. 캐시된 읽기는 새로 처리할 때의 $10.00에 비해 $1.00로, 90% 절감되며, 긴 세션은 동일한 프리픽스를 수십 번 다시 전송합니다. $12.50의 캐시 쓰기 비용은 한 번만 지불됩니다. 위의 계산 예시에서, 모든 호출이 8,000토큰 프리픽스를 캐시 없이 다시 전송해야 했다면 Astra의 청구액은 $10.73에서 약 $25.00로 상승했을 것입니다. 캐시는 예산에 있어 다른 어떤 단일 항목보다 더 많은 일을 하고 있습니다.

여러 개에 관한 기록

이 블로그의 여러 페이지, GPT-6 Astra vs GPT-5.6 Sol: 2.5배 가격이 그만한 가치가 있을까?GPT-6 Astra 수요로 200달러 ChatGPT Pro 신규 가입 중단에서는 Astra의 토큰 가격이 GPT-5.6 Sol의 2.5배로 책정되어 있다고 밝히고 있습니다. 이 수치는 Sol의 프로모션 요금인 입력 $4.00, 출력 $20.00을 기준으로 계산된 것으로, 이는 OpenAI의 가격 페이지에 현재 게시되어 있으며 프로모션 요금이라고 설명되고 있는 요율로, 최소 2026년 11월 21일까지 제공됩니다.

따라서 그 배수는 여전히 유효하다 — 다만 이전 페이지들에는 없던 만료일이 생겼다. Sol의 비프로모션 요금인 입력 $5.00, 출력 $30.00을 기준으로 하면 Astra는 입력 2배, 출력 약 1.67배이며 2.5배가 아니다. 2.5배라고 말하는 페이지들은 프로모션 기간에 관한 것으로 읽어야 한다. 비교의 방향은 바뀌지 않지만, 프로모션이 끝나는 순간 격차의 크기는 5분의 1에서 3분의 1만큼 줄어든다. 2026년 11월 21일 이후를 기준으로 예산을 세우는 사람은 누구든 Sol 분모로 $5.00와 $30.00을, Astra 배수로 2배 / 1.67배를 사용해야 한다. 우리는 그 페이지들의 논증을 다시 진술하는 것이 아니다 — 그곳의 벤치마크와 신뢰성 추론은 그 자체로 성립한다 — 다만 그 계산에 사용된 분모를 바로잡을 뿐이다.

"무료"라는 질문, 얼버무리지 않고 답하다

이 모델에는 무료 티어가 없고, 무료로 접근할 수 있는 API 경로도 없습니다. 무료 및 Go ChatGPT 사용자는 GPT-6 Astra를 전혀 사용할 수 없습니다. Plus 구독자는 ChatGPT Work와 Codex를 통해서만 사용할 수 있으며, 일반 채팅에서는 사용할 수 없습니다. API는 첫 토큰부터 입력 100만 개당 $10.00로 과금되며, 이 숫자를 줄이는 가장 저렴한 합법적 방법은 100만 개당 $5.00의 배치 티어로, 이는 능력이 아니라 지연 시간을 대가로 치르게 합니다. 무료 GPT-6 Astra API 접근을 광고하는 사람은 누구든 무언가를 재판매하는 것입니다. 보통 자체 데이터 약관을 가진 서드파티 게이트웨이의 체험 크레딧 풀이지요. 그것이 반드시 나쁜 거래는 아니지만, 무료도 아니고 OpenAI도 아닙니다.

API가 아니라 구독을 기준으로 용량 계획을 세우는 경우라면 알아둘 만합니다. 2026년 9월 10일, OpenAI는 Astra에 대한 수요를 이유로 $200 ChatGPT Pro 등급의 신규 가입과 업그레이드를 일시 중단했습니다. $100 등급인 Plus, Go, API, Business 및 Enterprise 계정은 계속 열려 있었습니다. 소비자에게는 사용량 제한이 적용되었지만 API와 엔터프라이즈 접근에는 적용되지 않았습니다. 계획이 소비자 구독의 사용 허용량에 의존한다면, 그것이 모델링해야 할 위험입니다.

라우팅하기, 그리고 라우터가 해결하지 못하는 것

Astra는 OrcaRouter를 통해 openai/gpt-6-astra라는 이름으로 제공되는 모델 중 하나입니다. 벤더가 부과하는 것과 동일한 $10.00 입력 및 $50.00 출력 요금이며, 당사 모델 페이지에 표시된 272K 초과 구간 요금 체계가 적용됩니다. 우리는 제공업체 정가를 0% 마크업으로 그대로 전달합니다. 이는 대부분의 모델보다 이 모델에서 더 중요합니다: 이 글의 수치는 이 모델의 수명 내에서 이미 한 번 바뀌었으며, 패스스루 가격은 누군가가 표를 업데이트하는 걸 기억하는 때가 아니라 벤더가 가격을 바꾸는 당일에 움직입니다.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, captured September 16, 2026, showing $10.00 per 1M input tokens and $50.00 per 1M output tokens, a 1M-token context window, 128K maximum output, text, image and file input, p50 time to first token of 6.70 s and 181.0M tokens of traffic over 7 days.

여기서 라우팅을 선택하는 솔직한 근거는 가격이 아닙니다. 팔아드릴 할인이 없으니까요. 그 근거는 위의 비용 계산이 워크로드에 따라 달라지며, 실제로 실행해 보기 전에는 40% 손익분기점의 어느 쪽에 속하게 될지 알 수 없다는 것입니다. Astra를 Sol, Terra, Luna와 함께 하나의 엔드포인트 뒤에 두면 자체 트래픽에서 달러당 완료 작업 수를 측정할 수 있고, 두 번째 계약이나 코드 변경 없이 모델을 전환할 수 있습니다. 라우팅 DSL을 사용하면 프로덕션 경로를 하나의 모델에 확정하는 대신 여러 모델에 걸쳐 호출을 구성할 수 있으며, 자동 페일오버는 이 모델이 이미 두 번 입증한 사례, 즉 이 모델에 대한 수요가 용량을 초과할 수 있다는 사례를 처리합니다.

트레이드오프는 똑같이 실재하며 짚고 넘어갈 가치가 있습니다. 라우터는 요청 경로의 한 홉이며, 장시간 자율 작업을 판매 포인트로 내세우는 모델에서는 그 홉이 장애 도메인에 추가되는 하나의 요소입니다. 이를 전혀 용납할 수 없다면 공급업체에 직접 문의하세요. 이 글의 여러 내용은 직접 관계에서만 존재합니다. Ope​nAI가 지원 엔드포인트에서 자격을 갖춘 API 고객에게 제공하는 Zero Data Retention 옵션은 Ope​nAI의 승인을 받아야 하며, 엔터프라이즈 활성화는 출시 시 기본적으로 꺼져 있고 관리자가 해당 요금표에 따라 켜는 것으로, 라우터가 부여할 수 있는 것이 아니라 귀하와 Ope​nAI 간의 계약입니다. Ope​nAI는 또한 이 모델의 Fast 모드가 EU 데이터 레지던시와 함께 사용할 수 없다고 문서화하고 있으므로, 레지던시와 속도를 함께 필요로 한다면 그 제약은 경로가 아니라 모델을 따릅니다. 그리고 라우터의 0% 마크업은 할인이 아닙니다. 우리는 직접 이용하는 것보다 저렴한 것이 아니라, 유지 관리할 통합이 더 적을 뿐 같은 가격입니다.

볼 것

하나의 날짜와 하나의 숫자. 날짜는 2026년 11월 21일로, 이날에는 Sol의 프로모션 가격이 더 이상 보장되지 않습니다 — 그 가격이 종료되면 입력에서 Sol 대비 Astra의 배수는 2.5배에서 2배로, 출력에서는 1.67배로 떨어지며, 유통되는 모든 작업당 비용 비교는 Astra 자체는 단 하나도 바뀌지 않은 채 Astra에 5분의 1에서 3분의 1만큼 더 유리해집니다. 숫자는 당신 자신의 손익분기점입니다: 두 모델 모두에서 대표적인 장기 작업 하나를 실행하고, 완료된 작업 수와 총 달러를 세어 보면, 이 페이지를 포함해 어떤 출판물보다 더 유용한 답을 얻게 될 것입니다.

뒤에 Astra를 두면Sol, Terra, Luna와 나란히 있는 단일 엔드포인트 자체 트래픽에서 달러당 완료된 작업을 측정하고 별도의 계약이나 코드 변경 없이 모델을 전환할 수 있습니다.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트