Step 5 Preview 대 Qwen 3.8 Max Prime의 '1 인덱스 포인트, 4달러 38센트'라는 문구가 적힌 생성된 타이틀 카드로, 세 개의 통계 칩이 있습니다: Artificial Analysis Intelligence Index 44 대 45, 인덱스 작업당 비용 $1.03 대 $5.41, 백만 토큰당 출력 가격 $2.70 대 $9.902. OrcaRouter 로고는 오른쪽 아래의 흰색 띠에 있습니다.
Guides & Insights

Step 5 Preview vs Qwen 3.8 Max Prime: 인덱스 포인트 1점, 4달러 38센트

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

검색창이 알려주지 않는 것부터 시작하자. Qwen 3.8 Max Prime은 모델이 아니다. 그것은 하나의 서빙 레인이다 — 동일한 Qwen3.8-Max 가중치를 공급업체가 2026년 8월 3일 일반 제공 단계로 가져갔고, 두 번째 모델 ID로 국제 요율표의 정확히 두 배 가격에 판매한 것이다. Step 5 Preview는 StepFun의 클로즈드 플래그십으로, 2026년 9월 20일 API를 열었고, 일반적인 의미의 모델이다: 하나의 엔드포인트, 하나의 가격, 당신이 보유할 수 없는 하나의 가중치 세트. 그래서 이 맞대결의 정직한 버전은 측정된 모델과 측정되지 않은 티어를 맞붙게 하며, 거기서 도출되는 계산은 어느 공급업체도 슬라이드에 올리지 않을 만큼 더 노골적이다. 독립적인 Artificial Analysis Intelligence Index에서 둘은 44 대 45로 1점 차이고, 완료된 작업 비용에서는 $1.03 대 $5.41로 차이가 난다. 작업당 1점, 4달러 38센트 — 그리고 그것은 Prime이 실제로 요금을 부과하는 속도를 하나도 사기 전의 일이다.

다음은 그 숫자를 해부한 내용입니다: 그 숫자가 어디에서 비롯되는지, Prime이 무엇을 두 배로 만들기도 전에 표준 Qwen ID가 이미 비교 대상의 더 비싼 절반인 이유, 그리고 작업당 추가 4달러가 사는 것과 사지 않는 것입니다.

그 이름이 제품이 하지 않는 일을 대신 하고 있다

알리바바는 2026년 9월 22일 윈치 콘퍼런스에서 Prime — 优速模式, 빠른 모드 — 를 발표하고 Model Studio 요금표의 한 행으로 공개했다. 알리바바 자체 문서는 무엇이 달라지는지 명확히 밝힌다: 출력 속도는 표준 API의 1.5~2배로 상승하며, 공급업체의 표현대로 기능과 사용 제한은 원래 모델과 동일하다. 새로운 파라미터 수, 새로운 엔드포인트 계약, 표준 ID에 없는 기능은 없다. 요청 본문에서 모델 이름을 바꾸면 빠른 차선에 올라선다.

Generated two-column comparison scoreboard for Step 5 Preview and Qwen 3.8 Max Prime across six shared rows: what the name refers to, 'a model' against 'a serving lane for Qwen3.8-Max'; Artificial Analysis Intelligence Index 44 against 45, measured on the standard Qwen ID with no Prime row; cost per index task $1.03 against $5.41; output price $2.70 against $9.902 per million tokens; output speed 87 against 35.4 tokens per second, again measured on the standard ID; and weights, 'proprietary, BF16 checkpoint promised 15 October' against 'proprietary, none'. A footer reads that index, speed and cost-per-task figures are per Artificial Analysis and were measured on the standard Qwen3.8-Max ID rather than on Prime, and that rate cards are Alibaba's international list price and StepFun's own. The OrcaRouter logo sits in a white strip at the bottom right.

그로 인해 그 검색어는 함정이 된다. Qwen3.8-Max보다 새로운 Qwen 플래그십을 찾는 사람은 "Prime"을 발견하고 그것을 버전 번호로 읽는다. 그것은 가격이다. 그 이름이 역량에 관해 암시하는 모든 것은 Qwen3.8-Max 자체가 제공한다: 2.4조 개 매개변수의 희소 전문가 혼합(MoE) 모델로, 토큰당 약 950억 개의 매개변수가 활성화되고, 레이어당 512개의 전문가가 있으며, 독립 위원회가 테스트한 구성에서 983,616토큰 컨텍스트를 갖춘다.

Step 5 Preview에는 그에 상응하는 모호성이 없으며, 정반대의 문제를 안고 있습니다. StepFun은 이를 전체 파라미터 약 6,000억 개, 활성 파라미터 270억 개, 텍스트·이미지·비디오 입력, 100만 토큰 컨텍스트 창, 문서화된 64,000 토큰 출력 상한으로 기재하며, 추론 강도를 낮음·중간·높음으로 선택할 수 있습니다. 이 모델은 독점적입니다. BF16 체크포인트는 2026년 10월 15일로 약속되었지만 아직 출시되지 않았습니다. BF16 빌드의 커뮤니티 미러는 API가 열린 날부터 Hugging Face에서 유통되어 왔지만, 재업로드는 릴리스가 아니며 StepFun은 오픈 가중치 발표를 게시하지 않았습니다.

그래서 단 하나의 벤치마크도 나오기 전에 이 짝은 정말로 한쪽으로 기울어져 있다: 다운로드가 될 수도 있는 프리뷰 모델 대, 다운로드가 되지 않을 모델의 가격이 다시 매겨진 서빙 티어.

지수 1포인트의 비용

두 모델 모두 동일한 독립 평가자에 의해 실행되었으며, 바로 여기서 토큰당 더 저렴하다는 이야기가 불편해집니다. 2026년 10월 10일에 계속 읽어보세요:

• Index — Step 5 Preview 44, 비교 가능한 모델 중앙값 26을 크게 웃돕니다. 0902 빌드의 Qwen3.8-Max는 45. 1점 차입니다.

• 완료된 인덱스 작업당 비용 — $1.03 대 $5.41. 5배 이상 더 좋습니다.

• 출력 가격 — 표준 ID에서 백만 토큰당 $6.00인 반면 $2.70이며, Prime으로 이동하면 $9.902가 됩니다. Step 5 Preview는 표준보다 2.2배 저렴하고 Prime보다 3.7배 저렴합니다.

• 입력 가격 — 표준 $2.00, Prime $3.301에 맞서는 $1.00. 출력 열의 거울상이며, 아래 비용 분석을 읽고 나면 더 중요하게 여겨지는 쪽이다.

• 캐시 적중 — Step 5 Preview에서는 백만 토큰당 $0.10, 90퍼센트 할인이며, Qwen3.8-Max에서는 $0.25, 87.5퍼센트 할인인데 공급업체 자체 페이지에서는 88퍼센트로 반올림합니다.

• 초당 출력 토큰 수 — 87 대 35.4. 여기서는 Qwen이 느린 쪽이며, 그 차이는 약 2.5배에 달한다.

토큰당 열과 작업당 열이 서로 다르며, 비용 분석을 열어야만 드러나는 이유 때문에 작업당 열이 믿어야 할 쪽입니다. Step 5 Preview의 인덱스 실행에서는 $1.03 중 $0.85가 입력 측이고 $0.17이 출력입니다. Qwen3.8-Max의 경우 $5.41 중 $4.76이 입력 측이고 $0.65가 출력입니다. 정가는 대략 두 배 차이지만 작업 청구서는 다섯 배 차이입니다. Qwen 실행이 하네스를 통해 약 99억 개의 입력 토큰을 밀어넣은 반면 Step 5 Preview는 55억 개였고, 그 볼륨의 대부분이 공급업체가 부여하는 할인율로 다시 읽히는 캐시 트래픽이지 헤드라인 요율이 아니기 때문입니다.

Step 5 Preview는 평가단에서 매우 장황하다고 설명되며, 전체 스위트에서 출력 토큰이 대략 1억 6천만 개로 중앙값 8,200만 개와 대비됩니다 — 그리고 Qwen3.8-Max도 똑같은 표현으로 설명되는데, 대략 1억 9천만 개로 같은 중앙값과 대비됩니다. 이들 중 어느 것도 간결하게 답하는 모델이 아닙니다. 출력 길이를 최적화하려는 것이었다면, 어느 칼럼도 당신에게 도움이 되지 않습니다.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 ranked 32 of 227 with a comparable-model median of 26, speed ranked 190 of 227, cost ranked 105 of 227 and verbosity ranked 103 of 227, pricing of $2.00 per million input tokens and $6.00 per million output tokens with an 88 percent cache discount, a measured cost of $5.41 per index task, 190 million output tokens generated across the run against an 82 million median, about 35 output tokens per second, and a 984k-token context.

그 비교에는 구멍이 하나 있는데, 그 구멍은 Prime 모양이다.

이전 섹션의 모든 수치는 표준 Qwen3.8-Max ID에서 측정되었습니다. 그중 Prime에서 측정된 것은 없습니다.

그건 단순한 형식적 문제가 아니다. Prime이 내세우는 명제 전체는 토큰이 더 빨리 도착한다는 것이며, 이 제품군에 대해 보드가 가진 유일한 속도 수치는 표준 ID의 초당 출력 토큰 35.4개다 — 여기서 논의된 세 가지 ID 중 큰 차이로 가장 느리고, Qwen3.8-Max가 단지 비싼 것을 넘어 눈에 띄게 성능이 떨어지는 유일한 행이다. Prime이 Alibaba가 제시한 범위의 상단을 달성하면 그 35.4는 70 정도가 되지만, 여전히 Step 5 Preview의 87보다 낮으면서 출력 토큰당 비용은 3.7배 더 든다. 범위의 하단을 달성하면 약 53이 된다.

그것들은 측정값이 아니라 공급업체가 제시한 배수를 기반으로 한 추정치이며, 그렇게 표기해야 합니다. 우리가 찾을 수 있는 한, Prime mode에 대한 독립적인 처리량 테스트를 게시한 사람은 아무도 없습니다. 1.5~2배라는 수치는 Alibaba 자체의 것이며, 이는 전체 티어를 떠받치는 단 하나의 핵심 주장입니다.

Prime에 유리하게 작용하는 단 하나의 구조적 세부 사항은 스로틀링 규칙인데, 이는 쉽게 간과하기 쉽습니다. Alibaba 문서에 따르면 Prime에서는 호출량이 속도 제한에 도달했을 때 플랫폼에 아직 여유 리소스가 있으면 요청이 스로틀링되지 않습니다. 따라서 사용자가 사용할 수 있는 처리량은 명시된 한도 아래로 떨어지지 않습니다. 이는 단단한 하한을 가진 소프트 상한입니다. 경합이 있을 때는 한도만큼을 얻고, 유휴 용량이 있을 때는 더 많이 얻을 수 있습니다. 수십 개의 순차 호출을 연달아 발생시키는 에이전트 루프에서는 중앙값보다 더 중요합니다. 가장 느린 호출이 루프가 끝나는 시점을 결정하기 때문입니다. 또한 Prime이 애초에 왜 제품으로 존재하는지에 대한 가장 명확한 설명이기도 합니다. Alibaba는 이미 구축해 둔 용량에서 대기열 위치를 판매하고 있으며, 그 대기열에서 먼저 서비스받을 권리에 두 배의 요금을 청구하고 있습니다.

두 요금표를 나란히 놓고 보면 알 수 있는 것

알리바바는 자사 Qwen 행들을 서로 인접하게 게재하는데, 이 덕분에 해당 티어의 산술은 유난히 깔끔해진다. 국제 페이지에서 Prime 행은 백만 토큰당 입력 $3.301, 출력 $9.902로 나오며, 표준 ID와 그 0902 핀의 경우 $1.65와 $4.951이다. 이는 두 열 모두에서 정확히 2.0이다 — 반올림한 근사치가 아니라 공개된 수치 그대로의 비율이다. StepFun의 영어 가격 페이지는 Step 5 Preview를 입력 $1.00, 캐시 적중 시 $0.10, 출력 $2.70으로 기재하며, 캐시 미스 입력에는 새 콘텐츠를 캐시에 기록하는 비용이 포함된다. 벤더가 공개한 캐시 적중 수치는 90퍼센트 할인이다; 독립 위원회는 같은 자료에서 95퍼센트를 기록하는데, 둘 중 어느 것을 기준으로 모델링하고 있는지 아는 것이 중요하다.

세 장의 카드를 한 열에 놓으면 윤곽이 분명해집니다. Prime 출력은 $9.902입니다. Standard Qwen 출력은 보드 기록에서 $6.00, Alibaba 자체 국제 페이지에서 $4.951입니다. Step 5 Preview 출력은 $2.70입니다. 그리고 아무도 광고하지 않는 저가 라인에서는 Step 5 Preview의 캐시 읽기가 Qwen의 $0.25 대비 $0.10입니다 — 이는 프리픽스를 반복하는 모든 워크로드에서 출력 열보다 더 중요합니다.

오래된 숫자에 관한 경고 하나를 드립니다. 이 제품군은 7주 동안 두 번 이상 가격이 조정되었기 때문입니다. Qwen3.8-Max의 널리 인용되는 입력 $2, 출력 $6은 8월 출시 당시의 대표 가격이며, 여전히 Alibaba의 싱가포르 탭에 표시되는 값입니다. 국제 및 글로벌 행은 이제 $1.65와 $4.951로 표시됩니다. 지출을 모델링하고 있다면 해당 지역의 요금표를 사용하고, 약정하는 날에 다시 확인하세요.

2×를 읽는 두 가지 방법

Prime은 standard ID의 두 배 가격에 같은 모델이기 때문에, 그 프리미엄은 가격을 매기기는 쉽지만 정당화하기는 어렵다. Alibaba 라인업의 최상단에서는 두 배의 속도를 위해 두 배를 지불하므로, 제거된 지연 시간 1초당 비용 중립적이다. 최하단에서는 1.5배를 위해 두 배를 지불하므로, 절약된 1초당 33퍼센트의 프리미엄이다. 어느 쪽 끝도 인터랙티브 작업에는 부당하지 않다; 어느 쪽도 야간 배치에는 정당화될 수 없다. 그래서 이 티어에 관한 표준 조언 — 지연에 민감한 호출은 Prime으로, 나머지는 모두 standard ID로 — 역시 올바른 조언이다.

Step 5 Preview와의 비교에서 추론은 형태를 바꾸는데, 바로 이 부분이 'vs' 프레이밍이 드러내는 지점이다. Prime은 가격에서 Step 5 Preview와 전혀 경쟁하지 않는다. standard ID는 이미 출력 토큰당 Step 5 Preview보다 더 비싸고, 완료된 작업당 다섯 배 더 비싸며, 점수는 1점 더 높다. Prime은 이미 지고 있던 방정식의 비용 쪽을 배수로 키우고, Step 5 Preview가 무료로 더 많이 제공하는 속도를 되사는 것이다. 이 패밀리에서 속도가 필요하다면, 솔직한 진술은 이 페이지 반대편의 모델이 백만 출력 토큰당 $2.70에 초당 87토큰을 제공하고, 고속 레인은 알리바바 자체 수치로 $9.902에서 약 70까지 올라가는 범위를 제공한다는 것이다.

그것은 Step 5 Preview가 이긴다는 주장이 아니다. 그것은 Prime의 가치가 전적으로 Alibaba 자체 제품 라인 내부에 국한된다는 주장이며, 그에 대한 근거가 Qwen3.8-Max의 1포인트 지수 우위, 983,616토큰 컨텍스트 또는 서로 다른 작업 프로필이 1M 토큰 Step 5 Preview 컨텍스트가 하지 못하는 일을 해내는 워크로드에 달려 있다는 주장이다. 그것은 아직 아무도 실행할 수 없는 비교인데, Prime 행이 어떤 독립적인 보드에도 존재하지 않기 때문이다.

Generated rate-card infographic comparing three published price lists in one column: Qwen 3.8 Max Prime at $3.301 input and $9.902 output per million tokens, the standard qwen3.8-max and qwen3.8-max-0902 IDs at $1.65 and $4.951 on Alibaba's international page against the $2 and $6 still shown on its Singapore tab, and Step 5 Preview at $1.00 input, $0.10 cached input and $2.70 output from StepFun's English pricing page. A footer reads that the Prime row is exactly 2.0 times the standard row on both columns and that all figures are vendor list prices read on 10 October 2026.

구매자에게 이것이 의미하는 바

이 둘 중 어느 것도 OrcaRouter에는 없습니다. Step 5 Preview는 StepFun 자체 API와 소수의 서드파티 플랫폼을 통해 접근할 수 있고, Prime은 워크스페이스 범위 엔드포인트에서 제공되는 Alibaba Cloud Model Studio 등급입니다. 그리고 두 주장 모두 이 글을 읽는 바로 그 1분 안에 우리 카탈로그에서 직접 확인하실 수 있습니다. 이는 우리 말을 그대로 믿는 것보다 더 나은 검증 방법입니다.

우리가 라우팅하는 것은 같은 패밀리의 다른 제품이며, 그것은 이 글의 계산이 계속해서 되돌아가 가리키는 제품이기도 합니다. 표준 Qwen3.8-Max와 날짜가 지정된 핀 Qwen3.8-Max-0902는 형제 모델인 Qwen3.8-Max-Preview, Qwen3.8-Flash, Qwen3.8-27B와 같은 키로 카탈로그에 위치하며, 200개가 넘는 다른 모델과 함께, 공급자 정가가 0% 마크업으로 그대로 전달됩니다. 그로부터 두 가지가 따라오며, 둘 다 위의 결정에 영향을 미칩니다. 첫째는 알리바바의 요금표 변경이 알리바바가 이를 공개하는 당일 우리 쪽에 나타난다는 점입니다 — 이는 이미 일곱 주 만에 이 패밀리를 두 번 재가격 책정한 공급업체에게 바라는 바로 그 속성입니다. 둘째는 여러분의 기준선이 더 이상 단일 공급업체에 대한 베팅이 아니게 된다는 점입니다: 표준 ID는 여러분이 기본 경로에 가장 계속 유지할 가능성이 높은 등급이며, 이를 직접 통합이 아니라 라우팅 계층 뒤에 두는 것이 Prime 결정을 계약 단위가 아니라 엔드포인트 단위로 되돌릴 수 있게 만드는 것입니다.

이 글의 제목에 나오는 두 이름 중에서 고르고 있다면, 구분은 명확합니다. 점수, 비디오와 이미지 입력, 90퍼센트 캐시 할인을 원할 때는 Step 5 Preview를 선택하고, 그 체크포인트가 라이선스가 아니라 10월 15일에 대한 약속인 프리뷰를 임대하고 있다는 점을 받아들이세요. Qwen 3.8 Max Prime는 이미 Qwen3.8-Max를 쓰기로 확정했고, 자신의 프롬프트에서 standard ID의 초당 35토큰이 비용을 발생시키는 원인임을 측정한 경우에만 선택하세요. 그리고 그 결정은 1.5×가 아니라 2×를 기준으로 비용을 따지세요. 벤더 제품군의 최상단은 프로덕션에서 보게 될 숫자가 아니기 때문입니다.

이 문제를 매듭지어 줄 측정치는 존재하지 않으며, 이를 그럴듯하게 포장하기보다 차라리 분명히 말할 가치가 있다. 누군가는 Prime을 Step 5 Preview도 함께 실행하는 하네스에 통과시키고, 배수가 아니라 처리량 분포를 공개하며, 그것이 사 주는 인덱스 포인트 옆에 작업당 비용 수치를 나란히 놓아야 한다. 그때까지 양측이 공유하는 유일한 숫자는 두 장의 요금표뿐이고, 그 요금표는 서로 반대 방향에서 같은 말을 한다: 빠른 레인은 Qwen3.8-Max 토큰을 사는 가장 비싼 방식이며, 대안이 같은 1초에 청구하는 값에 견주어 벽시계 1초를 사는 가장 느린 방식이다.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트