
Step 5 Preview vs DeepSeek V4 Pro: Den ena är ett löfte, den andra är en MIT-licens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Allt i den här jämförelsen hänger på en fråga som inte har något med benchmarks att göra: vad kan du faktiskt ladda ner? DeepSeek V4 Pro — versionen som leverantören släppte som DeepSeek-V4-Pro-0813 den 13 augusti 2026 — är en mixture-of-experts-modell med 1,6 biljoner parametrar under MIT-licens, med vikter som ligger på Hugging Face just nu. Step 5 Preview, som StepFun tillkännagav den 20 september 2026, är en gles MoE med 600 miljarder parametrar som får åtta poäng högre på samma oberoende resultattavla och har ett Hugging Face-arkiv som innehåller exakt en fil, .gitattributes. StepFun säger att BF16-checkpointen kommer den 15 oktober. Så den ärliga formen av den här jämförelsen är inte ”vilken modell som är bättre”. Det är ”vilken av dessa två du kan bygga vidare på under det här kvartalet, och vilken du väntar på”.
Den inramningen är mindre spännande än en benchmarkduell och betydligt mer användbar, eftersom gapet på åtta punkter och väntetiden på tjugofem dagar inte är samma typ av faktum. Det ena kan man planera utifrån redan i dag.
Åtta punkter, och de fyra som spelar roll
Artificial Analysis kör båda modellerna genom Intelligence Index v4.3.2 — tio utvärderingar — vilket är den enda platsen där dessa två har mätts av samma hand.
• Intelligensindex — Step 5 Preview 44 mot DeepSeek V4 Pro 36
• Placering på den tavlan — Step 5 Preview 24:e av 200 vs DeepSeek V4 Pro 7:e av 113 i sin klass
• Terminal-Bench 4.0 — Step 5 Preview 33,3 %; DeepSeek V4 Pro finns inte listad på samma resultattavla, så det finns ingen jämförbar agentisk rad att citera
• Uthastighet — Step 5 Preview 99,8 tokens/sek mot DeepSeek V4 Pro 88,8 tokens/sek
• Tid till första token — Step 5 Preview 2,96 s mot DeepSeek V4 Pro 1,69 s
• Pris per 1M tokens — Step 5 Preview $1.00 in / $2.70 ut jämfört med DeepSeek V4 Pro $1.32 in / $3.96 ut vid DeepSeeks högtrafikpris, som halveras till $0.66 / $1.98 i lågtrafik
• Cacherabatt — Step 5 Preview 95 % mot DeepSeek V4 Pro 97 %
• Kontext — båda 1M tokens; DeepSeek publicerar ett utdatatak på 384 000 tokens, StepFun har inte publicerat något
• Vikter — Step 5 Preview har stängts, BF16-checkpoint schemalagd till 15 oktober; DeepSeek V4 Pro MIT, nedladdningsbar nu
Två rader motsäger rubriken. DeepSeek V4 Pro svarar sin första token på 1,69 sekunder, mot Step 5 Previews 2,96 – ett försprång på 43 % vid varje anrop, vilket i en lång agentloop ackumuleras till verklig väggklockstid. Och dess cacherabatt är två punkter bättre, vilket spelar störst roll för precis den arbetsbelastning båda dessa modeller säljs för: en agent som skickar samma systemprompt och repository-kontext igen vid varje tur lever nästan helt inom den rabatten.
Det sammanvägda gapet på åtta poäng är verkligt, och det är också mindre än vad åtta poäng låter som. Ett index är en sammansättning av tio utvärderingar, och det är i sammansättningen som de två modellerna skiljer sig åt. Step 5 Previews 33,3 % på Terminal-Bench 4.0 är ett genuint agentiskt resultat; DeepSeek V4 Pros egen främsta styrka är långhorisontellt resonemang till ett pris som inget annat i open-weights-klassen matchar. Ingen av resultattavlorna publicerar en rad där de två ställs direkt mot varandra, vilket är det ärliga skälet till att denna jämförelse inte kan avgöras med en enda siffra.

Vad "öppen" ger dig när leverantören ändrar sig
Här är den del av den här matchningen som ett specifikationsblad inte kan förmedla, och det är värt att nämna med de faktiska datumen, eftersom det hände elva dagar innan Step 5 Preview tillkännagavs.
DeepSeek meddelade användarna att man skulle lägga ner V4 Pro. Den 9 september uppgav företaget att förfrågningar skulle dirigeras till den nyare DeepSeek V4.1 Flash; den 10 september fastställde man datumet till 12:00 pekingtid den 14 september. Den 11 september backade man – V4 Pro API-tjänsten fortsätter efter den 14 september, faktureringen oförändrad, med DeepSeeks egna ord. Modellsträngen, kontexten på 1M tokens och gränsen på 500 samtidiga förfrågningar är fortfarande desamma som de var, och DeepSeeks sida Models & Pricing har ändringen som en fotnot på deepseek-v4-proraden
Läs det som en demonstration av det som öppna vikter faktiskt skyddar dig mot, och av det som de inte skyddar mot. API:et togs nästan bort genom ett schemaläggningsbeslut. Vikterna kunde inte tas bort. En MIT-licensierad checkpoint på din egen hårdvara har ingen leverantör som kan meddela att den pensioneras, och det är en annan sorts garanti än ett prislöfte — det är inte ens ett löfte.
Vilket är precis det gap som Step 5 Preview sitter i. StepFun har åtagit sig den 15 oktober för BF16-checkpointen, och repositorienamnet som företaget redan har reserverat — stepfun-ai/Step-5-Preview-BF16 — är det format som du finjusterar och kvantiserar utifrån, namngivet vid skapandet och fyllt senare. Det är en signal om tidsplanering, inte en artefakt. Tills repositoriet innehåller något annat än en .gitattributes, är Step 5 Preview en modell du hyr, på en enda leverantörs villkor, utan licens att läsa och utan reservlösning om villkoren ändras.
De två sätten att vara det billiga alternativet
Båda dessa modeller underbjuder den slutna frontlinjen med bred marginal, och mekanismerna är inte desamma, vilket har betydelse för hur hållbart priset är.
DeepSeek V4 Pro är billig eftersom ett labb publicerade vikterna och en konkurrensutsatt serveringsmarknad pressade ut marginalen ur dem. Det är ett strukturellt golv: vem som helst kan servera checkpointen, så priset sätts av kostnaden för en GPU-timme snarare än av ett företags prissättningsstrategi. DeepSeeks eget API prissätter den i två fönster – 1,32 och 3,96 dollar under högtrafik, hälften så mycket utanför – och högtrafiken är kort, några timmar på vardagsmorgnar i UTC, så det mesta av trafiken hamnar på den billigare taxan och helger ser aldrig den högre.
Steg 5 Preview är billig eftersom StepFun bestämde sig för att prissätta den så. Det finns en endpoint, en prislista och ingen andra källa. Det är inte en anklagelse – en sparse-modell på 600B/27B kostar verkligen mindre att betjäna än vad dess parameterantal antyder, och förhållandet mellan aktiverade parametrar är anledningen. Det är helt enkelt en annan sorts pris, och skillnaden visar sig den dag StepFun beslutar att previewen har gjort sitt.
Prisgapet mellan de två är tillräckligt litet för att det inte borde avgöra något: $1.00 och $2.70 mot $1.32 och $3.96 är en skillnad på 24 % på input och 32 % på output, väl inom det intervall som en cachediskontering, en skillnad i outputlängd eller en återförsöksfrekvens kan sudda ut. I frågan om ordrikedom ligger de två nära varandra — Step 5 Preview genererade 160M output-tokens i indexkörningen mot ett medianvärde på 92M, och DeepSeek V4 Pros egen körning ligger i samma spann. Ingen av dem är en sparsam modell, och båda säljs som billiga per token snarare än billiga per uppgift.

Var var och en hör hemma i en riktig stack
Om du behöver en modell som du kan finjustera, kvantisera, hosta i ditt eget VPC eller lämna till ett juridiskt team med en licensfil som de kan läsa, är detta inte ett svårt val och det handlar inte om benchmarks. DeepSeek V4 Pro är tillgänglig under MIT idag. Step 5 Preview har ingen licens, ingen konfiguration och ingen parameterfil, och det tidigaste du kan planera utifrån är mitten av oktober. Indexgapet på åtta punkter ändrar inte den kalkylen, eftersom en modell du inte kan ladda ner inte kan driftsättas.
Om det du vill ha är det starkaste agentiska resultatet som finns för en dollar per miljon indatatoken, ligger Step 5 Preview före på den enda resultattavla som har mätt båda, och det är det bättre standardvalet för det arbete med försök och misstag som fyller större delen av en agentloop – extrahering, klassificering, testscaffolding, de rutinmässiga anropen mellan de två som spelar roll. Dess 99,8 tokens per sekund gör också att utdata blir färdig snabbare än DeepSeek V4 Pros 88,8, vilket kortar själva loopen snarare än bara notan.
Det besvärliga fallet är det som de flesta team faktiskt befinner sig i: du vill ha siffran från Step 5 Preview, men du kan inte lägga en förhandsvisnings-endpoint som öppnades på lanseringsdagen, utan publicerat tak för utdata, på en produktionsväg. Det är ett routingproblem, och det är det som den här jämförelsen avslutar med. DeepSeek V4 Pro nås via OrcaRouter för $0,66 och $1,98 per miljon tokens, lågtrafikhalvan av DeepSeeks prislista på $1,32 och $3,96, och de omkringliggande textmodellerna vid sidan av — bakom en enda nyckel för fler än 200 modeller med 0 % påslag, så att en prisändring från DeepSeek landar på din faktura samma dag i stället för vid förnyelsen. Rikta den utforskande delen av trafiken mot förhandsvisningen och håll produktionsvägen kvar på modellen med en licens bakom sig, med automatisk failover mellan leverantörer som utför det arbete som en förhandsvisnings-endpoints kapacitetskurva gör nödvändigt.

Vad skulle avgöra det
Tre saker, och alla tre kan kontrolleras snarare än diskuteras.
Den första är licensen. När BF16-checkpointen släpps, vad säger repositoriet att ett företag får göra med den? En tillåtande licens stänger större delen av detta gap på egen hand, eftersom den gör åttapoängsförsprånget till något du kan äga i stället för att hyra. En restriktiv licens lämnar DeepSeek V4 Pro som den enda modellen i paret som du faktiskt kan bygga en produkt på.
Den andra är utdatataket. DeepSeek publicerar 384 000 tokens. StepFuns tillkännagivande anger 1M kontext och nämner inget tak för utdata, och en separat tredjepartskonfiguration som cirkulerade under läckan listade 350 000 kontext med ett maximalt utdata på 64 000. För det långsiktiga agentiska arbete som båda modellerna säljs för är den siffran inte en fotnot.
Det tredje är om priset håller när förhandsversionssuffixet tas bort. Ett förhandspris är ett nyckeltal för kundanskaffning; ett lanseringspris är en affärsmodell. Prisgolvet för DeepSeek V4 Pro sätts av en konkurrensutsatt serving-marknad och kan inte röra sig särskilt mycket. Step 5 Previews kan ändras en tisdag.
Fram till att de två första har besvarats är den praktiska tolkningen att DeepSeek V4 Pro är modellen du driftsätter och Step 5 Preview är modellen du benchmarkar mot — med förbehållet att en preview-endpoint som bara är några dagar gammal och ligger åtta punkter över ett moget MIT-licensierat flaggskepp är ett verkligt resultat, och anledningen till att 15 oktober är värd en kalenderanteckning snarare än en axelryckning.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
