
OpenAI o3 vs DeepSeek V4 Pro: Premium-resonemangseran slutar där prisgapet öppnar sig
- DeepSeekNYDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M tokens
- z-aiNYZ.ai: GLM 5.32026-08-1860Intelligens75Kodning
- obsidianNYQwen3.8 27B2026-08-1552Intelligens68Kodning
- qwenNYQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNYDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligens69Kodning
- grokNYSpaceXAI: Grok 4.62026-08-1261Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaMeta: Muse Spark 1.12026-07-1653Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1560Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligens71Kodning
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligens77Kodning
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligens77Kodning
Matchen mellan OpenAI o3 och DeepSeek V4 Pro är verkligen två siffror som kolliderar. OpenAI o3, som släpptes den 16 april 2025, var referenspunkten för premiumresonemang – modellen som man betalade extra för när kostnaden för ett felaktigt svar var högre än kostnaden för tokens. DeepSeek V4 Pro, som blev allmänt tillgänglig som build 0813 den 13 augusti 2026 efter en stillsam kvällslansering och en utrullning som inkluderade ett återdraget tillkännagivande och vikter som laddats upp på nytt, är modellen som fick den premien att framstå som ett kategorifel: ett oberoende index som står över o3:s, till ungefär en femtedel av priset, med öppna vikter därutöver. Och kollisionen är tidsstämplad, eftersom OpenAI o3 lämnar ChatGPT den 26 augusti 2026, dess API-snapshots följer den 11 december, och varje vecka i jämförelsen gynnar modellen som inte kommer att försvinna.
Två modeller som lanserades med ett års mellanrum i filosofi.
o3 är flaggskeppet för ren resonemangsförmåga: en sluten modell som tränats att tänka länge innan den svarar, med ett kontextfönster på 200K, upp till 100K utdata och bildinmatning invävd i sin tankekedja. Enligt OpenAIs egna siffror satte den ribban för 2025 – 96,7 % på AIME 2024, 87,7 % på GPQA Diamond, 69,1 % på SWE-bench Verified utan scaffolding, en Codeforces Elo på 2727 – och OpenAI sänkte senare priset från $10/$40 till $2/$8 per miljon tokens, där det fortfarande ligger. DeepSeek V4 Pro är en helt annan ekonomisk verklighet: en mixture-of-experts-modell med 1,6 biljoner parametrar och cirka 49 miljarder aktiva per token, ett kontextfönster på 1 miljon token, 384K maxutdata, textbaserad inmatning och – nytt med 0813 GA-bygget – en ombyggd post-training-stack samt inbyggd Responses-API- och Codex-integrering som fick dess agent-poäng att hoppa från förhandsversionens 12,8 till 62,7 på DeepSWE. Den är också open-weights: checkpointen DeepSeek-V4-Pro-0813 kan laddas ner på Hugging Face under MIT-licensen, efter ett kaotiskt första dygn då releasens banner togs bort och vikterna kortvarigt gav 404 innan en korrigerad config-omlistning.
Kostnadsgapet i faktiska siffror
Priskorten sköter det mesta av argumentationen på egen hand:
• OpenAI o3 — 2,00 USD per miljon inmatning, 8,00 USD per miljon utmatning, 0,50 USD cachad inmatning. Resonemangstokens faktureras som utmatning, så en svår fråga förbrukar tanketokens innan svaret.
• DeepSeek V4 Pro — $0,435 per miljon input (cache miss), $0,003625 cacheträff, $0,87 per miljon output idag. Output är ungefär 4,6× billigare än o3, input med cacheträff är i praktiken gratis.
• Varningen med ett datum på sig — DeepSeeks planerade prishöjning den 17 augusti flyttar V4 Pro-utdata från 6 yuan till 27 yuan per miljon under högtrafik (13,5 under lågtrafik) och cache-miss-indata från 3 till 9 yuan. Även med den nya högtrafikstaxan hamnar utdatan på en liten bråkdel av o3:s $8. Fönstret för att bygga mot dagens taxa mäts i dagar, vilket i sig är en del av migrationskalkylen.
{{1}}Ekonomin per korrekt svar skärper poängen.{{/1}} {{2}}o3:s dolda resonemangstoken innebär att den verkliga kostnaden per svårt svar är flera gånger dess utmatningspris.{{/2}} {{3}}DeepSeek V4 Pro resonerar också, och dess tänkande faktureras också som utmatning, men till $0,87 är den absoluta utgiften ett avrundningsfel jämfört med en o3-session som tänker i en och en halv minut.{{/3}} {{4}}Agentkostnadsramen som DeepSeek använde vid lanseringen — ungefär en 45× prisskillnad per uppgift jämfört med den stängda frontlinjen — överdriver i jämförelse med just o3, men riktningen är inte omtvistad: detta är en 4–10× skillnad i effektiv kostnad beroende på arbetsbelastning.{{/4}}
Var kvalitetsgapet faktiskt står
Den poäng som betyder mest är den oberoende. På Artificial Analysis Intelligence Index noterar DeepSeek V4 Pro 53 och rankas som #2 av de 104 modeller som indexet för närvarande listar; o3 ligger runt 30 — en skillnad på över 20 poäng på samma testmiljö. Det är den enskilt tydligaste sammanfattningen av var två års framsteg lämnade flaggskeppet för premiumresonemang: det är inte längre bara prismässigt underbjudet; det besegras på den oberoende sammanvägningen.
Bilden per benchmark är rörigare och behöver ärliga etiketter. DeepSeek V4 Pros främsta agentsiffror — Terminal-Bench 2.1 på 87,9, CyberGym på 83,3, DeepSWE på 62,7, AutomationBench före de stängda frontmodellerna — är DeepSeeks egna påståenden från 0813-lanseringen, inte oberoende reproducerade i skrivande stund, och utrullningens incident med fel konfiguration innebär att ingen kan vara säker på att API:t betjänade de slutgiltiga korrigerade vikterna när tidiga tredjepartssiffror samlades in. o3:s lanseringsriktmärken är lika mycket leverantörsrapporterade, men de validerades delvis genom oberoende omtestning redan 2025, då det verkligen toppade resonemangslistorna. Inom matematik och ren resonemangsförmåga ser o3:s publicerade resultat fortfarande bättre ut än DeepSeek V4 Pros — DeepSeeks styrkor ligger i agentisk verktygsanvändning, kodning och långsiktiga uppgifter, vilket är en annan testsvit än matematikolympiaderna som o3 dominerade.

Vad o3 fortfarande gör bättre
Två saker överlever jämförelsen intakt. För det första matematik och noggrant resonemang: o3:s AIME 96,7 % och GPQA 87,7 % ligger fortfarande över allt DeepSeek V4 Pro har publicerat, och om din arbetsbelastning är ett svårt bevis eller ett tävlingsproblem är o3 — så länge det fortfarande körs — det säkrare svaret. För det andra bildresonemang: o3 kan tänka på en skärmbild eller ett diagram i sin tankekedja, och DeepSeek V4 Pro är endast text; 0813-bygget lade inte till någon visionkodare, och om din uppgift kräver att modellen läser en bild, är DeepSeek V4 Pro inte ett substitut för o3 på den punkten. Ingen av fördelarna är en anledning att stanna kvar på en modell som fasas ut, men båda är skäl att vara ärlig med att migreringen inte är en ren uppgradering.
Det andra som är värt att notera är skillnaden i öppna vikter, vilket inte alls är ett riktmärke. o3 var stängt och konsolideras nu bort till dess att det inte längre existerar; du kan inte hålla det igång på din egen hårdvara. DeepSeek V4 Pro:s 0813-checkpoint är din, permanent, MIT-licensierad – samma vikter, samma modell med 1,6 biljoner parametrar, självhostad om du har de ~1,5 terabyte hårdvara som krävs. För team som brändes av att vara beroende av en stängd modell som en leverantör kunde pensionera, är det ett strukturellt svar på exakt det problem som o3:s pensionering innebär.
Migrerar arbetsbelastningen
För API-teamet som kommer från o3 är DeepSeek V4 Pro det billigaste stället att landa och, på det agentiska och kodningsarbete som det mesta av API-användningen faktiskt är, är det sällan en nedgradering. De verkliga fallgroparna är operativa, inte kvalitetsmässiga: V4 Pro är begränsad till 500 samtidiga förfrågningar på det officiella API:et, ett tak som du kommer att nå med en agentflotta, och dess prissättning ändras den 17 augusti. Båda dessa är precis vad ett routningslager är till för.
På OrcaRouter levereras DeepSeek V4 Pro till leverantörens listpris som passeras med 0 % påslag — så dagens $0.44/$0.87 är live här samma dag som den är live hos DeepSeek, och när topp-/lågtrafiksschemat från 17 augusti införs, återspeglas det här samma dag också. En nyckel når också resten av denna kohort av o3-ersättare, och automatisk failover är det rena svaret på 500-samtidighetsgränsen: peka en produktionssökväg mot V4 Pro plus en andra modell på samma nyckel och låt routern absorbera taket. OpenAI o3 i sig finns inte på den nyckeln — den förblir tillgänglig via OpenAI:s eget API och flera tredjepartsplattformar fram till den 11 december, då ögonblicksbilden upphör.

Vem matematiken gynnar
För alla vars o3-arbetsbelastning handlar om kodning, agentloopar eller långkontextbearbetning är matematiken inte ens nära: DeepSeek V4 Pro slår o3 på det oberoende indexet, kostar en bråkdel så mycket, och dess öppna vikter innebär att just detta beroende inte kan dras in under dig. De team som har en genuin anledning att hålla o3 vid liv just nu är de smala — hård ren matematisk resonemangsförmåga, och allt byggt på o3:s bildtänkande — och även de borde testa ersättare mot verkliga arbetsbelastningar före december, för deadline bryr sig inte om ditt kantfall. Premiumresonemangseran som o3 definierade tog slut med pensioneringsbeskedet; DeepSeek V4 Pro råkar bara vara där den billigaste platsen i nästa era finns.

Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
