
DeepSeek V4 Pro vs Kimi K3: Hastighet och pris mot ett resonemangstak på 44 poäng
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleNYGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0240Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligens69Kodning
DeepSeek V4 Pro och Kimi K3 är de två flaggskeppen för resonemang med öppna vikter och ett fönster på en miljon token, och deras konkurrens antog en stabil form för en månad sedan: Kimi K3 (Moonshot AI:s 2,8T-parametermodell, släppt den 16 juli 2026) är intelligensledaren, och DeepSeek V4 Pro (släppt den 13 augusti 2026) är ledaren inom hastighet och pris. Det nya är att den billiga halvan av paret var nära att tas bort under första halvan av september — DeepSeek lade den 8:e V4 Pro på en avvecklingsbana med den 14 september som datum, sköt upp det och ställde sedan den 11:e in avvecklingen helt, med löfte om att fortsätta betjäna modellen med oförändrad fakturering. Det spelar större roll för den här duellen än för de flesta, eftersom "billig, snabb, 1M-kontext, öppna vikter" är en kombination som är svår att ersätta när alternativet kostar fem gånger så mycket.
Oberoende siffror är mätningar från Artificial Analysis. DeepSeeks och Moonshots egna lanseringsbenchmarkar märks som leverantörsrapporterade, eftersom ingen av dem har reproducerats oberoende.
Kimi K3 vinner indexet; V4 Pro vinner notan
Den oberoende resultattavlan är entydig om vem som är smartare. Kimi K3 med maximal ansträngning får 44 på Artificial Analysis Intelligence Index och rankas som #2 bland jämförbara modeller. DeepSeek V4 Pro får 36 och rankas som #7 i sin klass. Det nio poängs avståndet är hela anledningen till att någon betalar Kimi K3:s priser. Och priserna är anledningen till att matchningen inte avgörs enbart av indexet: Kimi K3 listas till $3,00 per miljon input-tokens och $15,00 per miljon output-tokens, medan V4 Pro listas till $0,66/$1,98 off-peak ($1,32/$3,96 peak). På output är det ungefär 7,5x — före cache-rabatten. V4 Pro:s cache-läsningar kostar ungefär $0,02 per miljon tokens off-peak, en rabatt på 97 %; Kimi K3:s cache-rabatt på 90 % utgår från en mycket högre bas. För en token-tung arbetsbelastning vidgas det effektiva gapet mot tio gånger.
• Intelligensindex — Kimi K3 44 (#2/113) mot V4 Pro 36 (#7/113)
• Pris — Kimi K3 $3.00/$15.00 per 1M mot V4 Pro $0.66/$1.98 lågtrafik ($1.32/$3.96 högtrafik)
• Hastighet — V4 Pro ~81 tokens/sek mot Kimi K3 ~35 tokens/sek
• Kontext – båda 1M tokens
• Parametrar — Kimi K3 2,8T totalt / 104B aktiva mot V4 Pro 1,6T totalt / 49B aktiva
• Vikter — båda öppna (Kimi K3 öppna vikter, V4 Pro MIT)
• Indata — Kimi K3 text och bild mot V4 Pro enbart text
Hastigheten är den del som alla underskattar
Glappet som ingen pratar om är genomströmningen. V4 Pro producerar omkring 81 tokens per sekund vid oberoende mätning; Kimi K3 klarar omkring 35. I en agentloop där modellen skriver flera tusen tokens per steg är det skillnaden mellan en uppgift som blir klar på några minuter och en som drar ut över en eftermiddag – och kostnadsskillnaden förstärker den, eftersom du betalar 15 dollar per miljon utdatatokens vid ungefär halva hastigheten. För interaktiva kodassistenter, storskalig dokumentbearbetning och alla arbetsbelastningar där klocktid är en budgetpost är V4 Pros kombination av 2,3 gånger högre hastighet till en sjundedel av utdatapriset det dominerande svaret.
När de nio poängen är värda det
Det ärliga argumentet för Kimi K3 är resonemangstaket. Dess utvärderingskostnad på Intelligence Index var omkring 3 658 dollar för körningen – en återspegling av genuint långa och dyra resonemangskedjor, inte en egenhet i prissättningen. Om din arbetsbelastning består av krävande resonemang – djupgående matematiska bevis, planering över långa horisonter, flera timmar långa agentiska uppgifter där nio extra indexpoäng visar sig som färre misslyckanden – förtjänar Kimi K3 sitt premiumpris. Det ärliga argumentet mot den är allt annat: genomströmningen, cacheekonomin, det blotta priset per token.
Den andra anledningen till att septembervändningen spelar roll här: för en månad sedan var det kloka rådet "om du ska standardisera på den billiga, snabba öppna modellen, säkra upp — den kan bli pensionerad." Sedan den 15 september är den säkringen föråldrad. DeepSeek har offentligt förbundit sig, med löfte om att meddela om något ändras, att behålla V4 Pro på API:et, och MIT-licensen innebär att modellen fortfarande kan driftsättas på din egen hårdvara oavsett vad DeepSeek gör med sitt API. Kimi K3:s öppna vikter ger samma frihet på den andra sidan, vilket är det som gör detta till en äkta jämförelse mellan två öppna vikter snarare än en kamp mellan en tjänst och en produkt.

Båda modellerna finns på OrcaRouter – DeepSeek V4 Pro och Kimi K3 dirigeras båda via plattformen på en enda nyckel, med leverantörernas listpriser vidarebefordrade utan påslag – och routnings-DSL:en är det naturliga sättet att dela upp den här matchningen: dirigera resonemangsuppgifterna med lång horisont till Kimi K3 där de nio poängen gör nytta, och dirigera det token-tunga genomströmningsarbetet till DeepSeek V4 Pro där prisskillnaden på 7,5x och hastighetsskillnaden på 2,3x gör jobbet åt dig. De två är komplement lika ofta som de är konkurrenter, och plattformen gör att det är lika mycket arbete att köra båda som att köra en.


Slutsatsen
Kimi K3 är den smartare modellen med öppna vikter, nio indexpoäng före, och dess premium – 7,5x på utdatatokens, ungefär halva hastigheten – är en verklig kostnad, inte ett avrundningsfel. DeepSeek V4 Pro är den snabba, billiga, tåliga arbetshästen, och efter den 11 september är den inte längre en flyktrisk. Det praktiska svaret är det som båda priskolumnerna pekar på: om dina uppgifter är svåra resonemangsuppgifter, köp Kimi K3; om de är token-tunga och tidskänsliga, köp DeepSeek V4 Pro; och om du har båda typerna, kör båda och routa efter uppgift.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
