
Gemini 3.7 Flash mot Grok 4.6: Googles priskrig mot SpaceXAI:s självkontrollerande agent
- googleNYGoogle: Gemini 3.8 Flash2026-09-0259Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0258Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0166Intelligens82Kodning
- AlibabaNYQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiNYZ.ai: GLM 5.3 Flash2026-08-2658Intelligens72Kodning
- DeepSeekNYDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1552Intelligens68Kodning
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1261Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
Tre veckor efter att Gemini 3.6 Flash i stort sett floppade, halverade Google priset och släppte Gemini 3.7 Flash — ett drag som de flesta bevakningar tolkade som en direkt attack mot Grok 4.6, den agentanpassade flaggskeppsmodellen som SpaceXAI hade släppt dagen innan för $2 och $6. Timingen är hela poängen: två modeller nära toppskiktet, med en dags mellanrum, båda riktade mot samma köpare — ett team som vill ha agentisk kodning utan att betala toppmodellpriser — och prissatta enligt motsatta filosofier. Google köper gensvaret med en fem månader lång kampanj. SpaceXAI säljer förtroende per uppgift till ett fast listpris.
Grok 4.6, som släpptes den 12 augusti 2026, är SpaceXAI:s förfining av sin grundmodell Grok 4.5 med 1,5 biljoner parametrar, byggd för långvariga agenter som verifierar att deras deluppgifter är slutförda, med ett kontextfönster på 500K, text- och bildinmatning och en taxa på $2/$6 som fördubblas vid över 200K inmatningstokens. Gemini 3.7 Flash, som släpptes den 13 augusti 2026, är Googles algoritmiska förfining av Gemini 3.6 Flash — 1M kontext, multimodalinmatning inklusive video och ljud, och ett introduktionspris på $0.75/$3.75 som fördubblas till $1.50/$7.50 den 1 januari 2027. På det oberoende Artificial Analysis Intelligence Index ligger Grok 4.6 på 61, ett tydligt steg över tidiga mätningar på cirka 56 för Gemini 3.7 Flash.
Priskriget, en linje per dimension
• Pris per 1M indata — Gemini 3.7 Flash $0.75 (intro) vs Grok 4.6 $2.00. Google underbjuder med mer än 60 %.
• Pris per 1M utdata — Gemini 3.7 Flash $3.75 (intro) jämfört med Grok 4.6 $6.00.
• Efter den 1 januari 2027 — fördubblas Gemini till $1,50/$7,50 medan Grok är oförändrad på $2/$6.
• Kontextfönster — Gemini 3.7 Flash 1M vs Grok 4.6 500K.
• Debitering för långa indata — Gemini debiterar fast pris över hela sitt kontextfönster; Grok fördubblas till $4/$12 vid eller över 200K indata.
• Tanketoken — Gemini fakturerar dem som utdata; Groks kostnad ingår i ett oberoende uppmätt ~$0.84 per uppgift.
Kortversionen: Gemini 3.7 Flash är billigare på varje rad i prislistan idag, och större delen av den fördelen försvinner den 1 januari. Grok 4.6 har samma pris i augusti som det kommer att ha i mars.

Vart tog Gemini 3.7 Flash:s pengar vägen
Googles egna siffror rapporterar stora hopp för Gemini 3.7 Flash jämfört med 3.6 Flash: 65,3 % på DeepSWE v1.1 (upp från 49,0 %), 43,6 % på FrontierCode 1.1 Main (upp från 34,4 %), 85,8 % på Terminal-bench 2.1 (upp från 78,0 %) och en WebDev Arena Elo på 1588 (upp från 1538). Dessa är leverantörsrapporterade siffror som inte har oberoende verifierats – den typ av mått som mäter en bana, inte ett omdöme mellan leverantörer. Men banan är poängen: fixarna kom tre veckor efter en lansering som recensenter i stort hade avfärdat, vilket visar att Google behandlar Flash-nivån som slagfältet, inte flaggskeppet.
Det andra som Googles kampanj gör är att komprimera inköpsfönstret. Till $0.75/$3.75 är modellen tillräckligt billig för att testas i volym; till $1.50/$7.50 är den fortfarande konkurrenskraftig men inte längre ett priskrigsvapen. Alla produktionsteam som antar den i introduktionsfönstret borde omvärdera dess ekonomi i december, inte anta att siffran följer med dem.
Var Grok 4.6:s pengar tog vägen
Grok 4.6:s argument är annorlunda: inte billigare tokens, utan färre bortkastade sådana. Den tränades för att självverifiera — att kontrollera att en deluppgift faktiskt är klar innan den går vidare — och oberoende mätningar styrker effekten: Artificial Analysis uppskattar dess kostnad till cirka $0.84 per uppgift, med ett GDPVal-AA v2 på 1 753 och ett Intelligence Index på 61. Det är siffror från tredje part, och de är det starkaste måttet i den här jämförelsen, eftersom de fångar det som priset per token missar: en modell som tar färre steg för att slutföra ett jobb är billigare per slutfört jobb även vid ett högre pris per token.
Avvägningen är där den billigare modellen har utrymme. Grok 4.6:s 500K-kontext är hälften av Gemini 3.7 Flash:s 1M, och dess $2/$6-pris fördubblas vid indata över 200K — så arbetsbelastningar med lång kontext och hög indata är precis där Grok 4.6:s listpris slutar vara konkurrenskraftigt mot Geminis kampanjpris.
Ekonomin per uppgift
Vid introduktionspriser ligger Gemini 3.7 Flash:s sammanvägda pris, givet en 80/20-fördelning mellan in- och utdata, på ungefär 1,35 dollar per miljon tokens; Grok 4.6:s prislapp vid samma fördelning är 2,80 dollar per miljon innan dess tilläggsavgift för långa indata. På pappret ser Google-modellen ut som en solklar volymvinnare. Komplikationen är att Geminis tanketokens faktureras som utdata, att dess benchmark-påståenden är en vecka gamla och att dess effektivitet per uppgift ännu inte har mätts oberoende — medan Grok 4.6:s har det. Billiga tokens i kombination med bortkastade omgångar kan kosta mer än dyra tokens som slutför uppgiften, och detta är en duell där ena sidan har data om den frågan och den andra inte har det.
Att satsa på den nya modellen utan att satsa på pipelinen
Grok 4.6 finns på OrcaRouter till SpaceXAI:s listpris på $2/$6 med 0% påslag, inklusive 2x-steget över 200K, som modellsidan hämtar live från routningslagret. Gemini 3.7 Flash är en dag gammal och på Googles eget API; dess föregångare Gemini 3.6 Flash finns på OrcaRouter till Googles listpris.


Om frågan som den här jämförelsen egentligen ställer är ”ska jag satsa min agentpipeline på den nya billiga modellen”, är routinglagret hedge: en failover-regel som kör agenten på Grok 4.6 idag och byter till Gemini 3.7 Flash den dag den landar, eller en fusionspanel där båda svarar och en domare jämkar dem – den typ av uppsättning som routing-DSL:et finns till för, och en som inte kräver att man väljer sida innan bevisen är inne.
Den ärliga läsningen
Om du vill ha den billigaste token idag och litar på treveckorsleveransen är Gemini 3.7 Flash det aggressiva spelet — priskriget är på riktigt, benchmark-vinsterna är rapporterade och introduktionsfönstret är en genuin rabatt. Om du vill ha en modell vars agenteffektivitet är oberoende uppmätt, vars pris inte rör sig i januari och vars självverifierande loop är designad för långvarigt arbete, är Grok 4.6 det konservativa valet — och AA-datan ger den en fördel i kostnad per slutförd uppgift. Ena sidan är en rea med nedräkning; den andra är ett pris med en bevisad historik. Båda är försvarbara — vilket är just det som gör detta till en verklig jämförelse snarare än en formalitet.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
