En titelskylt för jämförelsen mellan Gemini 3.7 Flash och Grok 4.6, som visar en prislapp med 50% rabatt och en blixt på Gemini 3.7 Flash-sidan, mittemot en sköld med en bock på Grok 4.6-sidan.
Guides & Insights

Gemini 3.7 Flash mot Grok 4.6: Googles priskrig mot SpaceXAI:s självkontrollerande agent

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Tre veckor efter att Gemini 3.6 Flash i stort sett floppade, halverade Go​ogle priset och släppte Gemini 3.7 Flash — ett drag som de flesta bevakningar tolkade som en direkt attack mot Grok 4.6, den agentanpassade flaggskeppsmodellen som SpaceXAI hade släppt dagen innan för $2 och $6. Timingen är hela poängen: två modeller nära toppskiktet, med en dags mellanrum, båda riktade mot samma köpare — ett team som vill ha agentisk kodning utan att betala toppmodellpriser — och prissatta enligt motsatta filosofier. Go​ogle köper gensvaret med en fem månader lång kampanj. SpaceXAI säljer förtroende per uppgift till ett fast listpris.

Grok 4.6, som släpptes den 12 augusti 2026, är SpaceXAI:s förfining av sin grundmodell Grok 4.5 med 1,5 biljoner parametrar, byggd för långvariga agenter som verifierar att deras deluppgifter är slutförda, med ett kontextfönster på 500K, text- och bildinmatning och en taxa på $2/$6 som fördubblas vid över 200K inmatningstokens. Gemini 3.7 Flash, som släpptes den 13 augusti 2026, är Go​ogles algoritmiska förfining av Gemini 3.6 Flash — 1M kontext, multimodalinmatning inklusive video och ljud, och ett introduktionspris på $0.75/$3.75 som fördubblas till $1.50/$7.50 den 1 januari 2027. På det oberoende Artificial Analysis Intelligence Index ligger Grok 4.6 på 61, ett tydligt steg över tidiga mätningar på cirka 56 för Gemini 3.7 Flash.

Priskriget, en linje per dimension

Pris per 1M indata — Gemini 3.7 Flash $0.75 (intro) vs Grok 4.6 $2.00. Google underbjuder med mer än 60 %.

Pris per 1M utdata — Gemini 3.7 Flash $3.75 (intro) jämfört med Grok 4.6 $6.00.

Efter den 1 januari 2027 — fördubblas Gemini till $1,50/$7,50 medan Grok är oförändrad på $2/$6.

Kontextfönster — Gemini 3.7 Flash 1M vs Grok 4.6 500K.

Debitering för långa indata — Gemini debiterar fast pris över hela sitt kontextfönster; Grok fördubblas till $4/$12 vid eller över 200K indata.

Tanketoken — Gemini fakturerar dem som utdata; Groks kostnad ingår i ett oberoende uppmätt ~$0.84 per uppgift.

Kortversionen: Gemini 3.7 Flash är billigare på varje rad i prislistan idag, och större delen av den fördelen försvinner den 1 januari. Grok 4.6 har samma pris i augusti som det kommer att ha i mars.

A comparison scoreboard for Gemini 3.7 Flash and Grok 4.6: Gemini at AA Index ~56, $0.75/$3.75 intro pricing, 1M context, Google-reported GDPVal-AA v2 of 1,525 and per-task cost not yet measured, versus Grok 4.6 at AA Index 61, $2/$6, 500K context, GDPVal-AA v2 of 1,753 and about $0.84 per task per Artificial Analysis, both proprietary.

Vart tog Gemini 3.7 Flash:s pengar vägen

Go​ogles egna siffror rapporterar stora hopp för Gemini 3.7 Flash jämfört med 3.6 Flash: 65,3 % på DeepSWE v1.1 (upp från 49,0 %), 43,6 % på FrontierCode 1.1 Main (upp från 34,4 %), 85,8 % på Terminal-bench 2.1 (upp från 78,0 %) och en WebDev Arena Elo på 1588 (upp från 1538). Dessa är leverantörsrapporterade siffror som inte har oberoende verifierats – den typ av mått som mäter en bana, inte ett omdöme mellan leverantörer. Men banan är poängen: fixarna kom tre veckor efter en lansering som recensenter i stort hade avfärdat, vilket visar att Go​ogle behandlar Flash-nivån som slagfältet, inte flaggskeppet.

Det andra som Go​ogles kampanj gör är att komprimera inköpsfönstret. Till $0.75/$3.75 är modellen tillräckligt billig för att testas i volym; till $1.50/$7.50 är den fortfarande konkurrenskraftig men inte längre ett priskrigsvapen. Alla produktionsteam som antar den i introduktionsfönstret borde omvärdera dess ekonomi i december, inte anta att siffran följer med dem.

Var Grok 4.6:s pengar tog vägen

Grok 4.6:s argument är annorlunda: inte billigare tokens, utan färre bortkastade sådana. Den tränades för att självverifiera — att kontrollera att en deluppgift faktiskt är klar innan den går vidare — och oberoende mätningar styrker effekten: Artificial Analysis uppskattar dess kostnad till cirka $0.84 per uppgift, med ett GDPVal-AA v2 på 1 753 och ett Intelligence Index på 61. Det är siffror från tredje part, och de är det starkaste måttet i den här jämförelsen, eftersom de fångar det som priset per token missar: en modell som tar färre steg för att slutföra ett jobb är billigare per slutfört jobb även vid ett högre pris per token.

Avvägningen är där den billigare modellen har utrymme. Grok 4.6:s 500K-kontext är hälften av Gemini 3.7 Flash:s 1M, och dess $2/$6-pris fördubblas vid indata över 200K — så arbetsbelastningar med lång kontext och hög indata är precis där Grok 4.6:s listpris slutar vara konkurrenskraftigt mot Geminis kampanjpris.

Ekonomin per uppgift

Vid introduktionspriser ligger Gemini 3.7 Flash:s sammanvägda pris, givet en 80/20-fördelning mellan in- och utdata, på ungefär 1,35 dollar per miljon tokens; Grok 4.6:s prislapp vid samma fördelning är 2,80 dollar per miljon innan dess tilläggsavgift för långa indata. På pappret ser Go​ogle-modellen ut som en solklar volymvinnare. Komplikationen är att Geminis tanketokens faktureras som utdata, att dess benchmark-påståenden är en vecka gamla och att dess effektivitet per uppgift ännu inte har mätts oberoende — medan Grok 4.6:s har det. Billiga tokens i kombination med bortkastade omgångar kan kosta mer än dyra tokens som slutför uppgiften, och detta är en duell där ena sidan har data om den frågan och den andra inte har det.

Att satsa på den nya modellen utan att satsa på pipelinen

Grok 4.6 finns på OrcaRouter till SpaceXAI:s listpris på $2/$6 med 0% påslag, inklusive 2x-steget över 200K, som modellsidan hämtar live från routningslagret. Gemini 3.7 Flash är en dag gammal och på Go​ogles eget API; dess föregångare Gemini 3.6 Flash finns på OrcaRouter till Go​ogles listpris.

The OrcaRouter model page for grok/grok-4.6, showing the New and Featured badges, the $2.00 per million input and $6.00 per million output pricing, a 500K-token context window, and the released August 12, 2026 label.The OrcaRouter model page for google/gemini-3.6-flash, showing the $1.50 per million input and $7.50 per million output pricing and the 1M-token context window.

Om frågan som den här jämförelsen egentligen ställer är ”ska jag satsa min agentpipeline på den nya billiga modellen”, är routinglagret hedge: en failover-regel som kör agenten på Grok 4.6 idag och byter till Gemini 3.7 Flash den dag den landar, eller en fusionspanel där båda svarar och en domare jämkar dem – den typ av uppsättning som routing-DSL:et finns till för, och en som inte kräver att man väljer sida innan bevisen är inne.

Den ärliga läsningen

Om du vill ha den billigaste token idag och litar på treveckorsleveransen är Gemini 3.7 Flash det aggressiva spelet — priskriget är på riktigt, benchmark-vinsterna är rapporterade och introduktionsfönstret är en genuin rabatt. Om du vill ha en modell vars agenteffektivitet är oberoende uppmätt, vars pris inte rör sig i januari och vars självverifierande loop är designad för långvarigt arbete, är Grok 4.6 det konservativa valet — och AA-datan ger den en fördel i kostnad per slutförd uppgift. Ena sidan är en rea med nedräkning; den andra är ett pris med en bevisad historik. Båda är försvarbara — vilket är just det som gör detta till en verklig jämförelse snarare än en formalitet.

Jämförda i den här artikeln2

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

providers@orcarouter.ai

Gå med i vår community

Discordsupport@orcarouter.aiXGitHubYouTube