Ett hero-titelkort för en artikel som jämför GPT-6 Sol med Kimi K3, med texten 'GPT-6 Sol vs Kimi K3' och underrubriken 'Tre antaganden om öppna vikter, testade mot en nota', som visar GPT-6 Sol som sluten till $2.00/$10.00 med ett Index på 48 och Kimi K3 som öppna vikter till $3.00/$15.00 med ett Index på 44.
Guides & Insights

GPT-6 Sol vs Kimi K3: Tre antaganden om öppna vikter, testade mot en nota

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Att köpa öppna vikter är vanligtvis en satsning på tre saker: att de blir billigare, att de ger dig kontroll och att de är en försäkring mot att en leverantör ändrar sig. Kimi K3, den 2,8 biljoner parametrar stora modellen som Moonshot AI släppte med öppna vikter den 27 juli 2026, och GPT-6 Sol, den slutna modellen som lanserades den 22 september 2026, är ett tydligt testfall för alla tre, eftersom de två modellerna ligger tillräckligt nära varandra på den neutrala resultattavlan för att antagandena själva måste bära argumentet.

Så här står de sig. K3 är inte billigare per uppgift – det är ungefär dubbelt så dyrt, med $3.00 och $15.00 per miljon tokens mot Sols $2.00 och $10.00. Kontrollen är verklig men har ett hårdvarugolv som de flesta team inte kommer att passera. Och försäkringen är det enda antagandet som håller helt, vilket gör den till det enda som är värt att betala för. Det som följer är aritmetiken bakom var och en.

De två modellerna, kortfattat

Kimi K3 är en gles mixture-of-experts-modell med 2,8 biljoner totala parametrar och ungefär 104 miljarder – cirka 3,7 % – aktiva per token, publicerad under en modifierad MIT-licens med ett kontextfönster på 1 048 576 token. Moonshots arkitektoniska påståenden är specifika: Kimi Delta Attention, ett hybridlinjärt uppmärksamhetsschema som företaget säger är upp till 6,3× snabbare vid långkontextavkodning, plus Attention Residuals och ett Stable LatentMoE-ramverk. Den tar in text och bild och returnerar text. Den icke-destillerade modellen överstiger 1 TB i storlek, och en produktionsdriftsättning beskrivs i termer av en miniminivå på 64 acceleratorer.

GPT-6 Sol är sluten, har en enda identifierare och är prissatt till ett fast pris på $2,00 och $10,00, med $0,20 för cachad läsning och $2,50 för cacheskrivningar, vilket omprissätter hela begäran över 272 000 indatatoken till $4,00 och $15,00. Den tar in text och bild och ger text ut, med ett fönster på 1 050 000 token, maximal indata på 922 000 token, ett utdatatak på 128 000 token och en kunskapsavgränsning den 20 april 2026.

Kontextfönstren är i praktiken samma siffra – en skillnad på 0,1 %. Det eliminerar det vanligaste skälet att föredra det ena, och innebär att beslutet helt och hållet vilar på de tre antagandena.

Antagande ett: öppna vikter är billigare. Det är de inte.

• Indata — GPT-6 Sol $2.00 per miljon tokens mot Kimi K3 $3.00 per miljon tokens

• Utdata — GPT-6 Sol $10,00 per miljon tokens mot Kimi K3 $15,00 per miljon tokens

• Cachad indata – GPT-6 Sol $0,20 per miljon tokens mot Kimi K3 $0,30 per miljon tokens; båda är en tiondel av priset för icke-cachad indata

• Intelligence Index, oberoende — GPT-6 Sol 48 vid maximal ansträngning mot Kimi K3 44 vid maximal ansträngning

• Kostnad per Index-uppgift, oberoende — GPT-6 Sol $1,06 vs Kimi K3 $2,00

• Utdatatoken för indexkörningen – GPT-6 Sol 77M vs Kimi K3 160M

• Kontextfönster — GPT-6 Sol 1 050 000 tokens vs Kimi K3 1 048 576 tokens

• Vikter — GPT-6 Sol stängd vs Kimi K3 öppen, nedladdningsbar och självhostbar

• Licens — GPT-6 Sol ej tillämplig vs Kimi K3 Modified MIT

• Totala parametrar — GPT-6 Sol ej offentliggjort vs Kimi K3 2 800 miljarder, varav 104 miljarder är aktiva per token

Sol är billigare på varje rad i prislistan, och gapet är som störst precis där agentiska arbetsbelastningar lägger sina pengar. Den oberoende nämnden är överens om riktningen och ungefär om storleken: Sol kostar ungefär hälften så mycket per slutförd uppgift, med fyra indexpunkter högre. K3 genererade lite drygt dubbelt så många utdatatokens för att köra samma index.

En nyans gör att detta inte blir en utklassning. Moonshot hävdar att K3 genererar 21 % färre utdatatokens än sin föregångare, och det arkitektoniska arbetet – uppmärksamhetsschemat, residualdesignen – är direkt inriktat på kostnaden för långkontextavkodning. I en arbetsbelastning som domineras av mycket långa indata kan K3:s effektivitetsfunktioner minska en del av gapet som indexkörningen visar. Ingen har publicerat den mätningen i en jämförbar testrigg, så behandla det som ett leverantörspåstående med en rimlig mekanism, inte som ett resultat.

A six-row scoreboard card titled 'GPT-6 Sol vs Kimi K3 - the scoreboard', comparing the two models on input price, output price, Intelligence Index, cost per task, weight availability and context window. The left column lists GPT-6 Sol at $2.00 input and $10.00 output, an Index of 48, $1.06 per task, closed weights and a 1,050,000-token context; the right column lists Kimi K3 at $3.00 and $15.00, an Index of 44, $2.00 per task, open weights under Modified MIT and a 1,048,576-token context. A footer reads 'Vendor list prices; Index per Artificial Analysis.'Screenshot of the Artificial Analysis model page for Kimi K3 (max), captured 23 September 2026, showing an Intelligence Index score of 44 in the open-weights class, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a cost of $2.00 per Intelligence Index task, 160 million output tokens generated during the index run, a 1M-token context window, 2.8 trillion total parameters with 104 billion active, and open model weights under the Kimi K3 license.

Antagande två: öppna vikter ger dig kontroll. Upp till ett hårdvarugolv.

Kontrollen är äkta och värd att uttrycka exakt, eftersom "öppna vikter" ofta används löst. En modifierad MIT-licens på en nedladdningsbar checkpoint innebär att du kan köra modellen på din egen hårdvara, finjustera den, låsa en specifik revision och hålla inferensen inom en gräns som du kontrollerar. Inget av detta är tillgängligt med GPT-6 Sol oavsett pris.

Det betyder inte att egen drift är ett kostnadsmässigt substitut för API:et. De publicerade siffrorna anger fullprecisionscheckpointen till ungefär 4,9 TB, eller omkring 397 GB vid 1-bitars kvantisering, med en lägsta driftsättningsnivå i intervallet 410 GB kombinerat minne och produktionsdriftsättningar som beskrivs i termer av 64 acceleratorer. Ett team som redan kör den typen av kluster har ett verkligt alternativ här. Ett team som inte gör det jämför en API-faktura mot ett kapitalinköp, och API-fakturan vinner med stor marginal.

Den ärliga versionen av kontrollargumentet är snävare än vad som vanligtvis sägs: öppna vikter ger dig möjligheten att lämna, inte möjligheten att köra billigt. Det är olika saker, och bara en av dem är tillgänglig för de flesta team.

Antagande tre: öppna vikter är en försäkring. Detta håller.

Det tredje antagandet överlever varje siffra ovan, och det är anledningen till att K3 över huvud taget har en marknad. Moonshot kan bli uppköpt, kan ändra sin licens för framtida versioner, kan fasa ut K3, kan höja sitt pris, kan stänga av prenumerationer — och man stängde av nya prenumerationer inom 48 timmar efter lanseringen för att skydda tjänstekvaliteten för befintliga betalande kunder, vilket är en levande demonstration av att API-åtkomst är ett policybeslut snarare än en egenskap.

Om K3 är utfasat fungerar vikterna du laddade ner fortfarande. Om Moonshot tredubblar API-priset påverkas inte din självhostade driftsättning. Om du behöver visa en revisor att din inferensstack är låst vid en känd revision ger en checkpoint dig det, och ett API gör det inte. Inget av detta syns i en tabell över kostnad per uppgift, och allt är verkligt.

Frågan är vad det är värt. Med siffrorna ovan betalar du ungefär dubbelt per slutförd uppgift för den försäkringen, plus fyra indexpoäng i förmåga. För en arbetsbelastning där en API-avveckling är ett avbrott i verksamheten, är det billigt. För en arbetsbelastning där du helt enkelt skulle byta modell, är det en premie för en säkring du aldrig kommer att utnyttja.

Båda ligger på en och samma tangent om du vill att de ska vara det.

Screenshot of OrcaRouter's model page for Kimi K3, captured 23 September 2026, showing the model id kimi/kimi-k3 from provider MoonshotAI, a 1,048,576-token context window, text and image input with text output, vision, tool, JSON and reasoning support, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a p50 time to first token of 8.11 seconds and an OpenAI-compatible API served over both /v1/chat/completions and /v1/responses.

Kimi K3 finns i OrcaRouters katalog till Moonshots listpris, enligt vidarefaktureringsmodellen som gör en Moonshot-prisändring gällande hos oss samma dag i stället för efter att en återförsäljare omförhandlar. GPT-6 Sol finns inte i vår katalog i skrivande stund och nås via OpenAIs eget API.

Den kombinationen är värd mer än det låter för just det här beslutet, eftersom de två modellerna tillhör olika felmoder. Anledningen att köra K3 är inte att det är billigare – det är det inte – utan att det är en hedge, och en hedge som man inte snabbt kan växla till är inte mycket till hedge. Att hålla K3 bakom samma slutpunkt som allt annat, med automatisk failover och en dirigeringsregel som kan ändras i konfigurationen, är det som förvandlar ”vi har en reservlösning med öppna vikter” från en bild i en presentation till något som fungerar klockan 3 på natten.

Vad var och en faktiskt är till för

• Om du vill ha lägsta kostnad per slutförd uppgift inom allmänt arbete — GPT-6 Sol, och marginalen är ungefär 2×.

• Om du vill ha den högsta kapaciteten på den neutrala resultattavlan av de två — GPT-6 Sol med fyra poäng.

• Om du redan driver ett kluster i minnesklassen 400 GB och uppåt och behöver inferens inom din egen gräns — K3, och kalkylen förändras helt, eftersom marginalkostnaden för vikterna inte är densamma som kostnaden för hårdvaran.

• Om ditt verkliga krav är att din modell inte kan tas ifrån dig — K3, och detta är det enda argumentet i jämförelsen som Sol inte kan bemöta.

• Om du väljer baserat på pris per token eftersom K3 verkar vara den billigare kinesiska modellen – kontrollera antalet tokens först. Med 160 miljoner utdatatokens för indexkörningen jämfört med Sols 77 miljoner innebär den billigare taxan att du köper fler tokens, inte en mindre räkning.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen