
Intern-S2-397B vs Qwen3.8-Max: Två kinesiska flaggskepp med motsatta ekonomiska satsningar
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleNYGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0240Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligens69Kodning
Intern-S2-397B och Qwen3.8-Max är de två mest betydelsefulla kinesiska flaggskeppslanseringarna i början av september 2026, och de har gjort motsatta ekonomiska satsningar. Intern-S2-397B, den 403 miljarder parametrar stora vetenskapliga multimodala modellen som Shanghai AI Laboratorys InternLM-team släppte under Apache-2.0 den 13 september, satsar på att öppna vikter är rätt väg för att vinna vetenskapliga och agentiska arbetsbelastningar: inget pris per token, vikter på Hugging Face och din egen hårdvara som mätare. Qwen3.8-Max, Alibabas flaggskepp med 2,4 biljoner parametrar som blev allmänt tillgängligt den 3 augusti och uppdaterades den 2 september, satsar på ett prissatt API med 2,00 USD per miljon indatatoken och 6,00 USD per miljon utdatatoken över en kontext på 1 miljon token, med öppna vikter som kommer en vecka efter GA och ett oberoende Artificial Analysis-resultat redan registrerat. Duellen mellan dem handlar mindre om vems benchmarks som vinner och mer om vilken satsning – ägande eller en förbrukningsbaserad slutpunkt – som matchar formen på din arbetsbelastning.
Två flaggskepp, två satsningar
Qwen3.8-Max är Alibabas högsta kapacitetsnivå i Qwen-serien, en sparse mixture-of-experts-modell med 2,4 biljoner parametrar totalt och omkring 95 miljarder aktiverade per token över 512 experter med 10 aktiva plus en delad. Den har ett kontextfönster på 1M tokens (983 616 tokens med tänkande aktiverat i det hostade API:et), ett tak för utdata på 131 072 tokens, text-, bild- och videoinmatning, och den serveras via en OpenAI-kompatibel endpoint. Dess mest utmärkande prisdrag är en fast taxa: samma $2.00 / $6.00 oavsett om din prompt är 5 000 tokens eller 900 000, där cachad indata har lägre pris — ingen tilläggsavgift för lång kontext, vilket är precis den hävstång som de flesta konkurrenter fortfarande tar betalt för. Alibaba positionerar den direkt mot GPT-5.5, Claude Opus 4.7 och Gemini 3.1 Pro i sin egen migreringsguide.
Intern-S2-397B är ett flaggskepp av annan form. Det är en mixture-of-experts-modell med 60 lager och 512 experter (10 aktiva per token), en 256K-kontext för textresonemang och 64K för multimodal, en indatayta bestående av text, bild och tidsserier, samt ett förträningsparadigm som läser råa sidor av vetenskaplig litteratur – figurer, layout, symbolisk notation och prosa – i stället för att först parsa ut text. Dess förstärkningsinlärning spänner över fler än tjugo vetenskapliga domäner, och den tränades för långsiktigt agentarbete i sandlådemiljöer. Dess prissättning är inte en prislista utan avsaknaden av en: var egen värd för Apache-2.0-vikterna, eller begär åtkomst till det officiella Intern-API:et.
• Pris — Intern-S2-397B: ingen prislista; egen serverdrift eller Intern API jämfört med Qwen3.8-Max: 2,00 $ / 6,00 $ per 1 miljon, fast pris, cachad indata lägre.
• Skala — Intern-S2-397B: 403B totalt, 512 experter / 10 aktiva vs Qwen3.8-Max: 2,4T totalt, 95B aktiva, 512 experter / 10 + 1 delad.
• Kontext — Intern-S2-397B: 256K text / 64K multimodal vs Qwen3.8-Max: 1M tokens, fast pris.
• Indata — Intern-S2-397B: text, bild, tidsserie vs Qwen3.8-Max: text, bild, video.
• Vikter — Intern-S2-397B: Apache-2.0, öppna på lanseringsdagen vs Qwen3.8-Max: anpassad Qwen3.8-Max-licens, öppnades 12 augusti efter GA.
• Oberoende poäng — Intern-S2-397B: ingen ännu mot Qwen3.8-Max: AA Intelligence Index 40, GPQA Diamond 92.7.
Båda tabellerna är leverantörstabeller, och bara en har en domare
Båda modellerna lanserades med benchmarktabeller som körts av leverantören, vilket gör att källhanteringen är identisk och resultathistoriken olika. Sedan dess har Qwen3.8-Max:s oberoende siffror ackumulerats: Artificial Analysis placerar den på 40 i sitt nuvarande Intelligence Index med ett GPQA Diamond på 92,7, ett HLE på 43,0 och en oberoende kodningspoäng på 71,8, till en kostnad av cirka 2,67 dollar per indexuppgift på den nuvarande skalan. Det är uppmätta siffror från en tredjepartsbevakare – den första riktiga domaren som någon av dessa två flaggskeppsmodeller har haft.
Intern-S2-397B:s bevis är dess eget kort, kört genom OpenCompass, VLMEvalKit och AgentCompass, publicerat tillsammans med vikterna: MMLU Pro 89,77, MMMU Pro 81,68, HMMT-2026 93,56, SWE-bench-Pro 68,54 och TerminalBench 2.1 på 64,04, en siffra som kortet självt visar förlorar mot en äldre sluten generation. Dess vetenskapliga rader är anledningen till att specialistargumentet finns: Biology-Instructions 55,71, SciReasoner 1.5 63,28, Mol-Instructions 53,95, MolecularIQ 62,35. Var och en av dessa är InternLMs egna, icke-reproducerade. Ställda sida vid sida berättar de två bevisbaserna samma historia från motsatta håll: den ena modellen är en specialist med respektabla allmänna rader och ingen extern mätning, den andra är en generalist med en oberoende poäng och ingen vetenskaplig finjustering.

Vad pengformerna faktiskt köper
Den fasta taxan på $2 / $6 är signaturdraget för Qwen3.8-Max, och det är värt att tydliggöra vad den ger. En repoanalysagent som skickar igenom 200 000 indatatokens med kodkontext i ett enda anrop betalar samma pris per token som en kort chatt – ingen tilläggsavgift för långa prompter – och med cachning sänker ett stabilt kodkontext det effektiva indatapriset dramatiskt vid återkommande trafik. Modellen kan också anropas som öppna vikter under Alibabas anpassade licens, som tillåter kommersiell användning med attribution samt skalbaserade trösklar över 100 miljoner MAU eller 20 miljoner USD i månadsintäkter, och ett separat avtal för stora företag inom model-as-a-service.
Intern-S2-397B:s ekonomi är den omvända: ingen mätare alls, utan en kapitalutgift. Vikterna är ungefär 807 GB i BF16 fördelade över 188 shards – en rejäl multi-GPU-nod – med ett FP8-bygge som minskar fotavtrycket med ungefär hälften. Om du redan äger den kapaciteten närmar sig marginalkostnaden för nästa vetenskapliga fråga elkostnaden, och det är vadet: ägande gör specialisten billig i marginalen. Om du inte äger hårdvaran är den "fria" modellen en pilot, och det officiella Intern API:et är det enda mätarbaserade alternativet.
De två flaggskeppen kan dela en söm om du routar. Qwen3.8-Max finns på OrcaRouter till Ali babas listpris, vidarebefordrat med 0 % påslag, så den fasta taxan på $2 / $6 och eventuella framtida prissänkningar landar här samma dag. Intern-S2-397B är inte routad — det är en helt ny checkpoint, och din väg till den går via leverantörens eget API eller en egenhostad driftsättning. Skicka den allmänna trafiken med videostöd och lång kontext till den mätarbaserade modellen på nyckeln du redan har; behåll det vetenskapliga batcharbetet på modellen du kör; låt automatisk redundansväxling täcka dig när endera sidans slutpunkt inte är frisk. Gränsen är en routingregel snarare än en andra integration.

Domen
Välj Qwen3.8-Max för allmänt resonemang och videokapabelt produktionsarbete där en fast taxa över en miljon tokens slår allt som dess rivaler tar betalt, och där en oberoende resultattavla minskar risken för att bygga på den. Dess vikter är tillräckligt öppna för att spela roll under en licens inom vars grindar de flesta team redan befinner sig, och dess mätare på $2 / $6 är det mest aggressiva priset på tavlan bland frontier-flaggskepp.
Välj Intern-S2-397B för vetenskapliga arbetsbelastningar – figurrika artiklar, molekylära diagram, tidsseriesignaler – där indata är multimodala på ett sätt som en generalist aldrig tränats för, och där datalokalisering eller finjustering på proprietära resultat gör Apache-2.0 till den avgörande egenskapen. Budgetera för hårdvaran, kör din egen utvärdering och behandla dess siffror som påståenden tills en oberoende granskare dyker upp.
Den ärliga sammanfattningen är att dessa två flaggskepp egentligen inte är utbytbara mot varandra. Det ena är ett egenägt vetenskapligt instrument med respektabel allmän förmåga; det andra är en hyrd, oberoende utvärderad generalist med fast pris och ett flyktigt intresse för vetenskap. Team som behöver båda bör betrakta gränsdragningen som ett routingbeslut – och bör köra om sina egna utvärderingar på Intern-S2-397B innan de tror på någon siffra på någon av leverantörernas presentationsbilder.

