Ett timglas på en tom modellpiedestal — Qwen3.8-27B-vikterna har inte släppts, så ingen gratis API kan finnas.
Guides & Insights

Gratis Qwen 3.8 27B API: Inte ännu — vad du ska köra istället

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Nej – från och med 12 augusti 2026 finns det ingen gratis Qwen3.8-27B-API, och det finns inte heller någon betald sådan. Modellen tillkännagavs den 3 augusti med löfte om öppna vikter till Hugging Face och ModelScope ”veckan den 10 augusti”, men den officiella Qwe​n-organisationen har fortfarande inget Qwen3.8-repositorium. Tills vikterna släpps kan ingen vara värd för Qwen3.8-27B, så ”gratis” är irrelevant. Här är de tre vägarna till gratis när vikterna väl landar (och vad var och en egentligen kostar), plus de modeller du kan köra gratis lokalt redan idag.

Inget gratis API ännu — vikterna är porten.

Alibaba tillkännagav Qwen3.8-familjen den 3 augusti 2026: Qwen3.8-Max med 2,4 biljoner parametrar (cirka 95 miljarder aktiva parametrar, en kontext på 1M-token, prissatt till 2 dollar per miljon inmatningstokens och 6 dollar per miljon utdatatokens på Alibaba Cloud Model Studio) och den täta, enmaskinella Qwen3.8-27B. Båda utlovades som öppna vikter på Hugging Face och ModelScope samma vecka.

Det löftet är nu två dagar försenat. Jag kontrollerade Hugging Face direkt den 12 augusti: den officiella Qwe​n-organisationen har inget Qwen3.8-repository av något slag. De Qwen3.8-27B-GGUF-, -FP8-, -NVFP4A16- och -NInfer-repon som visas i modellsökningen är platshållarkort — noll viktfiler, ensiffriga nedladdningsantal, modellkort som bokstavligen lyder ”reserverat inför Qwe​n/Qwen3.8-27B-släppet.” Betrakta inte dessa som bevis på att modellen finns; betrakta dem som människor som reserverar parkeringsplatser.

Två saker du inte kan ta för givet. För det första: licensen – ingen har nämnts för Qwen3.8-27B. Nyligen utgivna Qwen-öppna vikter har släppts under Tongyi Qianwen-licensen, vars klausul om 100 miljoner aktiva användare per månad utlöser kommersiella licenssamtal i stor skala – Apache 2.0 är inte en säker standard. För det andra: specifikationerna – Alibaba har inte publicerat någon benchmarktabell, kontextfönster eller bekräftat hårdvarukrav för 27B. Allt som upprepas om den idag är spekulation.

Vi gick igenom checklistan inför släppet – vad som är bekräftat, vad som är rykte, vad du ska kontrollera innan du laddar ner – i Qwen3.8-27B Open Weights: What We Know Before the Drop. Den här artikeln är den del som det inlägget inte täckte: hur ”gratis” faktiskt kommer att fungera när modellen väl har släppts.

Efter att vikterna faller: tre vägar till frihet, och vad var och en egentligen kostar.

”Gratis” är aldrig gratis. Alla tre vägarna till en gratis Qwen3.8-27B flyttar kostnaden någonstans; skillnaden är var den hamnar. 27B är en tät modell — var och en av dess cirka 27 miljarder parametrar är aktiv för varje token — så kostnaderna nedan handlar om riktig hårdvara, inte marknadsföring.

Three routes to a free Qwen3.8-27B API after the weights drop: run it yourself, a hosted free tier, or OrcaRouter's planned free tier — and the real cost of each.

Rutt 1: Kör det själv — gratis i pengar, prissatt i hårdvara

Den enda vägen där "gratis" blir bokstavligen sant efter att hårdvaran är köpt. Unsloth-medgrundaren Daniel Han förväntar sig att 27B ska kunna köras i cirka 17 GB VRAM vid lanseringen – ett mål, inte en specificerad spec. Med den uppmätta kvantiseringsstegen för Qwen3.6-27B som proxy: Q4_K_M landar runt 16 GB, Q6_K runt 21 GB, FP8 runt 27 GB och full BF16 runt 54–56 GB. Det realistiska minimum idag är ett 24 GB-kort – RTX 3090, RTX 4090 eller A6000-klass – vid Q4.

Timing spelar roll: officiella vikter med vLLM eller SGLang brukar fungera inom dagar efter en release, men communityns GGUF- och AWQ-kvantiseringar släpar efter med en till två veckor, så en Ollama-liknande "pull and run" kommer inte att finnas på releasedagen. De dolda kostnaderna är ström, en tyst maskin och din tid. Vinsten är integritet – ingenting lämnar din dator – och en marginell kostnad på noll som förräntas om du använder GPU:n för andra modeller också.

Alternativ 2: Värdbaserade gratissnivåer — gratis i pengar, prissatta i begränsningar

När vikterna väl är ute, förvänta dig en utvärderingskvot från Alibaba Cloud och gratisnivåer från de vanliga serverless-värdarna. Mönstret att vänta sig är det som Alibaba redan kör för Qwen3.8-Max: en 1M-token-kvot för nya användare, endast Singapore-regionen, giltig i 90 dagar, ingen överrullning — och resonemangstokens faktureras som utdata, så en modell som resonerar som standard kan bränna hela tilldelningen under en prototyphelg. Vad du faktiskt betalar är hastighetsbegränsningar, en regional låsning, ett utgångsdatum och att dina uppmaningar går till en tredje part. En gratisnivå är en inkörsport för att utvärdera modellen, inte en plats att distribuera den på.

Rutt 3: OrcaRouters gratisnivå — planerad, inte live

Eftersom sökfrågan bokstavligen är "free", ska vi vara tydliga: OrcaRouter planerar en gratisnivå för Qwen3.8-27B när vikterna väl levereras. Den är inte live. Det finns ingen endpoint att anropa, och jag tänker inte klistra in ett exempel på en platshållare. Vi kommer att meddela när det finns något att meddela. Det vi faktiskt är värd för idag är Qwen3.8-Max till $2/$6 per 1M tokens utan påslag — och 27B finns inte på plattformen, eftersom ingen kan servera den ännu.

Det du kan använda gratis just nu

Om ditt behov är "en öppen modell i 27B-klassen som jag kan köra utan att betala," behöver du inte vänta. Den ärliga motsvarigheten är Qwen3.6-27B, den direkta föregångaren till modellen du väntar på.

Comparison of Qwen3.6-27B and Nemotron 3.5 Lightning 30B A3B, which you can run free today, against Qwen3.8-27B, which is not yet released.

Qwen3.6-27B är Apache 2.0, en tät 27,8B-modell med 262K kontext och inbyggd text-, bild- och videoinmatning. En Q4_K_M GGUF är cirka 16,5 GB och körs med ungefär 25 tokens per sekund på en 24 GB konsument-GPU (16–18 tokens per sekund på en M4 Max). Siffror från leverantörens modellkort: SWE-Bench Verified 77,2, MMLU-Pro 86,2, AIME 2026 94,1, GPQA Diamond 87,8 och MMMU 82,9. Om Qwen3.8-27B är "en 27B", så är detta den 27B du faktiskt kan få tag på idag — samma familj, samma täta design, redan öppen.

Nemotron 3.5 Lightning 30B A3B är en annan form, också gratis: släppt den 11 augusti 2026 under NVIDIAs OpenMDW 1.1-licens. Den är en 30B-total, ~3B-aktiv Mixture-of-Experts-modell med en hybrid Mamba-2-arkitektur och upp till 1M kontext — NVFP4-checkpoints är cirka 21,6 GB och en Q4 GGUF på cirka 25 GB. Den behöver ett kort med 24 GB+ minne, eftersom alla 30 miljarder parametrar ligger i minnet även om bara cirka 3 miljarder aktiveras per token. De första rapporterna anger nära 45 tokens per sekund på en enda GPU. Den är byggd för agentens exekveringslager – verktygsanrop, validering, formatering – inte för frontlinjeresonemang. Om din arbetsbelastning består av storskaligt agentgrovarbete, kan den slå en dense 27B-modell i din faktiska uppgift.

Och om det du specifikt vill ha är en gratis värdbaserad API idag snarare än en lokal installation, är det enda ärliga "gratis" Alibabas Qwen3.8-Max-kvot: 1M tokens, Singapore-regionen, 90 dagar. Det är inte 27B, och det är ett utvärderingstillägg, inte en tjänst – använd den för att prova Qwen3.8-beteendet nu, och flytta sedan.

När detta råd är fel

Om du redan äger en GPU med 24GB+, är "vänta på gratisnivåer"-resonemanget fel för dig. Den dag vikterna släpps är vLLM på de officiella vikterna din gratisnivå; du skulle vänta på en bekvämlighet du inte behöver. Håll ut i ungefär två veckor bara om du specifikt vill ha den polerade GGUF-kvantiseringsstegen.

Om du bygger en prototyp mot ett API-kontrakt, de värdbaserade gratiskvoterna (när 27B väl har dem) kan kosta mindre än din tid — även med 90-dagars utgång och regionsspärren är att hyra en GPU-dator för en veckas prototypande vanligtvis den dyrare vägen.

Om licensen visar sig vara Tongyi Qianwen snarare än Apache, kommer "fria vikter" inte att innebära att man fritt kan kommersialisera över tröskeln på 100 miljoner MAU. Läs LICENSE-filen i själva repositoryt innan du bygger något på det — det är det enskilt vanligaste sättet som "fria öppna vikter" blir till en faktura.

Och om Alibaba skjuter upp datumet igen — det är redan två dagar förbi det utlovade fönstret — varje vecka som går gör Qwen3.6-27B till det rätta valet snarare än nödlösningen.

A timeline from announcement to free local run of Qwen3.8-27B.

Slutsats

Det finns ingen gratis Qwen3.8-27B API eftersom det inte finns någon Qwen3.8-27B någonstans. När vikterna släpps är de tre gratisvägarna självhostning (betalas i hårdvara), värdbaserade gratissnivåer (betalas i begränsningar) och OrcaRouters planerade gratissnivå – som inte är live ännu, och det kommer vi att säga när den är det. Idag är det närmaste gratisalternativet Qwen3.6-27B på din egen hårdvara. Att vänta kostar dig ingenting förutom 27B; att köra föregångaren kostar dig ingenting förutom en GPU som du kan sätta i arbete på allt annat under tiden.