
Agora-2: Odysseys spelbara världsmodell kör 20 deltagare på fyra GPU:er
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 36 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 181 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
Agora-2placerar tjugo deltagare i en simulering och kallar det en spelbar forskningsförhandsvisning. Odyssey publicerade den 21 september 2026 i ett inlägg med titeln "Introducerar Agora-2: Framsteg inom världssimulering med flera agenter", undertecknat av Oliver Cameron, och siffran som cirkulerar är tjugo. Siffran som spelar roll är uppdelningen inuti den. En session stöder upp till fyra samtidiga mänskliga kontrollanter tillsammans med sexton autonoma entiteter, och de är inte samma sorts deltagare — fyra personer som skriver rörelsekommandon, sexton policyer som utför dem. Odyssey tränade policyerna själva, på nivåer i ett spel som man också tränade på: artikeln säger att världen lärs in från inspelningar av Diablo II.
Den distinktionen mellan kontrollerade och simulerade deltagare är där nästan allt intressant med Agora-2 finns. Det är också där merparten av bevakningen kommer att bli suddig, eftersom "20 spelare" är en renare mening än "fyra spelare och sexton inlärda agenter som delar ett tillstånd som överlever utanför skärmen." Det Odyssey släpper är inte en videogenerator med flerspelarläge påskruvat. Det är närmare en spelserver vars fysik, animering och rendering alla har ersatts av inlärda komponenter, och vars enda genuina innehållskälla är en datauppsättning med inspelat spelande.
Tjugo deltagare är fyra personer och sexton policyer
Odyssey säger uttryckligen att Agora-2 stöder fem gånger så många deltagare som Agora-1 och att det gick från att simulera en enda miljö till att simulera flera miljöer med beteende över längre tidshorisonter. Sessionsformen ser ut så här:
• Mänskliga kontrollanter – upp till 4 samtidiga, var och en tillhandahåller rörelse- och åtgärdsinmatning
• Autonoma entiteter — 16 per session, styrda av inlärda policyer för monster och följeslagare snarare än av spelare
• Totalt antal deltagare — 20 i ett gemensamt världstillstånd, vilket är siffran som Odyssey leder med
• Miljöer — flera, jämfört med den enda miljö som Agora-1 kunde simulera
• Innehållsbas — upptagningar av Diablo II, så världen, tillgångarna och reglerna är alla ärvda från en inspelad korpus
• Utgivningsform — en spelbar forskningsförhandsvisning, inte en produkt, utan vikter, licens eller pris
De autonoma sexton är inte dekoration. Odysseys rapport beskriver träning av separata monster- och följeslagarpolicyer, och utvärderingssiffrorna är specifika: 23 771 exempel på monsterpolicyer från slutfasen, hämtade från en baslärare plus återhämtnings- och retentionsdata, och 128 005 exempel för följeslagarpolicyn, utvärderade mot 252 utvärderingsepisoder respektive 24 utvärderingsfall. Det är dessa policyer som gör att en session med fyra personer känns befolkad. De är också anledningen till att deltagarantalet är ett designval snarare än ett kapacitetsanspråk – sexton är hur många agenter världsservern tränades att hantera tillsammans med fyra människor, inte hur många den teoretiskt skulle kunna rymma.
Arkitekturen är en liten modell och en stor.
Agora-2 separerar det som avgör vad som händer från det som avgör hur det ser ut, och storleksgapet mellan dem är den mest slående siffran i artikeln. Simuleringsmodellen har 4 457 777 parametrar – ungefär 4,46 miljoner, fyra lager brett, bredd 256, fyra huvuden, ett historikfönster på fyra steg, fjorton rörelsegrenar och ett separat huvud för riktning. Renderaren är en flow-matching-transformer på omkring en miljard parametrar, sexton block med bredd 2 048, varav fem bär kausal temporal uppmärksamhet, och körs i fem lösarsteg per uppdatering.
Renderaren är villkorad på ett prefix på 342 token snarare än på den råa världen:
• Karta — 144 tokens, ett lokalt 12×12-rutnät av brickor runt betraktningspunkten
• Entiteter — 36 tokens, fyra för användarkontrollerade deltagare och 32 för övriga entitetsplatser
• Övergående effekter — 160 tokens för effekter som varken är karta eller entitet
• Visa och deltagarlista — en token vardera för kameraåtgärden och sessionens deltagarlista
• Per uppdatering — 300 bildtokens som riktar uppmärksamhet mot dessa 342 konditioneringstokens
• Codec — en RAE-baserad latent vid 2 bildrutor till 15×20×32, sedan x264 CRF 18 eller NVENC QP 18 på vägen ut
Odyssey anger skälet till att betingningen är strukturerad på detta sätt: en inlärd värld behöver hålla entitetsegenskaper i ett tillstånd som överlever varje enskild kamera. Inlägget säger det rakt ut – eftersom entitetsegenskaper bevaras oberoende av en viss vy förblir de tillgängliga när en entitet är utanför bild. Det är meningen som skiljer Agora-2 från en videomodell. En generator som bara betingas av de senaste bildrutorna tappar monstret i samma stund som du tittar bort från det; en världsmodell som håller ett explicit tillstånd gör det inte.

Fyra GPU:er köper fyra spelare
Serveringsplanen i rapporten är den minst offentliggjorda delen av Agora-2 och den mest användbara för alla som uppskattar vad en värld som denna skulle kosta. Odysseys konfiguration för en session med fyra spelare är fyra NVIDIA RTX PRO 4500-kort: en renderare per GPU, där en av dessa GPU:er också är värd för simuleringsmodellen och agentpolicyn. De angivna målen är femton latenta uppdateringar per sekund med trettio visade bildrutor per sekund.
Två tal i bilagan gör den konfigurationen konkret. Vid 165 watt mätte teamet en inferensminskning på 9,9 % till följd av en ändring i renderaren – 62,92 millisekunder ned till 56,69 millisekunder över 3 200 anrop per implementation. Och renderarens träning var lika specifik: sextiotusen uppdateringar på 4 232 000 segment följt av ytterligare sextiotusen på 4 332 800 segment, AdamW med en inlärningshastighet på 1e-4, batchstorlek 128, EMA 0,9999, körd på 32 B200-GPU:er. Den korpusen är specificerad post för post – 1 200 000 stridssegment med fullständig trupp, 2 016 000 stratifierade segment för specialförmågor, 504 000 segment för passage över lik, 512 000 rörelsesegment utan autonoma entiteter och 100 800 segment för bossportalers livscykel.
Läs de två styckena tillsammans, så framträder produktens form tydligt. Renderaren är den dyra halvan med tre storleksordningar fler parametrar, en GPU per samtidig tittare vid serving och trettiotvå B200:or vid träning. Simuleringsmodellen – den del som faktiskt avgör vad som händer i världen – har fyra och en halv miljon parametrar, vilket är mindre än de flesta inbäddningstabeller. Agora-2 är ett renderingsproblem klätt i en spelmotorkostym.
De publicerade siffrorna, och det enda de inte visar
Rapportens kvantitativa resultat är, enligt Odysseys egen inramning, ablationer av dess egna designval snarare än konkurrenskraftiga benchmarkresultat, och de bör läsas så:
• Strukturerat prefix mot en VAE-baslinje – 0,001279 medelkvadratfel och 30,11 dB PSNR mot 0,010272 och 20,67 dB, en förbättring på 9,44 dB, över 90 parade utvärderingar från 30 klipp och 3 frön
• Renderer-uppmärksamhet — 20,09 millisekunder per tvåbilds-denoiseruppdatering med det strukturerade prefixet, jämfört med 37,06 med cross-attention och 18,82 med poolad AdaLN, en minskning på 45,8 % för denoisern och 34,1 % för kärnan
• Historik-dropout vid 50 % – 0,05695 i strömningsfel och 0,19535 i kallstart mot 0,06041 och 0,21082 utan dropout, vid något sämre fidelitet för kartperturbering
• Simuleringsnoggrannhet – 85,17 % för rörelsegrenprediktion, 68,17 % för den svårare delmängden med blockerade exempel, och 95,84 % i animationsläge, med förutsagda lägesväxlingar på 7,49 % mot 3,54 % uppmätta
Var och en av dessa siffror mäts mot en annan konfiguration av Agora-2. Ingen av dem är en jämförelse mot ett levererat system, och ingen av dem beskriver spel i realtid. Avsnitt 8 i rapporten är uppriktigt om gapet. Överföring till nya tillgångar, regler eller miljöer är fortfarande otestad. Fel ackumuleras. Oberoende genererade bilder kan fortfarande skilja sig åt i utseende, synlighet eller tidpunkt för händelser. Och meningen som är värd att citera i sin helhet: hållbar bildfrekvens och latens från inmatning till visning under interaktion mellan flera agenter i realtid har inte utvärderats kvantitativt. De femton uppdateringarna per sekund och trettio bildrutor per sekund ovan är mål, inte mätningar.

Var förhandsvisningen finns, vad den inte innehåller
Den spelbara förhandsvisningen finns på Odysseys egen webbplats, nås via demoadressen agora.odyssey.ml, som omdirigerar till agora.odyssey.systems. Den tekniska rapporten är den PDF som länkas från samma tillkännagivande. Det som inte publiceras är lika anmärkningsvärt som det som publiceras: inga modellvikter, inget kodförråd, ingen licens, inget inferens-API och inget pris. Odyssey beskriver släppet som en forskningsförhandsvisning och behandlar banan mot multiagentinteraktion i sina grundläggande världsmodeller som framtida arbete, med PROWL listad som det forskningsspår man bygger ut och Odyssey-3 nämnd som den slutliga destinationen.
Det spelar roll för alla som planerar att bygga mot Agora-2, för det praktiska svaret i dag är att du inte kan — varken via oss eller via någon annans hostade endpoint. OrcaRouter tillhandahåller inte Agora-2, Agora-1 eller Odyssey-3; de modellrutterna finns inte i vår katalog. Det vår plattform däremot erbjuder är resten av ett bygge som kan ligga runt en inlärd värld: en enda endpoint som täcker 200+ modeller, prissatt enligt varje leverantörs listpris utan påslag, så när en leverantör sänker ett pris är ändringen live här samma dag, och ett routinglager som automatiskt flyttar över en begäran när en leverantör försämras. Om du till slut använder en modell för att generera banlayouter, skriva policykod eller texta inspelat spel, är det den delen vi faktiskt kan hjälpa till med.
Vad du ska titta på
Agora-2 är ett verkligt resultat med en verklig brasklapp, och de två är lätta att förväxla. Resultatet är att en delad, beständig värld med flera miljöer kan simuleras och renderas för tjugo deltagare utifrån en korpus av inspelat spelande, och att Odyssey kan peka på de specifika designbeslut – explicit tillstånd, ett strukturerat betingningsprefix, en liten simuleringsmodell – som gjorde att det fungerade. Brasklappen är att artikelns egen sektion 8 listar live-latens, varaktig bildfrekvens, överföring mellan miljöer och felackumulering som outvärderade. Fram till dess att någon publicerar ett bildfrekvensspår från en verklig session med fyra spelare är den ärliga sammanfattningen att Agora-2 bevisar arkitekturen och lämnar upplevelsen omätt.
Det andra att hålla ögonen på är färdriktningen. Odysseys egen inramning placerar Agora-2 som ett steg på vägen mot att lägga in interaktion mellan flera agenter i en grundläggande världsmodell, med PROWL som forskningsutvidgningen och Odyssey-3 som det namngivna målet. Om det inträffar upphör den intressanta frågan att vara huruvida en världsmodell kan hantera tjugo deltagare och blir i stället huruvida en världsmodell kan föra dem in i en värld som den aldrig har tränats på – vilket är precis den transferfråga som den aktuella rapporten avstår från att besvara.

