
Agora-2: игровая модель мира Odyssey запускает 20 участников на четырёх GPU
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 36 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 181 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Agora-2 помещает двадцать участников в одну симуляцию и называет это играбельным исследовательским превью. Odyssey опубликовала её 21 сентября 2026 года в посте под названием «Представляем Agora-2: развитие мультиагентного моделирования миров», подписанном Оливером Кэмероном, и число, которое все повторяют, — это двадцать. Число, которое имеет значение, — это разделение внутри него. Сессия поддерживает до четырёх одновременных операторов-людей наряду с шестнадцатью автономными сущностями, и это не один и тот же тип участников — четыре человека, вводящие команды движения, шестнадцать политик, исполняющих их. Odyssey обучила эти политики сама, на этапах игры, на которой она тоже обучалась: в статье говорится, что мир выучен по записям Diablo II.
Это различие между контролируемыми и симулированными участниками — то, в чём заключается почти всё интересное в Agora-2. И именно здесь большинство освещения размоется, потому что «20 игроков» — это более чистая фраза, чем «четыре игрока и шестнадцать обученных агентов, совместно использующих состояние, которое сохраняется за пределами экрана». То, что выпускает Odyssey, — не генератор видео с прикрученным мультиплеером. Это ближе к игровому серверу, в котором физика, анимация и рендеринг были полностью заменены обученными компонентами, а единственный настоящий источник контента — набор данных записанной игры.
Двадцать участников — это четыре человека и шестнадцать полисов.
Odyssey прямо указывает, что Agora-2 поддерживает в пять раз больше участников, чем Agora-1, и что она перешла от моделирования одной среды к моделированию нескольких сред с поведением на более длительном горизонте. Структура отдельной сессии выглядит так:
• Люди-операторы — до 4 одновременно, каждый обеспечивает ввод команд перемещения и действий
• Автономные сущности — 16 за сессию, управляемые обученными политиками монстров и компаньонов, а не игроками
• Всего участников — 20 в одном общем состоянии мира, и именно эту цифру Odyssey выдвигает на первый план
• Среды — множество, а не одна среда, которую могла моделировать Agora-1
• Основа контента — записи Diablo II, поэтому мир, ассеты и правила — всё унаследовано из единого записанного корпуса
• Форма выпуска — играбельный исследовательский предпросмотр, а не продукт, без весов, без лицензии и без цены
Автономные шестнадцать — не декорация. Отчёт Odyssey описывает обучение отдельных политик для монстров и компаньонов, и цифры оценки конкретны: для политики монстров на финальном этапе насчитывается 23 771 пример, полученный из базового учителя, а также из данных восстановления и удержания, а для политики компаньона — 128 005 примеров; оценка проводилась соответственно на 252 оценочных эпизодах и 24 оценочных кейсах. Именно эти политики заставляют сессию с четырьмя игроками ощущаться наполненной. Они также причина того, что число участников — это дизайнерский выбор, а не заявление о вместимости: шестнадцать — это столько агентов, сколько сервер мира был обучен обслуживать вместе с четырьмя людьми, а не столько, сколько он теоретически мог бы вместить.
Архитектура — это одна маленькая модель и одна большая.
Agora-2 разделяет то, что решает, что произойдёт, и то, что решает, как это выглядит, и разрыв в размерах между ними — самая поразительная цифра в статье. Модель симуляции имеет 4 457 777 параметров — примерно 4,46 млн, четыре слоя в ширину, ширина 256, четыре головы, окно истории в четыре шага, четырнадцать ветвей движения и отдельную голову для ориентации. Рендерер — это трансформер flow matching примерно на один миллиард параметров, шестнадцать блоков шириной 2 048, пять из которых используют причинное временное внимание, запускаемый на пять шагов решателя на каждое обновление.
Рендерер зависит от префикса из 342 токенов, а не от исходного мира:
• Карта — 144 токена, локальная сетка тайлов 12×12 вокруг точки обзора
• Сущности — 36 токенов: четыре для управляемых пользователем участников и 32 для других слотов сущностей
• Временные эффекты — 160 токенов для эффектов, которые не являются ни картой, ни сущностью
• Просмотр и список участников — по одному токену для действия камеры и списка участников сессии
• На каждое обновление — 300 токенов изображения, применяющих внимание к этим 342 токенам обусловливания
• Кодек — латент на основе RAE для 2 кадров в 15×20×32, затем x264 CRF 18 или NVENC QP 18 на выходе
Odyssey называет причину, по которой кондиционирование структурировано именно так: обученному миру нужно сохранять свойства сущностей в состоянии, которое переживает любую конкретную камеру. В посте это сказано прямо — поскольку свойства сущностей сохраняются независимо от любого конкретного ракурса, они остаются доступными, когда сущность вне кадра. Именно эта фраза отличает Agora-2 от видеомодели. Генератор, который кондиционируется только на недавних кадрах, теряет монстра в тот момент, когда вы отворачиваетесь от него; модель мира, которая хранит явное состояние, — нет.

Четыре GPU покупают четырёх игроков
План обслуживания в отчёте — наименее освещённая часть Agora-2 и самая полезная для всех, кто оценивает, во сколько обошёлся бы подобный мир. Конфигурация Odyssey для сессии на четырёх игроков — четыре карты NVIDIA RTX PRO 4500: по одному рендереру на каждый GPU, причём один из этих GPU также размещает модель симуляции и политику агента. Заявленные целевые показатели — пятнадцать обновлений латентного состояния в секунду при тридцати отображаемых кадрах в секунду.
Две цифры в приложении конкретизируют эту конфигурацию. При 165 ваттах команда измерила снижение времени вывода на 9,9% в результате изменения рендерера — с 62,92 миллисекунд до 56,69 миллисекунд на 3200 вызовов на реализацию. И обучение рендерера было столь же конкретным: шестьдесят тысяч обновлений на 4 232 000 сегментах, за которыми последовали ещё шестьдесят тысяч на 4 332 800 сегментах, AdamW со скоростью обучения 1e-4, батч 128, EMA 0,9999, запущено на 32 GPU B200. Этот корпус детализирован — 1 200 000 сегментов боя с полным составом, 2 016 000 стратифицированных сегментов особых способностей, 504 000 сегментов перемещения по трупам, 512 000 сегментов движения без автономных сущностей и 100 800 сегментов жизненного цикла портала босса.
Прочитайте эти два абзаца вместе — и форма продукта становится ясна. Рендерер — это дорогая половина: на три порядка больше параметров, одна GPU на каждого одновременного зрителя при обслуживании и тридцать две B200 при обучении. Модель симуляции — та часть, которая фактически определяет, что происходит в мире, — это четыре с половиной миллиона параметров, что меньше, чем у большинства таблиц эмбеддингов. Agora-2 — это задача рендеринга, наряженная в костюм игрового движка.
Опубликованные цифры — и то единственное, чего они не показывают
Количественные результаты отчёта, по собственному признанию Odyssey, представляют собой абляции собственных проектных решений, а не конкурентный бенчмарк, и именно так их и следует читать:
• Структурированный префикс против базовой модели VAE — среднеквадратичная ошибка 0,001279 и PSNR 30,11 дБ против 0,010272 и 20,67 дБ, прирост 9,44 дБ, по 90 парным оценкам из 30 клипов и 3 сидов
• Внимание рендерера — 20,09 миллисекунды на обновление денойзера для двух кадров со структурированным префиксом против 37,06 с cross-attention и 18,82 с pooled AdaLN, сокращение времени денойзера на 45,8% и ядра — на 34,1%
• Отсев истории на 50 % — ошибка потоковой передачи 0,05695 и ошибка холодного старта 0,19535 против 0,06041 и 0,21082 без отсева, при чуть худшей точности при возмущениях карты
• Точность симуляции — 85,17% при предсказании ветвлений движения, 68,17% на более сложном подмножестве заблокированных примеров и 95,84% в режиме анимации, при этом прогнозируемые переключения режима составляют 7,49% против зафиксированных 3,54%.
Каждая из этих цифр измерена относительно другой конфигурации Agora-2. Ни одна из них не является сравнением с выпущенной системой, и ни одна из них не описывает живую игру. В разделе 8 отчёта прямо говорится об этом разрыве. Перенос на новые ассеты, правила или среды остаётся непроверенным. Ошибки накапливаются. Независимо сгенерированные изображения всё ещё могут расходиться по внешнему виду, видимости или времени событий. И предложение, которое стоит процитировать полностью: устойчивая частота кадров и задержка от ввода до отображения во время взаимодействия нескольких агентов в реальном времени не были количественно оценены. Пятнадцать обновлений в секунду и тридцать кадров в секунду выше — это целевые показатели, а не результаты измерений.

Где находится предварительный просмотр и что в него не входит
Играбельное превью находится на собственном сайте Odyssey, доступ к которому осуществляется по демонстрационному адресу agora.odyssey.ml, перенаправляющему на agora.odyssey.systems. Технический отчёт — это PDF-файл, ссылка на который дана в том же анонсе. То, что не опубликовано, столь же примечательно, как и то, что опубликовано: нет весов модели, нет репозитория, нет лицензии, нет API для инференса и нет цены. Odyssey описывает этот релиз как исследовательское превью и рассматривает переход к многоагентному взаимодействию внутри своих фундаментальных мировых моделей как будущую работу; PROWL указан как исследовательское направление, которое компания развивает, а Odyssey-3 назван конечной целью.
Это важно для всех, кто планирует разрабатывать под Agora-2, потому что практический ответ на сегодня таков: нельзя — ни через нас, ни через чей-либо ещё хостинговый эндпоинт. OrcaRouter не обслуживает Agora-2, Agora-1 или Odyssey-3; этих маршрутов моделей нет в нашем каталоге. Что наша платформа действительно предоставляет, так это остальную часть сборки, которая может окружать обученный мир: единый эндпоинт, охватывающий 200+ моделей, по цене из прайс-листа каждого провайдера без наценки, так что когда поставщик снижает цену, изменение отражается здесь в тот же день, и слой маршрутизации, который автоматически перенаправляет запрос при деградации провайдера. Если вы в итоге используете модель для генерации планировок уровней, написания кода политик или добавления субтитров к записанному геймплею, именно с этим мы действительно можем помочь.
Что посмотреть
Agora-2 — это настоящий результат с настоящей оговоркой, и эти две вещи легко перепутать. Результат состоит в том, что общий, постоянный, многосредовый мир можно симулировать и отрисовывать для двадцати участников на основе корпуса записанной игры, и что Odyssey может указать на конкретные проектные решения — явное состояние, структурированный префикс обусловливания, крошечная модель симуляции, — которые позволили этого добиться. Оговорка же в том, что в самом разделе 8 статьи живая задержка, устойчивая частота кадров, перенос между средами и накопление ошибок перечислены как неоценённые. Пока кто-нибудь не опубликует трассировку частоты кадров из реальной сессии на четверых игроков, честное резюме таково: Agora-2 доказывает работоспособность архитектуры и оставляет сам опыт неизмеренным.
Второе, на что стоит обратить внимание, — это направление движения. Собственная трактовка Odyssey представляет Agora-2 как шаг на пути к встраиванию мультиагентного взаимодействия внутрь фундаментальной модели мира, где PROWL — это исследовательское расширение, а Odyssey-3 — заявленная цель. Если это произойдёт, интересный вопрос перестанет быть вопросом о том, способна ли модель мира поддерживать двадцать участников, и станет вопросом о том, способна ли модель мира перенести их в мир, на котором она никогда не обучалась, — а это как раз тот вопрос переноса, на который текущий отчёт отвечать отказывается.

