Сгенерированная hero-карточка с заголовком «Представляем Astra for Law», подзаголовком «Юридическая конфигурация GPT-6 Astra от OpenAI», со строкой даты «Astra for Law анонсирована 17 сентября 2026 г. · GPT-6 Astra выпущена 3 сентября 2026 г.», над тремя карточками с подписями «Индекс юридического поиска — 230M+ URL-адресов законов США», «Корпус — CourtListener, Free Law Project» и «API — gpt-6-astra-law, скоро», с футером «Показатели бенчмарков заявлены вендором; независимо не воспроизведены.» и логотипом OrcaRouter, наложенным в правом нижнем углу.
Guides & Insights

Представляем Astra for Law: OpenAI ставит за GPT-6 Astra индекс юридического поиска

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Astra for Law была анонсирована 17 сентября 2026 года как конфигурация для юридической работы, построенная на GPT-6 Astra, флагманской модели, выпущенной компанией двумя неделями ранее, 3 сентября. Это не новая модель. Это те же веса за другой входной дверью: специализированный индекс юридического поиска, инструкции, специфичные для юриспруденции, и набор инструментов, нацеленных на исследование прецедентного права США. Это различие важнее, чем предполагает подача запуска, потому что каждая цифра в анонсе — это сравнение конфигурации с базовой моделью, а не показатель новой возможности — и почти вся работа выполняется конфигурацией.

Основное утверждение: Astra for Law прошла проверку общей корректности на 54,0% из 200 вопросов по американскому юридическому исследованию, взятых из закрытого валидационного набора Legal Research Bench от Vals AI, против 38,7% у GPT-6 Astra при использовании только веб-поиска — относительное улучшение на 40%, как это подаёт OpenAI. Это заявленные вендором цифры на закрытом разбиении, и ни одна независимая лаборатория их не воспроизвела. То, что можно увидеть независимо, полезнее: в собственном публичном сравнении Vals AI GPT-6 Astra указана на уровне 39,42% ±3,40 на этом бенчмарке, что по сути и есть базовый уровень, с которым сравнивает OpenAI. Разрыв возникает из-за индекса юридического поиска и инструкций, а не из-за того, что модель стала лучшим юристом.

Вот что уже выпущено, что фактически было измерено, а что всё ещё отсутствует.

Что на самом деле представляет собой Astra for Law

Поверх GPT-6 Astra было добавлено три вещи, и ни одна из них не является изменением весов. На брифинге для прессы Джейсон Бёмиг — соучредитель Ironclad, которого OpenAI наняла в июне 2026 года, — и инженер Шервин Ву описали релиз как конфигурацию доменных инструкций, настроек, таких как длина ответа, и инструментария для юридической отрасли, который, как ожидается, будет расширяться со временем.

Индекс юридического поиска — слой поиска по судебной практике США, законам, нормативным актам, правилам судопроизводства и административным решениям, охватывающий более 230 миллионов URL-адресов, причём источники добавляются ежедневно.

Происхождение корпуса — индекс опирается на CourtListener, библиотеку, которую поддерживает некоммерческая организация Free Law Project; по словам OpenAI, она охватывает более 99,9% опубликованного прецедентного права США. Он дополняет лицензионный контент от таких поставщиков, как Thomson Reuters.

Юридические инструкции — набор инструкций по предметной области для применения исследований к фактам, разработки аргументов или условий сделки и выявления слабых мест или неопределённости в позиции.

A generated single-column scoreboard titled 'Astra for Law — the scoreboard' with six rows reading 'Underlying model: GPT-6 Astra', 'Legal Search Index: 230M+ U.S. law URLs', 'Corpus: CourtListener, 99.9% of precedential case law', 'Availability: Trusted Access, Am Law 200 only', 'API model id: gpt-6-astra-law, not yet open' and 'Headline benchmark: 54.0% vs 38.7% vendor-reported', above the footer 'All figures OpenAI-reported on a private validation set; no independent reproduction.' with the OrcaRouter logo composited in the bottom-right corner.

Демонстрация в брифинге была конкретной, а не абстрактной: Ву подготовил ходатайство об отклонении иска для больницы, столкнувшейся с иском о дискриминации по инвалидности и ответных действиях, занимался оспариванием акционером продажи активов в течение праздничных выходных и разбирался со спором об обязательствах по продажам. Ничто из этого не является новой возможностью для передовой модели. Новым является то, что часть работы, связанная с поиском, больше не проходит через общий веб-поиск.

Бенчмарк, читайте внимательно.

После запуска появились четыре цифры — все приписываются OpenAI, все на одном и том же приватном валидационном наборе, и все заслуживают того, чтобы их отделить друг от друга:

Общая корректность — 54,0 % для Astra for Law против 38,7 % для GPT-6 Astra с веб-поиском, при максимальном уровне усилий рассуждения.

Найдено эталонных дел — на 24 % больше в вопросах, посвящённых судебной практике, снова при максимальном уровне усилий рассуждения.

Найдено релевантных фрагментов — до 54% больше из правильных судебных решений при тех же затратах на рассуждение, что и в базовом варианте.

Длина ответа — в среднем примерно в два раза длиннее в протестированных настройках рассуждения.

Вот этот последний показатель и нужно сопоставлять с первым. Проверку общей корректности, которая вознаграждает полноту, легче пройти с более длинным ответом, и часть прироста в 15,3 пункта, вероятно, объясняется тем, что слой извлечения просто предоставляет модели больше материала. Это не критика результата — обнаружение на 24% большего числа эталонных случаев является реальным, отдельно заявленным улучшением, — но это означает, что сводный показатель и показатели извлечения следует рассматривать вместе, а не сводный показатель сам по себе.

Проблема приватного сплита — более серьёзная. Валидационный набор, который OpenAI держит у себя и не публикует, никто не может воспроизвести, а публичная таблица лидеров того же бенчмарка рисует более скромную картину: на собственной странице сравнения Vals AI указаны GPT-6 Astra — 39.42% ±3.40 в Legal Research Bench, а Gemini 3.8 Flash — 38.94% ±3.39. Что бы ни вызвало скачок до 54.0%, в публичной таблице этого не видно, потому что публичная таблица оценивает базовую модель без подключённого юридического индекса.

A screenshot of the Vals AI 'Compare Models' leaderboard captured September 18, 2026, comparing Gemini 3.8 Flash and GPT-6 Astra: Legal Research Bench (Agentic US legal research) shows Gemini 3.8 Flash 38.94% ±3.39 against GPT-6 Astra 39.42% ±3.40; Vals Index shows 62.25% against 66.61%; and the table also lists Finance Agent (V2) 61.44% vs 53.54%, Tax Agent Bench 66.77% vs 63.34%, MedCode 48.13% vs 48.49%, Terminal-Bench Science 8.57% vs 65.71%, Code Migration 36.55% vs 67.74%, Terminal-Bench 4.0 13.13% vs 57.07% and Vibe Code Bench v1.1 78.65% vs 89.59%, with a Vals Index date of 2026-09-11.

Сверка Legora и число внутри неё

Самое весомое стороннее подтверждение в материалах о запуске — это тест рабочего процесса от Legora, юридический инженер которой Персевейл Перкс провёл сверку финансовой отчётности: сопоставление показателей черновой отчётности с пробным балансом, консолидационной ведомостью и счетами за предыдущий год. Агент Legora выполнил сверку по 41 документу за один прогон, за считанные минуты, фиксируя каждую проверку и создавая построчную запись для проверки. Он обнаружил все четыре ошибки, которые Legora заложила в счета, включая разрыв в £500,000, скрытый в примечании к выручке, сохранил все проверки, которые прошла предыдущая модель, и добавил ещё около пятидесяти.

Это по-настоящему хороший результат на по-настоящему сложном наборе документов. И именно здесь скрыто самое полезное число за весь цикл запуска. В Benchmark for Agentic Reasoning от Legora, который охватывает реальные сквозные юридические задачи, улучшение в рабочем процессе по финансовой отчётности составило около 40% — а среднее улучшение по всем задачам BAR составило около 3%. Оба числа принадлежат Legora, оба описывают одну и ту же модель, но распространение получило лишь одно из них. Если вы оцениваете это для фирмы, 3% — это цифра, на которую стоит ориентироваться при планировании, а 40% — это цифра, на которую можно надеяться.

Независимое тестирование указывает на иной режим отказа

Две независимые оценки стоит поставить рядом с показателями запуска, с той оговоркой, что обе они небольшие и получены из единственного источника.

HAQQ протестировала GPT-6 Astra на 41 реальном юридическом вопросе в 20 областях практики при среднем уровне рассуждений. Astra вышла вперёд по юридической сути с 17,63 из 20 — меньше чем на балл. Это стоило $0,2622 за ответ — примерно в одиннадцать раз больше стоимости ответа GPT-5.6 Luna Pro ради менее чем одного балла прироста по совокупному показателю. Собственное прочтение HAQQ проницательно: преимущество не в том, что модель умнее, а в том, что она перестаёт писать. Тот же тест показал, что переключение усилия рассуждений с низкого на высокое увеличило стоимость примерно в 1,5 раза, а задержку — примерно в 1,8 раза, при этом снизив оценённое качество на 0,17 балла — рычаг затрат, замаскированный под рычаг качества, и причина зафиксировать настройку усилия, а не оставлять её на максимуме.

Вывод, который должен разойтись шире всего, касается не затрат. В юрисдикциях за пределами США все три протестированные модели ссылались на правильную норму, но при этом искажали её содержание. Astra была юридически права в 66,7% таких пунктов; Claude Opus 5 — в 100%. Проверка цитирования пропускает такой ответ, потому что цитата существует и является правильной. Клиент — нет. Это тот режим отказа, который юридический поисковый индекс меньше всего способен устранить, поскольку индекс охватывает только США, а ошибка кроется в прочтении, а не в поиске.

Что вы действительно можете получить и когда

Astra for Law пока не является общедоступным. Доступ открывается через новую программу Trusted Access, ориентированную на фирмы Am Law 200 и предоставляемую через ChatGPT и Codex. API описывается как «скоро» под идентификатором модели gpt-6-astra-law, отображаясь в списке выбора моделей как «GPT-6 Astra Law»; Harvey и Legora названы клиентами API, которые будут на нем строить. Цена для юридической конфигурации не опубликована, и это самый крупный открытый вопрос для всех, кто планирует бюджет с учетом нее.

Trusted Access включает два условия обработки данных: Zero Data Retention в API и исключение использования ChatGPT Enterprise из проверки людьми по умолчанию. Когда на брифинге его спросили об исключениях, Бёмиг не стал утверждать, что политика абсолютна: «Всё определённо сложнее, чем одно предложение», — сказал он, отметив, что полное соглашение занимает около 30 страниц, и добавив, что OpenAI уверена: эти 30 страниц отвечают потребностям. OpenAI заявляет, что работает с Latham & Watkins над разрешениями на доступ к информации, этическими барьерами, инструкциями клиентов и надзором со стороны фирмы.

Экосистемная составляющая больше, чем модельная: 26 плагинов от поставщиков, включая Thomson Reuters, Harvey, Legora, iManage, Relativity, Clio, Intapp и DeepJudge; девять плагинов сообщества от групп юридической инженерии; и 47 кастомных навыков, созданных продвинутыми пользователями-юристами. ChatGPT for Word также стал общедоступным для вычитки, предлагаемых правок и отметок форматирования. Инженеры OpenAI, работающие на местах, сотрудничали с Sullivan & Cromwell над анализатором соглашений, с Ropes & Gray над due diligence для M&A и с Cooley над GO Public.

Для контекста о том, насколько сейчас заполнена эта ниша: Anthropic выпустила Claude for Legal в мае 2026 года, за три месяца до появления Astra for Law.

Риски, которые не отражает ни один бенчмарк на той странице

Ни один из материалов запуска не отвечает на два вопроса управления, которые главный юрисконсульт фирмы задаст в первую очередь. По состоянию на сентябрь 2026 года для GPT-6 Astra не было опубликовано ни сертификата SOC 2, ни ISO, ни HIPAA, и нет опубликованных сведений об изоляции данных конкретной фирмы, локальном развёртывании или резидентности данных. Отсутствие — не доказательство провала; это просто отсутствие документации, а это уже другая проблема, и решать её должна сама фирма, прежде чем туда поступят материалы, защищённые привилегией.

Что касается этической стороны, действующие правила — это Модельное правило 1.6 ABA о конфиденциальности, которое регулирует, чем фирма может делиться со сторонним поставщиком услуг, и может требовать обновлённых раскрытий информации и информированного согласия, а также Правило 5.3 о надзоре за помощью неюристов, под которое подпадает результат работы ИИ. Причина, по которой оба правила действуют, а не являются чисто теоретическими, — Mata v. Avianca, в котором адвокаты были подвергнуты санкциям за представление в суд несуществующих дел, сгенерированных ИИ. Индекс юридического поиска по реальным судебным решениям делает этот конкретный сбой менее вероятным. Это не делает такой сбой невозможным и никак не влияет на сбой, вызванный неверным прочтением положения, который задокументировала HAQQ.

Если вы хотите развить это до открытия API

Если честно, на сегодняшний день gpt-6-astra-law нет ни в чьём API, включая наш, — OpenAI говорит «скоро», но не называет дату. Что же доступно прямо сейчас — так это базовая модель: openai/gpt-6-astra представлена на OrcaRouter с нулевой наценкой, то есть прайс-лист провайдера OpenAI передаётся без изменений, поэтому изменение цены на эту модель со стороны вендора отражается в тот же день. Один ключ открывает доступ к более чем 200 моделям, с автоматическим переключением при сбое между провайдерами и DSL маршрутизации для объединения нескольких моделей в один вызов.

A screenshot of OpenAI's developer documentation page for GPT-6 Astra, captured September 18, 2026, showing the model badge labelled 'Default' with the line 'Our most capable model, built for the hardest end-to-end work', a 1,050,000 context window, 128,000 max output tokens, an Apr 30 2026 knowledge cutoff, reasoning token support, and the pricing card reading Input $10.00, Cached input $1.00, Cache writes $12.50, Output $50.00 per 1M tokens, with the notes that prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request, that cache writes are billed at 1.25x the uncached input token rate, and that Batch and Flex are priced at 50% of Standard rates while Fast mode is priced at 2x.

Практическое следствие для команды юридической инженерии — это разделение. Всё в рабочем процессе Astra for Law, что не зависит от Legal Search Index — составление документов на основе предоставленных вами фактов, реструктурирование набора пунктов, форматирование по шаблону фирмы, создание контрольного списка для проверки — можно прототипировать уже сегодня на базовой GPT-6 Astra и заменить идентификатор модели, когда откроется вариант для юридической сферы, не меняя вашу интеграцию. Всё, что зависит от индекса, прототипировать нельзя, потому что индекс — это та часть, которая пока не продаётся. Две оговорки, которые стоит прямо назвать: запрос, проходящий через маршрутизатор, не покрывается автоматически одобрением Zero Data Retention от OpenAI, которое предоставляется на уровне организации, поэтому фирме, которой нужен ZDR, следует подтвердить покрытие для конкретного используемого маршрута; и маршрутизатор — это дополнительный промежуточный узел в пути данных, что является реальной ценой для привилегированных материалов, даже когда это обеспечивает вам отказоустойчивость.

Что посмотреть

Три вещи, в порядке того, насколько они изменят картину. Дата выхода API для gpt-6-astra-law, поскольку это разница между пилотом и продуктом. Цена, поскольку базовые 10 долларов за миллион входных и 50 долларов за миллион выходных токенов предполагают пересмотр цены для длинного контекста свыше 272 000 входных токенов, который наборы юридических документов будут регулярно пересекать, — а если юридическая конфигурация стоит дороже этого, экономика сверки 41 документа существенно меняется. И независимый повторный прогон тех 200 вопросов на разбиении, которое контролирует кто-то другой. Пока этого не существует, 54,0% — это число OpenAI о конфигурации OpenAI, и защитимое утверждение — более узкое: индекс судебной практики США плюс юридические инструкции дают существенно лучший поиск, чем общий веб-поиск, по вопросам юридических исследований США. На этом утверждении стоит действовать. Остального стоит подождать.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно