Обсудить задачу
новость

OpenAI выпустила GPT-6 Astra: что изменилось для практика

5 сентября 2026

Что OpenAI выкатила 3 сентября

OpenAI выпустила GPT‑6 Astra. Раскатывают волнами: сначала ограниченному кругу организаций, следом модель получат все на Plus, Pro, Business и Enterprise, а также API, Microsoft Azure и AWS Bedrock. У корпоративных клиентов доступ по умолчанию выключен – включает администратор рабочего пространства. На Pro, Business и Enterprise дополнительно дают версию Astra Pro.

Два дня назад я разбирал заявку компании на риски – новость о том, что Astra стала первой моделью уровня Critical по кибербезопасности. Тогда были только слова про опасность и никакой конкретики про доступ. Теперь опубликованы цены, лимиты и таблицы бенчмарков, а значит можно считать.

Пустой офисный стол ночью, монитор светится, мышь и клавиатура двигаются сами, на экране заполняются формы – Нейровод, neurovod.ru
главное в релизе не проценты на бенчмарках, а то, что модель работает мышкой в чужих интерфейсах

Главное в этом релизе – не очередной процент на тестах. Astra подаётся как модель, которая работает за компьютером: заполняет онлайн-формы, обновляет карточки клиентов, разбирает данные в специализированных программах, проверяет собранный интерфейс в браузере. И вот тут цифры действительно другого порядка, чем были весной.

Нужна не самая умная модель, а та, что закроет вашу задачу?

Подберу связку под конкретный процесс и посчитаю стоимость прогона на ваших объёмах, а не по прайсу вендора. Дальше соберу и запущу.

Обсудить задачу Или сначала прайс: 29 услуг со сроками и ценами
Евгений Семенов, Нейровод

Сколько стоит миллион токенов и почему это ещё не цена задачи?

По стандартному тарифу API Astra стоит 10 долларов за миллион входных токенов и 50 за миллион выходных. Чтение из кэша – доллар, запись в кэш – 12,5. Отдельно есть быстрый режим: до двух раз быстрее обычной обработки за двойную цену.

Сравнивать надо с тем флагманом, который стоял до неё. GPT‑5.6 Sol идёт по промо-цене 4 и 20 долларов, и промо держится минимум до 21 ноября 2026 года. Получается, Astra дороже ровно в 2,5 раза по обеим сторонам. Обычная цена Sol – 5 и 30, так что после ноября разрыв сожмётся: вдвое по входу и в 1,7 раза по выходу.

модель вход, $/1 млн кэш, $/1 млн выход, $/1 млн
GPT-6 Astra 10 1 50
GPT-5.6 Sol, промо до 21.11.2026 4 0,40 20
GPT-5.6 Terra 2 0,20 12
GPT-5.6 Luna 0,20 0,02 1,20

А теперь интересное. Цена за токен и цена за задачу – разные вещи. На Terminal-Bench 4.0 Astra берёт 57,9% против 37,3% у Sol, и стоимость одной задачи при этом, по расчёту OpenAI, примерно на 9% ниже. На тесте Agents' Last Exam модель тратит примерно на 65% меньше выходных токенов, чем Claude Opus 5, и держит результат выше. Дороже за миллион, короче в рассуждении.

Это ровно то, о чём я писал в разборе, почему агент съедает 60 тысяч токенов на запрос: в длинной автономной работе счёт формирует не тариф, а объём переработанного контекста. Так что считать надо прогон своей задачи, а не строчку прайса.

Что меняет модель, которая умеет мышкой

Работа в чужом интерфейсе была демонстрацией, а не инструментом. Модель кликала, ошибалась, тратила час на то, что человек делает за десять минут. Astra сдвинула обе цифры сразу.

На OSWorld 2.0 она набирает 72,6% против 65,7% у Sol и тратит примерно на 47% меньше времени: около 40 минут на задачу вместо 75. На ScreenSpot-Pro без инструментов – 92,7% против 76,9%. На AutomationBench, где меряют офисную рутину, разрыв ещё грубее: 41,4% против 18,1% у Sol и 31,4% у Claude Fable 5.1. Вдобавок OpenAI обновила обвязку Codex, и на тесте Mind2Web задача закрывается в 1,9 раза быстрее, чем на прежней связке с Sol.

Куда это ляжет первым делом – понятно уже сейчас. Перенос данных между системами, у которых нет нормального API. Снятие отчётов из интерфейсов, куда программно не пускают. Заполнение форм в старых кабинетах. У меня заметная часть запросов на внедрение ИИ в CRM упирается именно в это: интеграции нет, а руками менеджер копирует по сорок минут в день.

Второй сдвиг – контекст. Окно 1 050 000 токенов, из них до 922 000 на вход и до 128 000 на ответ, знания по 30 апреля 2026 года. На длинном контексте от 512 тысяч до миллиона токенов Astra держит 96,3% против 73,8% у Sol. Для задач вроде поиска по внутренним документам это важнее, чем ещё один процент на олимпиадной математике: там модель или находит нужный абзац в пятисотстраничном регламенте, или нет.

Третье – работа с людьми. Astra умеет задавать уточняющий вопрос асинхронно: продолжает ту часть работы, что от ответа не зависит, и ждёт только там, где ответ меняет результат. В Codex появился механизм заметок между контекстными окнами: вместо сжатия истории в один пересказ модель ведёт записи и может искать по прежним окнам. Пока это включается флагом в конфиге, дефолтом обещают сделать позже.

Где Astra впереди, а где проигрывает

OpenAI называет Astra самой интеллектуальной моделью в мире. Их же сводная таблица говорит осторожнее.

тест GPT-6 Astra GPT-5.6 Sol Claude Fable 5.1
Terminal-Bench 4.0, работа в терминале 57,9% 37,3% 55,8%
AutomationBench, офисная рутина 41,4% 18,1% 31,4%
Humanity's Last Exam, с инструментами 57,2% не назван 65,0%
Artificial Analysis Intelligence Index v4.1.1 61,2 60,9 65,7

По сводному индексу Artificial Analysis Astra набирает 61,2 против 65,7 у Fable 5.1. На Humanity's Last Exam с инструментами – 57,2% против 65,0%. Обе цифры OpenAI печатает у себя же в таблице, не пряча. Читается это так: в агентной и компьютерной работе Astra ушла вперёд заметно, в общей эрудиции – нет. Выбор модели снова зависит от задачи, а не от строчки «самая умная».

Отдельная колонка – кибербезопасность, из-за которой модель и получила уровень Critical. На ExploitBench у Astra 100% против 78,5% у Sol. На SRE-Bench, где надо разобрать бинарник без исходников, – 88,0% с первой попытки и 99,2% за четыре, у Sol 55,9% и 68,7%. В ходе оценки модель нашла и применила две ранее неизвестные уязвимости, их сейчас раскрывают мейнтейнерам. Публичная версия собирать эксплойты откажется, послабления для защитников обещают открывать через программу Daybreak.

Что до дисциплины: в тесте с ловушками, собранном после августовского инцидента с Hugging Face, Sol без production-защит выходил за пределы разрешённой цели в 48% случаев, Astra – в нуле. Доля неудачных исходов на компьютерных задачах 2,4% против 9,5% у Fable 5.1 и 11,5% у Opus 5. И про собственные возможности модель врёт втрое реже: 4,2% против 12,2%.

Кому Astra применима уже сейчас?

Тем, кто гоняет агентов на API, – пересчитать свою задачу целиком. Не по прайсу, а прогоном: на длинных сценариях экономия на токенах может перекрыть подорожание в 2,5 раза, а может и не перекрыть, если задача короткая и модель отвечает одним абзацем.

Тем, кто сидит на подписке, – ничего делать не надо, Astra входит в существующие лимиты, сверх них докупаются кредиты. Корпоративным администраторам – включить модель в рабочем пространстве руками, по умолчанию она выключена.

И сразу про границы. На Astra не собрать голосовой бот: Realtime, Assistants, дообучение, эмбеддинги и аудио она не поддерживает вовсе, для разговорных сценариев остаются отдельные realtime-модели. Лимиты первого тарифного тира – 500 запросов и 500 тысяч токенов в минуту, для потокового разбора документов это узкое место. Уровни усилия задаются от low до max, и цена прогона зависит от них сильнее, чем от строчки прайса.

Ещё одна вещь, которую стоит заложить в архитектуру заранее. Проверки безопасности могут остановить работу: в ChatGPT и Codex у пользователя спросят подтверждение, а в API задача просто остановится. Автономный агент без логики повторов на этом встанет молча.

Что осталось неясным

Сроков полной раскатки нет – «в ближайшие дни». Нет и границы между публичной Astra и той конфигурацией, которой откроют киберфункции через Daybreak: сказано только, что послабления придут в ближайшие недели.

OpenAI сама признаёт неприятное: рассуждения Astra стало труднее отслеживать, чем у Sol. Причина в том, что модель решает задачи за меньшее число письменных шагов, и на простых задачах контролирует свои рассуждения плотнее. Компания называет мониторинг приоритетом исследований, но факт зафиксирован в релизе прямым текстом.

И отдельно – про то, чего в первоисточнике нет. По сети разошлись формулировки, будто OpenAI объявила наступление эры AGI и впервые обучила модель более чем на 100 000 видеокарт на площадке Stargate в Техасе. Ни на странице релиза, ни в карточке модели в документации я этого не нашёл. Цифру обучения компания не публиковала, поэтому и повторять её не буду: пересказ пересказа – плохая опора для решений о своём стеке.

Посчитать свою задачу на новых ценах?

Обсудить задачу Или сначала прайс со сроками и ценами

Источник: релиз OpenAI «GPT‑6 Astra: A new generation of intelligence» и страница тарифов OpenAI, откуда взяты цены.

Именной сертификат курса «ИИ для новичков» – neurovod.ru
БЕСПЛАТНО
курс с сертификатом

ИИ для новичков

Семь коротких уроков с тестами: от «что такое ИИ» до первого собственного ИИ-помощника в вашем деле. Без воды и почтовых рассылок. В конце – сертификат.

Начать бесплатно

Есть идея? Сделаем вместе

Партнёрский формат: ваша идея и знание рынка + мои руки и запущенные проекты. Расскажите – за пару дней скажу честно, взлетит ли и что для этого нужно.

Рассказать идею