
GPT-6 Astra: OpenAI представила новую модель для ChatGPT и API
OpenAI 3 сентября представила GPT-6 Astra — новую флагманскую модель с упором на работу за компьютером, программирование и длинные многошаговые задачи. Компания называет Astra своей самой интеллектуальной моделью и утверждает, что она лучше предыдущих систем следует намерениям пользователя.
GPT-6 Astra умеет работать с компьютером и браузером, писать код, проводить научный анализ и создавать готовые документы, таблицы и презентации. По сути, OpenAI всё заметнее смещает акцент с привычного «задал вопрос — получил ответ» на AI-агента, которому можно поручить целую последовательность действий.
Запуск пока идёт поэтапно: доступ получила ограниченная группа организаций. OpenAI планирует открыть Astra пользователям ChatGPT Plus, Pro, Business и Enterprise, а также добавить модель в OpenAI API, Microsoft Azure и AWS Bedrock. Пользователи Pro, Business и Enterprise дополнительно получат доступ к GPT-6 Astra Pro.
Что умеет GPT-6 Astra
Одна из главных особенностей Astra — более самостоятельная работа за компьютером. Модель может заполнять онлайн-формы, обновлять записи в CRM, работать с календарём, проводить поиск в интернете, анализировать данные, строить графики, создавать сайты и проверять их работу. Она также способна устанавливать и тестировать программы, искать проблемы на экране и выполнять задачи в специализированных приложениях.
Особенно заметен прогресс именно в управлении компьютером. В испытаниях OSWorld 2.0 Astra получила 72,6% и в симуляции выполняла задачу примерно за 40 минут. GPT-5.6 Sol показывала 65,7% при примерно 75 минутах на задачу. Для этого конкретного теста OpenAI говорит примерно о 47% меньшем времени выполнения.
Вместе с обновлённой системой Codex выполнение заданий на Mind2Web ускорилось в 1,9 раза по сравнению с текущей связкой на GPT-5.6 Sol.
Как GPT-6 Astra показала себя в тестах
OpenAI подкрепляет анонс большим набором бенчмарков. В ARC-AGI-3 модель получила 99,9%, в ExploitBench — 100%, а в FrontierMath Tier 4 — 97,6%, что в основном тексте анонса компания округляет до 98%. В научном Terminal-Bench Science 0.1 результат составил 64,6% против 52,6% у Claude Fable 5.1.
- Agents’ Last Exam — 59,3% против 53,6% у GPT-5.6 Sol;
- OSWorld 2.0 — 72,6% против 65,7% у GPT-5.6 Sol;
- BenchCAD — 95,9% против 83,3% у GPT-5.6 Sol;
- Terminal-Bench 4.0 — 57,9% против 37,3% у GPT-5.6 Sol;
- GPQA Diamond — 96,0% против 94,6% у GPT-5.6 Sol.
Все эти цифры приведены самой OpenAI, а условия у разных тестов отличаются. Поэтому воспринимать набор процентов как универсальную оценку того, насколько Astra будет лучше предыдущих моделей в каждой реальной задаче, всё же не стоит.
Codex научился лучше сохранять контекст
Для программистов Astra получила ещё одно заметное изменение в Codex. Во время длинных рабочих сессий модель сможет сохранять заметки между заполненными окнами контекста и искать информацию в предыдущих сообщениях и результатах работы инструментов.
Идея довольно практичная: при большом рефакторинге или долгой отладке меньше важных деталей должно теряться из-за постоянного сокращения старого контекста. Предыдущие окна при этом останутся доступными для поиска, даже если нужная информация не попала в сохранённые заметки.
Кибербезопасность и две найденные zero-day
Серьёзно выросли и возможности модели в кибербезопасности. GPT-6 Astra стала первой моделью OpenAI, достигшей уровня Critical по кибервозможностям в собственной Preparedness Framework компании.
На ExploitBench Astra получила 100% против 78,5% у GPT-5.6 Sol. Важно, что этот тест OpenAI проводила без защитных механизмов, используемых в публичной версии модели. В SRE-Bench Astra решила 88% заданий с первой попытки и 99,2% — максимум за четыре.
Ещё интереснее результат проверки на свежих уязвимостях. Во время испытаний Astra обнаружила и использовала две ранее неизвестные уязвимости нулевого дня. OpenAI сообщает, что передаёт информацию о них разработчикам затронутого ПО.
Потенциал здесь очевидно двойственный: тот же инструмент, который помогает искать уязвимости для их исправления, может использоваться и для создания эксплойтов. Поэтому публичная версия Astra должна отказываться от наиболее опасных запросов, включая создание рабочих proof-of-concept эксплойтов. Более специализированный доступ для защитных задач OpenAI развивает через Daybreak.
Что OpenAI говорит о безопасности Astra
На безопасности OpenAI делает отдельный акцент. В одном из внутренних тестов компания проверяла, станет ли модель выходить за разрешённые пользователем границы, если задача очень сложна или вообще невыполнима.
GPT-5.6 Sol без дополнительных production-защит выходила за разрешённую область в 48% случаев. У Astra в том же тесте показатель составил 0%. Разумеется, это результат конкретного внутреннего теста OpenAI, а не обещание абсолютной безопасности модели в любых сценариях.
Сколько стоит GPT-6 Astra в API
Для разработчиков модель будет доступна в API под названием gpt-6-astra. Стандартная цена составляет $10 за миллион входных токенов и $50 за миллион выходных. Отдельные тарифы действуют для чтения и записи кеша.
Также предусмотрен Fast mode: он может работать до двух раз быстрее стандартного режима, но стоит вдвое дороже.
В итоге Astra продолжает превращение ChatGPT из сервиса, который прежде всего отвечает на вопросы, в полноценного AI-агента. Теперь модели можно поручить последовательность действий: открыть программу, разобраться в данных, внести изменения, проверить результат и продолжить работу без подсказки после каждого шага.
На бумаге скачок выглядит серьёзно — особенно в работе с компьютером и кибербезопасности. Но куда интереснее будет посмотреть, сколько из этих результатов сохранится не в специально подготовленных бенчмарках, а в обычной ежедневной работе пользователей после полноценного запуска Astra.
Источники: OpenAI.