OpenAI представила GPT-6 Astra — новую модель с упором на работу с компьютером, программирование, исследования и многошаговые задачи. Компания описывает Astra фразой: «всё, что вы можете сделать на компьютере, Astra может сделать за вас».
Сейчас OpenAI открывает доступ ограниченному числу организаций. Компания планирует расширять доступ в ближайшие дни, но пока не уточнила полный список тарифов, регионов и пользователей, которые получат модель первыми.
Читайте также: Как сделать своего ИИ-агента в ChatGPT
Нейросеть GPT-6 Astra — что умеет и как работает
Главное изменение связано с computer use — Astra может самостоятельно работать с программами и сайтами. Модель перемещается между веб-страницами, заполняет формы и работает с таблицами. OpenAI также заявляет об улучшениях в программировании, исследованиях и сложных задачах из нескольких последовательных действий.
В ChatGPT Astra может готовить документы, таблицы и презентации по шаблонам и инструкциям пользователя. Если пользователь меняет требования во время работы, модель может учитывать новые условия и продолжать задачу.
Такой сценарий меняет роль модели в работе с компьютером. Пользователь может поручить ей последовательность действий целиком — например, обработать данные в таблице и подготовить на их основе документ — вместо отдельных запросов на каждом этапе.
Бенчмарки GPT-6 Astra
GPT-6 Astra обошла GPT-5.6 Sol и Claude Fable 5.1 в большинстве опубликованных OpenAI тестов. Модель лучше справляется с работой в интерфейсах и длинными агентными задачами: на OSWorld V2-Offline она получила 72,6% против 65,7% у Sol, а среднее время выполнения задания сократилось примерно с 75 до 40 минут.

Astra также показала сильные результаты в программировании, научных задачах и работе с инструментами — 74,1% на DeepSWE, 95,9% на BenchCAD и 97,6% на FrontierMath Tier 4. В Terminal-Bench Science и AutomationBench она опередила Fable 5.1, а на Terminal-Bench 4.0 разрыв между ними оказался небольшим — 57,9% против 55,8%.
Самый большой отрыв OpenAI показывает на ARC-AGI-3, где Astra набрала почти 100%, тогда как Sol — 7,8%; результата Fable 5.1 в таблице нет. При этом такие цифры нельзя считать универсальным рейтингом моделей: часть тестов использует разные инструменты и конфигурации запуска, а в ARC-AGI-3 OpenAI запускала Astra через собственную агентную инфраструктуру.
Какие ограничения добавила OpenAI?
OpenAI встроила дополнительный мониторинг действий Astra. Система проверяет ситуации, в которых модель могла неверно понять инструкцию пользователя. В таком случае ChatGPT может приостановить или остановить работу, чтобы пользователь проверил действия и решил, продолжать ли задачу.
Отдельное внимание компания уделяет кибербезопасности. Astra стала первой моделью OpenAI, которая достигла уровня Critical по кибервозможностям в Preparedness Framework. По оценке OpenAI, при наличии нужных инструментов и доступа модель способна находить ранее неизвестные уязвимости и разрабатывать способы их эксплуатации в защищённых системах. Из-за этого компания усилила ограничения, мониторинг и защиту вокруг модели.
Почему это важно? Раньше пользователь мог обращаться к ИИ за кодом, текстом или инструкцией, а затем самостоятельно выполнять часть действий в программах. Astra рассчитана на сценарий, где модель получает задачу и выполняет связанные этапы через доступные ей инструменты.
Для рабочих задач это означает более длинные цепочки действий внутри одного запроса: модель может работать с файлами, таблицами, документами и веб-интерфейсами и учитывать изменения требований по ходу выполнения. При этом доступ к самой Astra пока ограничен, поэтому проверить эти сценарии смогут не все пользователи.
Итог: GPT-6 Astra переводит часть работы с ИИ от генерации результата к выполнению многошаговых задач на компьютере, но OpenAI пока разворачивает модель только для ограниченной группы организаций.