GPT-6 Astra, представленная OpenAI 3 сентября 2026 года, важна не столько очередным приростом качества ответов, сколько изменением самой модели взаимодействия с искусственным интеллектом. Astra умеет не только рассуждать и генерировать текст или код, но и самостоятельно выполнять многошаговые задачи через браузер, терминал и графические интерфейсы.

Пользователь может поставить цель, а модель сама разбивает её на этапы, открывает нужные инструменты, работает с интерфейсами, проверяет результат и продолжает выполнение. Это приближает ChatGPT к управляемому цифровому исполнителю. Но полноценной заменой человеку Astra пока не стала: критические действия, доступ к инструментам и потенциально опасные операции ограничены системами безопасности и контролем пользователя.

Релиз
3 сентября 2026
OSWorld 2.0
72,6%
ARC-AGI-3
99,9%
API
$10 / $50

Что именно выпустила OpenAI

OpenAI позиционирует GPT-6 Astra как свою наиболее интеллектуальную и наиболее aligned-модель. Релиз состоялся 3 сентября 2026 года, первоначально с ограниченной доступностью для организаций. Затем OpenAI начала расширять доступ к Astra для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также через API, Microsoft Azure и AWS Bedrock.

В линейке представлены GPT-6 Astra и GPT-6 Astra Pro. Стандартная версия предназначена для широкого набора сценариев, а Pro ориентирована на пользователей с повышенными требованиями к производительности и доступу к продвинутым возможностям.

В API модель доступна под идентификатором gpt-6-astra. Для полноценного tool calling OpenAI рекомендует Responses API. Standard-тариф заявлен на уровне 10 долларов за миллион входных токенов и 50 долларов за миллион выходных. Fast mode работает быстрее, но стоит дороже.

Особенно важны новые механизмы для долгих задач: асинхронные вызовы инструментов, передача дополнительных инструкций во время выполнения и изменение уровня reasoning без потери контекста. Это превращает модель из генератора отдельных ответов в ядро длительного процесса автоматизации.

Почему Astra отличается от обычного ChatGPT

Обычный чат с ИИ в основном работает по схеме «запрос — ответ». Даже если модель имеет доступ к инструментам, пользователю часто приходится самостоятельно открывать сайты, переносить данные, запускать программы, проверять результат и возвращаться с дополнительными инструкциями.

Astra меняет эту схему. Пользователь может поставить цель вроде: «Собери данные о конкурентах, занеси их в таблицу, подготовь краткую презентацию и проверь, что все ссылки работают». После этого модель способна самостоятельно пройти через последовательность действий, используя доступные инструменты.

ЭтапЧто делает Astra
ПланированиеРазбивает цель на последовательность действий
ResearchИщет и анализирует информацию через доступные инструменты
Computer useРаботает с интерфейсами, окнами, сайтами и приложениями
СозданиеГотовит код, документы, таблицы, презентации и веб-проекты
ПроверкаТестирует результат и ищет ошибки
ИтерацияПродолжает работу после промежуточных результатов и уточнений

Computer use — главный скачок

Ключевая возможность Astra — computer use. Модель может воспринимать состояние интерфейса и взаимодействовать с ним: нажимать элементы, вводить текст, переключаться между окнами и адаптироваться к изменениям на экране.

OpenAI показывает сценарии с заполнением онлайн-форм, обновлением CRM, организацией календаря, браузерным research, подготовкой документов, созданием сайтов и веб-приложений, frontend QA, установкой и тестированием программ и диагностикой проблем.

Это принципиально отличается от модели, которая просто объясняет пользователю, что нужно нажать. Astra получает возможность сама пройти часть пути от инструкции до результата.

Что Astra уже умеет делать

Список сценариев показывает, что OpenAI пытается использовать Astra как универсальный слой автоматизации поверх существующего ПО. Модель может работать с браузером, терминалом, редакторами и другими инструментами, если среда предоставляет ей соответствующие возможности.

В разработке Astra способна создавать и изменять код, запускать тесты, искать ошибки и работать с длинными инженерными задачами. В Codex она может сохранять заметки между окнами контекста, находить старые требования и результаты тестов и продолжать работу над проектом.

В ChatGPT функция Sites позволяет по запросу создавать, размещать и делиться сайтами, веб-приложениями и играми. Это уже не просто генерация исходного кода: ценность заключается в сокращении количества ручных действий между идеей и работающим результатом.

Что показывают benchmark-тесты

Benchmark-тесты показывают не универсальное превосходство Astra во всех возможных задачах, а особенно заметный рост в агентных, компьютерных и инженерных сценариях. OpenAI сравнивает модель с предыдущим поколением GPT-5.6 Sol, используя различные исследовательские конфигурации.

ТестGPT-6 AstraGPT-5.6 SolЧто измеряет
ARC-AGI-399,9%7,8%Абстрактное решение новых задач
FrontierMath Tier 497,6%83,0%Сложные математические задачи
ExploitBench100%78,5%Кибербезопасностные задачи
Terminal-Bench 4.057,9%37,3%Инженерные задачи в терминале
OSWorld 2.072,6%65,7%Работа с графическими интерфейсами
AutomationBench41,4%18,1%Профессиональная автоматизация
ScreenSpot-Pro92,7%76,9%Понимание элементов интерфейса
Agents’ Last Exam59,3%53,6%Сложные агентные и профессиональные задачи

Наиболее интересен не один рекорд, а сочетание качества, скорости и эффективности. На OSWorld 2.0 Astra получила 72,6% против 65,7% у Sol и выполняла задачи значительно быстрее. В некоторых агентных сценариях OpenAI также сообщает о существенном сокращении количества используемых токенов.

При этом независимые оценки дают более умеренную картину. В Artificial Analysis Intelligence Index Astra находится близко к предыдущему поколению, а некоторые конкурирующие модели показывают более высокий результат. Это важная оговорка: Astra не стала безусловным лидером во всех типах reasoning.

Astra стала более автономной — но не полностью

Astra умеет планировать последовательность действий, использовать внешние инструменты, реагировать на изменения интерфейса и продолжать работу после промежуточных результатов. Это позволяет запускать длинные workflows, в которых модель не обязана получать отдельную инструкцию на каждый шаг.

Однако автономность ограничена несколькими уровнями контроля. Пользователь задаёт цель и полномочия, системные политики ограничивают доступ к сайтам и приложениям, а потенциально чувствительные действия могут требовать подтверждения.

Покупки, отправка сообщений, удаление данных, публикация и другие необратимые действия требуют дополнительных механизмов контроля. Если система считает операцию потенциально опасной или несанкционированной, выполнение может быть приостановлено.

Это принципиальная особенность агентного ИИ. Ошибка обычного чат-бота чаще всего означает неправильный текстовый ответ. Ошибка агента может изменить данные в CRM, удалить файл, отправить сообщение или опубликовать материал. Поэтому права доступа и аварийная остановка становятся частью самого продукта.

Почему OpenAI назвала Astra Critical по кибербезопасности

OpenAI впервые присвоила модели уровень Critical по Preparedness Framework. Это означает, что при наличии подходящих инструментов Astra демонстрирует способности, которые компания считает достаточно сильными для потенциально серьёзных рисков в кибербезопасности.

В экспертных тестах OpenAI сообщает об обнаружении и эксплуатации ранее неизвестных уязвимостей, построении сложных цепочек компрометации и высоких результатах на специализированных benchmark-тестах. Эти результаты показывают, что агентный coding выходит далеко за рамки обычного написания кода.

При этом такие возможности не означают, что обычный пользователь получает свободный доступ к опасным сценариям. Production-версия использует дополнительные ограничения, мониторинг, изоляцию и проверки, а потенциально вредоносные запросы могут блокироваться.

Daybreak Blue: отдельный режим для защитников

Daybreak Blue — специализированная конфигурация программы OpenAI Daybreak для проверенных специалистов и ограниченной группы тестировщиков. Она предназначена прежде всего для defensive workflows: анализа уязвимостей, проверки исправлений, malware analysis и detection engineering.

Важно не смешивать результаты Daybreak Blue с обычной production-версией ChatGPT. Это отдельная среда с другими условиями и предназначением, поэтому её возможности нельзя автоматически считать доступными каждому пользователю Astra.

Главный новый риск — мониторинг самого агента

OpenAI сообщает, что Astra лучше соблюдает ограничения и реже получает серьёзные misalignment-флаги в симуляциях автономных Codex-задач. Однако одновременно компания отмечает проблему: по мере роста интеллектуальности становится сложнее надёжно контролировать внутренний процесс принятия решений модели.

Это создаёт своеобразный парадокс. Чем лучше агент понимает задачу, тем меньше ему требуется пошаговых инструкций. Но чем меньше человеческого контроля на каждом этапе, тем важнее возможность быстро определить, что агент отклонился от цели или пытается выполнить нежелательное действие.

Astra против конкурентов

В опубликованных OpenAI тестах Astra показывает сильные результаты в OSWorld, AutomationBench, Terminal-Bench и ARC-AGI-3. Однако независимые оценки показывают более конкурентную картину: отдельные модели Anthropic, Google и других разработчиков сохраняют преимущества в некоторых задачах reasoning, research и общей интеллектуальной оценке.

Поэтому главным преимуществом Astra выглядит не абсолютный результат отдельного benchmark-теста, а комбинация reasoning, computer use, coding, browsing и длительных workflows в одном агентном цикле.

Что Astra может изменить для бизнеса

Если агент способен работать с существующими программами через интерфейс, бизнесу не обязательно ждать отдельную AI-интеграцию для каждого сервиса. Модель потенциально может стать универсальным слоем автоматизации поверх уже используемого ПО.

СфераПотенциальный сценарий
РазработкаНаписание, отладка, тестирование и миграция кода
МаркетингResearch, сбор данных и подготовка материалов
АналитикаСбор информации, обработка данных и регулярные отчёты
Customer SupportРабота с CRM и обработка типовых обращений
Офисная работаТаблицы, документы, презентации и календарь
Веб-автоматизацияРабота с сайтами и формами без отдельной интеграции
Создание ПОПрототипирование сайтов, приложений и внутренних инструментов

Под потенциальным давлением могут оказаться сервисы, значительная часть ценности которых связана с ручным переносом данных: простые CRM-инструменты, form automation, некоторые task managers, презентационные сервисы и отдельные low-code продукты.

Но Astra не обязательно будет напрямую заменять эти продукты. Более вероятный сценарий — появление универсального AI-слоя, который сможет управлять множеством SaaS-систем вместо пользователя. При этом бизнесу всё равно понадобятся права доступа, аудит действий, надёжность, юридическая ответственность и специализированные интеграции.

А что насчёт AGI?

OpenAI описывает Astra как большой шаг в развитии ИИ и переход к новой модели взаимодействия с компьютерами. Однако называть Astra достигшей AGI было бы некорректно.

AGI не имеет единого общепринятого определения, а benchmark-тесты не могут сами по себе доказать наличие универсального интеллекта. Astra всё ещё зависит от инструментов, ограничений среды, прав доступа и человеческого контроля.

Гораздо точнее говорить о другом сдвиге: ChatGPT постепенно перестаёт быть исключительно собеседником. Astra показывает модель, в которой ИИ получает цель, самостоятельно выполняет последовательность действий и возвращается к пользователю уже с результатом.

Почему GPT-6 Astra действительно важна

Главное в Astra — не очередные проценты в benchmark-тестах. Её значение раскрывается в связке возможностей: reasoning помогает спланировать работу, computer use позволяет взаимодействовать с интерфейсом, coding даёт возможность создавать и изменять программы, а агентная архитектура позволяет соединить всё это в один длительный workflow.

Раньше пользователь мог попросить ИИ написать код, получить инструкцию или подготовить таблицу, а затем сам выполнял следующие шаги. Теперь всё больше этих действий может переходить непосредственно к модели.

Именно поэтому Astra может оказаться важнее предыдущих обновлений даже без абсолютного лидерства во всех benchmark-тестах. Она меняет не только качество ответа, но и единицу работы: вместо отдельного запроса пользователь начинает передавать ИИ целую задачу.

Итог

GPT-6 Astra — это шаг от ИИ, который преимущественно отвечает, к ИИ, который способен действовать. Модель может работать с браузером, программами и терминалом, создавать код и документы, проводить research, тестировать результат и продолжать длинные задачи после промежуточных изменений.

При этом Astra пока не является полностью автономным цифровым сотрудником. Права доступа, подтверждения, системные политики и мониторинг ограничивают действия модели, особенно когда они могут быть необратимыми или опасными.

Но направление уже очевидно. Если предыдущие поколения делали ИИ более умным собеседником, Astra делает его более способным исполнителем. И именно этот переход может оказаться гораздо важнее очередного скачка в качестве текста.