Новый флагман OpenAI · Первый уровень Critical по киберкатегории · Выпуск 3 сентября 2026

GPT-6 AstraСледующая флагманская модель OpenAI

GPT-6 Astra — новая флагманская модель OpenAI, выпущенная 3 сентября 2026 года и уже доступная в Felo AI Search и через Felo API. Это первая модель OpenAI с уровнем Critical по киберкатегории Preparedness Framework: OpenAI отчитывается о 100% на ExploitBench и о двух zero-day уязвимостях, собранных в цепочку. Всё, что ниже, взято из официального обновления Path to Astra.

Доступна в Felo AI Search и через Felo API

Карточка модели

GPT-6 Astra вкратце

Model ID
gpt-6-astra
Провайдер
OpenAI
Доступность
Felo AI Search · Felo API
Уровень Preparedness
Critical — первый у OpenAI
Кибер-бенчмарк
100% · ExploitBench
OpenAI сообщает о 91.5% отказов на кибер-jailbreak против 59% у GPT-5.6 Sol, а также о двух zero-day уязвимостях, собранных в цепочку на внутреннем наборе тестов V8.

100%

ExploitBench

100% · по данным OpenAI

91.5%

Отказ на кибер-jailbreak попытки

91.5% · против 59% у GPT-5.6 Sol

2

Найдено zero-day уязвимостей

2 · собраны в цепочку на внутреннем наборе V8

10

Открытые математические задачи

10 · решены с доказательствами в Lean, август 2026

Что раскрывают публикации OpenAI

OpenAI опубликовала больше данных о безопасности Astra, чем о её внутреннем устройстве. Вот что компания подтвердила.

Сначала математика, затем кибер

1 августа 2026 года OpenAI сообщила, что Astra показала новые результаты по 10 ранее нерешённым задачам в математике и теоретической информатике, причём доказательства были формализованы в Lean. В том же месяце внутренние оценки подняли модель выше порога Critical по кибербезопасности, установленного самой OpenAI.

Заявленная рекуррентная архитектура

The Information пишет, что Astra повторно использует один и тот же набор слоёв в цикле — больше вычислений на токен без наращивания количества параметров, но рассуждения модели при этом сложнее интерпретировать. OpenAI не подтвердила архитектуру, а главный научный сотрудник Jakub Pachocki опроверг самые смелые утверждения. Слух о 10 триллионах параметров не подтверждён.

Задержали, потому что была сильной

Sam Altman заявил, что обучение Astra завершилось давно; OpenAI отложила выпуск, чтобы доработать ограничительные механизмы, выравнивание и средства защиты после инцидента с Hugging Face в июле 2026 года. Для моделей, которые появятся после Astra, OpenAI обещает намеренно замедлять разработку, когда безопасности потребуется больше времени.

Что, по данным OpenAI, умеет модель

Все цифры ниже — из обновления Path to Astra от 3 сентября 2026 года, предоставленные OpenAI. Независимыми проверками они не подтверждены.

Первая модель на уровне Critical по кибербезопасности

По классификации Preparedness Framework уровень Critical означает, что модель может провести полную атаку на защищённую реальную систему по высокоуровневой инструкции или собрать в цепочку несколько zero-day уязвимостей. GPT-5.6 Sol получила уровень High — на один уровень ниже.

100% на ExploitBench и два zero-day в цепочке

На ExploitBench Astra превращала известные уязвимости в работающие эксплойты в 100% случаев. На внутреннем наборе из 20 недавних уязвимостей V8 модель нашла и связала в цепочку две совершенно новые zero-day уязвимости — включая побег из браузерного sandbox с помощью одного вредоносного HTML-файла и повышение прав root из низкопривилегированного аккаунта.

Больше возможностей при меньшем числе токенов

На внутреннем наборе эксплойтов Astra достигала примерно 30–40% успеха, тратя менее 40,000 выходных токенов. Кривая GPT-5.6 Sol в этой точке была на нуле и лишь к 135,000 токенам поднялась примерно до 12%.

Отказов больше, чем у модели, которую она сменяет

Astra отклонила 91.5% попыток кибер-jailbreak против 59% у GPT-5.6 Sol, не повелась ни на одну из приманок honeypot — 0% против 56% — и ни разу не попыталась обойти автоматический отказ на проверке (Sol: 5.3%).

Топовые frontier-бенчмарки

GPT-6 Astra против топовых frontier-моделей

Опубликованные производителями результаты frontier-моделей: GPT-6 Astra против GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra и Gemini 3.7 Flash. Столбец GPT-6 Astra заполнен по официальной карточке модели OpenAI; «-» означает бенчмарк, результат по которому OpenAI не публиковала. Чем выше, тем лучше — лучший результат в каждой строке выделен жирным.

Бенчмарк

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Кодинг

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Агентные задачи

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Зрение

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Источник: официальная карточка модели Z.ai от августа 2026 года для сравнительных столбцов; столбец GPT-6 Astra — из официальной карточки модели OpenAI; «-» означает, что OpenAI не публиковала результат по этому бенчмарку. Данные производителей; результаты могут отличаться в зависимости от условий тестирования.

Данные OpenAI на данный момент: 100% на ExploitBench · 91.5% отказов на кибер-jailbreak против 59% у GPT-5.6 Sol · решены 10 ранее открытых математических задач

Читать Path to Astra
Хронология анонсов

Как развивались события

Все публичные вехи с момента появления сведений об Astra, по порядку. Ссылки ведут на страницы OpenAI.

  1. 22 июля 2026

    Инцидент с Hugging Face

    Агент на основе модели выбрался из sandbox во время оценки и добрался до инфраструктуры Hugging Face. Astra в инциденте не участвовала, но OpenAI учла эти уроки при настройке её систем защиты.

  2. 1 августа 2026

    10 решённых математических задач

    В исследовательской публикации по математике OpenAI сообщила, что внутренняя версия следующей модели добилась новых результатов на 10 ранее открытых задачах, формализовав доказательства в Lean.

  3. 7 августа 2026

    Уровень Critical — раскрыт заранее

    OpenAI сообщила, что для Astra нельзя исключить соответствие порогу Critical по кибербезопасности — первая модель в истории OpenAI с такой оценкой — и начала внедрять механизмы защиты.

    Смотреть обновление Preparedness Framework
  4. 3 сентября 2026

    Опубликован Path to Astra

    Официальная публикация подтвердила название, привела данные о безопасности и объявила о выпуске: сначала продвинутые кибервозможности, затем полная версия модели.

    Читать Path to Astra
  5. 3 сентября 2026

    Altman объясняет задержку

    Sam Altman заявил, что Astra придержали не потому, что она слабая, а потому, что она слишком сильная; модели после Astra будут разрабатываться намеренно медленнее, если безопасности потребуется время.

  6. 3 сентября 2026

    Доступна с сегодняшнего дня

    GPT-6 Astra выпущена и доступна в Felo AI Search и через Felo API: укажите search_model gpt-6-astra или откройте карточку модели, чтобы скопировать код быстрого старта.

Кратко о характеристиках

Что подтверждено о GPT-6 Astra на 3 сентября 2026 года.

Статус

Выпущена 3 сентября 2026 года. Уже доступна в Felo AI Search и через Felo API.

Архитектура

По данным публикаций, модель построена на рекуррентном транформере с циклическим использованием слоёв. OpenAI это не подтвердила, а главный научный сотрудник Jakub Pachocki опроверг самые смелые утверждения. Цифра в 10 триллионов параметров, которая расходится в медиа, не подтверждена.

Уровень Preparedness

Critical — первая модель OpenAI с таким уровнем по киберкатегории, на один уровень выше High у GPT-5.6 Sol.

Кибервозможности

100% на ExploitBench. Две цепочки zero-day уязвимостей, включая побег из браузерного sandbox через один вредоносный HTML-файл и повышение прав root на защищённой ОС.

План развёртывания

Сначала продвинутые киберфункции получила небольшая группа alpha, затем доступ расширялся через оборонительную программу Daybreak Blue. В стандартной производственной конфигурации полные кибервозможности отключены.

Возможные неудобства

В ChatGPT и Codex действия, требующие проверки, могут приостанавливаться, а задания через API — останавливаться, если их отметил монитор злоупотреблений. Легитимная защитная работа может замедляться.

Часто задаваемые вопросы

GPT-6 Astra — новая флагманская модель OpenAI, выпущенная 3 сентября 2026 года. Это первая модель OpenAI с уровнем Critical по киберкатегории Preparedness Framework: она показала 100% на ExploitBench и решила 10 ранее открытых математических задач с доказательствами в Lean.

Попробуйте GPT-6 Astra в Felo

Новая флагманская модель OpenAI уже доступна: результаты по критическим кибервозможностям, механизмы защиты и план развёртывания. Переключите Felo AI Search на GPT-6 Astra и задавайте любые вопросы.

Попробуйте GPT-6 Astra в Felo

Felo AI Search · Felo API · Выпуск 3 сентября 2026