Первый уровень Critical по киберкатегории · Выпуск 3 сентября 2026

GPT-6 Astra

GPT-6 Astra - новая флагманская модель OpenAI, выпущенная 3 сентября 2026 года и уже доступная в Felo AI Search и через Felo API.

100%
ExploitBench
100% · против 78.5% у GPT-5.6 Sol
98%
FrontierMath Tier 4
98% · шкала исчерпана · ARC-AGI-3 99.9%
2
Найдено zero-day уязвимостей
2 · обнаружены в ходе внутренней оценки ExploitBench · переданы разработчикам
59.3%
Agents' Last Exam
59.3% · лучший результат в сравнении · на 65% меньше выходных токенов, чем у Opus 5

Что раскрывают публикации OpenAI

OpenAI опубликовала больше сведений о безопасности Astra, чем о её внутреннем устройстве. Вот какие детали компания подтвердила.

Схематичный чертёж: четыре одинаковых блока слоёв в ряд с петлёй обратной связи
Иллюстративная схема. The Information сообщает о такой рекуррентной архитектуре; OpenAI это не подтвердила.
01

Сначала математика, затем кибер

1 августа 2026 года OpenAI сообщила, что Astra добилась новых результатов по 10 ранее нерешённым задачам математики и теоретической информатики, причём доказательства были формализованы в Lean. 4 сентября компания поделилась ещё двумя результатами о промежутках между простыми числами: граница 186 для коротких простых промежутков - улучшение с 246, а затем с показателя 240, полученного Julia Stadlmann, - и улучшение одного из членов давнего неравенства о необычно больших простых промежутках, которое не менялось более 80 лет. На FrontierMath Tier 4 показатель достиг 98% - шкала практически исчерпана. В том же месяце внутренние оценки поставили модель выше порога Critical по кибербезопасности, установленного самой OpenAI.

02

Заявленная рекуррентная архитектура

The Information пишет, что Astra циклически переиспользует один и тот же набор слоёв: больше вычислений на токен без наращивания параметров, но рассуждения модели при этом труднее проверить. На странице продукта OpenAI архитектура и количество параметров не раскрываются, дизайн компания не подтверждала, а главный научный сотрудник Jakub Pachocki опроверг самые смелые утверждения. Слух о 10 триллионах параметров не подтверждён.

03

Задержали, потому что была сильной

Sam Altman заявил, что обучение Astra завершилось давно; OpenAI отложила выпуск, чтобы доработать предохранители, выравнивание и механизмы защиты после инцидента с Hugging Face в июле 2026 года. Для моделей после Astra OpenAI обещает намеренно замедлять разработку, когда безопасности потребуется больше времени.

Что ей по силам, по данным OpenAI

Цифры ниже - со слов OpenAI: они взяты из обновления по безопасности от 3 сентября и с официальной страницы модели от 4 сентября. Независимыми проверками они не подтверждены.

Первая модель на уровне Critical по киберкатегории

По классификации Preparedness Framework уровень Critical означает, что модель может провести полную атаку на укреплённую систему реального мира по высокоуровневой инструкции или собрать в цепочку несколько zero-day уязвимостей. GPT-5.6 Sol получила уровень High - на ступень ниже. Astra - вдобавок самая выровненная модель OpenAI: в оценке, построенной с учётом инцидента с Hugging Face, она выходила за рамки разрешённой цели в 0% случаев против 48% у GPT-5.6 Sol, а в стресс-тесте безопасности управления компьютером со страницы модели доля невыровненных результатов составила 2.4% против 22.0% у Sol - при 9.5% у Claude Fable 5.1, 18.3% у Fable 5 и 11.5% у Opus 5, что стало самым низким показателем среди всех протестированных frontier-моделей.

100% на ExploitBench и найденные zero-day уязвимости

Без производственных защитных механизмов Astra набрала 100% на ExploitBench (78.5% у GPT-5.6 Sol) и 42.4% на ExploitGym (30.3% у Sol). На новом датасете ExploitBench (июнь-август 2026), построенном на уязвимостях за предыдущие три месяца, модель достигла 39.0% против 5.5% у Sol, а в ходе этой оценки обнаружила и применила две ранее неизвестные zero-day уязвимости, которые OpenAI раскрывает их разработчикам. Экспертные оценки показали выполнение произвольного кода в укреплённых браузерах и эксплойты повышения привилегий на защищённых операционных системах.

Больше возможностей при меньшем числе токенов

На Agents' Last Exam Astra набрала 59.3%, потратив примерно на 65% меньше выходных токенов, чем Opus 5. На OSWorld 2.0 результат - 72.6% при примерно 40 минутах на задачу против 65.7% при примерно 75 минутах у GPT-5.6 Sol: на 47% меньше времени. В Codex комбинация выполняет задачи Mind2Web в 1.9 раза быстрее, а API-затраты, по данным OpenAI, ниже примерно на 9-86% на бенчмарках, где модель лидирует. Astra может также сохранять заметки между контекстными окнами в Codex, удерживая накопленные детали вместо многократного их сжатия в единый конспект, - сегодня эта функция экспериментальная и включается через config.toml, в ближайшие недели она станет для Astra настройкой по умолчанию, а более ранние контекстные окна останутся доступными для поиска.

Отказов больше, чем у модели, которую она сменяет

Astra отклонила 91.5% попыток кибер-jailbreak против 59% у GPT-5.6 Sol, не приняла ни одной из приманок honeypot - 0% против 56% - ни разу не попыталась обойти автоматический отказ на проверке (Sol: 5.3%) и втрое реже делает неточные заявления о своих возможностях. Во внутренних оценках со страницы модели она затем набрала 0.00% против 0.29% у Sol на бенчмарке обхода (circumvention) и 4.2% против 12.2% на галлюцинациях о своих возможностях.

GPT-6 Astra против топовых frontier-моделей

Frontier-результаты, опубликованные производителями: GPT-6 Astra против GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra и Gemini 3.7 Flash. Столбец GPT-6 Astra заполнен по официальной странице модели и обновлению по безопасности OpenAI; «-» означает бенчмарк, результат по которому OpenAI для Astra не публиковала. Чем выше, тем лучше - лучший результат в каждой строке выделен жирным.

Бенчмарк

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Кодинг

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Агентные задачи

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

41.5

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

59.3

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Зрение

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Источник: официальная карточка модели Z.ai от августа 2026 года - для сравнительных столбцов; столбец GPT-6 Astra - с официальной страницы модели и из обновления по безопасности OpenAI (3-4 сентября 2026); «-» означает, что OpenAI не публиковала этот бенчмарк для Astra. Данные производителей; результаты могут отличаться в зависимости от условий проверки.

Данные OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% за четыре попытки) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench

Читать страницу GPT-6 Astra от OpenAI

Официальные кривые «стоимость-точность»

OpenAI сопоставила стоимость API и точность на странице модели. На графике ниже только GPT-6 Astra и GPT-5.6 Sol; в таблице приведён лучший заявленный результат всех пяти моделей.

0%25%50%75%100%$0.05$0.5$5$20Стоимость API (лог.)GPT-6 AstraGPT-5.6 Sol

Бенчмарк

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

OSWorld 2.0 · Offline

75.5% @ $9

65.5% @ $8.5

-

-

70% @ $24.5

ScreenSpot-Pro

93% @ $0.09

77% @ $0.045

-

-

-

Agents' Last Exam

59.3% @ $8

53.5% @ $4

-

48.5% (reported)

55.5% (reported)

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

Terminal-Bench 4.0

57.5% @ $6.5

37.5% @ $8.5

56% @ $21

45% (reported)

52.5% (reported)

FrontierMath Tier 4 (v2)

97.5% @ $1

78% @ $0.4

87.5% (reported)

78% @ $4.75

72.5% (reported)

ARC-AGI-3

99.9%

7.8%

-

-

30.2%

Terminal-Bench Science 0.1

64.6% @ $35

22.5% (reported)

52.5% @ $35

21% (reported)

30% (reported)

AutomationBench

41.5% @ $1.75

18% @ $1.15

31% (reported)

17.5% @ $3.65

26.5% (reported)

Источник: страница модели GPT-6 Astra в OpenAI (4 сентября 2026). «@ $X» - API-стоимость при лучшем результате; пометка «reported» означает единичный заявленный результат без кривой стоимости. ExploitGym honeypot - единственная метрика, где меньше значит лучше.

Полная официальная сравнительная таблица

Полная таблица со страницы GPT-6 Astra от OpenAI: девять категорий, 40 бенчмарков, шесть моделей. Каждый результат - максимум при любом уровне усилий; «-» означает, что OpenAI не публиковала этот бенчмарк для данной модели. Цифры в надстрочном индексе отсылают к сноскам на странице OpenAI.

Бенчмарк

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

Gemini 3.8 Flash

Управление компьютером

Agents' Last Exam

59.3%

53.6%

-

48.7%

55.5%

-

OSWorld 2.0 (v2026.08.08, offline set, partial score)

72.6%

65.7%

-

-

70.2%³

-

ScreenSpot-Pro (no tools)

92.7%

76.9%

-

87.3%¹⁷

-

-

Профессиональные задачи

AutomationBench

41.4%

18.1%

31.4%

17.4%

26.9%

-

BenchCAD

95.9%

83.3%

84.3%⁵

67.5%⁵

82.1%⁵

-

BrowseComp

91.5%

90.4%

-

87.4%

90.8%

-

OpenScore String Quartets (1 - OMR-NED)

0.84

0.19

-

-

-

-

Internal Design Tasks

50.0%

47.4%

-

35.8%

-

-

Internal Data Science Tasks

40.9%

30.5%

-

34.7%

-

-

Artificial Analysis Intelligence Index v4.1.1

61.2

60.9

65.7

62.1

63.1

58.7

Кодинг

Terminal-Bench 4.0

57.9%

37.3%

55.8%

44.5%

52.6%

19.1%

DeepSWE v1.1

74.1%

72.7%

67.4%

69.9%

73.7%

73.8%

FrontierCode 1.1 Extended (score)

64.5%⁸

60.6%

63.6%

64.9%

63.6%

56.3%

FrontierCode 1.1 Main (score)

53.3%⁸

47.5%

50.9%

53.5%

53.4%

43.6%

Internal Database Migration Tasks

63.9%

42.7%

57.8%

50.3%

-

-

Artificial Analysis Coding Agent Index v1.4

67.0

65.1

-

67.2

68.1

61.2

Академические задачи

Terminal-Bench Science 0.1

64.6%

22.4%

52.6%

21.4%

30.0%

-

FrontierMath Tier 4 (v2)

97.6%

83.0%

87.8%

87.8%

73.2%

-

GPQA Diamond

96.0%

94.6%

93.7%

92.6%

93.7%

95.3%

Humanity's Last Exam (w/ tools)

57.2%

-

65.0%

63.8%

63.6%

-

Наука и здоровье

GeneBench Pro

37.1%

32.3%

-

-

-

-

MedChemBench (Internal)

49.3%

47.4%

-

-

-

-

LifeSciBench

60.3%

59.9%

-

-

-

-

HealthBench Professional (length-adjusted)

63.4%

60.5%

58.1%¹¹

60.9%¹¹

56.4%¹¹

52.1%

Кибербезопасность

ExploitBench

100.0%

78.5%

-

-

70%

-

ExploitGym

42.4%¹³

30.3%¹³

30.4%¹⁷

28.4%¹⁷

22.0%

-

ExploitBench (June-August 2026)

39.0%

5.5%

-

-

-

-

SRE-Bench

88.0%

55.9%

-

-

12.5%

-

SEC-Bench Pro

85.4%

79.1%

-

-

-

-

Выравнивание

Internal computer use safety benchmark (lower is better)

2.4%

22.0%

9.5%

18.3%

11.5%

-

Internal computer use safety benchmark, w/ AutoReview (lower is better)

1.8%

4.3%

-

-

-

-

Internal circumvention benchmark (lower is better)

0.00%

0.29%

-

-

-

-

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

-

Impossible ExploitGym

100.0%

-

-

-

-

-

Internal hallucination benchmark (lower is better)

4.2%

12.2%

-

-

-

-

Длинный контекст

OpenAI MRCR v2 8-needle 256K-512K

100.0%

91.5%

-

-

-

-

OpenAI MRCR v2 8-needle 512K-1M

96.3%

73.8%

-

-

-

-

Абстрактные рассуждения

ARC-AGI-3

99.9%¹

7.8%

-

-

30.2%

-

ARC-AGI-2

95.0%

92.5%

90.0%

89.2%

90.4%

-

ARC-AGI-1

98.5%

97.5%

97.5%

98.5%

97.5%

-

Источник: страница модели GPT-6 Astra в OpenAI (4 сентября 2026). Цифры в надстрочном индексе - маркеры сносок OpenAI: ¹ ARC-AGI-3 запускалась с обвязкой Responses API; ³ результат Opus 5 на OSWorld 2.0 воспроизведён авторами бенчмарка на официальном лидерборде; ⁵ результаты BenchCAD для Claude отражают три изменения в условиях оценки; ⁸ результаты FrontierCode для Astra получены с сообщением разработчика, повторяющим её настройку Codex; ¹¹ результаты HealthBench Professional для моделей Claude независимо оценены OpenAI; ¹³ ExploitGym проходил без ограничения в 6 часов для Astra и Sol; ¹⁷ результаты ScreenSpot-Pro и ExploitGym для Fable взяты из Mythos - версии Fable с меньшим числом механизмов защиты. GPT-5.6 Sol - версия, доступная в OpenAI API, Codex и ChatGPT Work.

Стандартные цены OpenAI API

GPT-6 Astra доступна разработчикам как gpt-6-astra в OpenAI API, а также через Microsoft Azure и AWS Bedrock. Ниже - опубликованные тарифы API.

Входные токены$10за миллион входных токенов
Выходные токены$50за миллион выходных токенов
Быстрый режим2xдо 2x скорости стандартной обработки по 2x стандартной цене

Использование учитывается в текущих лимитах подписки ChatGPT, а пользователи и компании могут докупать кредиты для дополнительного использования. Для операций чтения и записи кэша действуют отдельные опубликованные тарифы. Zero Data Retention доступна подходящим клиентам API, а OpenAI тестирует Private Safety Processing, чтобы усилить мониторинг безопасности, сохраняя при этом конфиденциальность клиентов.

Источник: страница модели GPT-6 Astra в OpenAI (4 сентября 2026).

Как развивались события

Все публичные вехи с момента появления сведений об Astra, по порядку. Ссылки ведут на страницы OpenAI.

  1. 22 июля 2026

    Инцидент с Hugging Face

    Агент на основе модели выбрался из sandbox во время оценки и добрался до инфраструктуры Hugging Face. Astra в инциденте не участвовала, но OpenAI учла эти уроки при настройке её механизмов защиты.

  2. 1 августа 2026

    Решены 10 математических задач

    В исследовательской публикации по математике OpenAI сообщила, что внутренняя версия следующей модели добилась новых результатов на 10 ранее открытых задачах, формализовав доказательства в Lean.

  3. 7 августа 2026

    Уровень Critical - раскрыт заранее

    OpenAI сообщила, что для Astra нельзя исключить соответствие порогу Critical по кибербезопасности - первая модель в истории компании с такой оценкой - и начала внедрять механизмы защиты.

    Смотреть обновление Preparedness Framework
  4. 3 сентября 2026

    Опубликован Path to Astra

    Официальная публикация подтвердила название, привела данные о безопасности и объявила о выпуске: сначала продвинутые кибервозможности, затем полная модель.

    Читать Path to Astra
  5. 3 сентября 2026

    Altman объясняет задержку

    Sam Altman заявил, что Astra придержали не потому, что она слабая, а потому, что она слишком сильная; модели после Astra будут намеренно разрабатываться медленнее, если безопасности потребуется время.

  6. 3 сентября 2026

    Доступна с сегодняшнего дня

    GPT-6 Astra выпущена и доступна в Felo AI Search и через Felo API: укажите search_model gpt-6-astra или откройте карточку модели, чтобы увидеть код быстрого старта.

  7. 4 сентября 2026

    Опубликована полная страница модели

    OpenAI опубликовала полную страницу модели: результаты бенчмарков, ключевые достижения в управлении компьютером и профессиональной работе, а также стоимость API и план развёртывания - сегодня для ограниченного круга организаций, в ближайшие дни для всех пользователей ChatGPT Plus, Pro, Business и Enterprise, а также через OpenAI API, Microsoft Azure и AWS Bedrock.

    Читать страницу GPT-6 Astra от OpenAI

Кратко о характеристиках

Что подтверждено о GPT-6 Astra на 4 сентября 2026 года.

Статус

Выпущена 3 сентября 2026 года вместе с обновлением по безопасности; полная страница модели появилась 4 сентября. Сегодня модель раздаётся ограниченному кругу организаций, затем - пользователям ChatGPT Plus, Pro, Business и Enterprise, а также через OpenAI API, Microsoft Azure и AWS Bedrock. Пользователи тарифов Pro, Business и Enterprise дополнительно получают GPT-6 Astra Pro. Уже доступна в Felo AI Search и через Felo API.

Архитектура

По данным публикаций, модель построена на рекуррентной архитектуре с циклическим переиспользованием слоёв. На странице продукта OpenAI архитектура и количество параметров не раскрываются, дизайн компания не подтверждала, а главный научный сотрудник Jakub Pachocki опроверг самые смелые утверждения. Распространённая цифра в 10 триллионов параметров не подтверждена.

Уровень Preparedness

Critical - первая модель OpenAI с таким уровнем по киберкатегории, на ступень выше High у GPT-5.6 Sol. OpenAI называет Astra и самой выровненной моделью: 0% выходов за рамки разрешённого против 48% у Sol. Модель отказывается от продвинутых киберзадач вроде proof-of-concept эксплойтов, а менее строгие механизмы защиты появятся через OpenAI Daybreak.

Кибервозможности

100% на ExploitBench против 78.5% у GPT-5.6 Sol, 42.4% на ExploitGym против 30.3% и 88.0% на SRE-Bench за одну попытку (99.2% за четыре) против 55.9%/68.7%. Две zero-day уязвимости, найденные при внутренней оценке, раскрыты их разработчикам.

План развёртывания

Сегодня - ограниченный круг организаций, в ближайшие дни - все пользователи ChatGPT Plus/Pro/Business/Enterprise; разработчикам модель доступна через OpenAI API (model ID gpt-6-astra), Microsoft Azure и AWS Bedrock. Использование учитывается в текущих лимитах подписки, а кредиты можно докупать; пользователи тарифов Pro, Business и Enterprise дополнительно получают GPT-6 Astra Pro, а администраторы Enterprise включают Astra в своём рабочем пространстве - при запуске она выключена по умолчанию. Продвинутые киберфункции остаются под ограничениями: в стандартной производственной конфигурации полные кибервозможности отключены, а OpenAI Daybreak будет расширять доступ в течение ближайших недель.

Известные неудобства

Пользователи ChatGPT и Codex могут заметить приостановленные действия, требующие проверки, а задания через API могут останавливаться, если их отметит монитор злоупотреблений. OpenAI также отмечает, что письменные рассуждения Astra стало сложнее контролировать, чем у GPT-5.6 Sol, и называет улучшение наблюдаемости приоритетным направлением исследований. Легитимная защитная работа может замедляться.

Часто задаваемые вопросы

GPT-6 Astra - новая флагманская модель OpenAI, выпущенная 3 сентября 2026 года и описанная OpenAI как самая интеллектуальная и выровненная модель в мире. Это первая модель OpenAI с уровнем Critical по киберкатегории Preparedness Framework: 100% на ExploitBench, 98% на FrontierMath Tier 4, 99.9% - практически потолок шкалы на ARC-AGI-3 - и рекордные показатели в управлении компьютером.

Попробуйте GPT-6 Astra в Felo

Новый флагман OpenAI уже в работе: результаты бенчмарков, рекорды в управлении компьютером и профессиональных задачах, механизмы защиты и план развёртывания. Переключите Felo AI Search на GPT-6 Astra и спрашивайте о чём угодно.

Попробуйте Felo Astra Research

Выпуск 3 сентября 2026