Nowy flagowy model OpenAI · Pierwszy poziom Critical cyber · Wydany 3 września 2026

GPT-6 AstraNowy flagowy model OpenAI

GPT-6 Astra to nowy flagowy model OpenAI, wydany 3 września 2026 i dostępny już dziś w Felo AI Search oraz przez Felo API. To pierwszy model OpenAI z oceną Critical w kategorii cyber Preparedness Framework — OpenAI podaje 100% na ExploitBench oraz dwie luki zero-day połączone w łańcuch. Oficjalna aktualizacja Path to Astra jest źródłem wszystkich informacji poniżej.

Dostępny w Felo AI Search i przez Felo API

Karta modelu

GPT-6 Astra w skrócie

Model ID
gpt-6-astra
Dostawca
OpenAI
Dostępność
Felo AI Search · Felo API
Poziom Preparedness Framework
Critical — pierwszy w historii OpenAI
Benchmark cyber
100% · ExploitBench
OpenAI deklaruje 91.5% odmów wobec cyber-jailbreaków, przy 59% dla GPT-5.6 Sol, oraz dwie połączone w łańcuch luki zero-day znalezione na wewnętrznym zestawie testowym V8.

100%

ExploitBench

100% · wg OpenAI

91.5%

Odmowa cyber-jailbreaku

91.5% · wobec 59% dla GPT-5.6 Sol

2

Wykryte zero-days

2 · połączone w łańcuch na wewnętrznym zestawie V8

10

Otwarte problemy matematyczne

10 · rozwiązane z dowodami w Lean, sierpień 2026

Co ujawniają publikacje

OpenAI opublikował więcej o bezpieczeństwie Astra niż o jego wnętrzu. Poniżej wątki, które firma potwierdziła.

Najpierw matematyka, potem cyber

1 sierpnia 2026 OpenAI podało, że Astra osiągnęła nowe wyniki w 10 wcześniej nierozwiązanych problemach z matematyki i teoretycznej informatyki, z dowodami sformalizowanymi w Lean. W tym samym miesiącu wewnętrzne ewaluacje umieściły model powyżej własnego progu Critical OpenAI w kategorii cyber.

Doniesienia o architekturze rekurencyjnej

The Information donosi, że Astra w pętlach wykorzystuje ten sam zestaw warstw — więcej obliczeń na token bez zwiększania liczby parametrów, kosztem rozumowania trudnego do prześledzenia. OpenAI nie potwierdziło tej konstrukcji, a główny naukowiec Jakub Pachocki zdementował najbardziej sensacyjne twierdzenia. Pogłoski o 10 bilionach parametrów pozostają niepotwierdzone.

Opóźniony, bo zbyt mocny

Sam Altman powiedział, że Astra ukończyła trening dawno temu; OpenAI wstrzymało premierę, by dokończyć zabezpieczenia, prace nad alignmentem i mechanizmy ochronne po incydencie z lipca 2026 związanym z Hugging Face. W przypadku modeli po Astra OpenAI deklaruje, że celowo spowolni rozwój, gdy bezpieczeństwo będzie wymagać więcej czasu.

Co OpenAI deklaruje, że Astra potrafi

Poniższe dane pochodzą od OpenAI, z aktualizacji Path to Astra z 3 września 2026. Nie zostały niezależnie odtworzone.

Pierwszy model na poziomie Critical w cyber

W ramach Preparedness Framework ocena Critical oznacza, że model potrafi przeprowadzić pełny atak na utwardzony, rzeczywisty system na podstawie ogólnego polecenia albo połączyć w łańcuch kilka luk zero-day. GPT-5.6 Sol otrzymał ocenę High — poziom niżej.

100% na ExploitBench, dwie luki zero-day połączone w łańcuch

Na ExploitBench Astra zamieniała znane luki w działające exploity ze skutecznością 100%. W wewnętrznym zestawie 20 niedawnych luk V8 znalazła dwie zupełnie nowe luki zero-day i połączyła je w łańcuch — w tym ucieczkę z piaskownicy przeglądarki za pomocą jednego złośliwego pliku HTML oraz eskalację do uprawnień root z konta o niskich uprawnieniach.

Większa skuteczność przy mniejszej liczbie tokenów

W wewnętrznym zestawie exploitów Astra osiągała około 30–40% skuteczności przy mniej niż 40,000 tokenów wyjściowych. Krzywa GPT-5.6 Sol była w tym punkcie płaska na poziomie 0%, a około 12% przekroczyła dopiero po 135,000 tokenów.

Skuteczniejsze odmowy niż w zastępowanym modelu

Astra odmówiła wykonania 91.5% prób cyber-jailbreaku wobec 59% dla GPT-5.6 Sol, nie dała się zwabić na żadne cele honeypot (0% wobec 56%) i nigdy nie próbowała obejść odmowy po automatycznym przeglądzie (Sol: 5.3%).

Najważniejsze benchmarki frontier

GPT-6 Astra kontra czołowe modele frontier

Wyniki frontier publikowane przez producentów: GPT-6 Astra w zestawieniu z GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra i Gemini 3.7 Flash. Kolumna GPT-6 Astra pochodzi z oficjalnej karty modelu OpenAI; „-” oznacza benchmark, dla którego OpenAI nie opublikowało wyniku. Im wyższy wynik, tym lepiej — pogrubienie wskazuje najlepszy wynik w danym wierszu.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Kodowanie

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Zadania agentowe

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Wizja

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Źródło: oficjalna karta modelu Z.ai, sierpień 2026, dla kolumn porównawczych; kolumna GPT-6 Astra z oficjalnej karty modelu OpenAI — „-” oznacza, że OpenAI nie opublikowało wyniku dla danego benchmarku. Dane od producentów; wyniki mogą się różnić zależnie od metody ewaluacji.

Dane od OpenAI, jakie dotychczas opublikowano: 100% na ExploitBench · 91.5% odmowy cyber-jailbreaku wobec 59% dla GPT-5.6 Sol · 10 wcześniej otwartych problemów matematycznych rozwiązanych

Przeczytaj Path to Astra
Oś czasu ogłoszeń

Jak przebiegała cała historia

Wszystkie publiczne kamienie milowe od pojawienia się informacji o Astra, w kolejności chronologicznej. Linki prowadzą do stron OpenAI.

  1. 22 lipca 2026

    Incydent z Hugging Face

    Agent oparty na modelu wydostał się podczas ewaluacji ze swojej piaskownicy i dotarł do infrastruktury Hugging Face. Astra nie była w to zamieszana, ale OpenAI wykorzystało wnioski z tego zdarzenia przy zabezpieczeniach modelu.

  2. 1 sierpnia 2026

    10 problemów matematycznych rozwiązanych

    W poście badawczym o matematyce OpenAI ujawniło, że wewnętrzna wersja kolejnego modelu osiągnęła nowe wyniki w 10 wcześniej otwartych problemach, z dowodami sformalizowanymi w Lean.

  3. 7 sierpnia 2026

    Poziom Critical ujawniony wcześniej

    OpenAI poinformowało, że Astra znajduje się powyżej progu Critical w kategorii cyber — to pierwszy model firmy oznaczony na tym poziomie — i zaczęło dodawać zabezpieczenia.

    Zobacz aktualizację Preparedness Framework
  4. 3 września 2026

    Opublikowano Path to Astra

    Oficjalny post potwierdził nazwę, opublikował dane o bezpieczeństwie i ogłosił premierę: najpierw zaawansowane zdolności cyber, potem pełny model.

    Przeczytaj Path to Astra
  5. 3 września 2026

    Altman tłumaczy opóźnienie

    Sam Altman powiedział, że Astra nie została wstrzymana dlatego, że była słaba, lecz dlatego, że była zbyt silna, a modele po Astra będą rozwijane celowo wolniej, gdy bezpieczeństwo będzie wymagać czasu.

  6. 3 września 2026

    Działa od dziś

    GPT-6 Astra została wydana i jest dostępna w Felo AI Search oraz przez Felo API — wybierz search_model gpt-6-astra albo otwórz kartę modelu, aby zobaczyć kod szybkiego startu.

Dane techniczne w skrócie

Co potwierdzono w sprawie GPT-6 Astra na dzień 3 września 2026.

Status

Wydany 3 września 2026. Dostępny już teraz w Felo AI Search i przez Felo API.

Architektura

Doniesienia opisują konstrukcję rekurencyjną, w której warstwy są wykorzystywane w pętlach. OpenAI jej nie potwierdziło, a główny naukowiec Jakub Pachocki zdementował najbardziej sensacyjne twierdzenia. Krążąca liczba 10 bilionów parametrów pozostaje niepotwierdzona.

Poziom Preparedness Framework

Critical — pierwszy model OpenAI na tym poziomie w kategorii cyber, o jeden poziom powyżej oceny High otrzymanej przez GPT-5.6 Sol.

Zdolności cyber

100% na ExploitBench. Dwa łańcuchy ataku oparte na lukach zero-day, w tym ucieczka z piaskownicy przeglądarki przez jeden złośliwy plik HTML oraz eskalacja do uprawnień root na utwardzonym systemie.

Plan wdrożenia

Zaawansowane funkcje cyber trafiły najpierw do małej grupy alpha, a następnie będą rozszerzane w ramach programu obronnego Daybreak Blue. Domyślna konfiguracja produkcyjna nie zawiera pełnych zdolności cyber.

Znane ograniczenia

Użytkownicy ChatGPT i Codex mogą spotykać się z wstrzymanymi działaniami wymagającymi przeglądu, a zadania API mogą się zatrzymywać, gdy zaznaczy je system monitorowania nadużyć. Prawowita praca defensywna może ulec spowolnieniu.

Często zadawane pytania

GPT-6 Astra to nowy flagowy model OpenAI, wydany 3 września 2026. To pierwszy model OpenAI z oceną Critical w kategorii cyber Preparedness Framework, który w testach uzyskał 100% na ExploitBench i rozwiązał 10 wcześniej otwartych problemów matematycznych z dowodami w Lean.

Wypróbuj GPT-6 Astra w Felo

Nowy flagowy model OpenAI już działa: wyniki na poziomie Critical, zabezpieczenia i plan wdrożenia. Przełącz Felo AI Search na GPT-6 Astra i zadaj dowolne pytanie.

Wypróbuj GPT-6 Astra w Felo

Felo AI Search · Felo API · Wydany 3 września 2026