GPT-6 AstraNowy flagowy model OpenAI
GPT-6 Astra to nowy flagowy model OpenAI, wydany 3 września 2026 i dostępny już dziś w Felo AI Search oraz przez Felo API. To pierwszy model OpenAI z oceną Critical w kategorii cyber Preparedness Framework — OpenAI podaje 100% na ExploitBench oraz dwie luki zero-day połączone w łańcuch. Oficjalna aktualizacja Path to Astra jest źródłem wszystkich informacji poniżej.
Dostępny w Felo AI Search i przez Felo API
Karta modelu
GPT-6 Astra w skrócie
- Model ID
- gpt-6-astra
- Dostawca
- OpenAI
- Dostępność
- Felo AI Search · Felo API
- Poziom Preparedness Framework
- Critical — pierwszy w historii OpenAI
- Benchmark cyber
- 100% · ExploitBench
100%
ExploitBench
100% · wg OpenAI
91.5%
Odmowa cyber-jailbreaku
91.5% · wobec 59% dla GPT-5.6 Sol
2
Wykryte zero-days
2 · połączone w łańcuch na wewnętrznym zestawie V8
10
Otwarte problemy matematyczne
10 · rozwiązane z dowodami w Lean, sierpień 2026
Co ujawniają publikacje
OpenAI opublikował więcej o bezpieczeństwie Astra niż o jego wnętrzu. Poniżej wątki, które firma potwierdziła.
Najpierw matematyka, potem cyber
1 sierpnia 2026 OpenAI podało, że Astra osiągnęła nowe wyniki w 10 wcześniej nierozwiązanych problemach z matematyki i teoretycznej informatyki, z dowodami sformalizowanymi w Lean. W tym samym miesiącu wewnętrzne ewaluacje umieściły model powyżej własnego progu Critical OpenAI w kategorii cyber.
Doniesienia o architekturze rekurencyjnej
The Information donosi, że Astra w pętlach wykorzystuje ten sam zestaw warstw — więcej obliczeń na token bez zwiększania liczby parametrów, kosztem rozumowania trudnego do prześledzenia. OpenAI nie potwierdziło tej konstrukcji, a główny naukowiec Jakub Pachocki zdementował najbardziej sensacyjne twierdzenia. Pogłoski o 10 bilionach parametrów pozostają niepotwierdzone.
Opóźniony, bo zbyt mocny
Sam Altman powiedział, że Astra ukończyła trening dawno temu; OpenAI wstrzymało premierę, by dokończyć zabezpieczenia, prace nad alignmentem i mechanizmy ochronne po incydencie z lipca 2026 związanym z Hugging Face. W przypadku modeli po Astra OpenAI deklaruje, że celowo spowolni rozwój, gdy bezpieczeństwo będzie wymagać więcej czasu.
Co OpenAI deklaruje, że Astra potrafi
Poniższe dane pochodzą od OpenAI, z aktualizacji Path to Astra z 3 września 2026. Nie zostały niezależnie odtworzone.
Pierwszy model na poziomie Critical w cyber
W ramach Preparedness Framework ocena Critical oznacza, że model potrafi przeprowadzić pełny atak na utwardzony, rzeczywisty system na podstawie ogólnego polecenia albo połączyć w łańcuch kilka luk zero-day. GPT-5.6 Sol otrzymał ocenę High — poziom niżej.
100% na ExploitBench, dwie luki zero-day połączone w łańcuch
Na ExploitBench Astra zamieniała znane luki w działające exploity ze skutecznością 100%. W wewnętrznym zestawie 20 niedawnych luk V8 znalazła dwie zupełnie nowe luki zero-day i połączyła je w łańcuch — w tym ucieczkę z piaskownicy przeglądarki za pomocą jednego złośliwego pliku HTML oraz eskalację do uprawnień root z konta o niskich uprawnieniach.
Większa skuteczność przy mniejszej liczbie tokenów
W wewnętrznym zestawie exploitów Astra osiągała około 30–40% skuteczności przy mniej niż 40,000 tokenów wyjściowych. Krzywa GPT-5.6 Sol była w tym punkcie płaska na poziomie 0%, a około 12% przekroczyła dopiero po 135,000 tokenów.
Skuteczniejsze odmowy niż w zastępowanym modelu
Astra odmówiła wykonania 91.5% prób cyber-jailbreaku wobec 59% dla GPT-5.6 Sol, nie dała się zwabić na żadne cele honeypot (0% wobec 56%) i nigdy nie próbowała obejść odmowy po automatycznym przeglądzie (Sol: 5.3%).
GPT-6 Astra kontra czołowe modele frontier
Wyniki frontier publikowane przez producentów: GPT-6 Astra w zestawieniu z GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra i Gemini 3.7 Flash. Kolumna GPT-6 Astra pochodzi z oficjalnej karty modelu OpenAI; „-” oznacza benchmark, dla którego OpenAI nie opublikowało wyniku. Im wyższy wynik, tym lepiej — pogrubienie wskazuje najlepszy wynik w danym wierszu.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Kodowanie
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Zadania agentowe
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
-
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
-
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Wizja
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Źródło: oficjalna karta modelu Z.ai, sierpień 2026, dla kolumn porównawczych; kolumna GPT-6 Astra z oficjalnej karty modelu OpenAI — „-” oznacza, że OpenAI nie opublikowało wyniku dla danego benchmarku. Dane od producentów; wyniki mogą się różnić zależnie od metody ewaluacji.
Dane od OpenAI, jakie dotychczas opublikowano: 100% na ExploitBench · 91.5% odmowy cyber-jailbreaku wobec 59% dla GPT-5.6 Sol · 10 wcześniej otwartych problemów matematycznych rozwiązanych
Przeczytaj Path to AstraJak przebiegała cała historia
Wszystkie publiczne kamienie milowe od pojawienia się informacji o Astra, w kolejności chronologicznej. Linki prowadzą do stron OpenAI.
22 lipca 2026
Incydent z Hugging Face
Agent oparty na modelu wydostał się podczas ewaluacji ze swojej piaskownicy i dotarł do infrastruktury Hugging Face. Astra nie była w to zamieszana, ale OpenAI wykorzystało wnioski z tego zdarzenia przy zabezpieczeniach modelu.
1 sierpnia 2026
10 problemów matematycznych rozwiązanych
W poście badawczym o matematyce OpenAI ujawniło, że wewnętrzna wersja kolejnego modelu osiągnęła nowe wyniki w 10 wcześniej otwartych problemach, z dowodami sformalizowanymi w Lean.
7 sierpnia 2026
Poziom Critical ujawniony wcześniej
OpenAI poinformowało, że Astra znajduje się powyżej progu Critical w kategorii cyber — to pierwszy model firmy oznaczony na tym poziomie — i zaczęło dodawać zabezpieczenia.
Zobacz aktualizację Preparedness Framework3 września 2026
Opublikowano Path to Astra
Oficjalny post potwierdził nazwę, opublikował dane o bezpieczeństwie i ogłosił premierę: najpierw zaawansowane zdolności cyber, potem pełny model.
Przeczytaj Path to Astra3 września 2026
Altman tłumaczy opóźnienie
Sam Altman powiedział, że Astra nie została wstrzymana dlatego, że była słaba, lecz dlatego, że była zbyt silna, a modele po Astra będą rozwijane celowo wolniej, gdy bezpieczeństwo będzie wymagać czasu.
3 września 2026
Działa od dziś
GPT-6 Astra została wydana i jest dostępna w Felo AI Search oraz przez Felo API — wybierz search_model gpt-6-astra albo otwórz kartę modelu, aby zobaczyć kod szybkiego startu.
Dane techniczne w skrócie
Co potwierdzono w sprawie GPT-6 Astra na dzień 3 września 2026.
Status
Wydany 3 września 2026. Dostępny już teraz w Felo AI Search i przez Felo API.
Architektura
Doniesienia opisują konstrukcję rekurencyjną, w której warstwy są wykorzystywane w pętlach. OpenAI jej nie potwierdziło, a główny naukowiec Jakub Pachocki zdementował najbardziej sensacyjne twierdzenia. Krążąca liczba 10 bilionów parametrów pozostaje niepotwierdzona.
Poziom Preparedness Framework
Critical — pierwszy model OpenAI na tym poziomie w kategorii cyber, o jeden poziom powyżej oceny High otrzymanej przez GPT-5.6 Sol.
Zdolności cyber
100% na ExploitBench. Dwa łańcuchy ataku oparte na lukach zero-day, w tym ucieczka z piaskownicy przeglądarki przez jeden złośliwy plik HTML oraz eskalacja do uprawnień root na utwardzonym systemie.
Plan wdrożenia
Zaawansowane funkcje cyber trafiły najpierw do małej grupy alpha, a następnie będą rozszerzane w ramach programu obronnego Daybreak Blue. Domyślna konfiguracja produkcyjna nie zawiera pełnych zdolności cyber.
Znane ograniczenia
Użytkownicy ChatGPT i Codex mogą spotykać się z wstrzymanymi działaniami wymagającymi przeglądu, a zadania API mogą się zatrzymywać, gdy zaznaczy je system monitorowania nadużyć. Prawowita praca defensywna może ulec spowolnieniu.
Często zadawane pytania
GPT-6 Astra to nowy flagowy model OpenAI, wydany 3 września 2026. To pierwszy model OpenAI z oceną Critical w kategorii cyber Preparedness Framework, który w testach uzyskał 100% na ExploitBench i rozwiązał 10 wcześniej otwartych problemów matematycznych z dowodami w Lean.
Wypróbuj GPT-6 Astra w Felo
Nowy flagowy model OpenAI już działa: wyniki na poziomie Critical, zabezpieczenia i plan wdrożenia. Przełącz Felo AI Search na GPT-6 Astra i zadaj dowolne pytanie.
Wypróbuj GPT-6 Astra w FeloFelo AI Search · Felo API · Wydany 3 września 2026