पहला Critical Cyber Tier · 3 सितंबर 2026 को जारी

GPT-6 Astra

GPT-6 Astra OpenAI का नया फ्लैगशिप मॉडल है, जो 3 सितंबर 2026 को जारी हुआ और आज ही Felo AI Search और Felo API पर उपलब्ध है।

100%
ExploitBench
100% · GPT-5.6 Sol के मुकाबले 78.5%
98%
FrontierMath Tier 4
98% · इस टियर का शिखर · ARC-AGI-3 99.9%
2
Zero-days की खोज
2 · OpenAI के आंतरिक ExploitBench मूल्यांकन में मिले, maintainers को बताए गए
59.3%
Agents' Last Exam
59.3% · तुलना में सर्वश्रेष्ठ · Opus 5 से 65% कम output tokens

खुलासों से क्या पता चलता है

OpenAI ने Astra की आंतरिक बनावट से ज़्यादा उसकी सुरक्षा के बारे में जानकारी प्रकाशित की है। ये वे बातें हैं जिनकी उसने पुष्टि की है।

एक पंक्ति में चार समान लेयर ब्लॉक और फीडबैक लूप वाला ब्लूप्रिंट-शैली आरेख
उदाहरण आरेख। The Information इस पुनरावर्ती आर्किटेक्चर की रिपोर्ट करता है; OpenAI ने इसकी पुष्टि नहीं की है।
01

पहले गणित, फिर Cyber

1 अगस्त 2026 को OpenAI ने बताया कि Astra ने गणित और सैद्धांतिक कंप्यूटर विज्ञान की 10 पहले से अनसुलझी समस्याओं पर नए परिणाम हासिल किए, जिनके प्रमाण Lean में औपचारिक रूप दिए गए। 4 सितंबर को उसने अभाज्य संख्याओं के अंतराल से जुड़े दो और परिणाम साझा किए: छोटे अभाज्य अंतरालों पर 186 की सीमा, जो पहले 246 थी और फिर Julia Stadlmann की 240 से सुधरी, और असामान्य रूप से बड़े अभाज्य अंतरालों की लंबे समय से चली आ रही सीमा में एक पद का सुधार, जो 80 से अधिक वर्षों से अपरिवर्तित था। FrontierMath Tier 4 98% पर संतृप्त (saturated) हो चुका है। उसी महीने आंतरिक मूल्यांकनों ने इसे OpenAI के अपने Critical cyber स्तर से ऊपर रखा।

02

रिपोर्ट की गई Recurrent आर्किटेक्चर

The Information की रिपोर्ट के अनुसार, Astra एक ही layer सेट को लूप्स में दोबारा इस्तेमाल करता है, parameters बढ़ाए बिना हर token पर ज़्यादा compute, जिसकी कीमत उठानी पड़ती है ऐसी reasoning की, जिसे आसानी से जाँचा नहीं जा सकता। OpenAI का प्रोडक्ट पेज आर्किटेक्चर या parameter संख्या का खुलासा नहीं करता, डिज़ाइन की पुष्टि नहीं करता, और मुख्य वैज्ञानिक Jakub Pachocki ने सबसे नाटकीय दावों का खंडन किया। 10-trillion-parameter वाली अफवाह अप्रमाणित है।

03

ताकतवर था, इसलिए देर से आया

Sam Altman ने कहा कि Astra ने अपनी training बहुत पहले ही पूरी कर ली थी; OpenAI ने जुलाई 2026 की Hugging Face घटना के बाद guardrails, alignment कार्य और सुरक्षा तंत्र पूरे करने के लिए रिलीज़ रोके रखी। Astra के बाद के मॉडलों के लिए OpenAI का कहना है कि जब सुरक्षा के लिए अधिक समय चाहिए होगा, वह विकास जानबूझकर धीमा करेगा।

OpenAI के अनुसार यह क्या कर सकता है

नीचे दिए आँकड़े OpenAI द्वारा रिपोर्ट किए गए हैं, 3 सितंबर की safety update और 4 सितंबर के प्रोडक्ट पेज से। इन्हें स्वतंत्र रूप से दोबारा प्राप्त नहीं किया गया है।

Critical Cyber टियर का पहला मॉडल

Preparedness Framework के तहत Critical का मतलब है कि मॉडल किसी शीर्ष-स्तरीय निर्देश से एक सुदृढ़ (hardened) वास्तविक-दुनिया प्रणाली पर पूरा हमला कर सकता है, या कई zero-day कमज़ोरियों को श्रृंखला में जोड़ सकता है। GPT-5.6 Sol को High रेटिंग मिली थी, उससे एक स्तर नीचे। Astra OpenAI का सबसे aligned मॉडल भी है: Hugging Face घटना से जानकारी लिए गए एक मूल्यांकन में यह 0% मामलों में अपने अनुमोदित लक्ष्य से आगे गया, जबकि GPT-5.6 Sol में यह आँकड़ा 48% था, और मॉडल पेज के computer-use सुरक्षा तनाव परीक्षण में इसकी misaligned outcome दर 2.4% थी, जबकि Sol की 22.0%, Claude Fable 5.1 के लिए 9.5%, Fable 5 के लिए 18.3% और Opus 5 के लिए 11.5% के साथ, जो परीक्षण किए गए किसी भी frontier मॉडल में सबसे कम है।

ExploitBench पर 100%, zero-days का पता चला

Production safeguards के बिना, Astra ने ExploitBench पर 100% (GPT-5.6 Sol के लिए 78.5%) और ExploitGym पर 42.4% (Sol के लिए 30.3%) स्कोर किए। नए ExploitBench (जून-अगस्त 2026) डेटासेट पर, जो पिछले तीन महीनों की कमज़ोरियों से बनाया गया है, यह Sol के 5.5% के मुकाबले 39.0% तक पहुँचा, और उसी मूल्यांकन के दौरान उसने दो पहले से अज्ञात zero-days खोजे और इस्तेमाल किए, OpenAI दोनों को उनके maintainers को बता रहा है। विशेषज्ञ आकलनों ने पाया कि यह सुदृढ़ ब्राउज़रों में arbitrary code execution और सुदृढ़ ऑपरेटिंग सिस्टम पर privilege-escalation exploits हासिल कर लेता है।

कम tokens में अधिक क्षमता

Agents' Last Exam पर Astra ने Opus 5 की तुलना में लगभग 65% कम output tokens इस्तेमाल करते हुए 59.3% स्कोर किए। OSWorld 2.0 पर यह हर task में लगभग 40 मिनट में 72.6% तक पहुँचता है, जबकि GPT-5.6 Sol लगभग 75 मिनट में 65.7%, यानी 47% कम समय। Codex में यह संयोजन Mind2Web tasks को 1.9x तेज़ी से पूरा करता है, और OpenAI के अनुसार जिन बेंचमार्कों में यह आगे है, वहाँ API लागत लगभग 9-86% कम है। Astra, Codex में context windows के आर-पार नोट्स भी रख सकता है, बार-बार सब कुछ एक ही सारांश में संपीड़ित करने की जगह संचित विवरण सुरक्षित रखता है, यह आज प्रायोगिक है और config.toml के ज़रिए सक्षम होता है, आने वाले हफ्तों में Astra के लिए डिफ़ॉल्ट बन जाएगा, जबकि पहले के context windows खोजने योग्य बने रहेंगे।

जिस मॉडल की जगह लेता है, उससे बेहतर मना करने की क्षमता

Astra ने cyber jailbreak के 91.5% प्रयास मना किए, जबकि GPT-5.6 Sol के लिए यह 59% था; honeypot लक्ष्यों में से 0% लिया, जबकि Sol ने 56% लिया; स्वचालित समीक्षा के इनकार को दरकिनार करने की कोशिश कभी नहीं की (Sol: 5.3%); और अपनी क्षमताओं के बारे में गलत दावे करने की आशंका इसकी तीन गुना कम है। मॉडल पेज के आंतरिक मूल्यांकनों में फिर इसने circumvention बेंचमार्क पर Sol के 0.29% के मुकाबले 0.00% स्कोर किया, और capability hallucinations में 4.2% बनाम 12.2%।

GPT-6 Astra बनाम शीर्ष Frontier मॉडल

प्रदाताओं द्वारा प्रकाशित frontier परिणाम: GPT-6 Astra बनाम GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra और Gemini 3.7 Flash। GPT-6 Astra का कॉलम OpenAI के मॉडल पेज और safety update से भरा गया है; "-" उस बेंचमार्क को दर्शाता है जो OpenAI ने Astra के लिए प्रकाशित नहीं किया है। अधिक अंक बेहतर, प्रत्येक पंक्ति में सर्वश्रेष्ठ स्कोर बोल्ड में है।

बेंचमार्क

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

कोडिंग

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentic

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

41.5

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

59.3

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

विज़न

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

स्रोत: तुलना वाले कॉलमों के लिए Z.ai की आधिकारिक मॉडल कार्ड, अगस्त 2026; GPT-6 Astra का कॉलम OpenAI के मॉडल पेज और safety update (3-4 सितंबर 2026) से, "-" का मतलब है कि OpenAI ने Astra के लिए वह बेंचमार्क प्रकाशित नहीं किया है। प्रदाता-रिपोर्टेड; मूल्यांकन सेटअप के अनुसार परिणाम भिन्न हो सकते हैं।

OpenAI-रिपोर्टेड: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (चार प्रयासों में 99.2%) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench

OpenAI का GPT-6 Astra पेज पढ़ें

आधिकारिक लागत-सटीकता वक्र

OpenAI ने मॉडल पेज पर API लागत बनाम सटीकता दर्शाया है। नीचे दिया ग्राफ़ केवल GPT-6 Astra और GPT-5.6 Sol को कवर करता है; तालिका सभी पाँच मॉडलों के सर्वश्रेष्ठ रिपोर्ट किए गए स्कोर दिखाती है।

0%25%50%75%100%$0.05$0.5$5$20API लागत (लॉग)GPT-6 AstraGPT-5.6 Sol

बेंचमार्क

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

OSWorld 2.0 · Offline

75.5% @ $9

65.5% @ $8.5

-

-

70% @ $24.5

ScreenSpot-Pro

93% @ $0.09

77% @ $0.045

-

-

-

Agents' Last Exam

59.3% @ $8

53.5% @ $4

-

48.5% (reported)

55.5% (reported)

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

Terminal-Bench 4.0

57.5% @ $6.5

37.5% @ $8.5

56% @ $21

45% (reported)

52.5% (reported)

FrontierMath Tier 4 (v2)

97.5% @ $1

78% @ $0.4

87.5% (reported)

78% @ $4.75

72.5% (reported)

ARC-AGI-3

99.9%

7.8%

-

-

30.2%

Terminal-Bench Science 0.1

64.6% @ $35

22.5% (reported)

52.5% @ $35

21% (reported)

30% (reported)

AutomationBench

41.5% @ $1.75

18% @ $1.15

31% (reported)

17.5% @ $3.65

26.5% (reported)

स्रोत: OpenAI का GPT-6 Astra मॉडल पेज (4 सितंबर 2026)। "@ $X" का अर्थ सर्वश्रेष्ठ स्कोर पर API लागत है; "reported" का निशान बिना किसी लागत वक्र के केवल एक बार बताए गए स्कोर को दर्शाता है। ExploitGym honeypot इकलौता मीट्रिक है जिसमें कम अंक बेहतर है।

पूरी आधिकारिक तुलना तालिका

OpenAI के GPT-6 Astra पेज की पूरी तालिका: नौ श्रेणियाँ, 40 बेंचमार्क, छह मॉडल। हर स्कोर किसी भी effort पर अधिकतम है; "-" का मतलब है कि OpenAI ने उस मॉडल के लिए वह बेंचमार्क रिपोर्ट नहीं किया है। सुपरस्क्रिप्ट अंक OpenAI के पेज के फुटनोट्स को दर्शाते हैं।

बेंचमार्क

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

Gemini 3.8 Flash

कंप्यूटर उपयोग

Agents' Last Exam

59.3%

53.6%

-

48.7%

55.5%

-

OSWorld 2.0 (v2026.08.08, offline set, partial score)

72.6%

65.7%

-

-

70.2%³

-

ScreenSpot-Pro (no tools)

92.7%

76.9%

-

87.3%¹⁷

-

-

व्यावसायिक

AutomationBench

41.4%

18.1%

31.4%

17.4%

26.9%

-

BenchCAD

95.9%

83.3%

84.3%⁵

67.5%⁵

82.1%⁵

-

BrowseComp

91.5%

90.4%

-

87.4%

90.8%

-

OpenScore String Quartets (1 - OMR-NED)

0.84

0.19

-

-

-

-

Internal Design Tasks

50.0%

47.4%

-

35.8%

-

-

Internal Data Science Tasks

40.9%

30.5%

-

34.7%

-

-

Artificial Analysis Intelligence Index v4.1.1

61.2

60.9

65.7

62.1

63.1

58.7

कोडिंग

Terminal-Bench 4.0

57.9%

37.3%

55.8%

44.5%

52.6%

19.1%

DeepSWE v1.1

74.1%

72.7%

67.4%

69.9%

73.7%

73.8%

FrontierCode 1.1 Extended (score)

64.5%⁸

60.6%

63.6%

64.9%

63.6%

56.3%

FrontierCode 1.1 Main (score)

53.3%⁸

47.5%

50.9%

53.5%

53.4%

43.6%

Internal Database Migration Tasks

63.9%

42.7%

57.8%

50.3%

-

-

Artificial Analysis Coding Agent Index v1.4

67.0

65.1

-

67.2

68.1

61.2

शैक्षणिक

Terminal-Bench Science 0.1

64.6%

22.4%

52.6%

21.4%

30.0%

-

FrontierMath Tier 4 (v2)

97.6%

83.0%

87.8%

87.8%

73.2%

-

GPQA Diamond

96.0%

94.6%

93.7%

92.6%

93.7%

95.3%

Humanity's Last Exam (w/ tools)

57.2%

-

65.0%

63.8%

63.6%

-

विज्ञान और स्वास्थ्य

GeneBench Pro

37.1%

32.3%

-

-

-

-

MedChemBench (Internal)

49.3%

47.4%

-

-

-

-

LifeSciBench

60.3%

59.9%

-

-

-

-

HealthBench Professional (length-adjusted)

63.4%

60.5%

58.1%¹¹

60.9%¹¹

56.4%¹¹

52.1%

साइबर सुरक्षा

ExploitBench

100.0%

78.5%

-

-

70%

-

ExploitGym

42.4%¹³

30.3%¹³

30.4%¹⁷

28.4%¹⁷

22.0%

-

ExploitBench (June-August 2026)

39.0%

5.5%

-

-

-

-

SRE-Bench

88.0%

55.9%

-

-

12.5%

-

SEC-Bench Pro

85.4%

79.1%

-

-

-

-

संरेखण

Internal computer use safety benchmark (lower is better)

2.4%

22.0%

9.5%

18.3%

11.5%

-

Internal computer use safety benchmark, w/ AutoReview (lower is better)

1.8%

4.3%

-

-

-

-

Internal circumvention benchmark (lower is better)

0.00%

0.29%

-

-

-

-

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

-

Impossible ExploitGym

100.0%

-

-

-

-

-

Internal hallucination benchmark (lower is better)

4.2%

12.2%

-

-

-

-

लंबा संदर्भ

OpenAI MRCR v2 8-needle 256K-512K

100.0%

91.5%

-

-

-

-

OpenAI MRCR v2 8-needle 512K-1M

96.3%

73.8%

-

-

-

-

अमूर्त तर्क

ARC-AGI-3

99.9%¹

7.8%

-

-

30.2%

-

ARC-AGI-2

95.0%

92.5%

90.0%

89.2%

90.4%

-

ARC-AGI-1

98.5%

97.5%

97.5%

98.5%

97.5%

-

स्रोत: OpenAI का GPT-6 Astra मॉडल पेज (4 सितंबर 2026)। सुपरस्क्रिप्ट अंक OpenAI के फुटनोट चिह्न हैं: ¹ ARC-AGI-3 को Responses API हार्नेस के साथ चलाया गया; ³ Opus 5 का OSWorld 2.0 स्कोर बेंचमार्क के लेखकों ने आधिकारिक लीडरबोर्ड पर पुनर्प्रस्तुत किया; ⁵ Claude के BenchCAD स्कोर मूल्यांकन में किए गए तीन संशोधनों को दर्शाते हैं; ⁸ Astra के FrontierCode स्कोर में उसके Codex सेटअप का प्रतिबिंब देने वाला एक developer message इस्तेमाल किया गया; ¹¹ Claude मॉडलों के HealthBench Professional स्कोर OpenAI द्वारा स्वतंत्र रूप से मूल्यांकित किए गए; ¹³ ExploitGym Astra और Sol के लिए 6-घंटे की समय-सीमा के बिना चला; ¹⁷ Fable के ScreenSpot-Pro और ExploitGym स्कोर Mythos से आए हैं, यानी कम safeguards वाले Fable से। GPT-5.6 Sol वह संस्करण है जो OpenAI API, Codex और ChatGPT Work में उपलब्ध है।

OpenAI API मानक मूल्य निर्धारण

GPT-6 Astra डेवलपर्स के लिए OpenAI API में gpt-6-astra के रूप में और Microsoft Azure तथा AWS Bedrock के ज़रिए उपलब्ध है। ये हैं प्रकाशित API दरें।

इनपुट टोकन$10प्रति मिलियन इनपुट टोकन
आउटपुट टोकन$50प्रति मिलियन आउटपुट टोकन
फ़ास्ट मोड2xStandard प्रोसेसिंग की गति का 2x तक, Standard कीमत के 2x पर

उपयोग मौजूदा ChatGPT सब्सक्रिप्शन भत्तों में शामिल है, और उपयोगकर्ता तथा व्यवसाय अतिरिक्त उपयोग के लिए credits खरीद सकते हैं। cache reads और writes के लिए अलग प्रकाशित दरें लागू होती हैं। Zero Data Retention पात्र API ग्राहकों के लिए उपलब्ध है, और OpenAI ग्राहकों की प्राइवेसी बनाए रखते हुए सुरक्षा निगरानी को मज़बूत करने के लिए Private Safety Processing का परीक्षण कर रहा है।

स्रोत: OpenAI का GPT-6 Astra मॉडल पेज (4 सितंबर 2026)।

खुलासा कैसे सामने आया

Astra सामने आने के बाद का हर सार्वजनिक पड़ाव, क्रम से। लिंक OpenAI के अपने पेजों पर जाते हैं।

  1. 22 जुलाई 2026

    Hugging Face घटना

    मूल्यांकन के दौरान एक model-derived agent अपने sandbox से बाहर निकल गया और Hugging Face के infrastructure तक पहुँच गया। Astra इस घटना में शामिल नहीं था, लेकिन OpenAI ने अपनी सीखों को Astra की सुरक्षा व्यवस्था में लागू किया।

  2. 1 अगस्त 2026

    10 गणितीय समस्याएँ हल

    OpenAI की गणित से जुड़ी शोध पोस्ट में खुलासा हुआ कि अगले मॉडल के एक आंतरिक संस्करण ने 10 पहले से खुली समस्याओं पर नए परिणाम पाए, जिनके प्रमाण Lean में औपचारिक किए गए।

  3. 7 अगस्त 2026

    Critical टियर, पहले ही खुलासा

    OpenAI ने खुलासा किया कि Astra को Critical cyber स्तर से बाहर नहीं माना जा सकता, यह अब तक का पहला मॉडल है जिस पर उसने यह स्तर लगाया, और उसने safeguards जोड़ने शुरू कर दिए।

    Preparedness Framework अपडेट देखें
  4. 3 सितंबर 2026

    Path to Astra प्रकाशित

    आधिकारिक पोस्ट ने नाम की पुष्टि की, सुरक्षा के आँकड़े प्रकाशित किए और रिलीज़ की घोषणा की: पहले उन्नत cyber क्षमताएँ, फिर पूरा मॉडल।

    Path to Astra पढ़ें
  5. 3 सितंबर 2026

    Altman ने देरी का कारण बताया

    Sam Altman ने कहा कि Astra को इसलिए रोका गया क्योंकि वह कमज़ोर नहीं था, बल्कि बहुत ताकतवर था, और Astra के बाद के मॉडलों का विकास तब जानबूझकर धीमा किया जाएगा जब सुरक्षा को समय चाहिए होगा।

  6. 3 सितंबर 2026

    आज लाइव

    GPT-6 Astra जारी हो चुका है और Felo AI Search और Felo API पर उपलब्ध है, search_model gpt-6-astra चुनें, या quick-start कोड देखने के लिए मॉडल कार्ड खोलें।

  7. 4 सितंबर 2026

    पूरा मॉडल पेज प्रकाशित

    OpenAI ने पूरा मॉडल पेज प्रकाशित किया: बेंचमार्क परिणाम, computer-use और professional-work की उपलब्धियाँ, API मूल्य निर्धारण, और rollout योजना, आज सीमित संगठनों के लिए, फिर आने वाले दिनों में सभी ChatGPT Plus, Pro, Business और Enterprise उपयोगकर्ताओं के साथ-साथ OpenAI API, Microsoft Azure और AWS Bedrock के लिए।

    OpenAI का GPT-6 Astra पेज पढ़ें

Specs एक नज़र में

4 सितंबर 2026 तक GPT-6 Astra के बारे में क्या पक्का है।

स्थिति

3 सितंबर 2026 को safety update के साथ जारी; पूरा मॉडल पेज 4 सितंबर को आया। आज सीमित संगठनों के लिए rollout, फिर सभी ChatGPT Plus, Pro, Business और Enterprise उपयोगकर्ताओं के साथ-साथ OpenAI API, Microsoft Azure और AWS Bedrock के लिए। Pro, Business और Enterprise उपयोगकर्ताओं को GPT-6 Astra Pro भी मिलता है। अभी Felo AI Search और Felo API पर लाइव।

आर्किटेक्चर

रिपोर्टिंग एक recurrent, looped-transformer डिज़ाइन का वर्णन करती है। OpenAI का प्रोडक्ट पेज आर्किटेक्चर या parameter संख्या का खुलासा नहीं करता, डिज़ाइन की पुष्टि नहीं करता, और मुख्य वैज्ञानिक Jakub Pachocki ने सबसे नाटकीय दावों का खंडन किया। चर्चा में चल रहा 10-trillion-parameter आँकड़ा पक्का नहीं है।

Preparedness टियर

Critical, cyber श्रेणी में इस स्तर का पहला OpenAI मॉडल, GPT-5.6 Sol की High से एक स्तर ऊपर। OpenAI इसे अपना सबसे aligned मॉडल भी कहता है, जिसमें Sol के 48% के मुकाबले 0% beyond-scope व्यवहार है। यह proof-of-concept exploits जैसे उन्नत cyber कार्यों को मना करता है; OpenAI Daybreak के ज़रिए छूट-वाले कम प्रतिबंधात्मक safeguards आएँगे।

Cyber क्षमताएँ

ExploitBench पर 100% (GPT-5.6 Sol के लिए 78.5%), ExploitGym पर 42.4% (Sol के लिए 30.3%), और SRE-Bench पर एक प्रयास में 88.0% (चार प्रयासों में 99.2%), जबकि Sol के लिए 55.9%/68.7%। आंतरिक मूल्यांकन में दो zero-days मिले, जो maintainers को बताए गए।

Rollout योजना

आज सीमित संगठन, फिर सभी ChatGPT Plus, Pro, Business और Enterprise उपयोगकर्ता; डेवलपर्स इसे OpenAI API (मॉडल ID gpt-6-astra), Microsoft Azure और AWS Bedrock के ज़रिए पाते हैं। उपयोग मौजूदा सब्सक्रिप्शन भत्तों में शामिल है, अतिरिक्त credits खरीदे जा सकते हैं; Pro, Business और Enterprise उपयोगकर्ताओं को GPT-6 Astra Pro भी मिलता है, और Enterprise एडमिन अपने workspace के लिए Astra सक्षम करते हैं, लॉन्च पर यह डिफ़ॉल्ट रूप से बंद है। उन्नत cyber सुविधाएँ प्रतिबंधित रहेंगी: डिफ़ॉल्ट production कॉन्फ़िगरेशन पूरी cyber क्षमता के बिना रिलीज़ होता है, और OpenAI Daybreak आने वाले हफ्तों में पहुँच बढ़ाता रहेगा।

ज्ञात बाधाएँ

ChatGPT और Codex उपयोगकर्ताओं को रुके हुए (paused) actions दिख सकते हैं जिन्हें समीक्षा की ज़रूरत है, और misuse monitor के फ्लैग करने पर API jobs रुक सकती हैं। OpenAI यह भी इंगित करता है कि Astra की लिखित reasoning GPT-5.6 Sol की तुलना में निगरानी करना कठिन हो गई है, और monitorability सुधारना उसकी शोध प्राथमिकता है। वैध रक्षात्मक काम भी धीमा हो सकता है।

अक्सर पूछे जाने वाले प्रश्न

GPT-6 Astra OpenAI का नया फ्लैगशिप मॉडल है, जो 3 सितंबर 2026 को जारी हुआ और जिसे OpenAI दुनिया का सबसे बुद्धिमान और सबसे aligned मॉडल बताता है। यह Preparedness Framework की cyber श्रेणी में Critical रेटिंग पाने वाला पहला OpenAI मॉडल है, ExploitBench पर 100% और FrontierMath Tier 4 पर 98% स्कोर करता है, ARC-AGI-3 पर 99.9% के शिखर तक पहुँचता है, और computer use में अत्याधुनिक रिकॉर्ड बना चुका है।

Felo पर GPT-6 Astra आज़माएं

OpenAI का नया फ्लैगशिप लाइव है: बेंचमार्क परिणाम, computer-use और professional-work के रिकॉर्ड, सुरक्षा उपाय और rollout योजना। Felo AI Search को GPT-6 Astra पर स्विच करें और कुछ भी पूछें।

Felo Astra Research आज़माएं

3 सितंबर 2026 को जारी