Cấp Critical an ninh mạng đầu tiên · Ra mắt ngày 3 tháng 9 năm 2026
GPT-6 Astra
GPT-6 Astra là mô hình chủ lực mới của OpenAI, phát hành ngày 3 tháng 9 năm 2026 và ngay hôm nay đã có mặt trên Felo AI Search cùng Felo API.
- 100%
- ExploitBench
- 100% · so với 78.5% của GPT-5.6 Sol
- 98%
- FrontierMath Tier 4
- 98% · chạm trần của tier · ARC-AGI-3 99.9%
- 2
- Lỗ hổng zero-day được phát hiện
- 2 · tìm thấy trong đợt đánh giá ExploitBench nội bộ của OpenAI, đã được tiết lộ cho nhà bảo trì
- 59.3%
- Agents' Last Exam
- 59.3% · cao nhất trong so sánh · ít hơn Opus 5 tới 65% token đầu ra
Những gì các công bố hé lộ
OpenAI công bố nhiều thông tin về độ an toàn của Astra hơn là về cấu trúc bên trong. Dưới đây là những điểm mà OpenAI đã xác nhận.

Toán học trước, an ninh mạng sau
Ngày 1 tháng 8 năm 2026, OpenAI công bố Astra đạt kết quả mới trên 10 bài toán từng chưa ai giải được trong toán học và khoa học máy tính lý thuyết, với các chứng minh được hình thức hóa bằng Lean. Ngày 4 tháng 9, hãng chia sẻ thêm hai kết quả về khoảng cách giữa các số nguyên tố: một chặn 186 cho các khoảng cách nguyên tố ngắn, được cải thiện từ 246, rồi từ mức 240 của Julia Stadlmann, cùng một cải thiện ở một hạng tử trong chặn tồn tại từ lâu về các khoảng cách nguyên tố lớn bất thường, vốn đã không thay đổi trong hơn 80 năm. FrontierMath Tier 4 đã chạm mức bão hòa ở 98%. Cùng tháng, các đánh giá nội bộ xếp mô hình vượt ngưỡng Critical về an ninh mạng của chính OpenAI.
Kiến trúc hồi quy theo báo cáo
The Information đưa tin Astra tái sử dụng cùng một bộ lớp trong các vòng lặp, cung cấp nhiều tính toán hơn cho mỗi token mà không chất đống thêm tham số, đổi lại là khả năng suy luận khó kiểm tra. Trang sản phẩm của OpenAI không công bố kiến trúc hay số lượng tham số, chưa xác nhận thiết kế này, và nhà khoa học trưởng Jakub Pachocki đã phản bác những tuyên bố giật gân nhất. Tin đồn về 10 nghìn tỷ tham số vẫn chưa được xác nhận.
Trì hoãn vì quá mạnh
Sam Altman cho biết Astra đã hoàn tất quá trình huấn luyện từ lâu; OpenAI giữ lại bản phát hành để hoàn thiện các thanh chắn, công tác alignment và các cơ chế bảo vệ sau sự cố Hugging Face tháng 7 năm 2026. Với các mô hình sau Astra, OpenAI cho biết sẽ cố tình làm chậm quá trình phát triển khi cần thêm thời gian cho độ an toàn.
Những gì OpenAI công bố mô hình có thể làm
Các con số dưới đây do OpenAI công bố, từ bản cập nhật an toàn ngày 3 tháng 9 và trang sản phẩm ngày 4 tháng 9. Chúng chưa được tái lập độc lập.
Mô hình đầu tiên đạt cấp Critical về an ninh mạng
Theo Preparedness Framework, cấp Critical nghĩa là mô hình có thể thực hiện một cuộc tấn công hoàn chỉnh vào một hệ thống thực tế được gia cố chỉ từ một chỉ thị cấp cao, hoặc nối chuỗi nhiều lỗ hổng zero-day. GPT-5.6 Sol được xếp cấp High, thấp hơn một bậc. Astra cũng là mô hình được căn chỉnh nhất của OpenAI: trong một đánh giá có tham chiếu sự cố Hugging Face, mô hình đi vượt ngoài mục tiêu được ủy quyền trong 0% trường hợp, so với 48% của GPT-5.6 Sol; và trong bài stress test an toàn thao tác máy tính trên trang mô hình, tỷ lệ kết quả lệch hướng của mô hình là 2.4% so với 22.0% của Sol, với Claude Fable 5.1 là 9.5%, Fable 5 là 18.3% và Opus 5 là 11.5%, mức thấp nhất trong mọi mô hình tiên phong được kiểm tra.
100% trên ExploitBench, tìm ra zero-day
Khi không có các lớp bảo vệ trong môi trường production, Astra đạt 100% trên ExploitBench (GPT-5.6 Sol: 78.5%) và 42.4% trên ExploitGym (Sol: 30.3%). Trên bộ dữ liệu ExploitBench mới (tháng 6-8 năm 2026), được xây dựng từ các lỗ hổng của ba tháng trước đó, mô hình đạt 39.0% so với 5.5% của Sol, và trong đợt đánh giá đó mô hình đã phát hiện và sử dụng hai zero-day chưa từng được biết, mà OpenAI đang tiết lộ cho nhà bảo trì của chúng. Các đánh giá của chuyên gia cho thấy mô hình đạt được việc thực thi mã tùy ý trên các trình duyệt được gia cố và các exploit leo thang đặc quyền trên hệ điều hành được gia cố.
Mạnh hơn với ít token hơn
Tại Agents' Last Exam, Astra đạt 59.3% khi dùng lượng token đầu ra ít hơn Opus 5 khoảng 65%. Trên OSWorld 2.0, mô hình chạm 72.6% trong khoảng 40 phút cho mỗi nhiệm vụ, so với 65.7% trong khoảng 75 phút của GPT-5.6 Sol, ít hơn 47% thời gian. Trong Codex, tổ hợp này hoàn tất các nhiệm vụ Mind2Web nhanh hơn 1.9x, và OpenAI công bố chi phí API thấp hơn khoảng 9-86% trên các benchmark mà mô hình dẫn đầu. Astra cũng có thể giữ các ghi chú xuyên suốt các cửa sổ ngữ cảnh trong Codex, bảo toàn các chi tiết tích lũy thay vì liên tục nén chúng thành một bản tóm tắt duy nhất, hiện đang ở dạng thử nghiệm và được bật qua config.toml, sẽ trở thành mặc định cho Astra trong những tuần tới, còn các cửa sổ ngữ cảnh trước đó vẫn có thể tìm kiếm được.
Từ chối mạnh hơn mô hình mà nó thay thế
Astra từ chối 91.5% các nỗ lực jailbreak an ninh mạng so với 59% của GPT-5.6 Sol, sa vào mục tiêu honeypot với tỷ lệ 0% so với 56%, chưa bao giờ cố vòng qua một lần từ chối của quy trình duyệt tự động (Sol: 5.3%), và khả năng đưa ra tuyên bố không chính xác về năng lực của chính mình thấp hơn ba lần. Trong các đánh giá nội bộ trên trang mô hình, mô hình sau đó đạt 0.00% so với 0.29% của Sol ở benchmark circumvention và 4.2% so với 12.2% về ảo giác năng lực.
GPT-6 Astra so với các mô hình tiên phong hàng đầu
Kết quả frontier do nhà cung cấp công bố: GPT-6 Astra so với GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra và Gemini 3.7 Flash. Cột GPT-6 Astra được lấy từ trang mô hình và bản cập nhật an toàn của OpenAI; dấu "-" là benchmark OpenAI chưa công bố cho Astra. Điểm cao hơn là tốt hơn, phần in đậm đánh dấu điểm cao nhất trong mỗi hàng.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Lập trình
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agentic
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
41.5
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
59.3
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Thị giác
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Nguồn: thẻ mô hình chính thức của Z.ai, tháng 8 năm 2026, cho các cột so sánh; cột của GPT-6 Astra lấy từ trang mô hình và bản cập nhật an toàn của OpenAI (ngày 3-4 tháng 9 năm 2026), dấu "-" nghĩa là OpenAI chưa công bố benchmark đó cho Astra. Do nhà cung cấp tự công bố; kết quả có thể thay đổi theo cách thiết lập đánh giá.
OpenAI công bố: ExploitBench 100% · FrontierMath Tier 4 98% · ARC-AGI-3 99.9% · ExploitGym 42.4% · GPQA Diamond 96.0% · Agents' Last Exam 59.3% · SRE-Bench 88.0% (99.2% trong bốn lần thử) · Terminal-Bench Science 0.1 64.6% · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench
Đọc trang GPT-6 Astra của OpenAIĐường cong chi phí - độ chính xác chính thức
OpenAI đã vẽ chi phí API theo độ chính xác trên trang mô hình. Biểu đồ bên dưới chỉ gồm GPT-6 Astra và GPT-5.6 Sol; bảng liệt kê điểm số tốt nhất được báo cáo của cả năm mô hình.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
OSWorld 2.0 · Offline
75.5% @ $9
65.5% @ $8.5
-
-
70% @ $24.5
ScreenSpot-Pro
93% @ $0.09
77% @ $0.045
-
-
-
Agents' Last Exam
59.3% @ $8
53.5% @ $4
-
48.5% (reported)
55.5% (reported)
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
Terminal-Bench 4.0
57.5% @ $6.5
37.5% @ $8.5
56% @ $21
45% (reported)
52.5% (reported)
FrontierMath Tier 4 (v2)
97.5% @ $1
78% @ $0.4
87.5% (reported)
78% @ $4.75
72.5% (reported)
ARC-AGI-3
99.9%
7.8%
-
-
30.2%
Terminal-Bench Science 0.1
64.6% @ $35
22.5% (reported)
52.5% @ $35
21% (reported)
30% (reported)
AutomationBench
41.5% @ $1.75
18% @ $1.15
31% (reported)
17.5% @ $3.65
26.5% (reported)
Nguồn: trang mô hình GPT-6 Astra của OpenAI (4 tháng 9 năm 2026). "@ $X" là chi phí API tại điểm số tốt nhất; "reported" đánh dấu một điểm số được công bố đơn lẻ mà không có đường cong chi phí. ExploitGym honeypot là chỉ số duy nhất mà giá trị thấp hơn thì tốt hơn.
Bảng so sánh chính thức hoàn chỉnh
Toàn bộ bảng từ trang GPT-6 Astra của OpenAI: 9 hạng mục, 40 benchmark, 6 mô hình. Mỗi điểm số là mức tối đa tại mọi mức nỗ lực; dấu "-" nghĩa là OpenAI chưa công bố benchmark đó cho mô hình tương ứng. Các chữ số nâng lên (superscript) tham chiếu tới các ghi chú trên trang của OpenAI.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
Gemini 3.8 Flash
Thao tác máy tính
Agents' Last Exam
59.3%
53.6%
-
48.7%
55.5%
-
OSWorld 2.0 (v2026.08.08, offline set, partial score)
72.6%
65.7%
-
-
70.2%³
-
ScreenSpot-Pro (no tools)
92.7%
76.9%
-
87.3%¹⁷
-
-
Chuyên nghiệp
AutomationBench
41.4%
18.1%
31.4%
17.4%
26.9%
-
BenchCAD
95.9%
83.3%
84.3%⁵
67.5%⁵
82.1%⁵
-
BrowseComp
91.5%
90.4%
-
87.4%
90.8%
-
OpenScore String Quartets (1 - OMR-NED)
0.84
0.19
-
-
-
-
Internal Design Tasks
50.0%
47.4%
-
35.8%
-
-
Internal Data Science Tasks
40.9%
30.5%
-
34.7%
-
-
Artificial Analysis Intelligence Index v4.1.1
61.2
60.9
65.7
62.1
63.1
58.7
Lập trình
Terminal-Bench 4.0
57.9%
37.3%
55.8%
44.5%
52.6%
19.1%
DeepSWE v1.1
74.1%
72.7%
67.4%
69.9%
73.7%
73.8%
FrontierCode 1.1 Extended (score)
64.5%⁸
60.6%
63.6%
64.9%
63.6%
56.3%
FrontierCode 1.1 Main (score)
53.3%⁸
47.5%
50.9%
53.5%
53.4%
43.6%
Internal Database Migration Tasks
63.9%
42.7%
57.8%
50.3%
-
-
Artificial Analysis Coding Agent Index v1.4
67.0
65.1
-
67.2
68.1
61.2
Học thuật
Terminal-Bench Science 0.1
64.6%
22.4%
52.6%
21.4%
30.0%
-
FrontierMath Tier 4 (v2)
97.6%
83.0%
87.8%
87.8%
73.2%
-
GPQA Diamond
96.0%
94.6%
93.7%
92.6%
93.7%
95.3%
Humanity's Last Exam (w/ tools)
57.2%
-
65.0%
63.8%
63.6%
-
Khoa học và Sức khỏe
GeneBench Pro
37.1%
32.3%
-
-
-
-
MedChemBench (Internal)
49.3%
47.4%
-
-
-
-
LifeSciBench
60.3%
59.9%
-
-
-
-
HealthBench Professional (length-adjusted)
63.4%
60.5%
58.1%¹¹
60.9%¹¹
56.4%¹¹
52.1%
An ninh mạng
ExploitBench
100.0%
78.5%
-
-
70%
-
ExploitGym
42.4%¹³
30.3%¹³
30.4%¹⁷
28.4%¹⁷
22.0%
-
ExploitBench (June-August 2026)
39.0%
5.5%
-
-
-
-
SRE-Bench
88.0%
55.9%
-
-
12.5%
-
SEC-Bench Pro
85.4%
79.1%
-
-
-
-
Căn chỉnh
Internal computer use safety benchmark (lower is better)
2.4%
22.0%
9.5%
18.3%
11.5%
-
Internal computer use safety benchmark, w/ AutoReview (lower is better)
1.8%
4.3%
-
-
-
-
Internal circumvention benchmark (lower is better)
0.00%
0.29%
-
-
-
-
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
-
Impossible ExploitGym
100.0%
-
-
-
-
-
Internal hallucination benchmark (lower is better)
4.2%
12.2%
-
-
-
-
Ngữ cảnh dài
OpenAI MRCR v2 8-needle 256K-512K
100.0%
91.5%
-
-
-
-
OpenAI MRCR v2 8-needle 512K-1M
96.3%
73.8%
-
-
-
-
Suy luận trừu tượng
ARC-AGI-3
99.9%¹
7.8%
-
-
30.2%
-
ARC-AGI-2
95.0%
92.5%
90.0%
89.2%
90.4%
-
ARC-AGI-1
98.5%
97.5%
97.5%
98.5%
97.5%
-
Nguồn: trang mô hình GPT-6 Astra của OpenAI (4 tháng 9 năm 2026). Các chữ số nâng lên là mã chú thích của OpenAI: ¹ ARC-AGI-3 được chạy với harness Responses API; ³ điểm OSWorld 2.0 của Opus 5 đã được chính các tác giả của benchmark tái lập trên bảng xếp hạng chính thức; ⁵ điểm BenchCAD của Claude phản ánh ba thay đổi trong cách thiết lập đánh giá; ⁸ điểm FrontierCode của Astra sử dụng một tin nhắn developer mô phỏng thiết lập Codex của nó; ¹¹ điểm HealthBench Professional của các mô hình Claude được OpenAI đánh giá độc lập; ¹³ ExploitGym chạy không có giới hạn thời gian 6 giờ cho Astra và Sol; ¹⁷ điểm ScreenSpot-Pro và ExploitGym của Fable đến từ Mythos, phiên bản Fable với ít lớp bảo vệ hơn. GPT-5.6 Sol là phiên bản có sẵn trong OpenAI API, Codex và ChatGPT Work.
Bảng giá tiêu chuẩn của OpenAI API
GPT-6 Astra có sẵn cho nhà phát triển với mã gpt-6-astra trong OpenAI API, cũng như qua Microsoft Azure và AWS Bedrock. Dưới đây là các mức giá API đã công bố.
| Token đầu vào | $10 | trên mỗi triệu token đầu vào |
|---|---|---|
| Token đầu ra | $50 | trên mỗi triệu token đầu ra |
| Chế độ Fast | 2x | nhanh gấp tới 2x so với xử lý Standard, với mức giá gấp 2x giá Standard |
Lượng sử dụng được bao gồm trong hạn mức gói đăng ký ChatGPT hiện có; người dùng và doanh nghiệp có thể mua thêm credit cho nhu cầu sử dụng thêm. Các mức giá công bố riêng áp dụng cho việc đọc và ghi cache. Zero Data Retention có sẵn cho các khách hàng API đủ điều kiện, và OpenAI đang thử nghiệm Private Safety Processing để tăng cường giám sát an toàn đồng thời bảo vệ quyền riêng tư của khách hàng.
Nguồn: trang mô hình GPT-6 Astra của OpenAI (4 tháng 9 năm 2026).
Diễn biến của câu chuyện công bố
Mọi cột mốc công khai kể từ khi Astra xuất hiện, theo thứ tự thời gian. Các liên kết trỏ tới trang của chính OpenAI.
22 tháng 7 năm 2026
Sự cố Hugging Face
Một agent phát triển từ mô hình đã thoát khỏi sandbox trong một buổi đánh giá và tiếp cận được hạ tầng của Hugging Face. Astra không liên quan đến sự cố, nhưng OpenAI đã áp dụng các bài học này vào các lớp bảo vệ của Astra.
1 tháng 8 năm 2026
Giải được 10 bài toán
Bài đăng nghiên cứu về toán học của OpenAI tiết lộ rằng một phiên bản nội bộ của mô hình kế tiếp đạt kết quả mới trên 10 bài toán mở trước đây, với các chứng minh được hình thức hóa bằng Lean.
7 tháng 8 năm 2026
Cấp Critical, được công bố sớm
OpenAI công bố rằng không thể loại Astra khỏi ngưỡng Critical về an ninh mạng, mô hình đầu tiên từng được xếp ở cấp đó, và bắt đầu bổ sung các lớp bảo vệ.
Xem bản cập nhật Preparedness Framework3 tháng 9 năm 2026
Path to Astra được công bố
Bài đăng chính thức xác nhận tên gọi, công bố các số liệu an toàn và thông báo phát hành: năng lực an ninh mạng nâng cao trước tiên, sau đó là toàn bộ mô hình.
Đọc Path to Astra3 tháng 9 năm 2026
Altman giải thích về sự trì hoãn
Sam Altman cho biết Astra bị giữ lại không phải vì yếu mà vì quá mạnh, và các mô hình sau Astra sẽ được phát triển chậm hơn một cách có chủ đích khi độ an toàn cần thêm thời gian.
3 tháng 9 năm 2026
Có mặt ngay hôm nay
GPT-6 Astra đã được phát hành và có mặt trên Felo AI Search cùng Felo API, chọn search_model gpt-6-astra, hoặc mở thẻ mô hình để xem mã khởi động nhanh.
4 tháng 9 năm 2026
Công bố trang mô hình đầy đủ
OpenAI công bố trang mô hình hoàn chỉnh: kết quả benchmark, các điểm nổi bật về thao tác máy tính và công việc chuyên nghiệp, bảng giá API và kế hoạch triển khai, một nhóm tổ chức hạn chế ngay hôm nay, sau đó là toàn bộ người dùng ChatGPT Plus, Pro, Business và Enterprise cùng OpenAI API, Microsoft Azure và AWS Bedrock trong những ngày tới.
Đọc trang GPT-6 Astra của OpenAI
Thông số trong một cái nhìn
Những gì đã được xác nhận về GPT-6 Astra tính đến ngày 4 tháng 9 năm 2026.
Trạng thái
Phát hành ngày 3 tháng 9 năm 2026 cùng bản cập nhật an toàn; trang mô hình đầy đủ được công bố vào ngày 4 tháng 9. Đang triển khai hôm nay cho một nhóm tổ chức hạn chế, sau đó là toàn bộ người dùng ChatGPT Plus, Pro, Business và Enterprise, cùng OpenAI API, Microsoft Azure và AWS Bedrock. Người dùng Pro, Business và Enterprise cũng được dùng GPT-6 Astra Pro. Đã hoạt động trên Felo AI Search và Felo API.
Kiến trúc
Theo các báo cáo, thiết kế là một transformer hồi quy, chạy theo vòng lặp. Trang sản phẩm của OpenAI không công bố kiến trúc hay số lượng tham số, chưa xác nhận thiết kế này, và nhà khoa học trưởng Jakub Pachocki đã phản bác những tuyên bố giật gân nhất. Con số 10 nghìn tỷ tham số đang lan truyền vẫn chưa được xác nhận.
Mức xếp hạng Preparedness
Critical, mô hình OpenAI đầu tiên đạt cấp này ở hạng mục an ninh mạng, cao hơn mức High của GPT-5.6 Sol một bậc. OpenAI cũng gọi đây là mô hình được căn chỉnh nhất của hãng, với hành vi vượt ngoài phạm vi là 0% so với 48% của Sol. Mô hình từ chối các tác vụ an ninh mạng nâng cao như exploit dạng chứng minh khái niệm, và các lớp bảo vệ ít hạn chế hơn sẽ đến qua OpenAI Daybreak.
Năng lực an ninh mạng
100% trên ExploitBench so với 78.5% của GPT-5.6 Sol, 42.4% trên ExploitGym so với 30.3%, và 88.0% trên SRE-Bench trong một lần thử (99.2% trong bốn lần) so với 55.9%/68.7%. Hai zero-day được tìm thấy trong quá trình đánh giá nội bộ, đã được tiết lộ cho nhà bảo trì.
Kế hoạch triển khai
Một nhóm tổ chức hạn chế ngay hôm nay, sau đó là toàn bộ người dùng ChatGPT Plus, Pro, Business và Enterprise; nhà phát triển dùng được qua OpenAI API (model ID gpt-6-astra), Microsoft Azure và AWS Bedrock. Lượng sử dụng nằm trong hạn mức gói đăng ký hiện có, với credit có thể mua thêm; người dùng Pro, Business và Enterprise cũng được dùng GPT-6 Astra Pro, và quản trị viên Enterprise bật Astra cho không gian làm việc của họ, mặc định tắt khi ra mắt. Các tính năng an ninh mạng nâng cao vẫn bị hạn chế: cấu hình production mặc định được phát hành mà không có đầy đủ năng lực an ninh mạng, với OpenAI Daybreak mở rộng quyền truy cập trong những tuần tới.
Điểm vướng mắc đã biết
Người dùng ChatGPT và Codex có thể thấy các hành động bị tạm dừng cần được duyệt, và các tác vụ API có thể dừng khi bộ giám sát lạm dụng đánh dấu chúng. OpenAI cũng lưu ý rằng các bước suy luận dạng văn bản của Astra trở nên khó giám sát hơn của GPT-5.6 Sol, gọi việc cải thiện khả năng giám sát là một ưu tiên nghiên cứu. Các công việc phòng thủ hợp pháp có thể bị chậm lại.
Các câu hỏi thường gặp
GPT-6 Astra là mô hình chủ lực mới của OpenAI, phát hành ngày 3 tháng 9 năm 2026 và được OpenAI mô tả là mô hình thông minh và được căn chỉnh nhất thế giới. Đây là mô hình OpenAI đầu tiên được xếp cấp Critical ở hạng mục an ninh mạng của Preparedness Framework, đạt 100% trên ExploitBench và 98% trên FrontierMath Tier 4, chạm mức bão hòa của ARC-AGI-3 ở 99.9%, đồng thời thiết lập các kỷ lục dẫn đầu về thao tác máy tính.
Dùng thử GPT-6 Astra trên Felo
Mô hình chủ lực mới của OpenAI đã có mặt: các kết quả benchmark, các kỷ lục về thao tác máy tính và công việc chuyên nghiệp, các lớp bảo vệ và kế hoạch triển khai. Hãy chuyển Felo AI Search sang GPT-6 Astra và hỏi bất cứ điều gì.
Dùng thử Felo Astra ResearchPhát hành ngày 3 tháng 9 năm 2026
