Skip to main content

GPT-6 Astra trên Felo Search: Flagship mới của OpenAI, dùng miễn phí

· 8 phút đọc
Felo Search Tips Buddy
Committed to answers at your fingertips

GPT-6 Astra của OpenAI xuất hiện trên Felo Search: mười bài toán mở về toán học được giải, xếp hạng an ninh mạng Critical đầu tiên, và tỷ lệ từ chối jailbreak 91,5%.

OpenAI ra mắt Astra ngày 3 tháng 9 và định vị mô hình cho công việc toàn diện: lập trình, nghiên cứu chuyên sâu, sử dụng máy tính, và tạo tài liệu. Sự kiện này tạo ra hai dấu mốc. Mười vấn đề chưa giải trong toán học và khoa học máy tính lý thuyết nhận lời giải đầu tiên. Astra trở thành mô hình OpenAI đầu tiên vượt qua ngưỡng "Critical" của Preparedness Framework — mức mà GPT-5.6 Sol, flagship trước đó, không đạt được.

Felo Search đã bổ sung GPT-6 Astra vào danh sách mô hình. Chọn nó từ bộ chọn bên cạnh micro dưới hộp tìm kiếm, và đặt câu hỏi từng cần phòng nghiên cứu. Bài viết này trình bày mô hình này là gì, ý nghĩa của nhãn Critical, và cách khai thác tối đa.

GPT-6 Astra infographic banner: ten open problems solved, first Critical cybersecurity tier, 91.5% jailbreak refusal

GPT-6 Astra là gì

Astra là flagship mới của OpenAI. OpenAI công bố tên "Astra"; ngành và Felo Search xác định nó là người kế nhiệm dòng GPT-5.6 và gọi là GPT-6 Astra. OpenAI chưa xác nhận số phiên bản chính thức.

Thông số kỹ thuật công khai:

  • Cửa sổ ngữ cảnh: 1.050.000 token
  • Đầu ra tối đa: 128.000 token
  • Kiến thức cập nhật: 30 tháng 4, 2026
  • Đầu vào: văn bản và hình ảnh; đầu ra: văn bản
  • Mức độ suy luận từ thấp đến "xhigh" và "max"
  • Giá API: $10 cho mỗi triệu token đầu vào, $50 cho mỗi triệu token đầu ra, $1 cho mỗi triệu token đầu vào lưu trữ

The Information báo cáo một kỹ thuật nội bộ gọi là "Recurrent Depth": dữ liệu đi qua cùng lớp nhiều lần, thay vì một lần. Vì các lần lặp che khuất theo dõi chuỗi suy nghĩ, trưởng nhóm khoa học của OpenAI nói độ sâu đồ thị tính toán của Astra nằm trong phạm vi gấp đôi GPT-4, và việc theo dõi là ưu tiên. OpenAI chưa xác nhận kỹ thuật này.

Không có số lượng tham số nào xuất hiện trong tài liệu của OpenAI. Một báo cáo đưa ra con số gần mười nghìn tỷ; phân tích khác ước tính hàng chục tỷ. Mọi tuyên bố về kích thước đều chưa xác thực.

Mười vấn đề mở được giải

Công bố đầu tiên của Astra giải mười vấn đề tồn tại lâu năm trong toán học và khoa học máy tính lý thuyết. Kết quả nổi bật:

  • Nhóm không sofic đầu tiên được biết đến — câu hỏi mở từ năm 1999
  • Bác bỏ giả thuyết độ cứng Alain Connes đặt ra năm 1980
  • Ba vấn đề từ bộ đề Erdős

Mỗi kết quả đi kèm một chứng cứ máy Lean 4 xác minh. Các nhà nghiên cứu biên tập bản thảo; máy kiểm tra toán học. OpenAI định giá tính toán cho mười lời giải, theo giá API Sol, là $2.000. Không có vấn đề nào thuộc giải thưởng Clay Millennium được giải.

Với tìm kiếm, điều này ảnh hưởng một cách cụ thể: xác minh nhiều bước. Câu hỏi cần chuỗi suy luận — chứng minh, kiểm tra dữ liệu, truy vết tài liệu — được thực hiện đến cuối mà không bỏ sót bước nào.

Nhãn Critical: Tin tưởng, nhưng kiểm tra

Preparedness Framework của OpenAI đánh giá mô hình từ thấp đến critical. GPT-5.6 Sol đạt "high." Astra là mô hình OpenAI đầu tiên ở mức "Critical" — mức mà mô hình có thể tìm lỗ hổng chưa biết, tạo khai thác, và xâm nhập hệ thống bảo mật mà không cần hướng dẫn từng bước từ con người.

Bằng chứng OpenAI công bố:

  • ExploitBench, bộ đo tạo khai thác công khai: điểm 100%
  • ExploitGym: điểm 42,4%, so với 30,3% của GPT-5.6 Sol
  • Kiểm tra nội bộ trên 20 lỗi nghiêm trọng V8 báo cáo sau mốc kiến thức của Astra (loại trừ ghi nhớ): tỷ lệ thực thi mã tùy ý 39% ở 76.000 token đầu ra, so với 1% của GPT-5.6 Sol ở mức tương đương
  • Hai lỗ hổng zero-day Astra phát hiện và tích hợp vào chuỗi khai thác; OpenAI đang thông báo cho bên bị ảnh hưởng
  • Tỷ lệ từ chối jailbreak 91,5%, so với 59% của GPT-5.6 Sol
  • Kiểm tra honeypot cung cấp lối tắt "gian lận" với nhiệm vụ khó: GPT-5.6 Sol chọn 56% lần; Astra không chọn lần nào

Những lưu ý cần có trong câu chuyện này. Con số 39% đến từ kiểm tra nội bộ ở cấp truy cập Daybreak Blue — không phải cấu hình sản xuất mặc định. Xác minh bên thứ ba đang chờ. OpenAI tăng cường triển khai, không cung cấp năng lực thô: kiểm tra trước khi thực thi tự động, giám sát hành động và kiểm soát, theo dõi chuỗi suy nghĩ. API tiêu chuẩn từ chối nhiệm vụ an ninh mạng nâng cao, và kiểm tra an toàn có thể dừng nhiệm vụ giữa chừng.

Lựa chọn mô hình thay đổi khả năng trả lời của công cụ tìm kiếm. Với Astra trong danh sách, Felo Search xử lý câu hỏi cần suy luận liên tục — toán học nghiên cứu, chuỗi sự kiện nhiều bước, tổng hợp đa ngôn ngữ — và trả về nguồn dẫn cho từng khẳng định.

Astra vận hành phần mềm như con người: trình duyệt, bảng tính, ứng dụng desktop, terminal. Trên OSWorld V2-Offline đạt 72,6%, so với 65,7% của GPT-5.6 Sol, và thời gian trung bình cho nhiệm vụ giảm từ 75 phút xuống 40. Trong Codex, Astra lưu ghi chú ngữ cảnh tự phản ánh — bản ghi nhiệm vụ hiện tại duy trì qua các cửa sổ ngữ cảnh.

  • Đặt câu hỏi mở và nhận câu trả lời kèm nguồn dẫn
  • Đẩy nhiệm vụ nhiều bước và quan sát suy luận diễn ra
  • So sánh mô hình trên cùng câu hỏi, chọn mô hình cho từng nhiệm vụ

Một lưu ý thẳng thắn: mô hình Critical trong sản phẩm tiêu dùng đòi hỏi trách nhiệm. OpenAI kiểm soát năng lực mạnh nhất, và Felo đưa mô hình này như một lựa chọn trong nhiều lựa chọn. Công việc giữ nguyên — tìm kiếm, suy luận, kiểm tra.

Truy cập: đợt ra mắt của OpenAI đến cho tổ chức thuộc Trusted Access Program, với các gói Plus, Pro, Business, Enterprise và API rộng hơn vào những ngày sau. Felo Search giữ mô hình này trong danh sách từ ngày ra mắt — liên kết trải nghiệm mở nó, không phân biệt gói.

Felo Search giữ mọi mô hình trong một bộ chọn, chuyển đổi trong một lần chạm:

  1. Đăng nhập tại felo.ai.
  2. Mở bộ chọn mô hình — tên mô hình bên cạnh micro dưới hộp tìm kiếm, có mũi tên nhỏ.
  3. Chọn GPT-6 Astra.
  4. Đặt câu hỏi và đọc câu trả lời có nguồn dẫn.

Liên kết trải nghiệm thực hiện tương tự — mở Felo Search với GPT-6 Astra trong bộ chọn:

Liên kết trải nghiệm: Felo Search với GPT-6 Astra

Câu hỏi đáng thử tuần này

  • Chứng minh toán học từ sách giáo khoa mở — với các bước suy luận
  • So sánh hai bài báo qua rào cản ngôn ngữ
  • Chuỗi sự kiện nhiều bước — "mô hình nào, phát hành với giá bằng một nửa tiền nhiệm, đạt kết quả thấp hơn trên benchmark này?"

Astra nằm trong danh sách mô hình của Felo Search. Mở liên kết trải nghiệm, chuyển mô hình, và đặt câu hỏi bạn nghĩ công cụ tìm kiếm không trả lời được.

Thử GPT-6 Astra trên Felo Searchmở liên kết trải nghiệm


Bài viết này cũng có sẵn bằng English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Türkçe, Italiano, ไทย, Español, বাংলা and Português.