Skip to main content

GPT-6 Astra trên Felo OpenAPI: Ngữ cảnh 1,05M và Công cụ Agent

· 7 phút đọc
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI bổ sung GPT-6 Astra với cửa sổ ngữ cảnh 1,05M, đầu ra tối đa 128K, và các endpoint Chat Completions, Responses, Messages tương thích.

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $10 input, and $50 output

Tài liệu dài, mã phức tạp, và luồng agent nhiều bước khiến nhóm phát triển phải chia nhỏ các lần gọi mô hình. Felo OpenAPI cung cấp GPT-6 Astra, cho phép một model ID xử lý các khối lượng công việc này qua các giao diện API tương thích.

Dùng thử GPT-6 Astra: https://openapi.felo.ai/models/openai/gpt-6-astra

GPT-6 Astra dành cho mục đích nào

GPT-6 Astra là phiên bản GPT-6 cao cấp nhất trên Nền tảng API Felo. OpenAI mô tả đây là mô hình mạnh nhất cho suy luận phức tạp, lập trình, sử dụng máy tính, nghiên cứu, và tạo tài liệu. Trang mô hình Felo liệt kê các khả năng: Suy luận, Công cụ, JSON, Streaming, và Thị giác.

Sử dụng model ID gpt-6-astra. Cửa sổ ngữ cảnh 1.050.000 tokens và đầu ra tối đa 128.000 tokens. OpenAI công bố mốc kiến thức là 30 tháng 4, 2026. Dung lượng này cho phép một yêu cầu chứa đặc tả, tóm tắt mã nguồn, định nghĩa công cụ, và lịch sử hội thoại trong một ngữ cảnh làm việc.

OpenAI liệt kê năm mức độ suy luận: low, medium, high, xhigh, và max. Chọn mức phù hợp với mục tiêu chất lượng, ngân sách độ trễ, và chi phí yêu cầu.

Thông báo của OpenAI cho biết GPT-6 Astra triển khai cho doanh nghiệp trong Chương trình Truy cập Tin cậy, với các gói Plus, Pro, Business, và Enterprise sẽ mở trong những ngày tiếp theo. Felo OpenAPI cung cấp đường dẫn mô hình cho nhà phát triển cần truy cập API qua nền tảng này.

Ba giao thức, một model ID

Nền tảng API Felo cung cấp ba giao diện yêu cầu tương thích:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

Ứng dụng dùng client tương thích OpenAI có thể giữ nguyên cấu trúc yêu cầu và chỉ thay đổi giá trị model thành gpt-6-astra. Client kiểu Claude có thể dùng giao diện Messages tương thích Anthropic. Trang mô hình liệt kê Claude Code, Codex, LLM API, và các client agent khác là trường hợp sử dụng.

Giá phù hợp ngân sách

Trang mô hình Felo hiện tại công bố mức giá:

Hạng mụcGiá
Đầu vào$10.00 mỗi 1M tokens
Đầu ra$50.00 mỗi 1M tokens

Trang cho biết giá ra mắt có thể thấp hơn giá API của nhà cung cấp chính thức đến 50%. Chi phí cuối cùng phụ thuộc mô hình, tỷ lệ đầu vào/đầu ra, sử dụng cache, và gói dịch vụ. Trang Felo hiện tại ghi $10.00 / 1M tokens đầu vào$50.00 / 1M tokens đầu ra. Ước tính chi phí bao gồm từng biến số; mức giá tiêu đề không phản ánh toàn bộ hóa đơn.

Tài liệu mô hình OpenAI công bố giá chuẩn $10.00 mỗi 1M tokens đầu vào, $1.00 mỗi 1M tokens đầu vào cache, và $50.00 mỗi 1M tokens đầu ra. Ghi cache tính 1.25x giá đầu vào chưa cache. Yêu cầu trên 272K tokens đầu vào tính 2x giá đầu vào và cache, cộng 1.5x đầu ra cho toàn bộ yêu cầu. Batch và Flex tính 50% giá chuẩn; Fast mode tính 2x giá áp dụng. Đây là giá tham khảo của OpenAI, không thay thế giá gói Felo ở trên.

Nguồn giáĐầu vàoĐầu vào cacheĐầu ra
Trang mô hình Felo$10.00 / 1MTrang liệt kê giá đầu vào cache và ghi cache$50.00 / 1M
Hướng dẫn mô hình OpenAI$10.00 / 1M$1.00 / 1M$50.00 / 1M

Gửi yêu cầu đầu tiên với năm bước

1. Tạo API key

Tạo key trong tài khoản Nền tảng API Felo và đặt làm biến môi trường:

export FELO_API_KEY="YOUR_API_KEY"

2. Đặt endpoint

Với Chat Completions, sử dụng:

https://openapi.felo.ai/api/v1/chat/completions

3. Đặt model ID

Truyền "model": "gpt-6-astra" cùng mảng messages. Yêu cầu cURL này kiểm tra đường dẫn:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. Thêm công cụ hoặc đầu ra có cấu trúc

Các tham số tương thích gồm tools, tool_choice, và response_format. Hỗ trợ từng điều khiển phụ thuộc giao thức và đường dẫn mô hình đã chọn. GPT-6 Astra hỗ trợ suy luận; khi giao thức và đường dẫn cung cấp điều khiển suy luận, giữ lại metadata suy luận trả về khi tiếp tục hội thoại.

OpenAI liệt kê các công cụ Responses API cho GPT-6 Astra: tìm kiếm web, tìm kiếm file, tạo ảnh, code interpreter, shell lưu trữ, áp dụng patch, kỹ năng, sử dụng máy tính, MCP, và tìm kiếm công cụ. Dùng endpoint Responses khi quy trình cần các công cụ lưu trữ này. Các giao diện và công cụ kích hoạt trên Felo có thể phụ thuộc đường dẫn đang dùng.

5. Bật streaming

Đặt stream thành true để nhận sự kiện gửi từ máy chủ:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

Danh sách kiểm tra trước khi chạy

  • Ước tính chi phí đầu vào với cửa sổ ngữ cảnh 1,05M.
  • Đặt max_tokens để giữ đầu ra trong ngân sách dự án.
  • Ghi lại dữ liệu đầu vào, đầu ra, cache, và gói dịch vụ cho từng ước tính yêu cầu.
  • Kiểm tra prompt trong Playground trước khi kết nối ứng dụng hoặc client agent.
  • Lưu mẫu hồi quy cho công cụ, đầu ra JSON, và streaming.
  • Đặt reasoning_effort ở mức hỗ trợ và ghi lại cùng dữ liệu độ trễ, chi phí.
  • Dùng quy tắc giá OpenAI để so sánh; dùng gói và đường dẫn Felo để ước tính số tiền phải trả.

Bắt đầu với trang mô hình

GPT-6 Astra tích hợp suy luận, lập trình, phân tích ngữ cảnh dài, và tác vụ agent trong một mục mô hình. Felo OpenAPI cung cấp lộ trình chuyển đổi qua Chat Completions, Responses, và Messages. Client hiện tại có thể giữ nguyên khi thay đổi giao diện yêu cầu để phù hợp khối lượng công việc.

Mở trang mô hình GPT-6 Astra để xem tham số, mẫu mã, và truy cập Playground.

Nguồn: Trang mô hình GPT-6 Astra trên Felo API Platform, Thông báo GPT-6 Astra của OpenAI, và Hướng dẫn mô hình GPT-6 Astra của OpenAI (truy cập ngày 04-09-2026). Giá Felo kiểm tra lại ngày 04-09-2026.