Skip to main content

Felo OpenAPI 上的 GPT-6 Astra:1.05M 上下文,单一模型 ID

· 阅读需 4 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI 新增 GPT-6 Astra,具备 1.05M 上下文窗口、128K 最大输出,并兼容 Chat Completions、Responses 和 Messages 端点。

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $5 input, and $30 output

长文档、复杂代码和多步 agent 流程让团队拆分模型调用。Felo OpenAPI 推出 GPT-6 Astra,一个模型 ID 处理这些任务,API 接口兼容。

试用 GPT-6 Astra:https://openapi.felo.ai/models/openai/gpt-6-astra

GPT-6 Astra 的用途

GPT-6 Astra 是 Felo API Platform 的旗舰 GPT-6 型号。模型页面定位其适合复杂推理、高级编程、长上下文分析和高能力 agent 工作流。功能包括 Reasoning、Tools、JSON、Streaming 和 Vision。

模型 ID 为 gpt-6-astra。上下文窗口为 1.05M tokens,最大输出为 128K tokens。请求可包含规范、代码库摘要、工具定义和对话历史,全部纳入一个上下文。

三种协议,一个模型 ID

Felo API Platform 提供三种兼容请求接口:

  • Chat CompletionsPOST https://openapi.felo.ai/api/v1/chat/completions
  • ResponsesPOST https://openapi.felo.ai/api/v1/responses
  • MessagesPOST https://openapi.felo.ai/api/v1/messages

OpenAI 兼容客户端可保持原有请求结构,仅需将 model 值改为 gpt-6-astra。Claude 风格客户端可用 Anthropic 兼容的 Messages 接口。模型页面列出 Claude Code、Codex、LLM API 及其他 agent 客户端为适用场景。

预算友好的定价

模型页面显示如下价格:

项目价格
输入每 1M tokens $5.00
输出每 1M tokens $30.00

页面说明,首发价格可能比官方 API 低至 50%。最终费用取决于模型、输入输出比例、缓存使用和当前套餐。费用估算包含各项变量,标价并非全部账单。

五步发起首次请求

1. 创建 API 密钥

在 Felo API Platform 账户中创建密钥,并设置为环境变量:

export FELO_API_KEY="YOUR_API_KEY"

2. 设置端点

Chat Completions 使用:

https://openapi.felo.ai/api/v1/chat/completions

3. 设置模型 ID

传递 "model": "gpt-6-astra"messages 数组。以下 cURL 请求测试接口:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. 添加工具或结构化输出

兼容参数包括 toolstool_choiceresponse_format。每项控制支持情况取决于所选协议和模型接口。GPT-6 Astra 支持推理,协议和接口开放推理控制时,继续对话时保留返回的推理元数据。

5. 启用流式输出

stream 设为 true,接收服务器推送事件:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

预检清单

  • 结合 1.05M 上下文窗口预估输入成本。
  • 设置 max_tokens,控制输出在项目预算内。
  • 记录每次请求的输入、输出、缓存和套餐数据。
  • 在 Playground 测试提示词,再接入应用或 agent 客户端。
  • 保留工具、JSON 输出和流式输出的回归样本。

从模型页面开始

GPT-6 Astra 将推理、编程、长上下文分析和 agent 工作整合到一个模型入口。Felo OpenAPI 通过 Chat Completions、Responses 和 Messages,为团队提供迁移路径。现有客户端可保持不变,仅需调整请求接口以适配任务。

打开 GPT-6 Astra 模型页面,获取参数、代码示例和 Playground 入口。

来源:Felo API Platform,GPT-6 Astra 模型页面(访问日期 2026-09-03)。