Skip to main content

GPT-6 Astra no Felo OpenAPI: Contexto de 1,05M e Ferramentas de Agente

· 6 minutos de leitura
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI adiciona GPT-6 Astra com janela de contexto de 1,05M, saída máxima de 128K e compatibilidade com os endpoints Chat Completions, Responses e Messages.

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $10 input, and $50 output

Documentos extensos, código complexo e fluxos de agente com múltiplas etapas exigem que equipes dividam chamadas de modelo. Felo OpenAPI oferece o GPT-6 Astra, então um único ID de modelo atende essas demandas por superfícies de API compatíveis.

Experimente o GPT-6 Astra: https://openapi.felo.ai/models/openai/gpt-6-astra

Para que serve o GPT-6 Astra

GPT-6 Astra é o modelo principal da linha GPT-6 na Plataforma Felo API. A OpenAI descreve como o modelo mais capaz para raciocínio complexo, programação, uso de computador, pesquisa e criação de documentos. A página do modelo Felo lista Raciocínio, Ferramentas, JSON, Streaming e Visão como capacidades.

Use o ID de modelo gpt-6-astra. A janela de contexto tem 1.050.000 tokens e a saída máxima é de 128.000 tokens. A OpenAI indica um corte de conhecimento em 30 de abril de 2026. Essa capacidade permite que uma solicitação inclua especificação, resumo de base de código, definições de ferramentas e histórico de conversa em um único contexto de trabalho.

A OpenAI lista cinco níveis de esforço de raciocínio: low, medium, high, xhigh e max. Escolha o nível que corresponde à meta de qualidade, orçamento de latência e custo da solicitação.

O anúncio da OpenAI informa que o GPT-6 Astra chega primeiro para empresas no Trusted Access Program, com acesso Plus, Pro, Business e Enterprise nos dias seguintes. O Felo OpenAPI oferece uma rota de modelo para desenvolvedores que precisam de acesso via API pela plataforma.

Três protocolos, um ID de modelo

A Plataforma Felo API expõe três superfícies de requisição compatíveis:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

Um aplicativo com cliente compatível com OpenAI mantém sua estrutura de requisição e só altera o valor de model para gpt-6-astra. Clientes no estilo Claude usam a superfície Messages compatível com Anthropic. A página do modelo lista Claude Code, Codex, LLM API e outros clientes de agente como casos de uso.

Preço que cabe no orçamento

A página atual do modelo Felo informa estas tarifas:

ItemTarifa
Entrada$10,00 por 1M tokens
Saída$50,00 por 1M tokens

A página informa que o preço de lançamento pode ser até 50% menor que as tarifas oficiais do provedor. O custo final depende do modelo, proporção entrada/saída, uso de cache e plano ativo. A página Felo atual lista $10,00 / 1M tokens de entrada e $50,00 / 1M tokens de saída. Uma estimativa de custo inclui cada variável; a tarifa principal não representa o valor total.

A documentação do modelo OpenAI lista tarifas padrão de $10,00 por 1M tokens de entrada, $1,00 por 1M tokens de entrada em cache e $50,00 por 1M tokens de saída. Escritas em cache usam 1,25x a tarifa de entrada sem cache. Solicitações acima de 272K tokens de entrada usam 2x as tarifas de entrada e cache, além de 1,5x para saída na solicitação completa. Batch e Flex usam 50% das tarifas padrão; Fast mode usa 2x as tarifas aplicáveis. Estes são valores de referência da OpenAI, não substituem o preço do plano Felo acima.

Fonte do preçoEntradaEntrada em cacheSaída
Página do modelo Felo$10,00 / 1MPágina lista tarifas de entrada em cache e escrita em cache$50,00 / 1M
Guia do modelo OpenAI$10,00 / 1M$1,00 / 1M$50,00 / 1M

Faça a primeira requisição em cinco passos

1. Crie uma chave de API

Crie uma chave na sua conta da Plataforma Felo API e defina como variável de ambiente:

export FELO_API_KEY="YOUR_API_KEY"

2. Defina o endpoint

Para Chat Completions, use:

https://openapi.felo.ai/api/v1/chat/completions

3. Defina o ID do modelo

Passe "model": "gpt-6-astra" com um array messages. Esta requisição cURL testa a rota:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. Adicione ferramentas ou saída estruturada

Parâmetros compatíveis incluem tools, tool_choice e response_format. O suporte para cada controle depende do protocolo e rota de modelo escolhidos. O GPT-6 Astra oferece raciocínio; quando o protocolo e a rota expõem controles de raciocínio, mantenha os metadados de raciocínio retornados ao continuar uma conversa.

A OpenAI lista estas ferramentas da Responses API para o GPT-6 Astra: busca web, busca de arquivos, geração de imagens, interpretador de código, shell hospedado, aplicar patch, habilidades, uso de computador, MCP e busca de ferramentas. Use o endpoint Responses quando o fluxo de trabalho exige essas ferramentas hospedadas. As superfícies expostas e ferramentas habilitadas pelo Felo dependem da rota ativa.

5. Ative o streaming

Defina stream como true para receber eventos enviados pelo servidor:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

Checklist de pré-voo

  • Estime o custo de entrada em relação à janela de contexto de 1,05M.
  • Defina max_tokens para manter a saída dentro do orçamento do projeto.
  • Registre dados de entrada, saída, cache e plano para cada estimativa de requisição.
  • Teste prompts no Playground antes de conectar um app ou cliente de agente.
  • Guarde amostras de regressão para ferramentas, saída JSON e streaming.
  • Defina reasoning_effort em um nível suportado e registre junto com latência e custo.
  • Use as regras de preço da OpenAI para comparação; use o plano e rota Felo para estimativa pagável.

Comece pela página do modelo

GPT-6 Astra reúne raciocínio, programação, análise de contexto longo e trabalho de agente em uma única entrada de modelo. Felo OpenAPI oferece caminho de migração por Chat Completions, Responses e Messages. Um cliente existente permanece enquanto a superfície de requisição muda para atender à demanda.

Abra a página do modelo GPT-6 Astra para parâmetros, exemplos de código e acesso ao Playground.

Fontes: Página do modelo GPT-6 Astra na Felo API Platform, Anúncio do GPT-6 Astra pela OpenAI e Guia do modelo GPT-6 Astra da OpenAI (acesso em 04/09/2026). Os preços da Felo foram verificados novamente em 04/09/2026.