Skip to main content

GPT-6 Astra en Felo OpenAPI: 1,05M de contexto, un solo ID de modelo

· 4 min de lectura
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI incorpora GPT-6 Astra con una ventana de contexto de 1,05M, salida máxima de 128K y compatibilidad con los endpoints de Chat Completions, Responses y Messages.

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $5 input, and $30 output

Documentos extensos, código complejo y flujos de agentes con varios pasos requieren dividir las llamadas al modelo. Felo OpenAPI ofrece GPT-6 Astra, así que un solo ID de modelo gestiona estas cargas mediante superficies API compatibles.

Prueba GPT-6 Astra: https://openapi.felo.ai/models/openai/gpt-6-astra

Para qué se diseñó GPT-6 Astra

GPT-6 Astra es el modelo principal de la gama GPT-6 en Felo API Platform. La página del modelo lo orienta a razonamiento complejo, programación avanzada, análisis de contexto largo y flujos de trabajo de agentes con alta capacidad. Enumera Razonamiento, Herramientas, JSON, Streaming y Visión como capacidades.

Utiliza el ID de modelo gpt-6-astra. La ventana de contexto es de 1,05M tokens y la salida máxima es de 128K tokens. Esta capacidad permite que una solicitud incluya una especificación, un resumen de código, definiciones de herramientas y el historial de conversación en un solo contexto de trabajo.

Tres protocolos, un solo ID de modelo

Felo API Platform expone tres superficies de solicitud compatibles:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

Una aplicación con un cliente compatible con OpenAI mantiene su estructura de solicitud y solo cambia el valor de model a gpt-6-astra. Los clientes tipo Claude pueden usar la superficie Messages compatible con Anthropic. La página del modelo enumera Claude Code, Codex, LLM API y otros clientes de agentes como casos de uso.

Precios que encajan en el presupuesto

La página del modelo muestra estas tarifas:

ÍtemTarifa
Entrada$5.00 por 1M tokens
Salida$30.00 por 1M tokens

La página indica que el precio de lanzamiento puede ser hasta un 50% menor que las tarifas oficiales del proveedor. El coste final depende del modelo, la mezcla de entrada/salida, el uso de caché y el plan activo. Una estimación de coste incluye cada variable; la tarifa principal no representa la factura completa.

Primer solicitud en cinco pasos

1. Crea una clave API

Crea una clave en tu cuenta de Felo API Platform y configúrala como variable de entorno:

export FELO_API_KEY="YOUR_API_KEY"

2. Configura el endpoint

Para Chat Completions, utiliza:

https://openapi.felo.ai/api/v1/chat/completions

3. Configura el ID de modelo

Incluye "model": "gpt-6-astra" con un array messages. Esta solicitud cURL prueba la ruta:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. Añade herramientas o salida estructurada

Los parámetros compatibles incluyen tools, tool_choice y response_format. El soporte para cada control depende del protocolo y la ruta de modelo seleccionados. GPT-6 Astra permite razonamiento; cuando el protocolo y la ruta exponen controles de razonamiento, conserva los metadatos de razonamiento devueltos al continuar una conversación.

5. Activa el streaming

Configura stream en true para recibir eventos enviados por el servidor:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

Lista de verificación previa

  • Calcula el coste de entrada según la ventana de contexto de 1,05M.
  • Configura max_tokens para mantener la salida dentro del presupuesto del proyecto.
  • Registra datos de entrada, salida, caché y plan para cada estimación de solicitud.
  • Prueba los prompts en el Playground antes de conectar una aplicación o cliente de agente.
  • Conserva muestras de regresión para herramientas, salida JSON y streaming.

Empieza por la página del modelo

GPT-6 Astra reúne razonamiento, programación, análisis de contexto largo y trabajo de agentes en una sola entrada de modelo. Felo OpenAPI ofrece a los equipos una vía de migración mediante Chat Completions, Responses y Messages. Un cliente existente permanece igual mientras la superficie de solicitud se adapta a la carga de trabajo.

Abre la página del modelo GPT-6 Astra para ver parámetros, ejemplos de código y la entrada al Playground.

Fuente: Felo API Platform, página del modelo GPT-6 Astra (consultada el 2026-09-03).