GPT-6 Astra en Felo OpenAPI: 1,05M de contexto y herramientas de agente
Felo OpenAPI incorpora GPT-6 Astra con una ventana de contexto de 1,05M, salida máxima de 128K y compatibilidad con los endpoints de Chat Completions, Responses y Messages.

Documentos extensos, código complejo y flujos de agente con varios pasos requieren que los equipos dividan las llamadas al modelo. Felo OpenAPI ofrece GPT-6 Astra, así un solo ID de modelo gestiona estas cargas de trabajo a través de superficies API compatibles.
Prueba GPT-6 Astra: https://openapi.felo.ai/models/openai/gpt-6-astra
Para qué se diseñó GPT-6 Astra
GPT-6 Astra es el nivel principal de GPT-6 en Felo API Platform. OpenAI lo describe como su modelo más capaz para razonamiento complejo, programación, uso de computadoras, investigación y creación de documentos. La página del modelo en Felo enumera Razonamiento, Herramientas, JSON, Streaming y Visión como capacidades.
Utiliza el ID de modelo gpt-6-astra. La ventana de contexto es de 1.050.000 tokens y la salida máxima es de 128.000 tokens. OpenAI indica un corte de conocimiento de 30 de abril de 2026. Esta capacidad permite que una solicitud contenga una especificación, un resumen de base de código, definiciones de herramientas y el historial de conversación en un solo contexto de trabajo.
OpenAI enumera cinco configuraciones de esfuerzo de razonamiento: low, medium, high, xhigh y max. Elige la configuración que se ajusta al objetivo de calidad, presupuesto de latencia y coste de la solicitud.
El anuncio de OpenAI indica que GPT-6 Astra se lanza para empresas en el Trusted Access Program, con acceso Plus, Pro, Business y Enterprise en los días siguientes. Felo OpenAPI proporciona una ruta de modelo para desarrolladores que necesitan acceso API a través de su plataforma.
Tres protocolos, un solo ID de modelo
Felo API Platform expone tres superficies de solicitud compatibles:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
Una aplicación con un cliente compatible con OpenAI puede mantener su estructura de solicitud y cambiar el valor de model a gpt-6-astra. Clientes tipo Claude pueden usar la superficie Messages compatible con Anthropic. La página del modelo enumera Claude Code, Codex, LLM API y otros clientes de agente como casos de uso.
Precios que encajan en el presupuesto
La página actual del modelo en Felo muestra estas tarifas:
| Ítem | Tarifa |
|---|---|
| Entrada | $10.00 por 1M tokens |
| Salida | $50.00 por 1M tokens |
La página indica que el precio de lanzamiento puede ser hasta un 50% menor que las tarifas oficiales del proveedor API. El coste final depende del modelo, mezcla de entrada/salida, uso de caché y plan activo. La página actual de Felo muestra $10.00 / 1M tokens de entrada y $50.00 / 1M tokens de salida. Una estimación de coste incluye cada variable; la tarifa principal no representa la factura completa.
La documentación del modelo de OpenAI indica tarifas estándar de $10.00 por 1M tokens de entrada, $1.00 por 1M tokens de entrada en caché y $50.00 por 1M tokens de salida. Las escrituras en caché usan 1,25x la tarifa de entrada sin caché. Solicitudes por encima de 272K tokens de entrada usan 2x en entrada y caché, más 1,5x en salida para la solicitud completa. Batch y Flex usan el 50% de las tarifas estándar; el modo Fast usa 2x la tarifa aplicable. Estas son tarifas de referencia de OpenAI, no sustituyen el precio del plan Felo mencionado arriba.
| Fuente de precio | Entrada | Entrada en caché | Salida |
|---|---|---|---|
| Página de modelo Felo | $10.00 / 1M | La página enumera tarifas de entrada en caché y escritura en caché | $50.00 / 1M |
| Guía de modelo OpenAI | $10.00 / 1M | $1.00 / 1M | $50.00 / 1M |
Primer solicitud en cinco pasos
1. Crear una clave API
Crea una clave en tu cuenta de Felo API Platform y asígnala como variable de entorno:
export FELO_API_KEY="YOUR_API_KEY"
2. Configurar el endpoint
Para Chat Completions, utiliza:
https://openapi.felo.ai/api/v1/chat/completions
3. Configurar el ID de modelo
Envía "model": "gpt-6-astra" junto con un array messages. Esta solicitud cURL prueba la ruta:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. Añadir herramientas o salida estructurada
Los parámetros compatibles incluyen tools, tool_choice y response_format. El soporte para cada control depende del protocolo y la ruta de modelo seleccionados. GPT-6 Astra permite razonamiento; cuando el protocolo y la ruta exponen controles de razonamiento, conserva los metadatos de razonamiento devueltos al continuar una conversación.
OpenAI enumera estas herramientas de la API de Responses para GPT-6 Astra: búsqueda web, búsqueda de archivos, generación de imágenes, intérprete de código, shell alojado, aplicar parche, habilidades, uso de computadora, MCP y búsqueda de herramientas. Utiliza el endpoint Responses cuando un flujo de trabajo requiere estas herramientas alojadas. Las superficies expuestas y herramientas habilitadas en Felo pueden depender de la ruta activa.
5. Activar streaming
Configura stream en true para recibir eventos enviados por el servidor:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
Lista de verificación previa
- Estima el coste de entrada según la ventana de contexto de 1,05M.
- Configura
max_tokenspara mantener la salida dentro del presupuesto del proyecto. - Registra datos de entrada, salida, caché y plan para cada estimación de solicitud.
- Prueba prompts en el Playground antes de conectar una app o cliente de agente.
- Conserva muestras de regresión para herramientas, salida JSON y streaming.
- Configura
reasoning_efforten un nivel soportado y regístralo junto con datos de latencia y coste. - Usa las reglas de precios de OpenAI para comparar; usa el plan y ruta de Felo para la estimación pagable.
Comienza por la página del modelo
GPT-6 Astra reúne razonamiento, programación, análisis de contexto largo y trabajo de agente en una sola entrada de modelo. Felo OpenAPI ofrece a los equipos una vía de migración a través de Chat Completions, Responses y Messages. Un cliente existente puede permanecer sin cambios mientras la superficie de solicitud se adapta a la carga de trabajo.
Abre la página del modelo GPT-6 Astra para ver parámetros, ejemplos de código y acceso al Playground.
Fuentes: Página del modelo GPT-6 Astra en Felo API Platform, Anuncio de OpenAI sobre GPT-6 Astra y Guía de modelo GPT-6 Astra de OpenAI (consultado el 2026-09-04). El precio de Felo se verificó de nuevo el 2026-09-04.