GPT-6 Astra su Felo OpenAPI: 1,05M di contesto, un solo ID modello
Felo OpenAPI aggiunge GPT-6 Astra con una finestra di contesto da 1,05M, output massimo di 128K e endpoint compatibili Chat Completions, Responses e Messages.

Documenti lunghi, codice complesso e flussi multi-step degli agenti portano i team a suddividere le chiamate ai modelli. Felo OpenAPI offre GPT-6 Astra, così un solo ID modello gestisce questi carichi tramite superfici API compatibili.
Prova GPT-6 Astra: https://openapi.felo.ai/models/openai/gpt-6-astra
Per cosa è progettato GPT-6 Astra
GPT-6 Astra rappresenta il livello di punta GPT-6 sulla piattaforma Felo API. La pagina del modello lo posiziona per ragionamento complesso, codifica avanzata, analisi di contesti lunghi e flussi di lavoro ad alta capacità per agenti. Elenca Ragionamento, Strumenti, JSON, Streaming e Visione tra le capacità.
Usa l’ID modello gpt-6-astra. La finestra di contesto è 1,05M token e l’output massimo è 128K token. Questa capacità consente a una richiesta di includere una specifica, un riassunto del codice, definizioni di strumenti e la cronologia della conversazione in un unico contesto operativo.
Tre protocolli, un solo ID modello
La piattaforma Felo API espone tre superfici di richiesta compatibili:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
Un’app con un client compatibile OpenAI mantiene la struttura della richiesta e cambia il valore model in gpt-6-astra. I client in stile Claude possono usare la superficie Messages compatibile Anthropic. La pagina del modello elenca Claude Code, Codex, LLM API e altri client agenti come casi d’uso.
Prezzi che rientrano nel budget
La pagina del modello elenca queste tariffe:
| Voce | Tariffa |
|---|---|
| Input | $5,00 per 1M token |
| Output | $30,00 per 1M token |
La pagina indica che il prezzo di lancio può essere fino al 50% inferiore rispetto alle tariffe ufficiali dei provider API. Il costo finale dipende dal modello, dalla combinazione input/output, dall’uso della cache e dal piano attivo. Una stima dei costi include ogni variabile; la tariffa principale non rappresenta il totale.
Effettua una prima richiesta in cinque passaggi
1. Crea una chiave API
Crea una chiave nel tuo account Felo API Platform e impostala come variabile d’ambiente:
export FELO_API_KEY="YOUR_API_KEY"
2. Imposta l’endpoint
Per Chat Completions, usa:
https://openapi.felo.ai/api/v1/chat/completions
3. Imposta l’ID modello
Passa "model": "gpt-6-astra" con un array messages. Questa richiesta cURL testa il percorso:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. Aggiungi strumenti o output strutturato
I parametri compatibili includono tools, tool_choice e response_format. Il supporto per ciascun controllo dipende dal protocollo selezionato e dal percorso del modello. GPT-6 Astra supporta il ragionamento; quando protocollo e percorso espongono controlli di ragionamento, conserva i metadati di ragionamento restituiti durante la continuazione della conversazione.
5. Attiva lo streaming
Imposta stream su true per ricevere eventi inviati dal server:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
Una checklist preflight
- Stima il costo input rispetto alla finestra di contesto da 1,05M.
- Imposta
max_tokensper mantenere l’output entro il budget del progetto. - Registra dati di input, output, cache e piano per ogni stima di richiesta.
- Testa i prompt nel Playground prima di collegare un’app o un client agente.
- Conserva campioni di regressione per strumenti, output JSON e streaming.
Inizia dalla pagina del modello
GPT-6 Astra offre ragionamento, codifica, analisi di contesti lunghi e lavoro degli agenti tramite un solo modello. Felo OpenAPI fornisce ai team un percorso di migrazione tramite Chat Completions, Responses e Messages. Un client esistente rimane in uso mentre la superficie di richiesta cambia per adattarsi al carico.
Apri la pagina modello GPT-6 Astra per parametri, esempi di codice e accesso al Playground.
Fonte: Felo API Platform, pagina modello GPT-6 Astra (consultata il 03-09-2026).