GPT-6 Astra auf Felo OpenAPI: 1,05M Kontext und Agenten-Tools
Felo OpenAPI integriert GPT-6 Astra mit einem 1,05M Kontextfenster, 128K maximaler Ausgabe sowie kompatiblen Chat Completions-, Responses- und Messages-Endpunkten.

Lange Dokumente, komplexer Code und mehrstufige Agenten-Flows verlangen von Teams, Modellaufrufe aufzuteilen. Felo OpenAPI stellt GPT-6 Astra bereit, sodass eine Modell-ID diese Arbeitslasten über kompatible API-Oberflächen verarbeitet.
GPT-6 Astra ausprobieren: https://openapi.felo.ai/models/openai/gpt-6-astra
Wofür GPT-6 Astra entwickelt wurde
GPT-6 Astra bildet die Spitzenklasse der GPT-6-Tarife auf der Felo API-Plattform. OpenAI beschreibt das Modell als leistungsfähig für komplexes Reasoning, Programmierung, Computeranwendungen, Recherche und Dokumentenerstellung. Die Modellseite von Felo nennt Reasoning, Tools, JSON, Streaming und Vision als Fähigkeiten.
Die Modell-ID lautet gpt-6-astra. Das Kontextfenster umfasst 1.050.000 Token und die maximale Ausgabe beträgt 128.000 Token. OpenAI gibt einen Wissensstand vom 30. April 2026 an. Diese Kapazität ermöglicht, Spezifikation, Codebasis-Zusammenfassung, Tool-Definitionen und Gesprächsverlauf in einem Arbeitskontext zu halten.
OpenAI bietet fünf Reasoning-Aufwand-Stufen: low, medium, high, xhigh und max. Wähle die Einstellung passend zur Qualitätsanforderung, Latenz und Kosten.
Die OpenAI-Ankündigung informiert, dass GPT-6 Astra im Trusted Access Program für Unternehmen eingeführt wird und Plus-, Pro-, Business- sowie Enterprise-Zugänge in den Folgetagen freigeschaltet werden. Felo OpenAPI stellt Entwicklern einen Modellpfad zur Verfügung, die API-Zugriff über die Plattform benötigen.
Drei Protokolle, eine Modell-ID
Die Felo API-Plattform bietet drei kompatible Anfrage-Oberflächen:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
Eine App mit OpenAI-kompatiblem Client behält ihre Anfrage-Struktur und ändert nur den model-Wert zu gpt-6-astra. Claude-Clients nutzen die Anthropic-kompatible Messages-Oberfläche. Die Modellseite nennt Claude Code, Codex, LLM API und andere Agenten-Clients als Anwendungsfälle.
Preise, die ins Budget passen
Die aktuelle Felo-Modellseite nennt diese Tarife:
| Position | Tarif |
|---|---|
| Input | $10.00 pro 1M Token |
| Output | $50.00 pro 1M Token |
Die Seite gibt an, dass Startpreise bis zu 50% unter den offiziellen Anbieter-API-Tarifen liegen können. Die endgültigen Kosten hängen vom Modell, Input/Output-Verhältnis, Cache-Nutzung und aktivem Plan ab. Die aktuelle Felo-Seite nennt $10.00 / 1M Input-Token und $50.00 / 1M Output-Token. Eine Kostenschätzung berücksichtigt jede Variable; der angegebene Tarif bildet nicht die gesamte Rechnung ab.
OpenAIs Modelldokumentation nennt Standardtarife von $10.00 pro 1M Input-Token, $1.00 pro 1M gecachte Input-Token und $50.00 pro 1M Output-Token. Cache-Schreibvorgänge nutzen 1,25x des ungecachten Input-Tarifs. Anfragen über 272K Input-Token verwenden 2x Input- und Cache-Tarife sowie 1,5x Output für die gesamte Anfrage. Batch und Flex nutzen 50% der Standardtarife; Fast-Modus verwendet 2x die jeweiligen Tarife. Dies sind OpenAI-Referenztarife und ersetzen nicht den oben genannten Felo-Planpreis.
| Preisquelle | Input | Gecachter Input | Output |
|---|---|---|---|
| Felo Modellseite | $10.00 / 1M | Seite nennt gecachte Input- und Cache-Schreib-Tarife | $50.00 / 1M |
| OpenAI Modellguide | $10.00 / 1M | $1.00 / 1M | $50.00 / 1M |
Erste Anfrage in fünf Schritten
1. API-Schlüssel erstellen
Erstelle einen Schlüssel im Felo API-Plattform-Konto und setze ihn als Umgebungsvariable:
export FELO_API_KEY="YOUR_API_KEY"
2. Endpunkt festlegen
Für Chat Completions nutze:
https://openapi.felo.ai/api/v1/chat/completions
3. Modell-ID festlegen
Übergebe "model": "gpt-6-astra" mit einem messages-Array. Diese cURL-Anfrage testet den Pfad:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. Tools oder strukturierte Ausgabe hinzufügen
Kompatible Parameter sind tools, tool_choice und response_format. Die Unterstützung für jede Steuerung hängt vom gewählten Protokoll und Modellpfad ab. GPT-6 Astra unterstützt Reasoning; wenn Protokoll und Pfad Reasoning-Steuerungen bereitstellen, bewahre zurückgegebenes Reasoning-Metadaten beim Fortsetzen des Gesprächs.
OpenAI nennt diese Responses API-Tools für GPT-6 Astra: Websuche, Dateisuche, Bildgenerierung, Code Interpreter, gehostete Shell, Patch anwenden, Skills, Computeranwendung, MCP und Toolsuche. Nutze den Responses-Endpunkt, wenn ein Workflow diese gehosteten Tools benötigt. Felos bereitgestellte Oberflächen und aktivierte Tools können vom gewählten Pfad abhängen.
5. Streaming aktivieren
Setze stream auf true, um Server-Sent Events zu empfangen:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
Checkliste vor dem Start
- Schätze die Input-Kosten im Verhältnis zum 1,05M Kontextfenster.
- Setze
max_tokens, um die Ausgabe im Projektbudget zu halten. - Erfasse Input-, Output-, Cache- und Plan-Daten für jede Anfrage-Schätzung.
- Teste Prompts im Playground, bevor eine App oder ein Agenten-Client verbunden wird.
- Bewahre Regression-Samples für Tools, JSON-Ausgabe und Streaming.
- Setze
reasoning_effortauf eine unterstützte Stufe und erfasse sie mit Latenz- und Kostendaten. - Nutze die OpenAI-Preisregeln zum Vergleich; verwende den Felo-Plan und Pfad für die zahlbare Schätzung.
Starte mit der Modellseite
GPT-6 Astra bündelt Reasoning, Programmierung, Langkontext-Analyse und Agentenarbeit hinter einer Modell-Eintragung. Felo OpenAPI bietet Teams einen Migrationspfad über Chat Completions, Responses und Messages. Ein bestehender Client bleibt bestehen, während die Anfrage-Oberfläche an die Arbeitslast angepasst wird.
Öffne die GPT-6 Astra Modellseite für Parameter, Codebeispiele und den Playground-Eintrag.
Quellen: Felo API-Plattform GPT-6 Astra Modellseite, OpenAI GPT-6 Astra Ankündigung und OpenAI GPT-6 Astra Modellguide (abgerufen am 04.09.2026). Felo-Preise wurden am 04.09.2026 erneut geprüft.