Skip to main content

GPT-6 Astra auf Felo OpenAPI: 1,05M Kontext und Agenten-Tools

· 5 Minuten gelesen
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPI integriert GPT-6 Astra mit einem 1,05M Kontextfenster, 128K maximaler Ausgabe sowie kompatiblen Chat Completions-, Responses- und Messages-Endpunkten.

GPT-6 Astra API Infografik-Cover mit 1,05M Kontext, 128K maximaler Ausgabe, $10 Input und $50 Output

Lange Dokumente, komplexer Code und mehrstufige Agenten-Flows verlangen von Teams, Modellaufrufe aufzuteilen. Felo OpenAPI stellt GPT-6 Astra bereit, sodass eine Modell-ID diese Arbeitslasten über kompatible API-Oberflächen verarbeitet.

GPT-6 Astra ausprobieren: https://openapi.felo.ai/models/openai/gpt-6-astra

Wofür GPT-6 Astra entwickelt wurde​

GPT-6 Astra bildet die Spitzenklasse der GPT-6-Tarife auf der Felo API-Plattform. OpenAI beschreibt das Modell als leistungsfähig für komplexes Reasoning, Programmierung, Computeranwendungen, Recherche und Dokumentenerstellung. Die Modellseite von Felo nennt Reasoning, Tools, JSON, Streaming und Vision als Fähigkeiten.

Die Modell-ID lautet gpt-6-astra. Das Kontextfenster umfasst 1.050.000 Token und die maximale Ausgabe beträgt 128.000 Token. OpenAI gibt einen Wissensstand vom 30. April 2026 an. Diese Kapazität ermöglicht, Spezifikation, Codebasis-Zusammenfassung, Tool-Definitionen und Gesprächsverlauf in einem Arbeitskontext zu halten.

OpenAI bietet fünf Reasoning-Aufwand-Stufen: low, medium, high, xhigh und max. Wähle die Einstellung passend zur Qualitätsanforderung, Latenz und Kosten.

Die OpenAI-Ankündigung informiert, dass GPT-6 Astra im Trusted Access Program für Unternehmen eingeführt wird und Plus-, Pro-, Business- sowie Enterprise-Zugänge in den Folgetagen freigeschaltet werden. Felo OpenAPI stellt Entwicklern einen Modellpfad zur Verfügung, die API-Zugriff über die Plattform benötigen.

Drei Protokolle, eine Modell-ID​

Die Felo API-Plattform bietet drei kompatible Anfrage-Oberflächen:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

Eine App mit OpenAI-kompatiblem Client behält ihre Anfrage-Struktur und ändert nur den model-Wert zu gpt-6-astra. Claude-Clients nutzen die Anthropic-kompatible Messages-Oberfläche. Die Modellseite nennt Claude Code, Codex, LLM API und andere Agenten-Clients als Anwendungsfälle.

Preise, die ins Budget passen​

Die aktuelle Felo-Modellseite nennt diese Tarife:

PositionTarif
Input$10.00 pro 1M Token
Output$50.00 pro 1M Token

Die Seite gibt an, dass Startpreise bis zu 50% unter den offiziellen Anbieter-API-Tarifen liegen können. Die endgültigen Kosten hängen vom Modell, Input/Output-Verhältnis, Cache-Nutzung und aktivem Plan ab. Die aktuelle Felo-Seite nennt $10.00 / 1M Input-Token und $50.00 / 1M Output-Token. Eine Kostenschätzung berücksichtigt jede Variable; der angegebene Tarif bildet nicht die gesamte Rechnung ab.

OpenAIs Modelldokumentation nennt Standardtarife von $10.00 pro 1M Input-Token, $1.00 pro 1M gecachte Input-Token und $50.00 pro 1M Output-Token. Cache-Schreibvorgänge nutzen 1,25x des ungecachten Input-Tarifs. Anfragen über 272K Input-Token verwenden 2x Input- und Cache-Tarife sowie 1,5x Output für die gesamte Anfrage. Batch und Flex nutzen 50% der Standardtarife; Fast-Modus verwendet 2x die jeweiligen Tarife. Dies sind OpenAI-Referenztarife und ersetzen nicht den oben genannten Felo-Planpreis.

PreisquelleInputGecachter InputOutput
Felo Modellseite$10.00 / 1MSeite nennt gecachte Input- und Cache-Schreib-Tarife$50.00 / 1M
OpenAI Modellguide$10.00 / 1M$1.00 / 1M$50.00 / 1M

Erste Anfrage in fünf Schritten​

1. API-Schlüssel erstellen​

Erstelle einen Schlüssel im Felo API-Plattform-Konto und setze ihn als Umgebungsvariable:

export FELO_API_KEY="YOUR_API_KEY"

2. Endpunkt festlegen​

Für Chat Completions nutze:

https://openapi.felo.ai/api/v1/chat/completions

3. Modell-ID festlegen​

Übergebe "model": "gpt-6-astra" mit einem messages-Array. Diese cURL-Anfrage testet den Pfad:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. Tools oder strukturierte Ausgabe hinzufügen​

Kompatible Parameter sind tools, tool_choice und response_format. Die Unterstützung für jede Steuerung hängt vom gewählten Protokoll und Modellpfad ab. GPT-6 Astra unterstützt Reasoning; wenn Protokoll und Pfad Reasoning-Steuerungen bereitstellen, bewahre zurückgegebenes Reasoning-Metadaten beim Fortsetzen des Gesprächs.

OpenAI nennt diese Responses API-Tools für GPT-6 Astra: Websuche, Dateisuche, Bildgenerierung, Code Interpreter, gehostete Shell, Patch anwenden, Skills, Computeranwendung, MCP und Toolsuche. Nutze den Responses-Endpunkt, wenn ein Workflow diese gehosteten Tools benötigt. Felos bereitgestellte Oberflächen und aktivierte Tools können vom gewählten Pfad abhängen.

5. Streaming aktivieren​

Setze stream auf true, um Server-Sent Events zu empfangen:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

Checkliste vor dem Start​

  • Schätze die Input-Kosten im Verhältnis zum 1,05M Kontextfenster.
  • Setze max_tokens, um die Ausgabe im Projektbudget zu halten.
  • Erfasse Input-, Output-, Cache- und Plan-Daten für jede Anfrage-Schätzung.
  • Teste Prompts im Playground, bevor eine App oder ein Agenten-Client verbunden wird.
  • Bewahre Regression-Samples für Tools, JSON-Ausgabe und Streaming.
  • Setze reasoning_effort auf eine unterstützte Stufe und erfasse sie mit Latenz- und Kostendaten.
  • Nutze die OpenAI-Preisregeln zum Vergleich; verwende den Felo-Plan und Pfad für die zahlbare Schätzung.

Starte mit der Modellseite​

GPT-6 Astra bündelt Reasoning, Programmierung, Langkontext-Analyse und Agentenarbeit hinter einer Modell-Eintragung. Felo OpenAPI bietet Teams einen Migrationspfad über Chat Completions, Responses und Messages. Ein bestehender Client bleibt bestehen, während die Anfrage-Oberfläche an die Arbeitslast angepasst wird.

Öffne die GPT-6 Astra Modellseite für Parameter, Codebeispiele und den Playground-Eintrag.

Quellen: Felo API-Plattform GPT-6 Astra Modellseite, OpenAI GPT-6 Astra Ankündigung und OpenAI GPT-6 Astra Modellguide (abgerufen am 04.09.2026). Felo-Preise wurden am 04.09.2026 erneut geprüft.