Felo OpenAPI의 GPT-6 Astra: 1.05M 컨텍스트, 하나의 모델 ID
Felo OpenAPI가 1.05M 컨텍스트 윈도우, 128K 최대 출력, 그리고 호환되는 Chat Completions, Responses, Messages 엔드포인트를 갖춘 GPT-6 Astra를 추가했다.

긴 문서, 복잡한 코드, 다단계 에이전트 흐름이 팀에게 모델 호출 분할을 요구한다. Felo OpenAPI는 GPT-6 Astra를 제공한다. 하나의 모델 ID로 호환되는 API 인터페이스에서 이런 작업을 처리한다.
GPT-6 Astra 사용하기: https://openapi.felo.ai/models/openai/gpt-6-astra
GPT-6 Astra의 목적
GPT-6 Astra는 Felo API Platform의 대표 GPT-6 등급이다. 모델 페이지는 복잡한 추론, 고급 코딩, 긴 컨텍스트 분석, 높은 능력의 에이전트 워크플로우에 적합하다고 설명한다. Reasoning, Tools, JSON, Streaming, Vision 기능을 제공한다.
모델 ID는 gpt-6-astra이다. 컨텍스트 윈도우는 1.05M 토큰이고 최대 출력은 128K 토큰이다. 이 용량으로 요청에 명세, 코드베이스 요약, 도구 정의, 대화 기록을 하나의 작업 컨텍스트에 담는다.
세 가지 프로토콜, 하나의 모델 ID
Felo API Platform은 세 가지 호환 요청 인터페이스를 제공한다:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
OpenAI 호환 클라이언트가 요청 구조를 유지하고 model 값을 gpt-6-astra로 바꾼다. Claude 스타일 클라이언트는 Anthropic 호환 Messages 인터페이스를 사용한다. 모델 페이지는 Claude Code, Codex, LLM API, 기타 에이전트 클라이언트 활용 사례를 제시한다.
예산에 맞는 가격
모델 페이지는 다음 요금을 안내한다:
| 항목 | 요금 |
|---|---|
| 입력 | 1M 토큰당 $5.00 |
| 출력 | 1M 토큰당 $30.00 |
페이지는 출시 가격이 공식 공급자 API 요금보다 최대 50% 낮을 수 있다고 안내한다. 최종 비용은 모델, 입력/출력 비율, 캐시 사용, 활성 요금제에 따라 달라진다. 비용 추정에는 각 변수가 포함된다. 표기 요금이 전체 청구서가 아니다.
첫 요청 만들기: 다섯 단계
1. API 키 생성
Felo API Platform 계정에서 키를 만들고 환경 변수로 설정한다:
export FELO_API_KEY="YOUR_API_KEY"
2. 엔드포인트 설정
Chat Completions에는 다음을 사용한다:
https://openapi.felo.ai/api/v1/chat/completions
3. 모델 ID 설정
"model": "gpt-6-astra"와 함께 messages 배열을 전달한다. 이 cURL 요청으로 경로를 테스트한다:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. 도구 또는 구조화 출력 추가
호환되는 파라미터에는 tools, tool_choice, response_format이 있다. 각 제어 지원 여부는 선택한 프로토콜과 모델 경로에 따라 달라진다. GPT-6 Astra는 추론을 지원한다. 프로토콜과 경로가 추론 제어를 제공하면 대화 이어갈 때 반환된 추론 메타데이터를 유지한다.
5. 스트리밍 활성화
stream을 true로 설정하면 서버 전송 이벤트를 받는다:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
사전 점검 목록
- 1.05M 컨텍스트 윈도우에 맞춰 입력 비용을 추정한다.
max_tokens를 설정해 출력이 프로젝트 예산 내에 있도록 한다.- 각 요청 추정에 입력, 출력, 캐시, 요금제 데이터를 기록한다.
- 앱이나 에이전트 클라이언트 연결 전에 Playground에서 프롬프트를 테스트한다.
- 도구, JSON 출력, 스트리밍 회귀 샘플을 보관한다.
모델 페이지에서 시작하기
GPT-6 Astra는 추론, 코딩, 긴 컨텍스트 분석, 에이전트 작업을 하나의 모델 엔트리로 제공한다. Felo OpenAPI는 팀에게 Chat Completions, Responses, Messages를 통한 마이그레이션 경로를 제공한다. 기존 클라이언트가 그대로 있고 요청 인터페이스만 작업에 맞게 바꾼다.
GPT-6 Astra 모델 페이지에서 파라미터, 코드 샘플, Playground 엔트리를 확인한다.
출처: Felo API Platform, GPT-6 Astra 모델 페이지 (2026-09-03 기준)