Felo OpenAPI에서 GPT-6 Astra: 1.05M 컨텍스트와 에이전트 도구
Felo OpenAPI는 1.05M 컨텍스트 윈도우, 128K 최대 출력, 그리고 호환되는 Chat Completions, Responses, Messages 엔드포인트와 함께 GPT-6 Astra를 추가했다.

긴 문서, 복잡한 코드, 다단계 에이전트 흐름은 팀이 모델 호출을 분할하게 만든다. Felo OpenAPI는 GPT-6 Astra를 제공하여 하나의 모델 ID로 이러한 작업을 호환 API 인터페이스에서 처리할 수 있다.
GPT-6 Astra 체험: https://openapi.felo.ai/models/openai/gpt-6-astra
GPT-6 Astra의 용도
GPT-6 Astra는 Felo API 플랫폼의 대표 GPT-6 등급이다. OpenAI는 이 모델을 복잡한 추론, 코딩, 컴퓨터 활용, 연구, 문서 작성에 가장 뛰어난 모델로 설명한다. Felo 모델 페이지는 추론, 도구, JSON, 스트리밍, 비전 기능을 명시한다.
모델 ID는 gpt-6-astra이다. 컨텍스트 윈도우는 1,050,000 토큰이고 최대 출력은 128,000 토큰이다. OpenAI는 지식 컷오프를 2026년 4월 30일로 명시한다. 이 용량으로 요청에 명세, 코드베이스 요약, 도구 정의, 대화 이력을 한 컨텍스트에 담을 수 있다.
OpenAI는 다섯 가지 추론 노력 설정을 제공한다: low, medium, high, xhigh, max. 품질 목표, 지연 시간, 요청 비용에 맞는 설정을 선택한다.
OpenAI 발표에 따르면 GPT-6 Astra는 Trusted Access Program의 기업에 제공되고, Plus, Pro, Business, Enterprise 접근이 며칠 내로 추가된다. Felo OpenAPI는 API 접근이 필요한 개발자를 위해 모델 경로를 제공한다.
세 가지 프로토콜, 하나의 모델 ID
Felo API 플랫폼은 세 가지 호환 요청 인터페이스를 제공한다:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
OpenAI 호환 클라이언트가 있는 앱은 요청 구조를 유지하고 model 값을 gpt-6-astra로 변경한다. Claude 스타일 클라이언트는 Anthropic 호환 Messages 인터페이스를 사용한다. 모델 페이지는 Claude Code, Codex, LLM API, 기타 에이전트 클라이언트를 활용 사례로 명시한다.
예산에 맞는 가격
현재 Felo 모델 페이지는 다음 요율을 명시한다:
| 항목 | 요율 |
|---|---|
| 입력 | $10.00 / 1M 토큰 |
| 출력 | $50.00 / 1M 토큰 |
페이지는 출시 가격이 공식 공급자 API 요율보다 최대 50% 저렴할 수 있다고 안내한다. 최종 비용은 모델, 입력/출력 비율, 캐시 사용, 활성 플랜에 따라 달라진다. 현재 Felo 페이지는 $10.00 / 1M 입력 토큰, $50.00 / 1M 출력 토큰을 명시한다. 비용 추정은 각 변수를 포함한다. 표기 요율이 전체 청구 금액은 아니다.
OpenAI 모델 문서는 표준 요율을 $10.00 / 1M 입력 토큰, $1.00 / 1M 캐시 입력 토큰, $50.00 / 1M 출력 토큰으로 명시한다. 캐시 기록은 비캐시 입력 요율의 1.25배를 사용한다. 272K 입력 토큰을 초과하는 요청은 전체 요청에 대해 입력 및 캐시 요율 2배, 출력 1.5배를 적용한다. Batch와 Flex는 표준 요율의 50%를, Fast 모드는 적용 요율의 2배를 사용한다. 이는 OpenAI 참고 요율이며, 위 Felo 플랜 가격을 대체하지 않는다.
| 가격 출처 | 입력 | 캐시 입력 | 출력 |
|---|---|---|---|
| Felo 모델 페이지 | $10.00 / 1M | 페이지에 캐시 입력 및 캐시 기록 요율 명시 | $50.00 / 1M |
| OpenAI 모델 가이드 | $10.00 / 1M | $1.00 / 1M | $50.00 / 1M |
다섯 단계로 첫 요청 만들기
1. API 키 생성
Felo API 플랫폼 계정에서 키를 생성하고 환경 변수로 설정한다:
export FELO_API_KEY="YOUR_API_KEY"
2. 엔드포인트 설정
Chat Completions의 경우 다음을 사용한다:
https://openapi.felo.ai/api/v1/chat/completions
3. 모델 ID 설정
"model": "gpt-6-astra"와 messages 배열을 전달한다. 아래 cURL 요청으로 경로를 테스트한다:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. 도구 또는 구조화 출력 추가
호환 파라미터에는 tools, tool_choice, response_format이 있다. 각 제어의 지원 여부는 선택한 프로토콜과 모델 경로에 따라 다르다. GPT-6 Astra는 추론을 지원한다. 프로토콜과 경로가 추론 제어를 제공하면, 대화를 이어갈 때 반환된 추론 메타데이터를 유지한다.
OpenAI는 GPT-6 Astra용 Responses API 도구로 웹 검색, 파일 검색, 이미지 생성, 코드 인터프리터, 호스팅 셸, 패치 적용, 스킬, 컴퓨터 사용, MCP, 도구 검색을 명시한다. 워크플로에 이러한 호스팅 도구가 필요하면 Responses 엔드포인트를 사용한다. Felo에서 노출되는 인터페이스와 활성화된 도구는 활성 경로에 따라 달라진다.
5. 스트리밍 활성화
stream을 true로 설정하면 서버 전송 이벤트를 수신한다:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
사전 점검 목록
- 1.05M 컨텍스트 윈도우에 맞춰 입력 비용을 산정한다.
max_tokens를 설정해 출력이 프로젝트 예산을 초과하지 않게 한다.- 각 요청 추정에 입력, 출력, 캐시, 플랜 데이터를 기록한다.
- 앱이나 에이전트 클라이언트 연결 전 Playground에서 프롬프트를 테스트한다.
- 도구, JSON 출력, 스트리밍에 대한 회귀 샘플을 보관한다.
reasoning_effort를 지원 수준으로 설정하고, 지연 시간 및 비용 데이터와 함께 기록한다.- 비교에는 OpenAI 가격 규칙을, 실제 청구 추정에는 Felo 플랜과 경로를 사용한다.
모델 페이지에서 시작
GPT-6 Astra는 추론, 코딩, 장문 분석, 에이전트 작업을 하나의 모델 엔트리로 제공한다. Felo OpenAPI는 Chat Completions, Responses, Messages를 통한 마이그레이션 경로를 팀에 제공한다. 기존 클라이언트는 그대로 두고 요청 인터페이스만 작업에 맞게 변경한다.
GPT-6 Astra 모델 페이지에서 파라미터, 코드 샘플, Playground 진입점을 확인한다.
출처: Felo API Platform GPT-6 Astra 모델 페이지, OpenAI GPT-6 Astra 발표, OpenAI GPT-6 Astra 모델 가이드 (2026-09-04 접속). Felo 가격은 2026-09-04에 재확인했다.