Claude Haiku 5.5, Felo OpenAPI에서 출시
Anthropic의 가장 저렴하고 빠른 모델이 출시 당일 Felo OpenAPI에 도입됨. 백만 토큰당 $0.10/$0.50, 1M 컨텍스트, 적응형 사고 — 하나의 API 키.
Anthropic은 2026년 10월 7일 Claude Haiku 5.5를 출시했다. 오늘 바로 호출할 수 있다.
Felo OpenAPI는 출시 당일 claude-haiku-5-5 경로를 Anthropic의 공식 가격으로 추가했다. 입력 토큰 백만 개당 $0.10, 출력 토큰 백만 개당 $0.50, 프롬프트 최대 100,000 토큰까지 적용된다. Haiku 4.5보다 90% 저렴하다. Claude 5.5 패밀리에서 가장 빠른 모델이 가장 저렴하게 운영된다.
Claude Haiku 5.5를 Felo OpenAPI에서 사용해보기: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

이번 출시의 의미
Haiku는 항상 저렴했다. 이번 모델은 에이전트 루프를 돌릴 때 약점이 되지 않는다.
Anthropic은 Haiku 5.5를 가장 저렴하고 빠르며, 가장 강력한 소형 모델이라고 소개한다. 벤치마크 결과가 그 주장을 뒷받침한다. 이전 모델과 비교해보면:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| 입력 / 출력 | $1 / $5 | $0.10 / $0.50 |
| 캐시 읽기 | $0.10 | $0.01 |
| 컨텍스트 / 최대 출력 | 200K / 64K 토큰 | 1M / 128K 토큰 |
| 노력 조절 | — | 5단계, 기본 medium |
| OSWorld 2.1 (컴퓨터 사용) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (도구 없음) | 10.2% | 45.9% |
가격은 백만 토큰 기준, 프롬프트 최대 100,000 토큰까지. 벤치마크 수치는 Anthropic 발표 기준.
성능 향상이 가격 인하보다 크다. OSWorld 2.1 컴퓨터 사용 벤치마크에서 Haiku 5.5는 72.4%를 기록했다. Haiku 4.5는 15.7%였다. Terminal-Bench 4.0은 0.0%에서 39.2%로 상승했다. 예전에는 중급 모델이 필요했던 작업이 이제 Haiku 라인에서 처리된다.
가격 구조
Haiku 5.5는 Claude 패밀리 중에서 프롬프트 길이에 따라 가격이 달라진다.
- 프롬프트 100,000 토큰 이하: 입력 $0.10, 출력 $0.50, 캐시 읽기 $0.01 — 백만 토큰 기준.
- 프롬프트 100,000 토큰 초과: 입력 $0.50, 출력 $2.50, 캐시 읽기 $0.05.
다른 Claude 모델은 전체 컨텍스트 윈도우에 대해 하나의 고정 요금이 적용된다. Haiku 5.5만 예외다. 토큰 단위로 예산을 잡았다면 다시 계산해야 한다.
대부분의 작업에서는 경계가 문제되지 않는다. Anthropic에 따르면 Haiku 4.5 요청의 90%가 100,000 토큰 이하에서 이루어진다. 이들은 90% 인하된 가격을 적용받는다. Haiku 5.5는 최신 토크나이저를 사용한다. 같은 텍스트가 Haiku 4.5보다 약 30% 더 많은 토큰으로 계산된다. Anthropic은 평균 실행 비용 감소를 약 75%로 본다.
$0.01 캐시 읽기가 핵심이다. 에이전트 루프는 입력 예산 대부분을 이미 보낸 컨텍스트를 다시 읽는 데 사용한다. 백만 토큰당 1센트면 긴 대화도 부담 없이 유지된다.

달라진 점
적응형 사고와 노력 조절 기능. Haiku 5.5는 처음으로 effort 파라미터를 받는다. 사고는 기본적으로 작업에 맞게 조절된다. 다섯 단계의 노력 — low, medium, high, xhigh, max, 기본 medium — 비용과 속도를 응답 품질과 맞바꿀 수 있다. 낮은 노력에서는 단순 요청에 사고를 생략한다.
1M 토큰 컨텍스트, 최대 128K 출력. Haiku 4.5보다 컨텍스트 윈도우는 다섯 배, 출력 한도는 두 배다. 한 윈도우에 약 555,000 단어가 들어간다. 대부분의 코드베이스, 트랜스크립트, 문서 집합을 한 번에 처리할 수 있다.
새 토크나이저. Haiku 5.5는 Claude 4.7 이후 모델과 같은 토크나이저를 사용한다. 요청과 응답 형태는 유지되지만, 같은 텍스트에서 토큰 수가 더 많아진다. Haiku 4.5 기준으로 맞춘 max_tokens 한도와 비용 계산은 다시 조정해야 한다.
브라우저 사용과 더 강한 거절. 모델은 컴퓨터 사용과 함께 브라우저 사용 도구를 지원한다. 안전 분류기가 요청을 바로 거절할 수 있다. 클라이언트에서 stop_reason이 "refusal"일 수 있음을 고려해야 한다.
마이그레이션 전 알아야 할 다섯 가지 주요 변경점
Haiku 5.5는 Haiku 4.5에서 코드만 모델 ID로 바꿔서 바로 쓸 수 없다. Anthropic의 마이그레이션 가이드에 변경점이 정리되어 있다. 기존 요청을 깨뜨리는 다섯 가지는 다음과 같다.
- 수동 사고 예산 거부.
thinking: {"type": "enabled", "budget_tokens": N}는 400 에러를 반환한다. 적응형 사고와effort로 깊이를 조절해야 한다. 사고 텍스트는 기본적으로 생략된다. 스트리밍하려면thinking.display를"summarized"로 설정한다. - 샘플링 파라미터 거부.
temperature,top_p,top_k를 모두 생략해야 한다. 기본값이 아닌 값은 400 에러를 반환한다.top_p: 1도 포함된다. - Assistant prefill 거부.
messages는 사용자 턴으로 끝나야 한다. 구조화된 출력이 필요하면 enum 필드가 있는 구조화 출력이나 분류 도구를 사용한다. - 컴퓨터 사용 도구셋으로 이동. Claude API와 Google Cloud에서
computer_20250124를computer_toolset_20260801로 교체해야 한다. - 사고 블록은 계정에 묶이고 추가만 가능. 사고 블록은 생성한 계정에서만 유효하다. 이전 내용이 모두 그대로일 때만 유지된다. 사고 블록을 다시 보낼 때 대화는 추가만 가능해야 한다.
한 가지 조용한 변화도 있다. 사고 토큰이 max_tokens에 포함된다. 응답은 사고 블록으로 시작할 수 있다. 콘텐츠 블록은 위치가 아니라 type 필드로 선택해야 한다. max_tokens에 사고 여유를 둬야 한다.
전체 마이그레이션 가이드는 Anthropic 공식 문서에서 확인할 수 있다.
Felo OpenAPI에서 Haiku 5.5 호출하기
경로가 활성화되어 있다. 통합 예시는 다음과 같다.
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI는 세 가지 호환 엔드포인트를 제공한다. 기존 클라이언트를 그대로 사용할 수 있다.
| Surface | Method | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (Anthropic-compatible) | POST | https://openapi.felo.ai/api/v1/messages |
Messages 엔드포인트는 Anthropic 호환이다. Claude 스타일 클라이언트는 https://openapi.felo.ai/api로 base URL만 지정하면 된다. 서드파티 SDK도 동일하다. baseURL을 https://openapi.felo.ai/api/v1로 설정하고 기존 코드를 유지한다.
서버 전송 이벤트를 위해 "stream": true를 추가한다. 경로는 추론, 도구 호출, JSON 출력, 스트리밍, 비전 모두 지원한다. 카탈로그의 다른 모델과 동일하다.
Felo Pro를 이미 사용 중이면 바로 접근 가능
Felo Pro에는 Felo OpenAPI 모델 API 접근이 포함된다. 구독 중이라면 Haiku 5.5 호출에 별도 계정이 필요 없다. API 키를 생성하고 에이전트를 엔드포인트에 연결하면 기존 Felo 크레딧으로 호출할 수 있다. 같은 키로 Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 등 모든 모델을 사용할 수 있다.
두 가지를 기억해야 한다:
- Felo Pro 크레딧은 하나의 풀이다. 검색, 리서치 에이전트, 슬라이드, 이미지, API 호출 모두 같은 잔액에서 차감된다. 모델 호출은 토큰 단위로 청구된다. API를 많이 쓰면 크레딧 소모가 빠르다.
- 도구 API는 별도다. 모델 호출은 Pro 접근으로 커버된다. Web Fetch, X Search, PPT 생성 같은 도구는 Felo API Platform 크레딧을 사용한다.
Pro가 아니라면? 모든 Felo 계정은 하루 200 크레딧 무료로 제공된다. Haiku 5.5에 실제 요청을 보내고 체험할 수 있다.
Haiku 5.5의 위치

Haiku 5.5는 작업이 단순하지만 양이 많을 때 선택한다.
- 서브에이전트와 압축 — Anthropic은 요약, 압축, 서브에이전트 작업을 직접 추천한다. 어려운 추론은 Opus 5.5나 Sonnet 5.5로 처리하고, Haiku 5.5가 그 주변 루프를 1/10 가격으로 맡는다.
- 대량 분류, 라우팅, 추출 — 토큰당 비용이 기능 출시 여부를 결정한다. 입력 토큰 백만 개당 $0.10, 출력 토큰 백만 개당 $0.50이면 한 번 더 분류하는 비용이 예산 고민에서 벗어난다.
- 지원 봇과 지연 민감 UX — 라인업에서 가장 빠른 경로다. 노력 조절로 마지막 밀리초까지 줄일 수 있다.
- 장문 작업 — Haiku 가격에 1M 윈도우면 전체 트랜스크립트, 계약서, 로그 파일을 한 번에 처리할 수 있다.
가장 어려운 추론이 필요하면 Opus 5.5가 플래그십이다. Felo OpenAPI에서도 사용할 수 있다. Sonnet 5.5는 대부분의 프로덕션 작업에 균형점이다. Haiku 5.5는 예산 때문에 못 쓰던 곳에 쓸 수 있는 모델이다.
지금 바로 사용해보기
Haiku 5.5는 오늘 Felo OpenAPI에서 Anthropic 공식 가격으로, 기존 키로 사용할 수 있다.
Playground에서 코드 없이 프롬프트를 테스트하고, API 키를 받아 에이전트를 엔드포인트에 연결한다. 서브에이전트, 분류기, 지원 봇이 모델 ID 하나로 90% 저렴해진다.
→ Claude Haiku 5.5를 Felo OpenAPI에서 사용해보기
이 글은 다음 언어로도 읽을 수 있습니다: English, 简体中文, 日本語, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা, Português.