Claude Haiku 5.5 доступен на Felo OpenAPI
Самая дешевая и быстрая модель Anthropic появилась на Felo OpenAPI в день запуска. $0.10/$0.50 за миллион токенов, 1M контекст, адаптивное мышление — один API-ключ.
Anthropic выпустил Claude Haiku 5.5 7 октября 2026 года. Модель доступна для вызова уже сейчас.
Felo OpenAPI добавил маршрут claude-haiku-5-5 в день запуска по цене Anthropic: $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов для запросов до 100,000 токенов. Это на 90% дешевле, чем Haiku 4.5, и самая быстрая модель в линейке Claude 5.5 стала самой экономичной для запуска.
Попробуйте Claude Haiku 5.5 на Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Почему этот релиз важен
Каждая версия Haiku стоила дешево. Впервые модель способна работать в агентном цикле без слабых мест.
Anthropic называет Haiku 5.5 самой дешевой, быстрой и способной малой моделью из всех выпущенных. Бенчмарки подтверждают это. Сравните с предыдущей версией:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| Вход / выход | $1 / $5 | $0.10 / $0.50 |
| Чтение из кэша | $0.10 | $0.01 |
| Контекст / макс. выход | 200K / 64K токенов | 1M / 128K токенов |
| Контроль усилия | — | 5 уровней, по умолчанию средний |
| OSWorld 2.1 (использование компьютера) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (без инструментов) | 10.2% | 45.9% |
Цены за миллион токенов, для запросов до 100,000 токенов. Бенчмарки по данным Anthropic.
Рост возможностей превысил снижение цены. На OSWorld 2.1, бенчмарке использования компьютера, Haiku 5.5 набирает 72.4%, тогда как Haiku 4.5 — 15.7%. Terminal-Bench 4.0 вырос с 0.0% до 39.2%. Задачи, которые требовали средних моделей по цене в 20 раз выше, теперь решаются на Haiku.
О ценообразовании
Haiku 5.5 отличается от других моделей Claude одним важным моментом: цена зависит от длины запроса.
- Запросы до 100,000 токенов: $0.10 вход, $0.50 выход, $0.01 чтение из кэша — за миллион токенов.
- Запросы свыше 100,000 токенов: $0.50 вход, $2.50 выход, $0.05 чтение из кэша.
Остальные модели Claude используют единую ставку для всего окна контекста. Haiku 5.5 — исключение, поэтому любые расчеты по токенам стоит пересчитать.
Для большинства задач граница не возникает. Anthropic сообщает, что 90% запросов к Haiku 4.5 укладываются в 100,000 токенов, и получают полное снижение цены на 90%. Поскольку Haiku 5.5 использует новый токенизатор — тот же текст считается примерно на 30% больше токенов, чем в Haiku 4.5 — Anthropic оценивает среднее снижение затрат примерно в 75%, а не чистые 90%.
Главное число — $0.01 за чтение из кэша. Агентные циклы расходуют большую часть бюджета на повторное чтение контекста; за цент за миллион токенов поддерживать длинный диалог почти ничего не стоит.

Что еще изменилось
Адаптивное мышление с регулировкой усилия. Haiku 5.5 впервые принимает параметр effort. Мышление адаптируется к задаче по умолчанию, а пять уровней усилия — low, medium, high, xhigh, max, средний по умолчанию — позволяют выбирать между стоимостью, скоростью и качеством ответа. На низком усилии модель пропускает мышление для простых запросов.
Контекст 1M токенов, максимум вывода 128K. Окно контекста стало в пять раз больше, чем у Haiku 4.5, а потолок вывода — вдвое выше. Одно окно содержит примерно 555,000 слов — больше, чем большинство кодовых баз, транскриптов или наборов документов для анализа за один вызов.
Новый токенизатор. Haiku 5.5 использует тот же токенизатор, что Claude 4.7 и новее. Запросы и ответы сохраняют структуру, но счет токенов выше для того же текста, поэтому лимиты max_tokens и оценки затрат, рассчитанные для Haiku 4.5, требуют пересмотра.
Использование браузера и более строгие отказы. Модель поддерживает инструменты для браузера наряду с компьютерными, а классификаторы безопасности могут отклонить запрос полностью — ожидайте stop_reason со значением "refusal" в клиенте.
Пять критичных изменений перед миграцией
Haiku 5.5 нельзя просто заменить идентификатором модели в коде для Haiku 4.5. Руководство по миграции Anthropic перечисляет изменения; вот пять, которые ломают существующие запросы.
- Ручные бюджеты мышления отклоняются.
thinking: {"type": "enabled", "budget_tokens": N}возвращает 400. Используйте адаптивное мышление и управляйте глубиной черезeffort. Текст мышления теперь пропускается по умолчанию, поэтому установитеthinking.displayв"summarized", если хотите стримить его. - Параметры семплирования отклоняются. Не используйте
temperature,top_pиtop_k. Любое нестандартное значение возвращает 400 — включаяtop_p: 1. - Автозаполнение ассистента отклоняется. Завершайте
messagesходом пользователя. Для структурированного вывода используйте структурированные выходы или инструменты классификации с enum-полями вместо трюков с автозаполнением. - Использование компьютера перенесено в инструментальный набор. Замените
computer_20250124наcomputer_toolset_20260801в Claude API и Google Cloud. - Блоки мышления привязаны к аккаунту и только дополняются. Блок мышления остается валидным только в аккаунте, где создан, и только если все предыдущие части не изменились. Сохраняйте диалоги только дополняемыми при отправке блоков мышления обратно.
Еще одно изменение неявное: токены мышления учитываются в max_tokens, и ответ может начинаться с блока мышления до любого текста. Выбирайте блоки по полю type, а не по позиции, и оставляйте запас max_tokens для мышления.
Полное руководство по миграции доступно в документации Anthropic.
Вызов Haiku 5.5 на Felo OpenAPI
Маршрут уже работает. Вот вся интеграция.
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI предоставляет три совместимых интерфейса, поэтому можно использовать уже существующий клиент:
| Интерфейс | Метод | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (совместим с Anthropic) | POST | https://openapi.felo.ai/api/v1/messages |
Поскольку Messages-эндпоинт совместим с Anthropic, клиентам в стиле Claude нужно только указать базовый URL https://openapi.felo.ai/api. Сторонние SDK работают аналогично — установите baseURL на https://openapi.felo.ai/api/v1 и используйте существующий код.
Добавьте "stream": true для серверных событий. Маршрут поддерживает рассуждение, вызов инструментов, вывод JSON, стриминг и работу с изображениями — тот же интерфейс, что и остальная коллекция.
Если вы уже платите за Felo Pro, доступ уже есть
Felo Pro включает доступ к моделям Felo OpenAPI через API. Если оформлена подписка, второй аккаунт для вызова Haiku 5.5 не нужен: создайте API-ключ, направьте агента на эндпоинт, и ваши текущие кредиты Felo покрывают вызовы. Один ключ работает для всей линейки — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 и других.
Два момента для ясности:
- Кредиты Felo Pro — один пул. Поиск, агенты для исследований, слайды, изображения и API-вызовы расходуют общий баланс. Модельные вызовы тарифицируются по токенам, поэтому интенсивное использование API расходует кредиты быстрее, чем несколько поисков в день.
- API инструментов отдельные. Модельные вызовы покрываются Pro-доступом; инструменты вроде Web Fetch, X Search и PPT-генерации используют кредиты Felo API Platform.
Еще не на Pro? Каждый аккаунт Felo получает 200 бесплатных кредитов в день, этого хватает для реальных запросов к Haiku 5.5 до принятия решения.
Где применяют Haiku 5.5

Haiku 5.5 выбирают, когда задача простая, а объем большой.
- Субагенты и сжатие — Anthropic рекомендует использовать для суммаризации, сжатия и работы субагентов. Запускайте Opus 5.5 или Sonnet 5.5 для сложных рассуждений, а Haiku 5.5 обрабатывает цикл вокруг них за десятую часть цены.
- Массовая классификация, маршрутизация и извлечение — стоимость за токен определяет, появятся ли эти функции вообще. При $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов, дополнительная классификация больше не становится вопросом бюджета.
- Боты поддержки и UX с минимальной задержкой — самый быстрый маршрут в линейке, теперь с регулировкой усилия для сокращения последних миллисекунд.
- Работа с длинными документами — окно 1M токенов по цене Haiku позволяет обработать целые транскрипты, наборы контрактов или лог-файлы за один вызов без сложной выборки.
Если нужен максимум сложных рассуждений, Opus 5.5 остается флагманом и тоже доступен на Felo OpenAPI. Sonnet 5.5 — баланс для большинства рабочих задач. Haiku 5.5 — модель для тех случаев, где бюджет раньше не позволял запуск.
Попробуйте сейчас
Haiku 5.5 уже работает на Felo OpenAPI по цене Anthropic, за ключом, который у вас уже есть.
Начните в Playground, чтобы протестировать запросы без кода, затем получите API-ключ и направьте агента на эндпоинт — субагенты, классификаторы и боты поддержки теперь обходятся на 90% дешевле.
→ Попробуйте Claude Haiku 5.5 на Felo OpenAPI
Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.