Skip to main content

Claude Haiku 5.5 доступен на Felo OpenAPI

· 9 минут чтения
Felo Search Tips Buddy
Committed to answers at your fingertips

Самая дешевая и быстрая модель Anthropic появилась на Felo OpenAPI в день запуска. $0.10/$0.50 за миллион токенов, 1M контекст, адаптивное мышление — один API-ключ.

Anthropic выпустил Claude Haiku 5.5 7 октября 2026 года. Модель доступна для вызова уже сейчас.

Felo OpenAPI добавил маршрут claude-haiku-5-5 в день запуска по цене Anthropic: $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов для запросов до 100,000 токенов. Это на 90% дешевле, чем Haiku 4.5, и самая быстрая модель в линейке Claude 5.5 стала самой экономичной для запуска.

Попробуйте Claude Haiku 5.5 на Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 на Felo OpenAPI: самый быстрый маршрут Haiku от Anthropic, на 90% дешевле Haiku 4.5

Почему этот релиз важен​

Каждая версия Haiku стоила дешево. Впервые модель способна работать в агентном цикле без слабых мест.

Anthropic называет Haiku 5.5 самой дешевой, быстрой и способной малой моделью из всех выпущенных. Бенчмарки подтверждают это. Сравните с предыдущей версией:

Claude Haiku 4.5Claude Haiku 5.5
Вход / выход$1 / $5$0.10 / $0.50
Чтение из кэша$0.10$0.01
Контекст / макс. выход200K / 64K токенов1M / 128K токенов
Контроль усилия—5 уровней, по умолчанию средний
OSWorld 2.1 (использование компьютера)15.7%72.4%
Terminal-Bench 4.00.0%39.2%
GDPval-AA v2.17351620
Humanity's Last Exam (без инструментов)10.2%45.9%

Цены за миллион токенов, для запросов до 100,000 токенов. Бенчмарки по данным Anthropic.

Рост возможностей превысил снижение цены. На OSWorld 2.1, бенчмарке использования компьютера, Haiku 5.5 набирает 72.4%, тогда как Haiku 4.5 — 15.7%. Terminal-Bench 4.0 вырос с 0.0% до 39.2%. Задачи, которые требовали средних моделей по цене в 20 раз выше, теперь решаются на Haiku.

О ценообразовании​

Haiku 5.5 отличается от других моделей Claude одним важным моментом: цена зависит от длины запроса.

  • Запросы до 100,000 токенов: $0.10 вход, $0.50 выход, $0.01 чтение из кэша — за миллион токенов.
  • Запросы свыше 100,000 токенов: $0.50 вход, $2.50 выход, $0.05 чтение из кэша.

Остальные модели Claude используют единую ставку для всего окна контекста. Haiku 5.5 — исключение, поэтому любые расчеты по токенам стоит пересчитать.

Для большинства задач граница не возникает. Anthropic сообщает, что 90% запросов к Haiku 4.5 укладываются в 100,000 токенов, и получают полное снижение цены на 90%. Поскольку Haiku 5.5 использует новый токенизатор — тот же текст считается примерно на 30% больше токенов, чем в Haiku 4.5 — Anthropic оценивает среднее снижение затрат примерно в 75%, а не чистые 90%.

Главное число — $0.01 за чтение из кэша. Агентные циклы расходуют большую часть бюджета на повторное чтение контекста; за цент за миллион токенов поддерживать длинный диалог почти ничего не стоит.

Цены Claude Haiku 5.5: $0.10 за миллион входных токенов до 100,000 токенов в запросе и снижение на 90% по сравнению с Haiku 4.5

Что еще изменилось​

Адаптивное мышление с регулировкой усилия. Haiku 5.5 впервые принимает параметр effort. Мышление адаптируется к задаче по умолчанию, а пять уровней усилия — low, medium, high, xhigh, max, средний по умолчанию — позволяют выбирать между стоимостью, скоростью и качеством ответа. На низком усилии модель пропускает мышление для простых запросов.

Контекст 1M токенов, максимум вывода 128K. Окно контекста стало в пять раз больше, чем у Haiku 4.5, а потолок вывода — вдвое выше. Одно окно содержит примерно 555,000 слов — больше, чем большинство кодовых баз, транскриптов или наборов документов для анализа за один вызов.

Новый токенизатор. Haiku 5.5 использует тот же токенизатор, что Claude 4.7 и новее. Запросы и ответы сохраняют структуру, но счет токенов выше для того же текста, поэтому лимиты max_tokens и оценки затрат, рассчитанные для Haiku 4.5, требуют пересмотра.

Использование браузера и более строгие отказы. Модель поддерживает инструменты для браузера наряду с компьютерными, а классификаторы безопасности могут отклонить запрос полностью — ожидайте stop_reason со значением "refusal" в клиенте.

Пять критичных изменений перед миграцией​

Haiku 5.5 нельзя просто заменить идентификатором модели в коде для Haiku 4.5. Руководство по миграции Anthropic перечисляет изменения; вот пять, которые ломают существующие запросы.

  1. Ручные бюджеты мышления отклоняются. thinking: {"type": "enabled", "budget_tokens": N} возвращает 400. Используйте адаптивное мышление и управляйте глубиной через effort. Текст мышления теперь пропускается по умолчанию, поэтому установите thinking.display в "summarized", если хотите стримить его.
  2. Параметры семплирования отклоняются. Не используйте temperature, top_p и top_k. Любое нестандартное значение возвращает 400 — включая top_p: 1.
  3. Автозаполнение ассистента отклоняется. Завершайте messages ходом пользователя. Для структурированного вывода используйте структурированные выходы или инструменты классификации с enum-полями вместо трюков с автозаполнением.
  4. Использование компьютера перенесено в инструментальный набор. Замените computer_20250124 на computer_toolset_20260801 в Claude API и Google Cloud.
  5. Блоки мышления привязаны к аккаунту и только дополняются. Блок мышления остается валидным только в аккаунте, где создан, и только если все предыдущие части не изменились. Сохраняйте диалоги только дополняемыми при отправке блоков мышления обратно.

Еще одно изменение неявное: токены мышления учитываются в max_tokens, и ответ может начинаться с блока мышления до любого текста. Выбирайте блоки по полю type, а не по позиции, и оставляйте запас max_tokens для мышления.

Полное руководство по миграции доступно в документации Anthropic.

Вызов Haiku 5.5 на Felo OpenAPI​

Маршрут уже работает. Вот вся интеграция.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI предоставляет три совместимых интерфейса, поэтому можно использовать уже существующий клиент:

ИнтерфейсМетодURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (совместим с Anthropic)POSThttps://openapi.felo.ai/api/v1/messages

Поскольку Messages-эндпоинт совместим с Anthropic, клиентам в стиле Claude нужно только указать базовый URL https://openapi.felo.ai/api. Сторонние SDK работают аналогично — установите baseURL на https://openapi.felo.ai/api/v1 и используйте существующий код.

Добавьте "stream": true для серверных событий. Маршрут поддерживает рассуждение, вызов инструментов, вывод JSON, стриминг и работу с изображениями — тот же интерфейс, что и остальная коллекция.

Если вы уже платите за Felo Pro, доступ уже есть​

Felo Pro включает доступ к моделям Felo OpenAPI через API. Если оформлена подписка, второй аккаунт для вызова Haiku 5.5 не нужен: создайте API-ключ, направьте агента на эндпоинт, и ваши текущие кредиты Felo покрывают вызовы. Один ключ работает для всей линейки — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7 и других.

Два момента для ясности:

  • Кредиты Felo Pro — один пул. Поиск, агенты для исследований, слайды, изображения и API-вызовы расходуют общий баланс. Модельные вызовы тарифицируются по токенам, поэтому интенсивное использование API расходует кредиты быстрее, чем несколько поисков в день.
  • API инструментов отдельные. Модельные вызовы покрываются Pro-доступом; инструменты вроде Web Fetch, X Search и PPT-генерации используют кредиты Felo API Platform.

Еще не на Pro? Каждый аккаунт Felo получает 200 бесплатных кредитов в день, этого хватает для реальных запросов к Haiku 5.5 до принятия решения.

Где применяют Haiku 5.5​

Где применяют Claude Haiku 5.5: массовая классификация, извлечение и работа субагентов между Sonnet 5.5 и Opus 5.5

Haiku 5.5 выбирают, когда задача простая, а объем большой.

  • Субагенты и сжатие — Anthropic рекомендует использовать для суммаризации, сжатия и работы субагентов. Запускайте Opus 5.5 или Sonnet 5.5 для сложных рассуждений, а Haiku 5.5 обрабатывает цикл вокруг них за десятую часть цены.
  • Массовая классификация, маршрутизация и извлечение — стоимость за токен определяет, появятся ли эти функции вообще. При $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов, дополнительная классификация больше не становится вопросом бюджета.
  • Боты поддержки и UX с минимальной задержкой — самый быстрый маршрут в линейке, теперь с регулировкой усилия для сокращения последних миллисекунд.
  • Работа с длинными документами — окно 1M токенов по цене Haiku позволяет обработать целые транскрипты, наборы контрактов или лог-файлы за один вызов без сложной выборки.

Если нужен максимум сложных рассуждений, Opus 5.5 остается флагманом и тоже доступен на Felo OpenAPI. Sonnet 5.5 — баланс для большинства рабочих задач. Haiku 5.5 — модель для тех случаев, где бюджет раньше не позволял запуск.

Попробуйте сейчас​

Haiku 5.5 уже работает на Felo OpenAPI по цене Anthropic, за ключом, который у вас уже есть.

Начните в Playground, чтобы протестировать запросы без кода, затем получите API-ключ и направьте агента на эндпоинт — субагенты, классификаторы и боты поддержки теперь обходятся на 90% дешевле.

→ Попробуйте Claude Haiku 5.5 на Felo OpenAPI

→ Создайте свой API-ключ


Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.