Anthropic выпустила Opus 5.5 22 сентября 2026 года

Claude Opus 5.5больше работы, меньше токенов

Первая модель семейства Claude 5.5. Она выходит на уровень Claude Fable 5.1 в большинстве задач, стоит на 40% меньше в эксплуатации, чем Opus 5, и выдаёт ответ более чем на 30% быстрее.

22 сент.
Выпуск 2026 года
Первая модель семейства Claude 5.5
4 $ / 20 $
API: вход / выход
За 1 млн токенов против 5 $ / 25 $ у Opus 5
medium
Effort по умолчанию
На ступень ниже Opus 5, который стартует с high
1 млн / 128 тыс.
Контекст / макс. вывод
То же окно, что у Opus 5, знания по июнь 2026 года

Уже в поиске Felo

Отдайте весь пакет документов, а потом задавайте вопрос.

Claude Opus 5.5 доступен в поиске Felo для задач с длинным вводом: сверять цифры между файлами, прослеживать утверждение до источника и выдавать ответ, который можно передать дальше.

Попробовать Opus 5.5 в поиске Felo

01

Удержать весь контекст

Окно контекста на 1 млн токенов и знания по июнь 2026 года. Длинная переписка, целый репозиторий или пакет документов остаются в одной задаче.

02

Проверять цифру, а не только вывод

Во внутреннем тесте Anthropic 16 отчётов из 18 прошли планку качества. Достаточно было одной выдуманной цифры или цитаты, чтобы работа провалилась.

03

Сказать, что сделано и чего не хватает

Anthropic переписала то, как модель общается: главное идёт первым, а отчёт прямо сообщает, что готово, что обнаружено и что осталось открытым.

Краткая инструкция

Переключиться на Claude Opus 5.5 в Felo

Claude Opus 5.5 появляется в выборе модели рядом с другими ведущими моделями вашего аккаунта.

Откройте выбор модели, выберите Claude Opus 5.5 и начните задачу в том же рабочем пространстве.

Чем отличается Opus 5.5

Само снижение стоимости и есть аргумент.

Anthropic делает ставку на эффективность, а не на более высокий балл в бенчмарке: меньше токенов на задачу, ниже цена за токен и на 40% меньше затрат на типичных нагрузках. Именно это делает длительную работу агентов по средствам.

01

Довести огромную работу до конца

Anthropic сообщает, что один из первых тестировщиков проверил и починил кодовую базу на 200 000 строк меньше чем за три часа, тогда как Opus 5 тратил больше 20 часов и в 2,5 раза больше токенов.

02

Найти ошибку до слияния

Deloitte сообщает, что даже на самой низкой ступени effort Opus 5.5 находил 72% известных ошибок при ревью кода против 56% у Opus 5 на high, при меньшем числе ложных срабатываний.

03

Оставить отчёт, которым можно пользоваться

Тексты короче и лучше структурированы. Box сообщает, что ответы стали на 40% менее многословными без потери точности, а токенов ушло втрое меньше, чем у Opus 5.

Выбор модели

Сравните цену токена с ценой ошибки.

Ниже — официальные публичные тарифы API за миллион токенов, а не цены подписки или использования в Felo. Строка effort важна не меньше строки цены: один и тот же запрос может стоить очень по-разному в зависимости от того, с какой ступени стартует модель.

Критерий
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
Цена API / 1 млн токенов
4 $ вход / 20 $ выход
10 $ вход / 50 $ выход
5 $ вход / 25 $ выход
10 $ вход / 50 $ выход
Чтение кэша / 1 млн токенов
0,20 $, это 0,05 от цены входа
0,25 $, это 0,025 от цены входа
0,50 $, стандартный коэффициент 0,1
Зависит от провайдера и уровня кэша
Effort по умолчанию
medium. Адаптивное мышление всегда включено и не отключается.
high. Адаптивное мышление всегда включено.
high. Мышление можно отключить на high и ниже.
Задаётся вызывающей стороной в каждом запросе
Где модель оправдана
Долгие агентные задачи по коду, ревью и работа со знаниями по цене среднего уровня.
Самая сложная логика и самые длинные агентные прогоны, когда Opus 5.5 не хватает даже на повышенном effort.
Предыдущая база Opus. Сравнивайте реальную доступность и задержки на своём трафике.
Флагманский уровень OpenAI по верхней границе прайса.

Публичные тарифы API и значения по умолчанию сверены 23 сентября 2026 года с анонсом Claude Opus 5.5 от Anthropic, страницами моделей Claude Platform и страницей GPT-6 Astra от OpenAI. Цена за токен — лишь часть общей стоимости задачи. Заявление Anthropic об эффективности — это снижение затрат на 40% на типичных нагрузках, что складывается из более низкой цены за токен и меньшего числа токенов на задачу.

Опубликованные результаты Anthropic

Где Opus 5.5 впереди, а где нет.

Anthropic опубликовала свои цифры рядом с Fable 5.1, Opus 5, GPT-6 Astra и GPT-5.6 Sol. Два из четырёх графиков ниже показывают точность относительно стоимости задачи, а не одну точность, потому что именно такое сравнение и проводит Anthropic.

Опубликованная Anthropic таблица сравнения Claude Opus 5.5 с Fable 5.1, Opus 5, GPT-6 Astra и GPT-5.6 Sol

Полное опубликованное сравнение

Агентная работа с кодом, работа со знаниями, бизнес-процессы, междисциплинарные рассуждения, научные исследования, работа с компьютером и распознавание графиков по всем пяти измеренным моделям.

Опубликованные Anthropic графики по агентной работе с кодом для Claude Opus 5.5

Агентная работа с кодом

Terminal-Bench 4.0, FrontierCode v1.1 и CursorBench 4.0 в виде зависимости точности от стоимости задачи.

Опубликованные Anthropic графики по работе со знаниями для Claude Opus 5.5

Работа со знаниями

GDPval-AA v2.1 по 44 профессиям, AutomationBench и WANDR — бенчмарк сбора данных от Perplexity.

Опубликованные Anthropic графики по работе с компьютером и рассуждениям для Claude Opus 5.5

Работа с компьютером и рассуждения

OSWorld 2.0, Humanity's Last Exam и Chartography, где последний измеряет точность считывания значений с графика.

Опубликованные Anthropic графики точности относительно стоимости задачи для Claude Opus 5.5

Точность относительно стоимости задачи

Главный тезис Anthropic — не более высокий балл любой ценой, а тот же или лучший результат за долю стоимости попытки.

Цифры опубликованы производителем. Если не указано иное, Anthropic запускала Opus 5.5 с адаптивным мышлением на max effort и оценивала его с включёнными производственными защитами. Когда эти защиты срабатывали, задачи по кибербезопасности выполняла Opus 4.8, а по биологии — Opus 5, что, вероятно, занижает опубликованные показатели Opus 5.5 в этих бенчмарках. Данные GPT-6 Astra и GPT-5.6 Sol приведены так, как их сообщает OpenAI. Разрывы в бенчмарках между производителями — слабый ориентир для реальных различий, о чём Anthropic говорит и сама.

Если вы уже используете Opus 5

Четыре изменения, которые ломают существующий код.

Anthropic перечисляет четыре несовместимых изменения для интеграций, уже работающих на Claude Opus 5, плюс пятое, которое меняет форму ответа, не приводя к ошибке запроса. Их стоит прочитать до замены идентификатора модели, потому что три из них возвращают ошибку 400 вместо тихой деградации.

01

Мышление больше нельзя отключить

В Opus 5 мышление отключалось на high и ниже. В Opus 5.5 оно всегда включено, и как отключение, так и ручной бюджет токенов возвращают ошибку 400. Единственным регулятором становится effort, а значение по умолчанию меняется с high на medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

Принудительный вызов инструментов отклоняется

tool_choice со значением "any" или с указанием конкретного инструмента возвращает ошибку 400, в том числе на эндпоинте подсчёта токенов. Используйте auto вместе со строгим вызовом инструментов или структурированным выводом и указывайте в промпте, когда инструмент уместен.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Блоки мышления привязаны к модели

Каждый блок мышления фиксирует, какая модель его создала. Opus 5.5 читает блоки Opus 5 и более ранних моделей Opus, Sonnet и Haiku, но не Fable и Mythos. Если маршрутизатор переводит диалог на другую модель, последующие ходы выполняются без прежних рассуждений.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 сохраняют мышление; остальные модели его теряют

04

Старый инструмент работы с компьютером убран

В Claude API и Google Cloud инструмент computer_20251124 возвращает ошибку 400. Объявите вместо него набор computer_toolset_20260801, уберите бета-заголовок и адаптируйте цикл агента под блоки member tool_use. В Amazon Bedrock старый инструмент продолжает работать.

computer_20251124 -> computer_toolset_20260801

Теперь effort — единственный регулятор мышления

Раз мышление нельзя отключить, настраивают effort. Opus 5.5 поддерживает все пять ступеней и стартует с medium, на ступень ниже Opus 5. Anthropic рекомендует заново прогнать перебор на своих оценках, а не переносить настройку, и задавать большой max_tokens на высоких ступенях: токены мышления учитываются в этом лимите, даже когда текст рассуждений не возвращается.

Ступень
По умолчанию
Рекомендация Anthropic
low
Нет
Самая экономная ступень с некоторой потерей возможностей. Anthropic советует её для простых задач и подагентов.
medium
Да
Значение по умолчанию для Opus 5.5. По словам Anthropic, на оценках по коду и работе со знаниями он не уступает Opus 5 на high и превосходит его.
high
Нет
Значение по умолчанию для большинства других моделей Claude. Сложные рассуждения и трудные задачи по коду.
xhigh
Нет
Длительная агентная работа и работа с кодом дольше 30 минут с бюджетами в миллионы токенов.
max
Нет
Самое глубокое доступное рассуждение без ограничений на расход токенов. Оставьте для задач, где вы измерили прирост качества.

Effort — это поведенческий сигнал, а не жёсткий бюджет токенов: на низкой ступени модель всё равно думает над действительно сложными задачами, просто меньше, чем на высокой. Anthropic также отмечает, что на одной и той же ступени Opus 5.5 думает больше за ход, чем Opus 5, особенно на xhigh и max, поэтому перенесённая настройка даст более длинные и дорогие ходы.

Где это уместно

Работа, за которой не уследить.

Opus 5.5 оправдан, когда задача идёт часами, охватывает больше файлов, чем человек способен удержать, или выдаёт результат, который должен проверить кто-то ещё. Это те случаи, которые описывают Anthropic и её первые тестировщики, а не обычные чат-промпты.

Миграции и аудит по всему репозиторию

Провести изменение через большой репозиторий, пока не пройдут тесты, вместо остановки на первом правдоподобном патче. Anthropic сообщает о миграции на 680 000 строк, завершённой одним тестировщиком меньше чем за день.

Ревью, которое находит настоящую ошибку

Тестировщик Anthropic под названием Column сообщил, что нашёл ошибку, сверившись с внешней документацией по сторонней интеграции, которая была неверно смоделирована несколько коммитов назад.

Финансовый и документальный анализ

Сначала построить модель, затем одностраничное резюме, сохранив оговорки. Anthropic сообщает об анализе слияния за 63 минуты против 93 у Opus 5 и вдвое дешевле.

Долго работающие команды агентов

Модель делегирует подагентам и подстраивает темп под бюджет времени. Anthropic рекомендует передавать мультиагентной системе сигнал о прошедшем времени, чтобы она распараллеливалась, а не выстраивалась в очередь.

Проверьте на длинной задаче

01

Принесите реальный контекст

Добавьте репозиторий, документы и требования, которые должна учесть полезная работа. Окно на 1 млн токенов существует именно для этого.

02

Назовите условие завершения

Скажите, что должно быть верно, чтобы работа считалась законченной. Совет Anthropic для работы без присмотра — держать части задачи в чек-листе, который модель обновляет.

03

Сравните готовый результат

Прогоните одну и ту же задачу на Opus 5.5, Opus 5 и Fable 5.1 в Felo. Сравнивайте не только ответ, но и тесты, оговорки и расход токенов.

Выберите Claude Opus 5.5, когда он появится в списке моделей вашего аккаунта.

Попробовать Opus 5.5 в Felo

Частые вопросы о Claude Opus 5.5

Claude Opus 5.5 — модель Anthropic для длительной агентной работы с кодом и работы со знаниями, выпущенная 22 сентября 2026 года как первая модель семейства Claude 5.5. По словам Anthropic, она выходит на уровень Claude Fable 5.1 в большинстве задач и стоит на 40% меньше в эксплуатации, чем Claude Opus 5.

Запустите длинную задачу по более низкой цене.

Поставьте Claude Opus 5.5 рядом с другими ведущими моделями в Felo и проверьте его на той работе, которую вы откладывали, потому что она занимает часы.

Попробовать Opus 5.5 в Felo

Начните с поиска Felo AI и выберите модель там, где она доступна.