GPT-6.1 Sol API: Почти-Astra производительность по меньшей цене
OpenAI GPT-6.1 Sol обеспечивает почти-Astra производительность для программирования, работы с компьютером и профессиональных задач за $2/$10 за миллион токенов с контекстным окном 1,05M.
Новая модель Sol от OpenAI не стремится стать самой умной. Она создана для постоянной работы без больших затрат.
GPT-6.1 Sol занимает место между флагманской GPT-6 Astra и легкой GPT-6 Luna. На странице модели OpenAI описывает ее одной строкой: "Почти-Astra производительность для сложных задач по меньшей цене." Для команд, которые создают агентные инструменты для программирования, работы с компьютером и документооборотом, этот компромисс становится главным.
В этом обзоре собраны характеристики GPT-6.1 Sol, стоимость, отличия от GPT-6 Sol и Astra, а также инструкция по вызову через Felo API Platform.

Что такое GPT-6.1 Sol
GPT-6.1 Sol — модель рассуждения для сложного программирования, работы с компьютером и профессиональных задач. OpenAI позиционирует ее как сбалансированный вариант в линейке GPT-6: она мощнее Luna, дешевле Astra и достаточно сильна для большинства рабочих нагрузок без необходимости использовать флагман.
На странице модели указано, как ее применять: сравнить Sol с Astra на своих задачах и решить, оправдывает ли разница в качестве разницу в цене. Такой подход отражает назначение модели. Sol — инструмент для контроля расходов, а не рекордсмен по тестам.
Страница модели Felo подтверждает эту позицию с платформенной стороны. GPT-6.1 Sol — "обновление GPT-6 Sol, все еще ниже флагманской GPT-6 Astra." Модель справляется с агентным программированием, работой с компьютером, документооборотом и автоматизацией многошаговых процессов, приближаясь к результатам Astra на этих задачах при гораздо меньших расходах. По сравнению с GPT-6 Sol, Felo отмечает меньше фактических ошибок и более точное соблюдение явных ограничений.
GPT-6.1 Sol выбирают для сложных, длительных и повторяющихся задач — когда счет должен оставаться предсказуемым.
Характеристики GPT-6.1 Sol
OpenAI публикует полную спецификацию на странице модели. Краткая версия ниже.
| Характеристика | GPT-6.1 Sol |
|---|---|
| Model ID | gpt-6.1-sol |
| Default snapshot | gpt-6.1-sol |
| Контекстное окно | 1 050 000 токенов |
| Максимум вводных токенов | 922 000 |
| Максимум выводных токенов | 128 000 |
| Knowledge cutoff | 30 апреля 2026 |
| Ввод | Текст, изображение |
| Вывод | Текст |
| Не поддерживается | Аудио, видео |
| Поддержка reasoning token | Да |
| Уровни reasoning effort | low, medium (по умолчанию), high, xhigh, max |
| Не поддерживается reasoning effort | none, minimal |
| Data residency | США и ЕС |
Два момента важнее основных цифр.
Во-первых, reasoning effort нельзя отключить. GPT-6.1 Sol не поддерживает none и minimal. При миграции с модели, где эти настройки были доступны, OpenAI советует начать с low и сравнить результаты на типовых задачах.
Во-вторых, вызов инструментов требует Responses API. GPT-6.1 Sol поддерживает Chat Completions для запросов без инструментов, но любой процесс с функциями, поиском файлов, веб-браузингом или управлением компьютером должен перейти на Responses. Это не уникальное ограничение Sol — OpenAI движется в этом направлении по всей платформе.
Цены GPT-6.1 Sol: что дают $2/$10
Стандартная цена OpenAI для GPT-6.1 Sol — $2 за миллион вводных токенов и $10 за миллион выводных токенов. В таблице учтены цены на кэш, что влияет на расчет для долгих агентных процессов.
| Метрика | Цена за 1M токенов |
|---|---|
| Ввод | $2.00 |
| Кэшированный ввод | $0.10 |
| Запись в кэш | $2.50 |
| Вывод | $10.00 |
Под таблицей действуют несколько правил:
- Кэшированный ввод стоит 5% от обычной ставки. OpenAI оценивает чтение кэша GPT-6.1 Sol в 0.05x, против 0.1x для большинства моделей GPT-5.6 и новее. Это значительная скидка для агентов, которые используют большой системный prompt или контекст репозитория на каждом шаге.
- Запись в кэш стоит 1.25x обычной ставки ввода. $2.50 за миллион токенов при записи префикса в кэш, затем $0.10 за миллион при чтении.
- Длинный контекст дороже. Prompt выше 272K вводных токенов тарифицируется по двойной ставке ввода и кэша и 1.5x вывода для всего запроса. В этом случае ввод — $4, кэшированный ввод — $0.20, запись в кэш — $5, вывод — $15 за миллион токенов.
- Batch и Flex дешевле на 50%. Если задача допускает асинхронную обработку, ставка снижается до $1 ввода и $5 вывода за миллион токенов.
- Fast mode стоит вдвое дороже Standard. Платите за меньшую задержку, а не за большую интеллектуальность.
- Региональная обработка добавляет 10% к цене там, где она доступна.
Скидка на чтение кэша — скрытый главный момент. Агент, который использует один и тот же 100 000-токенный контекст репозитория двадцать раз, платит $0.10 за миллион кэшированных токенов вместо $2.00 за миллион новых вводных токенов. За долгую сессию разница быстро накапливается.
Для сравнения, GPT-6 Astra стоит $10 ввода и $50 вывода за миллион токенов. GPT-6.1 Sol — в пять раз дешевле по обоим направлениям. GPT-6 Luna еще дешевле: $0.10 ввода и $0.50 вывода, но теряет почти-Astra возможности, которые делают Sol интересной.

Новое в GPT-6, что доступно Sol
GPT-6.1 Sol наследует функции платформы GPT-6, которые OpenAI представила с поколением Astra. Несколько из них особенно важны для агентных задач.
Асинхронный вызов инструментов
Обычно вызов функции приостанавливает модель до получения результата от приложения. При асинхронном вызове инструментов параметр async: true в определении инструмента позволяет модели продолжать работу — рассуждать, вызывать другие инструменты или отвечать на независимые части запроса — пока приложение выполняет долгую задачу в фоне.
Приложение все равно выполняет инструмент и управляет ожидающей работой. Когда задача завершена, результат возвращается в следующем запросе Responses с исходным call_id. В документации OpenAI это описано как способ начать долгий поиск заранее и добавить ответ, когда данные готовы.
Для Sol это естественно. Агент программирования запускает длинный тест, продолжает проверять другие файлы и добавляет результаты теста по завершении.
Управление в середине хода
Mid-turn steering позволяет пользователю отправить исправление или новое требование, пока модель еще работает. Через WebSocket к Responses API сервер сохраняет выполненную работу и добавляет обновление в продолжение.
Важное ограничение: steering не переписывает уже отправленный вывод, не отменяет предыдущие действия и не отменяет инструменты, которые уже запущены. Меняется направление дальнейшей работы, а не прошлое. Если steering прерывает исходный ответ, он завершается с incomplete_details.reason: "steered", а новое сообщение содержит обновление.
Изменение reasoning в ходе диалога
Можно повысить или снизить уровень reasoning effort во время диалога, добавив элемент configuration_update во ввод. Обновленный уровень действует до следующего изменения. OpenAI советует не менять request-level reasoning.effort, чтобы префикс prompt оставался кэшируемым.
Это сочетание — дешевые чтения кэша плюс регулируемый reasoning — делает Sol экономичной для смешанных задач. Используйте low для рутинных шагов, переключайтесь на xhigh при сложных задачах без переписывания диалога.
Мультиагентность (бета)
Мультиагентность доступна как бета-функция для GPT-6.1 Sol и всех моделей GPT-5.6. Корневой агент может запускать подагентов, работающих параллельно, каждый с собственным контекстом, и объединять их результаты в финальный ответ.
OpenAI рекомендует использовать это для задач, которые делятся на независимые потоки: исследование разных частей большого кода, сравнение предложений, параллельный поиск источников или анализ нескольких причин сбоя одновременно. По умолчанию max_concurrent_subagents — 3.
Компромисс — расход токенов. Больше агентов — больше токенов, поэтому мультиагентность выгодна, когда важна скорость и сфокусированный контекст, а не экономия токенов.
Компакция и сохраненное reasoning
Долгие агенты заполняют контекстное окно. Компакция уменьшает размер контекста, сохраняя состояние для следующих ходов. Можно включить серверную компакцию через context_management с compact_threshold в запросе Responses; сервер отправляет зашифрованный элемент компакции при превышении порога токенов.
GPT-6.1 Sol поддерживает также reasoning.context: "all_turns", что позволяет совместимым reasoning элементам из предыдущих ходов переходить в следующий. Сохраненное reasoning остается непрозрачным — API не возвращает исходный reasoning текст модели — но обеспечивает непрерывность в долгой сессии.
WebSocket режим
WebSocket режим поддерживает постоянное соединение с Responses API и отправляет только новые элементы ввода на каждом шаге. OpenAI сообщает о примерно 40% более быстрой обработке при 20+ вызовах инструментов. Для модели, ориентированной на агентное программирование и работу с компьютером, это прямое снижение задержки.
GPT-6.1 Sol vs GPT-6 Sol vs Astra vs Luna
В семье GPT-6 теперь четыре уровня. Выбор зависит от требуемого качества и частоты запуска задачи.
| Модель | Позиционирование | Ввод / вывод за 1M | Лучшее применение |
|---|---|---|---|
| GPT-6 Astra | Максимальный интеллект | $10 / $50 | Сложное reasoning, программирование, профессиональные задачи |
| GPT-6.1 Sol | Почти-Astra по меньшей цене | $2 / $10 | Сложное программирование, работа с компьютером, документооборот |
| GPT-6 Sol | Предыдущий уровень Sol | $2 / $10 | Текущие Sol задачи до обновления |
| GPT-6 Luna | Быстрее и дешевле всех | $0.10 / $0.50 | Фокусные, массовые задачи |
GPT-6.1 Sol и GPT-6 Sol имеют одинаковую цену, но это разные модели. На странице Felo GPT-6.1 Sol описана как обновление с меньшим количеством фактических ошибок и более точным соблюдением ограничений. Ставка на чтение кэша также снижена вдвое: $0.10 за миллион токенов вместо $0.20. Если вы уже используете GPT-6 Sol в продакшене, обновление улучшает качество и экономику кэширования при той же цене.
OpenAI связывает уровень reasoning effort с типом задачи:
- GPT-6.1 Sol на medium — сложные технические задачи и координированные результаты, которые будут дорабатываться.
- GPT-6.1 Sol на extra high — готовые deliverables, связанные визуальные системы и решения на основе противоречивых данных.
- Astra на low — лаконичные тексты и адаптация контента с сохранением фактов и нюансов.
- Astra на medium — амбициозные проекты с широким контекстом, надежными взаимодействиями и полными результатами.
- Astra на extra high — сложный анализ и deliverables с высокими требованиями.
- Luna на low — точные правки, ограниченное решение задач и простая обработка данных.
- Luna на extra high — поиск текущего контекста в нескольких приложениях, приоритизация работы и решение задач с четкими ограничениями.
Практическое правило из Codex: используйте Sol для повторяющихся, длительных задач с кодом, приложениями и документами, когда важна цена. Оставьте Astra для самых сложных задач. Применяйте Luna для четких, повторяемых задач.
Как вызвать GPT-6.1 Sol через Felo API Platform
Felo API Platform предоставляет GPT-6.1 Sol через совместимые эндпоинты, поэтому можно сохранить текущий SDK и просто сменить базовый URL.
Модель доступна по адресам:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages (Anthropic-совместимый):
POST https://openapi.felo.ai/api/v1/messages
Шаг 1: Получите API ключ
Создайте ключ в своем аккаунте Felo API Platform и экспортируйте его:
export FELO_API_KEY="YOUR_API_KEY"
Шаг 2: Сделайте первый запрос
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "Explain the tradeoff between reasoning effort and cost."}
]
}'
Шаг 3: Используйте совместимый SDK
Направьте любой OpenAI-совместимый SDK на https://openapi.felo.ai/api/v1. Для клиентов в стиле Claude используйте Anthropic-совместимый базовый URL https://openapi.felo.ai/api.
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.FELO_API_KEY,
baseURL: "https://openapi.felo.ai/api/v1",
});
const response = await client.responses.create({
model: "gpt-6.1-sol",
reasoning: { effort: "medium" },
input: "Review this pull request for correctness, security, and missing tests.",
});
console.log(response.output_text);
Шаг 4: Включите стриминг при необходимости
Добавьте stream: true, чтобы получать события от сервера по мере работы модели.
На странице модели Felo GPT-6.1 Sol указана цена $2.00 за миллион вводных токенов и $10.00 за миллион выводных токенов, с запуском по цене до 50% ниже официальных API. Итоговая стоимость зависит от модели, соотношения ввода/вывода, использования кэша и активного тарифа. Чтения кэша тарифицируются вдвое дешевле, чем у GPT-6 Sol.
Платформа поддерживает reasoning, инструменты, JSON-вывод, стриминг и vision для этой модели, а также Playground для тестирования prompt до написания кода.
Лучшие сценарии использования GPT-6.1 Sol
OpenAI рекомендует применять модель для сложных проектов, где важна цена. Несколько конкретных паттернов выделяются.
Агентное программирование в масштабе
Агент, который читает репозиторий, предлагает изменения, запускает тесты и итерации — именно такой workload создан для Sol. Контекстное окно 1.05M вмещает большие кодовые базы, скидка на чтение кэша выгодна при повторном использовании контекста репозитория, асинхронный вызов инструментов поддерживает продуктивность агента во время тестов.
В Codex OpenAI рекомендует Sol для повторяющихся, длительных задач с кодом и приложениями, когда важна цена, а Astra — для самых сложных задач.
Работа с компьютером и автоматизация процессов
GPT-6.1 Sol поддерживает полный набор инструментов Responses: computer_use, hosted_shell, apply_patch, mcp, tool_search. Это делает модель пригодной для агентов, которые управляют ПО, заполняют формы, перемещают данные между системами или автоматизируют многошаговые бизнес-процессы.
На странице модели Felo указаны работа с компьютером и автоматизация процессов как основные сценарии.
Профессиональная работа с документами
Sol принимает текст и изображения, что охватывает сканы, графики, скриншоты и презентации. В руководстве по выбору модели OpenAI приведены два примера: создание презентации для совета директоров на основе финансовых результатов и создание сайта по брифу продукта. Оба случая включают большие входные данные, несколько итераций и высокий, но не максимальный, уровень качества.
Исследования и анализ с параллельными потоками
С включенной мультиагентностью Sol делит исследовательскую задачу на независимые потоки, запускает их параллельно и объединяет результаты. Сравнение предложений поставщиков, ревью pull request с трех сторон или анализ нескольких гипотез сбоя — хорошие примеры.
Массовая пакетная обработка
Batch и Flex снижают цену Sol до $1 ввода и $5 вывода за миллион токенов. Для ночной обработки документов, массового суммирования или крупной выборки, где вывод будет проверяться, такая цена расширяет возможности.
Чеклист миграции: переход с GPT-6 Sol на GPT-6.1 Sol
OpenAI советует изучить руководство по миграции перед переходом с gpt-6-sol на gpt-6.1-sol. Краткая версия ниже.
- Установите Model ID. Измените
modelнаgpt-6.1-sol. - Исправьте reasoning effort. GPT-6.1 Sol не поддерживает
noneиminimal. Заменитеnoneнаlow, тестируйте миграциюminimalначиная сlow. - Переведите вызов инструментов на Responses. Chat Completions работает для запросов без инструментов. Любой вызов функций, поиск в интернете, поиск файлов, работа с компьютером или MCP требует Responses API.
- Удалите неподдерживаемые параметры. При reasoning effort не равном
noneуберитеtemperature,top_p,top_logprobs. В Chat Completions также удалитеlogprobs. В Responses уберитеmessage.output_text.logprobsизinclude. - Обновите настройки кэширования prompt. При миграции с GPT-5.5 или старше замените
prompt_cache_retentionнаprompt_cache_options.ttlсо значением"30m". - Используйте
configuration_updateдля изменения reasoning. Если приложение меняет effort между ходами, используйте элементыconfiguration_updateвместо изменения request-levelreasoning.effort, чтобы префикс prompt оставался кэшируемым. - Проверьте data residency. GPT-6.1 Sol поддерживает хранение данных в США и ЕС. Fast mode недоступен при хранении данных в ЕС.
- Сравните с Astra. Запустите обе модели на типовых задачах и сравните качество, задержку и итоговую стоимость — включая reasoning токены, которые тарифицируются как выводные.
Ограничения и доступность
GPT-6.1 Sol не заменяет Astra полностью и пока доступна не везде.
Ограничения возможностей. OpenAI позиционирует Sol ниже Astra. Для самых сложных reasoning и важных deliverables Astra остается рекомендуемой моделью. Sol — экономичный вариант для сложных задач, а не максимальный по качеству.
Нет дообучения. GPT-6.1 Sol не поддерживает дообучение и предсказанный вывод. Также не поддерживаются embedding, генерация изображений, видео, речь, транскрипция, перевод и модерация. Это модель reasoning с вводом текст/изображение и выводом текст.
Нет аудио и видео ввода. Ввод — только текст и изображение.
Reasoning нельзя отключить. Уровни none и minimal не поддерживаются, поэтому каждый запрос включает reasoning overhead.
Роллаут продолжается. Запуск OpenAI охватывает Plus, Pro, Business, Enterprise и Edu планы в Codex на десктопе и CLI, а также ChatGPT Work на вебе и мобильных устройствах. Для Enterprise и Edu модель выключена по умолчанию до включения администратором. Free и Go планы не включены при запуске.
Fast mode с ограничениями. Standard и Fast доступны при запуске, но Fast mode стоит вдвое дороже Standard и недоступен при хранении данных в ЕС. Ultrafast для GPT-6.1 Sol появится позже.
Действуют лимиты запросов. Стандартные лимиты: от 500 RPM и 500 000 TPM на Tier 1 до 15 000 RPM и 40 000 000 TPM на Tier 5.
FAQ
Что такое GPT-6.1 Sol?
GPT-6.1 Sol — сбалансированная модель GPT-6 от OpenAI, между флагманской GPT-6 Astra и легкой GPT-6 Luna. OpenAI описывает ее как почти-Astra производительность для сложного программирования, работы с компьютером и профессиональных задач по меньшей цене.
Сколько стоит GPT-6.1 Sol?
OpenAI оценивает GPT-6.1 Sol в $2 за миллион вводных токенов и $10 за миллион выводных токенов. Кэшированный ввод — $0.10 за миллион токенов, запись в кэш — $2.50 за миллион токенов. Prompt выше 272K вводных токенов тарифицируется по повышенным ставкам.
Какое контекстное окно у GPT-6.1 Sol?
GPT-6.1 Sol имеет контекстное окно 1 050 000 токенов, максимум 922 000 вводных и 128 000 выводных токенов.
Поддерживает ли GPT-6.1 Sol вызов инструментов?
Да, но вызов инструментов требует Responses API. Chat Completions поддерживается для запросов без инструментов.
Можно ли отключить reasoning в GPT-6.1 Sol?
Нет. GPT-6.1 Sol поддерживает уровни reasoning effort: low, medium, high, xhigh, max. none и minimal не поддерживаются.
Как GPT-6.1 Sol сравнивается с GPT-6 Sol?
GPT-6.1 Sol — обновление GPT-6 Sol с меньшим количеством фактических ошибок и более точным соблюдением ограничений, согласно странице модели Felo. Оба имеют одинаковую цену за токены, но GPT-6.1 Sol снижает ставку кэшированного ввода до $0.10 за миллион токенов.
Доступна ли GPT-6.1 Sol на Felo API Platform?
Да. Felo API Platform предоставляет GPT-6.1 Sol через Chat Completions, Responses и Anthropic-совместимые Messages эндпоинты. Запуск по цене до 50% ниже официальных API, чтения кэша тарифицируются вдвое дешевле, чем у GPT-6 Sol.
Итог
GPT-6.1 Sol — ответ OpenAI на практическую задачу: лучшая модель слишком дорогая для всех задач, а самая дешевая часто недостаточно хороша. Sol занимает промежуточное положение с почти-Astra возможностями, контекстным окном 1.05M, ставкой чтения кэша 5% и ценой в пять раз ниже Astra.
Для команд, которые создают агентные решения для программирования, работы с компьютером и автоматизации документооборота, это модель для первого теста. Сравните ее с Astra на своих задачах, следите за расходом reasoning токенов и принимайте решение по соотношению цены и качества.
Попробуйте GPT-6.1 Sol в Felo API Platform Playground или вызовите напрямую с Felo API ключом.
Источники
- Страница модели GPT-6.1 Sol — OpenAI
- Использование GPT-6 — OpenAI
- Выбор модели — OpenAI
- API цены — OpenAI
- Доступность моделей Codex и ChatGPT — OpenAI
- Асинхронный вызов инструментов — OpenAI
- Mid-turn steering — OpenAI
- Reasoning модели — OpenAI
- Кэширование prompt — OpenAI
- Компакция — OpenAI
- Мультиагентность — OpenAI
- WebSocket режим — OpenAI
- Fast mode — OpenAI
- Хранение данных — OpenAI
- GPT-6.1 Sol — Felo API Platform
Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.