DeepSeek V4 Flash теперь на Felo — бесплатно для Pro-подписчиков на 7 дней
DeepSeek V4 Flash теперь на Felo. Действующие подписчики Felo Pro получают 7 дней бесплатного доступа с 6 августа — с поиском, Codex/CC и Deep Research включительно.

31 июля вышла стабильная версия DeepSeek V4 Flash, и результаты удивили многих. Апрельский превью был неплохим, но эта версия — совсем другой уровень. Бенчмарки агентов выросли. DSpark с спекулятивным декодированием разгоняет пропускную способность свыше 60 токенов в секунду. И начиная с сегодняшнего дня, 6 августа, все действующие подписчики Felo Pro получают 7 дней бесплатного доступа к V4 Flash — с поиском, Codex и полным набором премиум-инструментов. Без апгрейда, без доплат, без банковской карты.
V4 Flash уже был лучшей моделью по соотношению цена/качество на рынке. Теперь он конкурирует с флагманскими системами в инженерных задачах, которые действительно востребованы каждый день. Вот что изменилось, почему это важно и что именно включает этот 7-дневный период.
Что изменилось с апреля
V4 Flash — это не урезанная версия V4 Pro. Он создавался с другими целями: максимальная скорость, низкое потребление ресурсов и удобство в реальных пайплайнах, а не только на бенчмарках.
Архитектура: 284 миллиарда общих параметров в схеме Mixture of Experts, при этом на каждый токен задействовано только 13 миллиардов. Это менее трети активных параметров DeepSeek V3. Тем не менее, он превосходит V3 почти по всем практическим тестам. Секрет — гибридная схема внимания: Compressed Sparse Attention (CSA) в паре с Heavily Compressed Attention (HCA), что снижает вычисления при инференсе до 10% от того, что требовалось V3 для такого же миллионного контекста.
Что это значит на практике: полный контекст в 1 миллион токенов работает на одной машине с 128 ГБ памяти. Это 750 000 слов. Весь кодовый репозиторий. 300-страничное юридическое дело. Три романа подряд. Без чанкинга, без скользящих окон, без ухищрений.
При контексте в 1 миллион токенов V4 Flash использует примерно 7% памяти KV-кэша, необходимой V3.2. Это не постепенное улучшение, а переход в другую категорию.
Вторая ключевая часть — DSpark. Это модуль спекулятивного декодирования, который генерирует и валидирует кандидаты токенов параллельно, фактически удваивая скорость. В итоге: 60+ токенов в секунду на обычном железе. Долгие сессии агентов ощущаются отзывчивыми, а не как ожидание компиляции.
У модели три режима рассуждения, которые можно переключать для каждого запроса:
| Режим | Поведение | Когда использовать |
|---|---|---|
| Non-Think | Быстро, без chain-of-thought | Быстрые ответы, переводы, черновики |
| Think High | Явное пошаговое рассуждение | Отладка, математика, структурный анализ |
| Think Max | Максимальная глубина рассуждений | Сложные доказательства, многошаговые агентные задачи |
Это не просто косметика. Используйте Non-Think для 90% запросов и переключайтесь на Think Max только при необходимости. Экономите время и токены, не ограничивая возможности.

Бенчмарки, которые действительно важны
Апрельский превью показал хорошие результаты. Продакшн-релиз 0731 построен вокруг посттренировочного этапа, сфокусированного почти исключительно на агентных возможностях. Прогресс очевиден:
| Бенчмарк | Превью (апрель) | Продакшн (0731) | V4 Pro (для сравнения) |
|---|---|---|---|
| SWE-bench Verified | — | 79.0% | 80.6% |
| Terminal Bench 2.1 | 61.8 | 82.7 | — |
| Cybergym | — | 76.7 | — |
| DeepSWE | 7.3 | 54.4 | — |
| GPQA Diamond | — | 71.2% | — |
| LiveCodeBench | — | 55.2% | 91.6% |
SWE-bench — тот самый тест, на который все ссылаются, и в этот раз это оправдано. 79.0% ставит V4 Flash всего в 1.6 пункта от V4 Pro, модели с более чем в 5 раз большим количеством активных параметров. Он оказывается в одном ряду с системами, которые стоят в 10–50 раз дороже за запрос.
Flash с 284 млрд параметров обходит апрельский превью Pro с 1.6 трлн параметров по агентному программированию. Основная заслуга — посттренировка, а не масштаб модели.
Честный компромисс: V4 Flash пока уступает Pro по воспроизведению знаний и задачам уровня олимпиадного программирования. Но это не те задачи, которыми заняты большинство инженеров. Чтение PR, отладка между файлами, рефакторинг, написание тестов — в реальной работе разница почти незаметна.
Что открывает 7-дневное бесплатное окно
В течение следующих 7 дней V4 Flash бесплатен для подписчиков Felo Pro. А Pro на Felo — это больше, чем просто выбор модели.
Pro Search с V4 Flash под капотом
Felo Search сочетает рассуждения V4 Flash с поиском по живой сети. Задайте вопрос на естественном языке. Felo собирает данные из разных источников на разных языках, синтезирует найденное и выдает прямой ответ с встроенными ссылками на источники. Без списка ссылок. Без SEO-мусора. Только ответ, привязанный к проверяемым источникам.
Pro Search идет глубже. Больше источников на запрос. Обработка длинных контекстов. Ответы, охватывающие крайние случаи, а не только очевидное. Deep Research превращает один вопрос в структурированный многостраничный отчет с заголовками и цитируемыми источниками — то, на что обычно уходит целый день ручной работы.
Интеграция Codex и CC
Это то, что особенно важно для разработчиков. V4 Flash нативно поддерживает Responses API от OpenAI, а значит, он сразу работает в Codex CLI, ChatGPT Desktop и расширении Codex для VS Code — без прослоек и костылей. Укажите deepseek-v4-flash в конфиге — и у вас фронтирный кодовый агент.
В течение 7 дней Pro-подписчики получают полный набор: агентное программирование с V4 Flash, оркестрация инструментов, редактирование нескольких файлов и контекст в 1 миллион токенов — весь репозиторий без чанкинга.

Остальные инструменты Pro
- 15 000 кредитов на старте + 200 кредитов ежедневно
- Неограниченное число Pro-поисков. Даже если кредиты закончились, остается 300 Pro-поисков в день
- Анализ файлов: загружайте PDF, CSV, код — V4 Flash обработает их
- Генерация слайдов: превращайте результаты поиска в презентации
- Ментальные карты: визуализируйте связи между источниками и понятиями
- Мульти-языковая агрегация: Felo читает источники на английском, китайском, японском, корейском и синтезирует на вашем языке
Без автопродления. Бесплатное окно закрывается через 7 дней, после чего V4 Flash возвращается к стандартной цене Pro.
Как получить бесплатный доступ
Три шага, меньше двух минут:
Шаг 1: Войдите в свой аккаунт Felo Pro на felo.ai. Предложение только для действующих Pro-подписчиков.
Шаг 2: С сегодняшнего дня, 6 августа, DeepSeek V4 Flash бесплатен на 7 дней. Предложение уже доступно в вашем кабинете — никаких кодов не нужно.
Шаг 3: Откройте Felo Search, выберите DeepSeek V4 Flash в выпадающем списке моделей и выполните Pro-поиск. Или зайдите на playground.felo.ai для прямого чата, либо укажите deepseek-v4-flash в конфиге Codex.
7-дневное окно начинается сегодня, 6 августа. Без очередей, без оплаты, без банковской карты.

Почему запускать V4 Flash через Felo, а не напрямую через API
Вы можете вызывать V4 Flash напрямую через API DeepSeek. Это дешево: $0.14 за миллион входных токенов, $0.28 за миллион выходных. Но чистый API-выход — это далеко не всё.
Актуальные данные. V4 Flash работает только с текстом. Он не ищет в интернете и имеет ограничение по дате обучения. Felo добавляет поверх живой поиск, так что вы получаете рассуждения на грани возможностей, но с опорой на свежую информацию, а не устаревшие веса.
Сравнение моделей бок о бок. В селекторе моделей Felo есть GPT-5.5, Claude Opus 5, Gemini 3.6 Flash и обе версии V4. Можно переключаться между моделями прямо в диалоге. Начните сессию с V4 Flash для скорости, переключитесь на Opus для второго мнения по сложной логике. Тот же контекст, те же источники.
Результаты поиска — не тупик. Экспортируйте находки в LiveDoc. Генерируйте слайды из ключевых идей. Стройте ментальные карты для визуализации связей. Бесплатное окно открывает весь этот пайплайн.
Временное, не постоянное. Это 7-дневное бесплатное окно для подписчиков Felo Pro. После окончания V4 Flash возвращается к стандартной цене Pro. Используйте неделю, чтобы понять, заслуживает ли он постоянного места в вашем рабочем процессе.
Как V4 Flash смотрится на фоне других моделей Felo
Felo дает доступ к целому стеку передовых моделей, не только DeepSeek. Вот где V4 Flash занимает своё место и когда стоит выбрать что-то другое.
V4 Flash против GPT-5.5. GPT-5.5 сильнее в тонких текстовых задачах, творчестве и неоднозначных инструкциях. Но на уровне API стоит заметно дороже за запрос. На Felo доступны обе. Если вы отлаживаете код или делаете быстрые поиски — V4 Flash часто быстрее. Если нужен текст с определённым стилем или сложным форматированием — GPT-5.5 всё ещё безопаснее.
V4 Flash против Claude Opus 5. Opus лидирует в длинных текстах, тщательных рассуждениях по книгам и следовании сложным форматам. V4 Flash быстрее, дешевле и теперь достаточно хорош на коде, чтобы многие разработчики использовали его по умолчанию. Opus — инструмент точности, когда результат должен быть идеальным.
V4 Flash против V4 Pro. Pro лучше в задачах, требующих глубоких знаний, олимпиадной математики и самых сложных кодовых задач. Flash лучше во всём остальном и настолько быстр, что вы забываете, что ждёте модель. Бесплатное окно покрывает обе. Используйте Pro для самых сложных задач, Flash — для всего остального.
V4 Flash против Gemini 3.6 Flash. Обе — скоростные модели с большим контекстом. Gemini поддерживает мультимодальный ввод (изображения, видео). V4 Flash — только текст, но сильнее в агентном программировании и имеет преимущество MIT-лицензии. Нужна работа с изображениями — берите Gemini. Нужен агент для кода — V4 Flash выигрывает.
FAQ
7-дневное бесплатное окно действительно бесплатно?
Да — для действующих подписчиков Felo Pro. Без карты, без автопродления. Окно открыто с 6 августа на 7 дней.
Что будет после 7 дней?
V4 Flash возвращается к стандартной цене Pro. Остальные функции Pro не меняются. Ничего не удаляется — история чатов, LiveDocs и сохранённые поиски сохраняются.
Нужно ли что-то устанавливать для интеграции с Codex?
Нет. V4 Flash нативно поддерживает Responses API. Укажите deepseek-v4-flash как модель в конфиге Codex — и он работает в Codex CLI, ChatGPT Desktop и расширении для VS Code. Одно изменение — работает везде.
Чем это отличается от прямого использования API DeepSeek?
API DeepSeek дешев и быстр. Felo добавляет поиск по сети в реальном времени, сравнение моделей и экспорт в документы, слайды и ментальные карты одним кликом. Если нужен только чистый инференс — используйте API. Если нужны ответы с поиском и рабочее пространство вокруг модели — Felo лучше.
Можно ли использовать V4 Flash на мобильном?
Да. Felo Search работает в любом мобильном браузере на felo.ai. LLM Playground на playground.felo.ai тоже адаптирован для мобильных.
Первая модель с открытыми весами, которую реально внедряют команды
Что отличает V4 Flash от других моделей с открытыми весами: инженерные команды внедряют его в продакшн как полноценную замену закрытым решениям. Не как эксперимент. Не как запасной вариант. А как основную модель.
MIT-лицензия. Полные веса на Hugging Face. Разрешено коммерческое дообучение. И с релизом 0731 агентные возможности перешли из "достаточно хорошо за свою цену" в "достаточно хорошо". 7-дневное бесплатное окно на Felo — самый простой способ для Pro-подписчиков проверить, подходит ли он для вашего рабочего процесса.
Войдите в Felo Pro и начните использовать DeepSeek V4 Flash бесплатно уже сегодня — 7-дневное окно закроется 12 августа.
Использовать DeepSeek V4 Flash бесплатно →
Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.