DeepSeek V4 Flash ya está en Felo — Gratis para suscriptores Pro durante 7 días
DeepSeek V4 Flash ya está disponible en Felo. Los suscriptores actuales de Felo Pro obtienen 7 días de acceso gratuito a partir del 6 de agosto — con Search, Codex/CC y Deep Research incluidos.

DeepSeek V4 Flash lanzó su versión de producción el 31 de julio, y los resultados sorprendieron a todos. La versión previa de abril estuvo bien. Esta versión es diferente. Los benchmarks de agentes se dispararon. DSpark, con decodificación especulativa, supera los 60 tokens por segundo. Y desde hoy, 6 de agosto, los suscriptores actuales de Felo Pro obtienen 7 días de acceso gratuito a V4 Flash — con Search, Codex y todo el kit premium incluido. Sin actualizaciones, sin pagos extra, sin tarjeta de crédito.
V4 Flash ya era el modelo con mejor relación calidad-precio del mercado. Ahora compite de tú a tú con sistemas de gama alta en las tareas de ingeniería que la gente realmente hace a diario. Aquí te contamos qué cambió, por qué es importante y qué incluye exactamente esta ventana de 7 días.
Qué cambió entre abril y ahora
V4 Flash no es una versión recortada de V4 Pro. Se diseñó con otros objetivos: velocidad pura, bajo consumo de recursos y utilidad en pipelines reales, no solo en tablas de benchmarks.
La arquitectura: 284 mil millones de parámetros totales en un esquema Mixture of Experts, con solo 13 mil millones activos por token. Eso es menos de un tercio de los parámetros activos de DeepSeek V3. Aun así, supera a V3 en casi todos los benchmarks prácticos. La diferencia está en un diseño híbrido de atención — Compressed Sparse Attention (CSA) junto con Heavily Compressed Attention (HCA) — que reduce los FLOPs de inferencia al 10% de lo que V3 necesitaba para el mismo contexto de un millón de tokens.
¿Qué significa esto en la práctica? Una ventana de contexto completa de 1 millón de tokens corre en una sola máquina de 128GB. Eso son 750,000 palabras. Una base de código entera. Un expediente legal de 300 páginas. Tres novelas seguidas. Sin dividir en fragmentos, sin ventanas deslizantes, sin trucos.
Con 1M de contexto, V4 Flash usa aproximadamente el 7% de la memoria de caché KV que necesitaba V3.2. No es una mejora incremental. Es otra categoría.
DSpark es la otra pieza clave. Es un módulo de decodificación especulativa que genera y valida tokens candidatos en paralelo, duplicando efectivamente el rendimiento. El resultado: más de 60 tokens por segundo en hardware común. Las sesiones largas de agentes se sienten ágiles, no como esperar a que compile un build.
El modelo tiene tres modos de razonamiento que puedes alternar por solicitud:
| Modo | Comportamiento | Cuándo usarlo |
|---|---|---|
| Non-Think | Rápido, sin razonamiento en cadena | Búsquedas rápidas, traducciones, borradores |
| Think High | Razonamiento paso a paso explícito | Depuración, matemáticas, análisis estructurado |
| Think Max | Máxima profundidad de razonamiento | Pruebas complejas, flujos de trabajo de agentes multi-paso |
Esto no es solo apariencia. Usa Non-Think para el 90% de tus prompts y cambia a Think Max solo cuando el problema realmente lo requiera. Ahorras tiempo y tokens sin limitar el potencial.

Los benchmarks que realmente importan
La versión previa de abril mostró buenos números. El lanzamiento de producción 0731 se centró en una etapa de post-entrenamiento orientada casi exclusivamente a capacidades agenticas. El salto no es sutil:
| Benchmark | Previa (abril) | Producción (0731) | V4 Pro (referencia) |
|---|---|---|---|
| SWE-bench Verified | — | 79.0% | 80.6% |
| Terminal Bench 2.1 | 61.8 | 82.7 | — |
| Cybergym | — | 76.7 | — |
| DeepSWE | 7.3 | 54.4 | — |
| GPQA Diamond | — | 71.2% | — |
| LiveCodeBench | — | 55.2% | 91.6% |
SWE-bench es el benchmark que todos citan, y por una vez la obsesión está justificada. 79.0% coloca a V4 Flash a solo 1.6 puntos de V4 Pro, un modelo con más de 5 veces los parámetros activos. Está en la misma conversación que sistemas que cuestan de 10 a 50 veces más por consulta.
El Flash de 284B parámetros supera a la versión previa de abril del Pro de 1.6T parámetros en codificación agentica. El post-entrenamiento es el factor clave aquí, no la escala del modelo.
El intercambio honesto: V4 Flash aún queda por detrás de Pro en recuperación de conocimiento puro y problemas de codificación de nivel competitivo. Pero esas no son las tareas en las que la mayoría de ingenieros pasan su día. Leer PRs, depurar entre archivos, refactorizar, escribir tests — en trabajo de ingeniería real, la diferencia es casi invisible.
Qué desbloquea realmente la ventana gratuita de 7 días
Durante los próximos 7 días, V4 Flash es gratis para suscriptores de Felo Pro. Y Pro en Felo es mucho más que un selector de modelos.
Pro Search con V4 Flash como motor
Felo Search combina el razonamiento de V4 Flash con búsqueda web en tiempo real. Haz una pregunta en lenguaje natural. Felo extrae información de fuentes en varios idiomas, sintetiza lo que encuentra y te da una respuesta directa con citas en línea. Sin listas de enlaces. Sin basura SEO. Solo la respuesta, anclada a fuentes que puedes consultar y verificar.
Pro Search va más allá. Más fuentes por consulta. Contextos más largos procesados. Respuestas que cubren casos límite en vez de quedarse en lo obvio. El modo Deep Research convierte una sola pregunta en un informe estructurado de varias páginas con secciones y fuentes citadas. El tipo de informe que normalmente te llevaría una tarde compilar a mano.
Integración con Codex y CC
Esta es la parte que más interesará a los desarrolladores. V4 Flash soporta de forma nativa la API de Responses de OpenAI, lo que significa que se integra en Codex CLI, ChatGPT Desktop y la extensión de Codex para VS Code sin capas de traducción ni parches de compatibilidad. Configura deepseek-v4-flash en tu archivo de configuración y tendrás un agente de codificación de última generación funcionando.
Durante la ventana de 7 días, los suscriptores Pro obtienen el paquete completo: codificación agentica con V4 Flash en el bucle, orquestación de herramientas, edición multi-archivo y una ventana de contexto de 1M de tokens que cabe todo tu repositorio sin dividirlo.

El resto del kit Pro
- 15,000 créditos cargados de inicio, más 200 créditos diarios
- Búsquedas Pro ilimitadas. Incluso si te quedas sin créditos, sigues teniendo 300 búsquedas Pro al día
- Análisis de archivos: sube PDFs, CSVs, archivos de código y deja que V4 Flash los procese
- Generación de diapositivas: convierte resultados de búsqueda en presentaciones
- Mapas mentales: visualiza cómo se conectan fuentes y conceptos
- Agregación multilingüe: Felo lee fuentes en inglés, chino, japonés y coreano y sintetiza en tu idioma
Sin renovación automática. La ventana gratuita termina tras 7 días, y V4 Flash vuelve a su precio estándar Pro.
Cómo reclamar la ventana gratuita
Tres pasos, menos de dos minutos:
Paso 1: Inicia sesión en tu cuenta Felo Pro en felo.ai. Esta oferta es para suscriptores Pro actuales.
Paso 2: Desde hoy, 6 de agosto, DeepSeek V4 Flash es gratis durante 7 días. La oferta está activa en tu panel — no necesitas código.
Paso 3: Abre Felo Search, selecciona DeepSeek V4 Flash en el menú de modelos y realiza una búsqueda Pro. O entra en playground.felo.ai para chatear directamente, o apunta tu configuración de Codex a deepseek-v4-flash.
La ventana de 7 días comienza hoy, 6 de agosto. Sin colas de aprobación, sin pagos, sin tarjeta registrada.

Por qué usar V4 Flash en Felo en vez de la API
Puedes llamar a V4 Flash directamente desde la API de DeepSeek. Es barato. $0.14 por millón de tokens de entrada, $0.28 por millón de salida. Pero el acceso API puro deja mucho fuera.
Anclaje en tiempo real. V4 Flash es solo texto. No busca en la web y tiene un límite de entrenamiento. Felo añade búsqueda en vivo, así que obtienes razonamiento de vanguardia anclado a información actual, no a pesos desactualizados.
Comparación de modelos en paralelo. El selector de modelos de Felo incluye GPT-5.5, Claude Opus 5, Gemini 3.6 Flash y ambas variantes de V4. Cambia de modelo en mitad de la conversación. Empieza un hilo con V4 Flash por velocidad, cambia a Opus para una segunda opinión en lógica compleja. Mismo contexto, mismas fuentes.
Los resultados de búsqueda no son callejones sin salida. Exporta hallazgos a un LiveDoc. Genera diapositivas con los puntos clave. Crea un mapa mental para ver cómo se conectan las fuentes. La ventana gratuita te da acceso a todo el pipeline.
Limitado en el tiempo, no permanente. Esta es una ventana gratuita de 7 días para suscriptores de Felo Pro. Al terminar, V4 Flash vuelve a su precio estándar Pro. Usa la semana para decidir si merece un lugar fijo en tu flujo de trabajo.
Cómo se compara V4 Flash con otros modelos en Felo
Felo te da acceso a una pila de modelos de vanguardia, no solo DeepSeek. Aquí te mostramos dónde encaja V4 Flash y cuándo podrías preferir otro.
V4 Flash vs GPT-5.5. GPT-5.5 es más fuerte en tareas de escritura matizada, trabajo creativo y manejo de instrucciones ambiguas. Pero cuesta mucho más por consulta a nivel API. En Felo, ambos están disponibles. Si depuras código o haces búsquedas rápidas, V4 Flash suele terminar antes. Si necesitas prosa con un tono particular o formato muy específico, GPT-5.5 sigue siendo la opción más segura.
V4 Flash vs Claude Opus 5. Opus domina en escritura larga, razonamiento cuidadoso sobre documentos extensos y seguir instrucciones de formato detalladas. V4 Flash es más rápido, más barato y ahora lo suficientemente bueno en código como para que muchos desarrolladores lo usen por defecto en el día a día. Piensa en Opus como la herramienta de precisión para cuando el resultado debe ser impecable.
V4 Flash vs V4 Pro. Pro es mejor en tareas intensivas en conocimiento, matemáticas de competición y los retos de codificación más difíciles. Flash es mejor en todo lo demás, y es tan rápido que olvidas que esperas a un modelo. La ventana gratuita cubre ambos. Prueba Pro para tu problema más difícil y Flash para el resto.
V4 Flash vs Gemini 3.6 Flash. Ambos son modelos rápidos con ventanas de contexto grandes. Gemini acepta entrada multimodal (imágenes, video). V4 Flash es solo texto, pero tiene mejores benchmarks en codificación agentica y la ventaja de la licencia MIT. Si necesitas visión, elige Gemini. Si necesitas un agente que escriba y edite código, V4 Flash lleva la delantera.
Preguntas frecuentes
¿La ventana gratuita de 7 días es realmente gratis?
Sí — para suscriptores actuales de Felo Pro. Sin tarjeta de crédito, sin renovación automática. La ventana empieza hoy, 6 de agosto, y dura 7 días.
¿Qué pasa después de los 7 días?
V4 Flash vuelve a su precio estándar Pro. El resto de tus funciones Pro no cambian. Nada se borra — tu historial de conversaciones, LiveDocs y búsquedas guardadas siguen ahí.
¿Necesito instalar algo para la integración con Codex?
No. V4 Flash soporta la API de Responses de forma nativa. Configura deepseek-v4-flash como tu modelo en la configuración de Codex y funcionará en Codex CLI, ChatGPT Desktop y la extensión de VS Code. Un solo cambio de configuración, se aplica en todas partes.
¿Cómo se compara esto con usar directamente la API de DeepSeek?
La API de DeepSeek es barata y rápida. Lo que Felo añade es búsqueda web en tiempo real, comparación multi-modelo y exportación con un clic a documentos, diapositivas y mapas mentales. Si solo necesitas inferencia pura, usa la API. Si quieres respuestas aumentadas con búsqueda y un espacio de trabajo alrededor del modelo, Felo es mejor opción.
¿Puedo usar V4 Flash en móvil?
Sí. Felo Search funciona en cualquier navegador móvil en felo.ai. El LLM Playground en playground.felo.ai también está optimizado para móviles.
El primer modelo open-weight que los equipos realmente implementan
Esto es lo que diferencia a V4 Flash de otros lanzamientos open-weight: los equipos de ingeniería lo están poniendo en pipelines de producción como sustituto real de alternativas cerradas. No como experimento. No como respaldo. Como modelo principal.
Licencia MIT. Pesos completos en Hugging Face. Permite fine-tuning comercial. Y con la versión 0731, las capacidades agenticas cruzaron la línea de "suficientemente bueno por el precio" a "suficientemente bueno". La ventana gratuita de 7 días en Felo es la forma más sencilla para que los suscriptores Pro comprueben si encaja en su flujo de trabajo.
Inicia sesión en Felo Pro y comienza a usar DeepSeek V4 Flash gratis hoy — la ventana de 7 días cierra el 12 de agosto.
Usa DeepSeek V4 Flash gratis →
Esta publicación también está disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, বাংলা and Português.