Skip to main content

DeepSeek V4 Flash est désormais sur Felo — Gratuit pour les abonnés Pro pendant 7 jours

· 13 minutes de lecture
Felo Search Tips Buddy
Committed to answers at your fingertips

DeepSeek V4 Flash arrive sur Felo. Les abonnés Felo Pro existants bénéficient de 7 jours d'accès gratuit à partir du 6 août — avec Recherche, Codex/CC et Deep Research inclus.

Essayez DeepSeek V4 Flash gratuitement pendant 7 jours avec Pro Search et Codex sur Felo

DeepSeek V4 Flash a lancé sa version de production le 31 juillet, et les résultats ont surpris tout le monde. La préversion d’avril était correcte. Cette version est différente. Les benchmarks d’agents ont explosé. DSpark, avec son décodage spéculatif, pousse le débit au-delà de 60 tokens par seconde. Et dès aujourd’hui, 6 août, les abonnés Felo Pro existants bénéficient de 7 jours d’accès gratuit à V4 Flash — avec Recherche, Codex et l’ensemble des outils premium inclus. Pas de mise à niveau, pas de paiement supplémentaire, pas de carte bancaire.

V4 Flash était déjà le meilleur rapport qualité/prix du marché. Désormais, il rivalise avec les modèles phares sur les tâches d’ingénierie que les gens réalisent au quotidien. Voici ce qui a changé, pourquoi c’est important, et ce que cette fenêtre de 7 jours inclut réellement.


Ce qui a changé entre avril et aujourd’hui

V4 Flash n’est pas une version allégée de V4 Pro. Il a été conçu pour des objectifs différents : vitesse brute, faible consommation de ressources, et utilisabilité dans des pipelines réels plutôt que sur des tableaux de benchmarks.

L’architecture : 284 milliards de paramètres au total dans une configuration Mixture of Experts, avec seulement 13 milliards actifs par token. C’est moins d’un tiers du nombre actif de DeepSeek V3. Pourtant, il surpasse V3 sur presque tous les benchmarks pratiques. La différence vient d’un design hybride d’attention — Compressed Sparse Attention (CSA) associé à Heavily Compressed Attention (HCA) — qui réduit les FLOPs d’inférence à 10% de ce que V3 consommait pour le même contexte d’un million de tokens.

Concrètement : une fenêtre de contexte complète d’1 million de tokens fonctionne sur une seule machine de 128 Go. Cela représente 750 000 mots. Une base de code entière. Un dossier juridique de 300 pages. Trois romans alignés. Pas de découpage, pas de fenêtres glissantes, pas d’astuces.

Avec 1M de contexte, V4 Flash utilise environ 7% de la mémoire du cache KV nécessaire à V3.2. Ce n’est pas une amélioration incrémentale. C’est une autre catégorie.

DSpark est l’autre élément. Il s’agit d’un module de décodage spéculatif qui génère et valide des tokens candidats en parallèle, doublant ainsi le débit. Résultat : plus de 60 tokens par seconde sur du matériel standard. Les sessions longues d’agents restent réactives, au lieu de donner l’impression d’attendre une compilation.

Le modèle propose trois modes de raisonnement à activer par requête :

ModeComportementQuand l’utiliser
Non-ThinkRapide, sans surcharge chain-of-thoughtRecherches rapides, traductions, brouillons
Think HighRaisonnement explicite étape par étapeDébogage, mathématiques, analyses structurées
Think MaxProfondeur maximale de raisonnementPreuves complexes, workflows d’agents multi-étapes

Ce n’est pas cosmétique. Utilisez Non-Think pour 90% de vos prompts et passez à Think Max uniquement quand le problème l’exige. Vous gagnez du temps et des tokens sans limiter vos possibilités.


DeepSeek V4 Flash contexte d’1 million de tokens et vitesse de décodage spéculatif DSpark

Les benchmarks qui comptent vraiment

La préversion d’avril affichait déjà de bons résultats. La version de production 0731 s’appuie sur un post-entraînement axé presque exclusivement sur les capacités agentiques. Le saut est net :

BenchmarkPreview (avril)Production (0731)V4 Pro (référence)
SWE-bench Verified79,0%80,6%
Terminal Bench 2.161,882,7
Cybergym76,7
DeepSWE7,354,4
GPQA Diamond71,2%
LiveCodeBench55,291,6%

SWE-bench est le benchmark que tout le monde cite, et pour une fois, c’est justifié. 79,0% place V4 Flash à seulement 1,6 point de V4 Pro, un modèle avec plus de 5 fois les paramètres actifs. Il se retrouve dans la même discussion que des systèmes coûtant 10 à 50 fois plus par requête.

Le Flash à 284B paramètres surpasse la préversion d’avril du Pro à 1,6T paramètres sur le codage agentique. Le post-entraînement fait ici la différence, pas la taille du modèle.

Le compromis honnête : V4 Flash reste derrière Pro sur la récupération brute de connaissances et les problèmes de codage de compétition. Mais ce ne sont pas les tâches sur lesquelles la plupart des ingénieurs passent leurs journées. Lire des PRs, déboguer entre fichiers, refactoriser, écrire des tests — sur le travail d’ingénierie réel, l’écart est à peine perceptible.


Ce que la fenêtre gratuite de 7 jours débloque réellement

Pendant les 7 prochains jours, V4 Flash est gratuit pour les abonnés Felo Pro. Et Pro sur Felo, c’est bien plus qu’un simple sélecteur de modèle.

Pro Search avec V4 Flash en moteur

Felo Search associe le raisonnement de V4 Flash à la recherche web en temps réel. Posez une question en langage naturel. Felo puise dans des sources multilingues, synthétise ce qu’il trouve, et vous donne une réponse directe avec des citations intégrées. Pas de liste de liens. Pas de décharge SEO. Juste la réponse, ancrée à des sources vérifiables.

Pro Search va plus loin. Plus de sources par requête. Contextes plus longs traités. Des réponses qui couvrent les cas limites au lieu de s’arrêter à l’évidence. Le mode Deep Research transforme une question en un rapport structuré de plusieurs pages avec titres de section et sources citées. Le genre de travail que vous passeriez un après-midi à compiler à la main.

Intégration Codex et CC

C’est la partie qui intéressera les développeurs. V4 Flash prend en charge nativement l’API Responses d’OpenAI, ce qui signifie qu’il s’intègre à Codex CLI, ChatGPT Desktop et l’extension VS Code Codex sans couches de traduction ni adaptations de compatibilité. Mettez deepseek-v4-flash dans votre config et vous disposez d’un agent de codage de pointe.

Pendant la fenêtre de 7 jours, les abonnés Pro bénéficient de l’ensemble : codage agentique avec V4 Flash en moteur, orchestration d’outils, modifications multi-fichiers, et une fenêtre de contexte d’1M de tokens qui englobe tout votre dépôt sans découpage.

Intégration Codex et CC avec DeepSeek V4 Flash dans les workflows développeurs

Le reste de la boîte à outils Pro

  • 15 000 crédits chargés d’emblée, plus 200 crédits quotidiens
  • Recherches Pro illimitées. Même après épuisement des crédits, vous avez encore 300 recherches Pro par jour
  • Analyse de fichiers : téléchargez des PDF, CSV, fichiers de code et laissez V4 Flash les traiter
  • Génération de slides : transformez les résultats de recherche en présentations
  • Cartes heuristiques : visualisez les liens entre sources et concepts
  • Agrégation multilingue : Felo lit des sources en anglais, chinois, japonais, coréen et synthétise dans votre langue

Pas de renouvellement automatique. La fenêtre gratuite se termine après 7 jours, et V4 Flash revient alors à son tarif Pro standard.


Comment profiter de la fenêtre gratuite

Trois étapes, moins de deux minutes :

Étape 1 : Connectez-vous à votre compte Felo Pro sur felo.ai. Cette offre est réservée aux abonnés Pro existants.

Étape 2 : Dès aujourd’hui, 6 août, DeepSeek V4 Flash est gratuit pendant 7 jours. L’offre est active sur votre tableau de bord — aucun code requis.

Étape 3 : Ouvrez Felo Search, sélectionnez DeepSeek V4 Flash dans la liste des modèles, et lancez une recherche Pro. Ou rendez-vous sur playground.felo.ai pour un chat direct, ou configurez Codex sur deepseek-v4-flash.

La fenêtre de 7 jours commence aujourd’hui, 6 août. Pas de file d’attente, pas de paiement, pas de carte bancaire.


Lancez l’essai gratuit de 7 jours DeepSeek V4 Flash Pro sur Felo sans carte bancaire

Pourquoi utiliser V4 Flash via Felo plutôt que l’API

Vous pouvez appeler V4 Flash directement via l’API de DeepSeek. C’est peu cher. $0,14 par million de tokens d’entrée, $0,28 par million de tokens de sortie. Mais l’accès brut à l’API laisse beaucoup de possibilités de côté.

Ancrage en temps réel. V4 Flash est uniquement textuel. Il ne recherche pas sur le web, et il a une date de coupure d’entraînement. Felo ajoute une couche de recherche en temps réel, pour un raisonnement de pointe ancré sur des informations actuelles, pas sur des poids obsolètes.

Comparaison de modèles côte à côte. Le sélecteur de modèles Felo inclut GPT-5.5, Claude Opus 5, Gemini 3.6 Flash, et les deux variantes V4. Changez de modèle en cours de conversation. Lancez un thread avec V4 Flash pour la vitesse, passez à Opus pour un second avis sur une logique complexe. Même contexte, mêmes sources.

Les résultats de recherche ne sont pas des impasses. Exportez vos découvertes dans un LiveDoc. Générez des slides à partir des points clés. Créez une carte heuristique pour visualiser les liens entre sources. La fenêtre gratuite vous donne accès à toute la chaîne.

Temporaire, pas permanent. Il s’agit d’une fenêtre gratuite de 7 jours pour les abonnés Felo Pro. À la fin, V4 Flash revient à son tarif Pro standard. Profitez de la semaine pour décider s’il mérite une place permanente dans votre workflow.


Comment V4 Flash se positionne face aux autres modèles sur Felo

Felo vous donne accès à une pile de modèles de pointe, pas seulement DeepSeek. Voici où V4 Flash s’inscrit dans la gamme et quand vous pourriez préférer un autre modèle.

V4 Flash vs GPT-5.5. GPT-5.5 est plus performant sur les tâches d’écriture nuancée, le travail créatif, et la gestion d’instructions ambiguës. Mais il coûte nettement plus cher par requête via l’API. Sur Felo, les deux sont disponibles. Si vous déboguez du code ou lancez des recherches rapides, V4 Flash termine souvent plus vite. Si vous avez besoin de prose avec un ton particulier ou d’un formatage très spécifique, GPT-5.5 reste le choix le plus sûr.

V4 Flash vs Claude Opus 5. Opus excelle sur l’écriture longue, le raisonnement approfondi sur des documents volumineux, et le respect d’instructions de formatage détaillées. V4 Flash est plus rapide, moins cher, et désormais suffisamment proche sur le code pour que de nombreux développeurs l’utilisent par défaut au quotidien. Considérez Opus comme l’outil de précision quand le rendu doit vraiment être parfait.

V4 Flash vs V4 Pro. Pro est meilleur sur les tâches à forte intensité de connaissances, les maths de compétition, et les défis de codage les plus difficiles. Flash est meilleur sur tout le reste, et il est si rapide qu’on oublie qu’on attend un modèle. La fenêtre gratuite couvre les deux. Essayez Pro pour vos problèmes les plus complexes et Flash pour tout le reste.

V4 Flash vs Gemini 3.6 Flash. Ce sont deux modèles axés sur la vitesse avec de grandes fenêtres de contexte. Gemini accepte des entrées multimodales (images, vidéo). V4 Flash est uniquement textuel mais affiche de meilleurs benchmarks de codage agentique et l’avantage de la licence MIT. Si vous avez besoin de vision, choisissez Gemini. Si vous cherchez un agent qui écrit et modifie du code, V4 Flash a l’avantage.


FAQ

La fenêtre gratuite de 7 jours est-elle vraiment gratuite ?

Oui — pour les abonnés Felo Pro existants. Pas de carte bancaire, pas de renouvellement automatique. La fenêtre commence aujourd’hui, 6 août, et dure 7 jours.

Que se passe-t-il après la fenêtre de 7 jours ?

V4 Flash revient à son tarif Pro standard. Vos autres fonctionnalités Pro restent inchangées. Rien n’est supprimé — votre historique de conversations, LiveDocs et recherches sauvegardées restent accessibles.

Dois-je installer quelque chose pour l’intégration Codex ?

Non. V4 Flash prend en charge l’API Responses nativement. Mettez deepseek-v4-flash comme modèle dans la config Codex, et cela fonctionne sur Codex CLI, ChatGPT Desktop et l’extension VS Code. Un changement de config, applicable partout.

Comment cela se compare-t-il à l’utilisation directe de l’API DeepSeek ?

L’API DeepSeek est peu chère et rapide. Ce que Felo ajoute, c’est l’ancrage en temps réel via la recherche web, une interface de comparaison multi-modèles, et l’export en un clic vers documents, slides et cartes heuristiques. Si vous voulez juste de l’inférence brute, utilisez l’API. Si vous cherchez des réponses enrichies par la recherche et un espace de travail autour du modèle, Felo est mieux adapté.

Puis-je utiliser V4 Flash sur mobile ?

Oui. Felo Search fonctionne dans tout navigateur mobile sur felo.ai. Le LLM Playground sur playground.felo.ai est également adapté au mobile.


Le premier modèle open-weight réellement déployé par les équipes

Voici ce qui distingue V4 Flash des autres modèles open-weight : des équipes d’ingénierie l’intègrent dans leurs pipelines de production comme véritable alternative aux solutions propriétaires. Pas comme un test. Pas comme un plan B. Comme modèle principal.

Licence MIT. Poids complets sur Hugging Face. Fine-tuning commercial autorisé. Et avec la version 0731, les capacités agentiques ont franchi le seuil où « assez bon pour le prix » est devenu « assez bon ». La fenêtre gratuite de 7 jours sur Felo est le moyen le plus simple pour les abonnés Pro de voir s’il tient la route dans votre workflow.


Connectez-vous à Felo Pro et commencez à utiliser DeepSeek V4 Flash gratuitement dès aujourd’hui — la fenêtre de 7 jours se termine le 12 août.

Utiliser DeepSeek V4 Flash gratuitement →


Cet article est également disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.