DeepSeek V4 Flash现已上线Felo — Pro订阅用户7天免费体验
DeepSeek V4 Flash现已上线Felo。现有Felo Pro订阅用户自8月6日起可享7天免费体验,包含搜索、Codex/CC和深度研究功能。

DeepSeek V4 Flash于7月31日正式发布,数据表现令人惊喜。四月的预览版还算不错,但这次完全不同。Agent基准测试大幅提升。DSpark推测解码让吞吐量突破每秒60个token。从今天8月6日开始,现有Felo Pro订阅用户可免费体验V4 Flash 7天,包含搜索、Codex和完整高级工具包。无需升级,无需额外付费,无需信用卡。
V4 Flash本就拥有市场上最佳的性价比,现在在工程任务上与旗舰级系统正面交锋,覆盖开发者每天实际工作的场景。下面介绍有哪些变化、为何重要,以及这7天免费体验具体包含什么。
四月以来有哪些变化
V4 Flash并不是精简版的V4 Pro,而是为不同目标打造:极致速度、低资源消耗,以及在真实流程中的可用性,而非仅仅追求基准分数。
架构方面:总参数量为2840亿,采用专家混合(Mixture of Experts)布局,每个token仅激活130亿参数。这还不到DeepSeek V3激活参数的三分之一,但在几乎所有实际基准测试中都超越了V3。关键在于混合注意力机制——压缩稀疏注意力(CSA)结合高度压缩注意力(HCA),将推理FLOPs降至V3的10%,却能处理同样的百万token上下文。
实际效果:完整的100万token上下文窗口可在单台128GB机器上运行。这相当于75万字,一整个代码库,一份300页的法律文件,三本小说连在一起。无需分块,无需滑动窗口,无需任何技巧。
在100万token上下文下,V4 Flash仅用V3.2所需KV缓存内存的约7%。不是小幅提升,而是完全不同的级别。
DSpark是另一核心。它是推测解码模块,可并行生成和验证候选token,几乎将吞吐量翻倍。结果是:在普通硬件上每秒60+个token。长时间的Agent会话响应迅速,不再像等待编译一样漫长。
模型支持三种推理模式,可按请求切换:
| 模式 | 行为 | 适用场景 |
|---|---|---|
| Non-Think | 快速,无链式思考负担 | 快速查找、翻译、草稿 |
| Think High | 显式逐步推理 | 调试、数学、结构化分析 |
| Think Max | 全面推理深度 | 难题证明、多步Agent流程 |
这不是表面功夫。90%的提示用Non-Think,只有遇到难题时再切换到Think Max。节省时间和token,同时不限制能力上限。

真正重要的基准测试
四月的预览版数据表现不错。0731正式版则围绕后训练阶段,几乎专注于Agent能力,提升非常明显:
| 基准 | 预览(四月) | 正式版(0731) | V4 Pro(参考) |
|---|---|---|---|
| SWE-bench Verified | — | 79.0% | 80.6% |
| Terminal Bench 2.1 | 61.8 | 82.7 | — |
| Cybergym | — | 76.7 | — |
| DeepSWE | 7.3 | 54.4 | — |
| GPQA Diamond | — | 71.2% | — |
| LiveCodeBench | — | 55.2% | 91.6% |
SWE-bench是大家最关注的,这次关注确实有道理。79.0%让V4 Flash距离V4 Pro仅1.6分,而后者激活参数量是前者的5倍多。它与每次查询成本高出10到50倍的系统同台竞技。
2840亿参数的Flash在Agent编码任务上超越了四月预览版的1.6万亿参数Pro。后训练阶段贡献最大,而非模型规模。
真实的权衡:V4 Flash在知识召回和竞赛级编码问题上仍落后于Pro。但这些并不是工程师日常工作的主要任务。审查PR、跨文件调试、重构、编写测试——在真实工程场景下,差距几乎看不见。
7天免费体验具体解锁了什么
接下来7天,V4 Flash对Felo Pro订阅用户免费开放。而Felo Pro不仅仅是模型选择器。
V4 Flash驱动的Pro搜索
Felo搜索结合V4 Flash推理与实时网页搜索。用自然语言提问,Felo从多语言来源抓取信息,综合结果并给出带内联引用的直接答案。没有链接列表,没有SEO垃圾,只给你答案,并附可点击验证的来源。
Pro搜索更进一步。每次查询抓取更多来源,处理更长上下文,答案覆盖边缘案例而非止步于常规。深度研究模式可将单个问题转化为结构化多页报告,带有章节标题和引用来源,相当于你亲自花一下午整理的成果。
Codex与CC集成
开发者最关心的部分。V4 Flash原生支持OpenAI的Responses API,意味着可无缝集成Codex CLI、ChatGPT Desktop和VS Code Codex扩展,无需翻译层或兼容补丁。只需在配置中设置deepseek-v4-flash,即可运行前沿级编码Agent。
在7天体验期间,Pro订阅用户可享完整功能:V4 Flash驱动的Agent编码、工具编排、多文件编辑,以及可容纳整个代码库的100万token上下文窗口,无需分块。

Pro工具包的其他功能
- 初始加载15,000积分,每天额外200积分
- 无限Pro搜索。即使积分用完,每天仍可进行300次Pro搜索
- 文件分析:上传PDF、CSV、代码文件,V4 Flash自动处理
- 幻灯片生成:将搜索结果转为演示文稿
- 思维导图:可视化来源与概念的关联
- 跨语言聚合:Felo可读取英文、中文、日文、韩文来源,并用你的语言综合输出
无自动续费。免费体验7天后结束,V4 Flash恢复标准Pro定价。
如何领取7天免费体验
三步,耗时不到两分钟:
第一步: 登录你的Felo Pro账号,访问 felo.ai。本次活动仅限现有Pro订阅用户。
第二步: 从今天8月6日起,DeepSeek V4 Flash免费体验7天。活动已在你的控制台上线,无需输入代码。
第三步: 打开Felo搜索,在模型下拉菜单中选择DeepSeek V4 Flash,进行Pro搜索。或前往 playground.felo.ai 直接聊天,或将Codex配置指向deepseek-v4-flash。
7天体验窗口自8月6日开启。无需审批,无需付款,无需绑定信用卡。

为什么要通过Felo使用V4 Flash而不是直接API
你可以直接通过DeepSeek的API调用V4 Flash,价格很低:每百万输入token仅$0.14,输出token$0.28。但API原生访问会错过很多功能。
实时信息补充。 V4 Flash仅支持文本,不会搜索网页,且有训练截止日期。Felo在其基础上叠加实时搜索,让推理基于最新信息,而非过时权重。
并排模型对比。 Felo的模型选择器包含GPT-5.5、Claude Opus 5、Gemini 3.6 Flash和两种V4。可在对话中随时切换模型。用V4 Flash开启线程以追求速度,遇到复杂逻辑再切换Opus寻求第二意见。上下文和来源都保持一致。
搜索结果不是终点。 可将结果导出为LiveDoc,生成幻灯片,制作思维导图,直观展示来源关联。免费体验期可用完整流程。
限时而非永久。 本次活动仅限Felo Pro订阅用户7天免费体验。结束后,V4 Flash恢复标准Pro定价。用这一周决定它是否值得长期使用。
V4 Flash与Felo其他模型的对比
Felo不仅提供DeepSeek,还集成多款前沿模型。V4 Flash在其中的定位及适用场景如下:
V4 Flash vs GPT-5.5 GPT-5.5在细腻写作、创意任务和处理模糊指令方面更强,但API查询成本高得多。在Felo,两者都可用。调试代码或快速搜索时,V4 Flash通常更快。如果需要特定语气或格式的文本,GPT-5.5依然更稳妥。
V4 Flash vs Claude Opus 5 Opus擅长长篇写作、对书籍级文档的细致推理,以及遵循复杂格式要求。V4 Flash更快、更便宜,编码能力已足够接近,许多开发者日常工作首选它。Opus适合对输出要求极高的场景。
V4 Flash vs V4 Pro Pro在知识密集任务、竞赛数学和最难编码挑战上更强。Flash在其他方面更优,速度快到让你忘记等待模型。免费体验覆盖两者。最难问题用Pro,其他用Flash。
V4 Flash vs Gemini 3.6 Flash 两者都是速度型大上下文模型。Gemini支持多模态输入(图片、视频),V4 Flash仅支持文本,但Agent编码基准更强且拥有MIT许可。如果需要视觉能力选Gemini,需要代码Agent选V4 Flash。
常见问题
7天免费体验真的免费吗?
是的——仅限现有Felo Pro订阅用户。无需信用卡,无自动续费。窗口自8月6日开启,持续7天。
7天体验结束后会怎样?
V4 Flash恢复标准Pro定价。你的其他Pro功能不变。不会删除任何内容——对话历史、LiveDoc和已保存搜索都保留。
Codex集成需要安装什么吗?
不需要。V4 Flash原生支持Responses API。只需在Codex配置中设置deepseek-v4-flash,即可在Codex CLI、ChatGPT Desktop和VS Code扩展中使用。一次配置,处处适用。
这与直接用DeepSeek API有何区别?
DeepSeek API便宜且快。Felo额外提供实时网页搜索补充、多模型对比界面,以及一键导出文档、幻灯片和思维导图。如果只需原生推理,用API即可。如果需要增强搜索和工作空间,Felo更适合。
可以在手机上用V4 Flash吗?
可以。Felo搜索支持任意手机浏览器访问felo.ai。LLM Playground(playground.felo.ai)也适配移动端。
首个真正被工程团队部署的开源权重模型
V4 Flash与其他开源权重模型的不同之处在于:工程团队已将其作为闭源替代品投入生产流程,不是实验,也不是备选,而是主力模型。
MIT许可,完整权重已上传Hugging Face,允许商业微调。0731版本后,Agent能力已达到“性价比足够”转变为“能力足够”的临界点。Felo的7天免费体验,是Pro订阅用户最低门槛验证其适用性的方式。
登录Felo Pro,立即免费体验DeepSeek V4 Flash——7天窗口将于8月12日关闭。
本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。