Skip to main content

DeepSeek V4 Flash现已上线Felo — Pro订阅用户7天免费体验

· 阅读需 15 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

DeepSeek V4 Flash现已上线Felo。现有Felo Pro订阅用户自8月6日起可享7天免费体验,包含搜索、Codex/CC和深度研究功能。

Try DeepSeek V4 Flash free for 7 days with Pro Search and Codex on Felo

DeepSeek V4 Flash于7月31日正式发布,数据表现令人惊喜。四月的预览版还算不错,但这次完全不同。Agent基准测试大幅提升。DSpark推测解码让吞吐量突破每秒60个token。从今天8月6日开始,现有Felo Pro订阅用户可免费体验V4 Flash 7天,包含搜索、Codex和完整高级工具包。无需升级,无需额外付费,无需信用卡。

V4 Flash本就拥有市场上最佳的性价比,现在在工程任务上与旗舰级系统正面交锋,覆盖开发者每天实际工作的场景。下面介绍有哪些变化、为何重要,以及这7天免费体验具体包含什么。


四月以来有哪些变化

V4 Flash并不是精简版的V4 Pro,而是为不同目标打造:极致速度、低资源消耗,以及在真实流程中的可用性,而非仅仅追求基准分数。

架构方面:总参数量为2840亿,采用专家混合(Mixture of Experts)布局,每个token仅激活130亿参数。这还不到DeepSeek V3激活参数的三分之一,但在几乎所有实际基准测试中都超越了V3。关键在于混合注意力机制——压缩稀疏注意力(CSA)结合高度压缩注意力(HCA),将推理FLOPs降至V3的10%,却能处理同样的百万token上下文。

实际效果:完整的100万token上下文窗口可在单台128GB机器上运行。这相当于75万字,一整个代码库,一份300页的法律文件,三本小说连在一起。无需分块,无需滑动窗口,无需任何技巧。

在100万token上下文下,V4 Flash仅用V3.2所需KV缓存内存的约7%。不是小幅提升,而是完全不同的级别。

DSpark是另一核心。它是推测解码模块,可并行生成和验证候选token,几乎将吞吐量翻倍。结果是:在普通硬件上每秒60+个token。长时间的Agent会话响应迅速,不再像等待编译一样漫长。

模型支持三种推理模式,可按请求切换:

模式行为适用场景
Non-Think快速,无链式思考负担快速查找、翻译、草稿
Think High显式逐步推理调试、数学、结构化分析
Think Max全面推理深度难题证明、多步Agent流程

这不是表面功夫。90%的提示用Non-Think,只有遇到难题时再切换到Think Max。节省时间和token,同时不限制能力上限。


DeepSeek V4 Flash 1 million token context and DSpark speculative decoding speed

真正重要的基准测试

四月的预览版数据表现不错。0731正式版则围绕后训练阶段,几乎专注于Agent能力,提升非常明显:

基准预览(四月)正式版(0731)V4 Pro(参考)
SWE-bench Verified79.0%80.6%
Terminal Bench 2.161.882.7
Cybergym76.7
DeepSWE7.354.4
GPQA Diamond71.2%
LiveCodeBench55.2%91.6%

SWE-bench是大家最关注的,这次关注确实有道理。79.0%让V4 Flash距离V4 Pro仅1.6分,而后者激活参数量是前者的5倍多。它与每次查询成本高出10到50倍的系统同台竞技。

2840亿参数的Flash在Agent编码任务上超越了四月预览版的1.6万亿参数Pro。后训练阶段贡献最大,而非模型规模。

真实的权衡:V4 Flash在知识召回和竞赛级编码问题上仍落后于Pro。但这些并不是工程师日常工作的主要任务。审查PR、跨文件调试、重构、编写测试——在真实工程场景下,差距几乎看不见。


7天免费体验具体解锁了什么

接下来7天,V4 Flash对Felo Pro订阅用户免费开放。而Felo Pro不仅仅是模型选择器。

V4 Flash驱动的Pro搜索

Felo搜索结合V4 Flash推理与实时网页搜索。用自然语言提问,Felo从多语言来源抓取信息,综合结果并给出带内联引用的直接答案。没有链接列表,没有SEO垃圾,只给你答案,并附可点击验证的来源。

Pro搜索更进一步。每次查询抓取更多来源,处理更长上下文,答案覆盖边缘案例而非止步于常规。深度研究模式可将单个问题转化为结构化多页报告,带有章节标题和引用来源,相当于你亲自花一下午整理的成果。

Codex与CC集成

开发者最关心的部分。V4 Flash原生支持OpenAI的Responses API,意味着可无缝集成Codex CLI、ChatGPT Desktop和VS Code Codex扩展,无需翻译层或兼容补丁。只需在配置中设置deepseek-v4-flash,即可运行前沿级编码Agent。

在7天体验期间,Pro订阅用户可享完整功能:V4 Flash驱动的Agent编码、工具编排、多文件编辑,以及可容纳整个代码库的100万token上下文窗口,无需分块。

Codex and CC integration with DeepSeek V4 Flash in developer workflows

Pro工具包的其他功能

  • 初始加载15,000积分,每天额外200积分
  • 无限Pro搜索。即使积分用完,每天仍可进行300次Pro搜索
  • 文件分析:上传PDF、CSV、代码文件,V4 Flash自动处理
  • 幻灯片生成:将搜索结果转为演示文稿
  • 思维导图:可视化来源与概念的关联
  • 跨语言聚合:Felo可读取英文、中文、日文、韩文来源,并用你的语言综合输出

无自动续费。免费体验7天后结束,V4 Flash恢复标准Pro定价。


如何领取7天免费体验

三步,耗时不到两分钟:

第一步: 登录你的Felo Pro账号,访问 felo.ai。本次活动仅限现有Pro订阅用户。

第二步: 从今天8月6日起,DeepSeek V4 Flash免费体验7天。活动已在你的控制台上线,无需输入代码。

第三步: 打开Felo搜索,在模型下拉菜单中选择DeepSeek V4 Flash,进行Pro搜索。或前往 playground.felo.ai 直接聊天,或将Codex配置指向deepseek-v4-flash

7天体验窗口自8月6日开启。无需审批,无需付款,无需绑定信用卡。


Start the 7-day free DeepSeek V4 Flash Pro trial on Felo with no credit card

为什么要通过Felo使用V4 Flash而不是直接API

你可以直接通过DeepSeek的API调用V4 Flash,价格很低:每百万输入token仅$0.14,输出token$0.28。但API原生访问会错过很多功能。

实时信息补充。 V4 Flash仅支持文本,不会搜索网页,且有训练截止日期。Felo在其基础上叠加实时搜索,让推理基于最新信息,而非过时权重。

并排模型对比。 Felo的模型选择器包含GPT-5.5、Claude Opus 5、Gemini 3.6 Flash和两种V4。可在对话中随时切换模型。用V4 Flash开启线程以追求速度,遇到复杂逻辑再切换Opus寻求第二意见。上下文和来源都保持一致。

搜索结果不是终点。 可将结果导出为LiveDoc,生成幻灯片,制作思维导图,直观展示来源关联。免费体验期可用完整流程。

限时而非永久。 本次活动仅限Felo Pro订阅用户7天免费体验。结束后,V4 Flash恢复标准Pro定价。用这一周决定它是否值得长期使用。


V4 Flash与Felo其他模型的对比

Felo不仅提供DeepSeek,还集成多款前沿模型。V4 Flash在其中的定位及适用场景如下:

V4 Flash vs GPT-5.5 GPT-5.5在细腻写作、创意任务和处理模糊指令方面更强,但API查询成本高得多。在Felo,两者都可用。调试代码或快速搜索时,V4 Flash通常更快。如果需要特定语气或格式的文本,GPT-5.5依然更稳妥。

V4 Flash vs Claude Opus 5 Opus擅长长篇写作、对书籍级文档的细致推理,以及遵循复杂格式要求。V4 Flash更快、更便宜,编码能力已足够接近,许多开发者日常工作首选它。Opus适合对输出要求极高的场景。

V4 Flash vs V4 Pro Pro在知识密集任务、竞赛数学和最难编码挑战上更强。Flash在其他方面更优,速度快到让你忘记等待模型。免费体验覆盖两者。最难问题用Pro,其他用Flash。

V4 Flash vs Gemini 3.6 Flash 两者都是速度型大上下文模型。Gemini支持多模态输入(图片、视频),V4 Flash仅支持文本,但Agent编码基准更强且拥有MIT许可。如果需要视觉能力选Gemini,需要代码Agent选V4 Flash。


常见问题

7天免费体验真的免费吗?

是的——仅限现有Felo Pro订阅用户。无需信用卡,无自动续费。窗口自8月6日开启,持续7天。

7天体验结束后会怎样?

V4 Flash恢复标准Pro定价。你的其他Pro功能不变。不会删除任何内容——对话历史、LiveDoc和已保存搜索都保留。

Codex集成需要安装什么吗?

不需要。V4 Flash原生支持Responses API。只需在Codex配置中设置deepseek-v4-flash,即可在Codex CLI、ChatGPT Desktop和VS Code扩展中使用。一次配置,处处适用。

这与直接用DeepSeek API有何区别?

DeepSeek API便宜且快。Felo额外提供实时网页搜索补充、多模型对比界面,以及一键导出文档、幻灯片和思维导图。如果只需原生推理,用API即可。如果需要增强搜索和工作空间,Felo更适合。

可以在手机上用V4 Flash吗?

可以。Felo搜索支持任意手机浏览器访问felo.ai。LLM Playground(playground.felo.ai)也适配移动端。


首个真正被工程团队部署的开源权重模型

V4 Flash与其他开源权重模型的不同之处在于:工程团队已将其作为闭源替代品投入生产流程,不是实验,也不是备选,而是主力模型。

MIT许可,完整权重已上传Hugging Face,允许商业微调。0731版本后,Agent能力已达到“性价比足够”转变为“能力足够”的临界点。Felo的7天免费体验,是Pro订阅用户最低门槛验证其适用性的方式。


登录Felo Pro,立即免费体验DeepSeek V4 Flash——7天窗口将于8月12日关闭。

立即免费体验DeepSeek V4 Flash →


本文还提供以下语言版本:English日本語한국어繁體中文हिन्दीFrançaisالعربيةРусскийاردوBahasa IndonesiaDeutschTiếng ViệtTürkçeItalianoไทยEspañolবাংলাPortuguês