DeepSeek V4 Flash 現已登陸 Felo — Pro 訂閱戶免費體驗 7 天
DeepSeek V4 Flash 現已登陸 Felo。現有 Felo Pro 訂閱戶自 8 月 6 日起可免費體驗 7 天,包含搜尋、Codex/CC 及深度研究功能。

DeepSeek V4 Flash 於 7 月 31 日正式發佈,成績令人驚艷。4 月的預覽版表現尚可,但這次的版本完全不同。Agent 基準分數大幅提升,DSpark 推測解碼技術讓吞吐量突破每秒 60 個 token。從今天(8 月 6 日)起,現有 Felo Pro 訂閱戶可免費體驗 V4 Flash 7 天,包含搜尋、Codex 及完整高級工具組。無需升級、無需額外付費、無需信用卡。
V4 Flash 原本就是市場上性價比最高的模型。現在,它在工程實務任務上已能與旗艦級系統一較高下。以下說明本次更新的重點、意義,以及這 7 天免費體驗包含哪些內容。
4 月至今有什麼改變
V4 Flash 並非 V4 Pro 的精簡版,而是為了不同目標打造:極致速度、低資源消耗,以及真正適用於生產流程,而非僅僅追求基準分數。
架構方面:總參數 2840 億,採用 Mixture of Experts(專家混合)設計,每個 token 僅啟用 130 億參數,遠低於 DeepSeek V3 的三分之一,卻在幾乎所有實用基準上勝過 V3。這得益於混合注意力機制——壓縮稀疏注意力(CSA)結合高度壓縮注意力(HCA),將推理所需 FLOPs 降至 V3 同等百萬 token 長度的 10%。
實際效果:完整 100 萬 token 上下文可在單台 128GB 機器上運行。這相當於 75 萬字、一個完整程式碼庫、一份 300 頁法律文件,或三本小說連在一起。無需分塊、無需滑動視窗、無需任何取巧。
在 100 萬 token 上下文下,V4 Flash 只需 V3.2 約 7% 的 KV 快取記憶體。這不是小幅提升,而是完全不同的等級。
DSpark 是另一個關鍵。它是一個推測解碼模組,能並行生成並驗證候選 token,實際上將吞吐量翻倍。結果是:在一般硬體上可達每秒 60+ token。長時間的 Agent 任務也能保持即時回應,不再像等待編譯那樣漫長。
模型提供三種推理模式,可依需求切換:
| 模式 | 行為 | 適用情境 |
|---|---|---|
| Non-Think | 極速,無 chain-of-thought 負擔 | 快速查詢、翻譯、草稿 |
| Think High | 明確逐步推理 | 除錯、數學、結構化分析 |
| Think Max | 最深層推理 | 難題證明、多步驟 Agent 工作流 |
這不是表面功能。90% 提示可用 Non-Think,僅在遇到難題時切換 Think Max。這樣可節省時間與 token,且不會限制能力上限。

真正重要的基準測試
4 月預覽版表現穩健。0731 正式版則專注於強化 Agent 能力,進步幅度顯著:
| 基準 | 預覽(4月) | 正式版(0731) | V4 Pro(參考) |
|---|---|---|---|
| SWE-bench Verified | — | 79.0% | 80.6% |
| Terminal Bench 2.1 | 61.8 | 82.7 | — |
| Cybergym | — | 76.7 | — |
| DeepSWE | 7.3 | 54.4 | — |
| GPQA Diamond | — | 71.2% | — |
| LiveCodeBench | — | 55.2% | 91.6% |
SWE-bench 是大家最常引用的指標,這次的成績確實值得關注。79.0% 讓 V4 Flash 與 V4 Pro 僅差 1.6 分,而 Pro 的啟用參數超過 5 倍。V4 Flash 已能與每次查詢成本高出 10 到 50 倍的系統並駕齊驅。
2840 億參數的 Flash,在 Agent 編碼上超越了 1.6 兆參數 Pro 的 4 月預覽版。這裡主要靠後訓練,而非模型規模。
誠實來說:V4 Flash 在知識回憶與競賽級編碼題上仍略遜於 Pro。但這些並非多數工程師日常工作。閱讀 PR、跨檔案除錯、重構、撰寫測試——在實務工程任務上,兩者差距微乎其微。
7 天免費體驗能解鎖什麼
接下來 7 天,V4 Flash 對 Felo Pro 訂閱戶免費開放。而 Felo 的 Pro 不只是模型選擇器。
內建 V4 Flash 的 Pro 搜尋
Felo 搜尋結合 V4 Flash 的推理能力與即時網頁搜尋。你可用自然語言提問,Felo 會跨語言擷取來源、整合資訊,並給出帶有內嵌引用的直接答案。沒有連結清單,沒有 SEO 垃圾,只有可點擊驗證的答案。
Pro 搜尋更進一步:每次查詢擷取更多來源、處理更長上下文、答案涵蓋邊緣案例而非僅止於表面。深度研究模式可將單一問題轉為結構化多頁報告,含章節標題與引用來源,等同你花一下午手動整理的成果。
Codex 與 CC 整合
這部分是開發者最關心的。V4 Flash 原生支援 OpenAI 的 Responses API,意味著可無縫整合 Codex CLI、ChatGPT Desktop 及 VS Code Codex 擴充套件,無需轉接層或相容性補丁。只要在設定中指定 deepseek-v4-flash,即可運行頂尖等級的編碼 Agent。
在 7 天體驗期間,Pro 用戶可完整體驗:由 V4 Flash 驅動的 Agent 編碼循環、工具協作、多檔案編輯,以及可容納整個專案的 100 萬 token 上下文,無需分塊。

其他 Pro 工具組
- 預先加值 15,000 點數,每日再送 200 點
- Pro 搜尋無限次。即使點數用完,每天仍有 300 次 Pro 搜尋額度
- 檔案分析:上傳 PDF、CSV、程式碼檔,讓 V4 Flash 處理
- 投影片產生:將搜尋結果轉為簡報
- 心智圖:視覺化來源與概念間的關聯
- 跨語言整合:Felo 可讀取英文、中文、日文、韓文來源,並以你的語言整合
無自動續訂。免費體驗 7 天結束後,V4 Flash 將恢復標準 Pro 價格。
如何領取免費體驗
三步驟,兩分鐘內完成:
步驟 1: 登入你的 Felo Pro 帳號 felo.ai。本優惠僅限現有 Pro 訂閱戶。
步驟 2: 從今天(8 月 6 日)起,DeepSeek V4 Flash 免費開放 7 天。無需輸入代碼,直接在儀表板啟用。
步驟 3: 開啟 Felo 搜尋,從模型下拉選單選擇 DeepSeek V4 Flash,開始 Pro 搜尋。或前往 playground.felo.ai 直接對話,或在 Codex 設定中指定 deepseek-v4-flash。
7 天體驗自今日(8 月 6 日)起跑。無需審核、無需付款、無需綁定信用卡。

為什麼要透過 Felo 使用 V4 Flash,而不是直接用 API
你可以直接透過 DeepSeek 的 API 調用 V4 Flash,價格低廉——每百萬輸入 token 只要 $0.14,輸出 $0.28。但僅用 API 會錯過許多功能。
即時資訊補強。 V4 Flash 僅支援文字,不會主動搜尋網路,且有訓練截止日。Felo 在其上疊加即時搜尋,讓你獲得結合最新資訊的前沿推理,而非過時權重。
多模型即時對比。 Felo 的模型選擇器包含 GPT-5.5、Claude Opus 5、Gemini 3.6 Flash 及兩種 V4。可在對話中隨時切換模型。例如用 V4 Flash 快速搜尋,再用 Opus 檢查複雜邏輯。上下文與來源一致。
搜尋結果可延伸應用。 可將發現匯出為 LiveDoc、從重點自動產生簡報、建立心智圖檢視來源關聯。免費體驗期間可完整使用這些流程。
體驗有時限,非永久。 本次為 Felo Pro 訂閱戶提供 7 天免費體驗。結束後 V4 Flash 恢復標準 Pro 價格。這週就是你評估是否納入日常工作的最佳時機。
V4 Flash 與 Felo 其他模型的比較
Felo 不只提供 DeepSeek,還有多款前沿模型。以下是 V4 Flash 在產品線中的定位,以及何時適合選用其他模型。
V4 Flash vs GPT-5.5
GPT-5.5 在細膩寫作、創意產出、處理模糊指令上更強,但 API 成本也高許多。在 Felo 上兩者皆可用。若需除錯或快速搜尋,V4 Flash 通常更快;若需特定語氣或格式的文章,GPT-5.5 仍是首選。
V4 Flash vs Claude Opus 5
Opus 擅長長篇寫作、精細推理(如書籍級文件)、嚴格格式要求。V4 Flash 更快、更便宜,且在程式碼上已足夠強大,許多開發者日常都選用它。Opus 則適合對輸出品質要求極高的場合。
V4 Flash vs V4 Pro
Pro 在知識密集型任務、競賽數學、最難的編碼挑戰上更勝一籌。Flash 則在其他情境表現更佳,且速度快到讓你忘記在等模型。免費體驗兩者皆可用,難題用 Pro,其他用 Flash。
V4 Flash vs Gemini 3.6 Flash
兩者皆為高速大上下文模型。Gemini 支援多模態(圖片、影片),V4 Flash 僅文字但 Agent 編碼基準更強,且有 MIT 授權優勢。需視覺選 Gemini,需編碼 Agent 選 V4 Flash。
常見問題
7 天免費體驗真的免費嗎?
是的——只要你是現有 Felo Pro 訂閱戶。無需信用卡、無自動續訂。體驗自 8 月 6 日起,為期 7 天。
7 天結束後會怎樣?
V4 Flash 恢復標準 Pro 價格。其他 Pro 功能不受影響。所有對話紀錄、LiveDoc、搜尋紀錄都會保留。
Codex 整合需要安裝什麼嗎?
不用。V4 Flash 原生支援 Responses API,只需在 Codex 設定中指定 deepseek-v4-flash,即可於 Codex CLI、ChatGPT Desktop、VS Code 擴充套件無縫使用。只需改一次設定,處處適用。
這跟直接用 DeepSeek API 有什麼不同?
DeepSeek API 便宜又快。Felo 則多了即時網頁搜尋、多模型對比、一鍵匯出文件、簡報、心智圖等功能。只需純推理可用 API,若需搜尋增強答案與完整工作空間,Felo 更合適。
可以在手機上用 V4 Flash 嗎?
可以。Felo 搜尋可在任何手機瀏覽器(felo.ai)使用,LLM Playground(playground.felo.ai)也支援行動裝置。
第一個真正被團隊部署的開源權重模型
V4 Flash 與其他開源權重模型最大不同在於:工程團隊已將其作為生產環境的主力模型,而非實驗或備用。
MIT 授權、完整權重於 Hugging Face 開放、允許商業微調。0731 版後,Agent 能力已從「性價比夠好」跨越到「真的夠好」。Felo 這 7 天免費體驗,是 Pro 訂閱戶最低門檻評估它是否適合你的工作流程的方式。
立即登入 Felo Pro,免費體驗 DeepSeek V4 Flash——7 天體驗將於 8 月 12 日結束。
本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。