Skip to main content

DeepSeek V4 Flash Kini Hadir di Felo — Gratis untuk Pelanggan Pro Selama 7 Hari

· 11 menit dibaca
Felo Search Tips Buddy
Committed to answers at your fingertips

DeepSeek V4 Flash kini tersedia di Felo. Pelanggan Felo Pro yang sudah ada mendapatkan akses gratis selama 7 hari mulai 6 Agustus — termasuk Search, Codex/CC, dan Deep Research.

Coba DeepSeek V4 Flash gratis selama 7 hari dengan Pro Search dan Codex di Felo

DeepSeek V4 Flash meluncurkan rilis produksinya pada 31 Juli, dan hasilnya mengejutkan banyak orang. Pratinjau dari April sudah cukup baik. Versi ini berbeda. Benchmark agen melonjak. DSpark speculative decoding mendorong throughput melewati 60 token per detik. Dan mulai hari ini, 6 Agustus, pelanggan Felo Pro yang sudah ada mendapatkan akses gratis selama 7 hari ke V4 Flash — termasuk Search, Codex, dan seluruh toolkit premium. Tanpa upgrade, tanpa biaya tambahan, tanpa kartu kredit.

V4 Flash sudah menjadi model dengan rasio harga dan performa terbaik di pasar. Kini ia bersaing dengan sistem kelas flagship pada tugas-tugas rekayasa yang benar-benar dilakukan orang setiap hari. Berikut apa yang berubah, mengapa itu penting, dan apa saja yang termasuk dalam jendela gratis 7 hari ini.


Apa yang berubah antara April dan sekarang

V4 Flash bukanlah versi ringan dari V4 Pro. Model ini dibangun untuk tujuan berbeda: kecepatan mentah, konsumsi sumber daya rendah, dan kegunaan dalam pipeline nyata, bukan sekadar skor benchmark.

Arsitekturnya: total 284 miliar parameter dalam tata letak Mixture of Experts, dengan hanya 13 miliar yang aktif per token. Itu kurang dari sepertiga jumlah aktif DeepSeek V3. Namun tetap mengungguli V3 di hampir semua benchmark praktis. Perbedaannya berasal dari desain attention hybrid — Compressed Sparse Attention (CSA) dipadukan dengan Heavily Compressed Attention (HCA) — yang memangkas FLOPs inferensi hingga 10% dari yang dibutuhkan V3 untuk konteks sejuta token yang sama.

Artinya dalam praktik: jendela konteks penuh 1 juta token berjalan di satu mesin 128GB. Itu setara 750.000 kata. Satu basis kode utuh. Berkas hukum 300 halaman. Tiga novel berjajar. Tanpa chunking, tanpa sliding window, tanpa trik.

Pada konteks 1 juta token, V4 Flash hanya menggunakan sekitar 7% memori cache KV yang dibutuhkan V3.2. Bukan peningkatan bertahap. Ini kategori berbeda.

DSpark adalah bagian lainnya. Ini adalah modul speculative decoding yang menghasilkan dan memvalidasi kandidat token secara paralel, secara efektif menggandakan throughput. Hasilnya: 60+ token per detik di perangkat keras standar. Sesi agen panjang terasa responsif, bukan seperti menunggu proses kompilasi.

Model ini memiliki tiga mode penalaran yang bisa Anda pilih per permintaan:

ModePerilakuKapan digunakan
Non-ThinkCepat, tanpa overhead chain-of-thoughtPencarian cepat, terjemahan, draft
Think HighPenalaran langkah demi langkah eksplisitDebugging, matematika, analisis terstruktur
Think MaxKedalaman penalaran penuhPembuktian sulit, workflow agen multi-langkah

Ini bukan sekadar kosmetik. Jalankan Non-Think untuk 90% prompt Anda dan beralih ke Think Max hanya saat masalah benar-benar membutuhkannya. Anda menghemat waktu dan token tanpa membatasi kemampuan.


Konteks 1 juta token DeepSeek V4 Flash dan kecepatan speculative decoding DSpark

Benchmark yang benar-benar penting

Pratinjau dari April mencatat angka yang solid. Rilis produksi 0731 dibangun di atas sesi pasca-pelatihan yang hampir seluruhnya menargetkan kapabilitas agentic. Lonjakannya tidak main-main:

BenchmarkPratinjau (April)Produksi (0731)V4 Pro (referensi)
SWE-bench Verified79.0%80.6%
Terminal Bench 2.161.882.7
Cybergym76.7
DeepSWE7.354.4
GPQA Diamond71.2%
LiveCodeBench55.2%91.6%

SWE-bench adalah benchmark yang sering dikutip, dan kali ini memang layak. 79.0% menempatkan V4 Flash hanya terpaut 1,6 poin dari V4 Pro, model dengan lebih dari 5x parameter aktif. Ia masuk dalam percakapan yang sama dengan sistem yang biayanya 10 hingga 50 kali lipat per query.

Flash 284B-parameter mengungguli pratinjau April Pro 1.6T-parameter pada coding agentic. Pasca-pelatihan yang melakukan sebagian besar pekerjaan di sini, bukan skala model.

Kompromi jujurnya: V4 Flash masih tertinggal dari Pro pada recall pengetahuan mentah dan soal coding tingkat kompetisi. Tapi itu bukan tugas yang dikerjakan engineer setiap hari. Membaca PR, debugging lintas file, refactor, menulis tes — untuk pekerjaan rekayasa nyata, gap-nya nyaris tak terlihat.


Apa saja yang dibuka oleh jendela gratis 7 hari ini

Selama 7 hari ke depan, V4 Flash gratis untuk pelanggan Felo Pro. Dan Pro di Felo lebih dari sekadar pemilih model.

Pro Search dengan V4 Flash di balik layar

Felo Search memadukan penalaran V4 Flash dengan pencarian web langsung. Ajukan pertanyaan dengan bahasa alami. Felo menarik sumber dari berbagai bahasa, mensintesis temuan, dan memberi Anda jawaban langsung beserta sitasi. Tanpa daftar link. Tanpa limbah SEO. Hanya jawaban, terhubung ke sumber yang bisa Anda klik dan verifikasi.

Pro Search lebih dalam lagi. Lebih banyak sumber diambil per query. Konteks lebih panjang diproses. Jawaban yang mencakup kasus tepi, bukan hanya yang jelas. Mode Deep Research mengubah satu pertanyaan menjadi laporan multi-halaman terstruktur dengan header dan sumber yang disitasi. Jenis laporan yang biasanya Anda susun manual seharian.

Integrasi Codex dan CC

Bagian ini yang akan disukai developer. V4 Flash mendukung OpenAI Responses API secara native, artinya langsung terintegrasi dengan Codex CLI, ChatGPT Desktop, dan ekstensi Codex di VS Code tanpa lapisan translasi atau shim kompatibilitas. Atur deepseek-v4-flash di konfigurasi Anda dan Anda menjalankan agen coding kelas terdepan.

Selama 7 hari ini, pelanggan Pro mendapat paket lengkap: coding agentic dengan V4 Flash sebagai mesin utama, orkestrasi alat, edit multi-file, dan jendela konteks 1 juta token yang memuat seluruh repo tanpa perlu chunking.

Integrasi Codex dan CC dengan DeepSeek V4 Flash dalam workflow developer

Toolkit Pro lainnya

  • 15.000 kredit dimuat di awal, plus 200 kredit harian
  • Pencarian Pro tanpa batas. Setelah kredit habis, Anda tetap dapat 300 pencarian Pro per hari
  • Analisis file: unggah PDF, CSV, file kode dan biarkan V4 Flash mengolahnya
  • Pembuatan slide: ubah hasil pencarian menjadi presentasi
  • Mind map: visualisasi keterkaitan sumber dan konsep
  • Agregasi lintas bahasa: Felo membaca sumber dalam bahasa Inggris, Mandarin, Jepang, Korea dan mensintesis dalam bahasa Anda

Tidak ada perpanjangan otomatis. Jendela gratis berakhir setelah 7 hari, dan V4 Flash kembali ke harga Pro standar.


Cara klaim jendela gratis

Tiga langkah, kurang dari dua menit:

Langkah 1: Masuk ke akun Felo Pro Anda di felo.ai. Penawaran ini hanya untuk pelanggan Pro yang sudah ada.

Langkah 2: Mulai hari ini, 6 Agustus, DeepSeek V4 Flash gratis selama 7 hari. Penawaran sudah aktif di dashboard Anda — tanpa kode.

Langkah 3: Buka Felo Search, pilih DeepSeek V4 Flash dari dropdown model, dan jalankan pencarian Pro. Atau kunjungi playground.felo.ai untuk chat langsung, atau arahkan konfigurasi Codex Anda ke deepseek-v4-flash.

Jendela 7 hari dimulai hari ini, 6 Agustus. Tanpa antrean persetujuan, tanpa pembayaran, tanpa kartu kredit.


Mulai uji coba gratis DeepSeek V4 Flash Pro 7 hari di Felo tanpa kartu kredit

Kenapa menjalankan V4 Flash lewat Felo, bukan langsung API

Anda bisa memanggil V4 Flash langsung lewat API DeepSeek. Harganya murah. $0.14 per sejuta token input, $0.28 per sejuta token output. Tapi akses API mentah meninggalkan banyak hal.

Grounding real-time. V4 Flash hanya teks. Ia tidak mencari web, dan punya cutoff pelatihan. Felo menambahkan pencarian langsung di atasnya, jadi Anda mendapat penalaran frontier yang terhubung ke informasi terbaru, bukan bobot lama.

Perbandingan model berdampingan. Pemilih model Felo mencakup GPT-5.5, Claude Opus 5, Gemini 3.6 Flash, dan kedua varian V4. Ganti model di tengah percakapan. Mulai thread dengan V4 Flash untuk kecepatan, pindah ke Opus untuk opini kedua pada logika rumit. Konteks sama, sumber sama.

Hasil pencarian bukan jalan buntu. Ekspor temuan ke LiveDoc. Buat slide dari poin utama. Bangun mind map untuk melihat keterkaitan sumber. Jendela gratis memberi Anda seluruh pipeline.

Bersifat sementara, bukan permanen. Ini jendela gratis 7 hari untuk pelanggan Felo Pro. Setelah berakhir, V4 Flash kembali ke harga Pro standar. Gunakan minggu ini untuk memutuskan apakah ia layak jadi bagian tetap workflow Anda.


Perbandingan V4 Flash dengan model lain di Felo

Felo memberi Anda akses ke tumpukan model frontier, bukan hanya DeepSeek. Berikut posisi V4 Flash di lineup dan kapan Anda mungkin memilih model lain.

V4 Flash vs GPT-5.5. GPT-5.5 lebih unggul untuk tugas menulis bernuansa, karya kreatif, dan instruksi ambigu. Tapi biayanya jauh lebih mahal per query di level API. Di Felo, keduanya tersedia. Jika Anda debugging kode atau mencari cepat, V4 Flash sering selesai lebih dulu. Jika butuh prosa dengan tone khusus atau format sangat spesifik, GPT-5.5 tetap pilihan aman.

V4 Flash vs Claude Opus 5. Opus unggul untuk tulisan panjang, penalaran hati-hati pada dokumen setebal buku, dan mengikuti instruksi format detail. V4 Flash lebih cepat, murah, dan kini cukup dekat pada kode sehingga banyak developer memilihnya untuk kerja harian. Anggap Opus sebagai alat presisi saat output harus benar-benar sempurna.

V4 Flash vs V4 Pro. Pro lebih baik untuk tugas berbasis pengetahuan, matematika kompetisi, dan tantangan coding tersulit. Flash unggul di semua hal lain, dan cukup cepat hingga Anda lupa sedang menunggu model. Jendela gratis mencakup keduanya. Coba Pro untuk masalah tersulit, Flash untuk sisanya.

V4 Flash vs Gemini 3.6 Flash. Keduanya model kecepatan dengan jendela konteks besar. Gemini mendukung input multimodal (gambar, video). V4 Flash hanya teks tapi unggul pada benchmark coding agentic dan keunggulan lisensi MIT. Jika butuh vision, pilih Gemini. Jika butuh agen yang menulis dan mengedit kode, V4 Flash lebih unggul.


FAQ

Apakah jendela gratis 7 hari benar-benar gratis?

Ya — untuk pelanggan Felo Pro yang sudah ada. Tanpa kartu kredit, tanpa perpanjangan otomatis. Jendela dimulai hari ini, 6 Agustus, dan berlangsung selama 7 hari.

Apa yang terjadi setelah 7 hari?

V4 Flash kembali ke harga Pro standar. Fitur Pro lain Anda tetap utuh. Tidak ada yang dihapus — riwayat percakapan, LiveDocs, dan pencarian tersimpan tetap aman.

Apakah saya perlu instalasi untuk integrasi Codex?

Tidak. V4 Flash mendukung Responses API secara native. Atur deepseek-v4-flash sebagai model di konfigurasi Codex, dan langsung berfungsi di Codex CLI, ChatGPT Desktop, dan ekstensi VS Code. Satu perubahan konfigurasi, berlaku di semua tempat.

Bagaimana perbandingannya dengan memakai API DeepSeek langsung?

API DeepSeek murah dan cepat. Yang ditambahkan Felo adalah grounding pencarian web real-time, permukaan perbandingan multi-model, dan ekspor satu klik ke dokumen, slide, dan mind map. Jika hanya butuh inferensi mentah, pakai API. Jika ingin jawaban berbasis pencarian dan workspace di sekitar model, Felo lebih cocok.

Apakah V4 Flash bisa dipakai di mobile?

Bisa. Felo Search berjalan di browser mobile mana pun di felo.ai. LLM Playground di playground.felo.ai juga siap untuk mobile.


Model open-weight pertama yang benar-benar dipakai tim

Inilah yang membedakan V4 Flash dari rilis open-weight lain: tim engineering benar-benar memasukkannya ke pipeline produksi sebagai pengganti nyata alternatif closed-source. Bukan eksperimen. Bukan cadangan. Sebagai model utama.

Berlisensi MIT. Bobot penuh di Hugging Face. Fine-tuning komersial diperbolehkan. Dan dengan rilis 0731, kapabilitas agentic-nya sudah melewati batas "cukup bagus untuk harga" menjadi "cukup bagus". Jendela gratis 7 hari di Felo adalah cara termudah bagi pelanggan Pro untuk melihat apakah ia cocok untuk workflow Anda.


Masuk ke Felo Pro dan mulai gunakan DeepSeek V4 Flash gratis hari ini — jendela 7 hari berakhir pada 12 Agustus.

Gunakan DeepSeek V4 Flash Gratis →


Tulisan ini juga tersedia dalam English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.