30 Eylül 2026'da duyuruldu · Aşamalı olarak kullanıma açılıyor

Gemini 4 Argonuzun araştırma, eksiksiz yazılmış

Google'ın Gemini 3'ten bu yana çıkardığı ilk amiral gemisi modeli; uzun ve çok adımlı işlerde derin muhakeme için tasarlandı. Çıktı sınırını 64K token'dan 1M token'a çıkarıyor ve Google'ın yayımladığı sayılarda kodlamada değil, bilgi işinde önde.

Felo API kapalı beta aşamasında — Gemini 4 Argon erişimi yakında açılacak.

Gemini 4 Argon ana görseli: mavi bir gradyan üzerinde model adının yanında büyük bir 4 rakamı
Google'ın duyuru görseli. Argon, Gemini 4.0 hattının güncellemesi olarak değil yeni bir adlandırma düzeniyle çıkıyor; adında sürüm numarası bulunmamasının nedeni bu.
1M
En fazla çıktı token'ı
64K'dan yükseltildi: tek bir akışta üretilen eksiksiz bir rapor.
2 $ / 10 $
Başlangıç API fiyatı
Milyon girdi ve çıktı token'ı başına. Önbelleğe alınan girdide %95 indirim.
77.9%
DeepSWE v1.1
Google'ın bildirdiği skor; Claude Opus 5.5 ve GPT-6 Astra'nın önünde.
15%
Halüsinasyon oranı
Artificial Analysis ölçümünde amiral gemisi modeller arasındaki en düşük oran.

Bu sayfadaki rakamlar ve grafikler, onları yayımlayan kuruluşlardan — Google, Arena.ai ve Artificial Analysis — alınmış ve değiştirilmeden aktarılmıştır.

Kullanıma açılma durumu

Argon henüz genel kullanıma açık değil. Kullanıma açılma sırası şöyle.

Google, Argon'u aşamalar hâlinde yayımlıyor ve ilk aşama herkese açık olan değil. Felo içindeki erişim de bu takvimle birlikte hazırlanıyor.

Şu anda açık

Güvenilen siber savunma ekipleri

Google'ın Fairwind programındaki seçili ortaklar Argon'a ilk ulaşanlar ve onu siber güvenlik korumaları olmadan kullanıyor.

Sıradaki aşama

Ücretli API müşterileri ve Google AI Ultra

Google daha geniş erişimin burada başlayacağını söylüyor. Tarih verilmedi ve bugün tek başına abonelik erişim sağlamıyor.

Henüz planlanmadı

Geliştiriciler, kurumlar ve son kullanıcılar

Ücretli katmanların ardından geliyor. Google genel kullanıma açılış için bir takvim taahhüdünde bulunmadı.

Felo Arama içinde Argon erişimi hazırlanıyor. Açıldığında bu sayfa güncellenecek.

Neyi iyi yapıyor

Hızlı yanıt vermek için değil, uzun işi bitirmek için kurulmuş bir model

Argon'un yayımlanan güçlü yanları okuma, muhakeme ve uzun yazma etrafında toplanıyor. Bu, karşılaştırıldığı kodlama odaklı amiral gemisi modellerden farklı bir profil.

Uzun bir iş boyunca dağılmayan muhakeme

Google, Argon'u saatler süren çok adımlı işler için konumlandırıyor; önceki modellerin dağıldığı ya da erken durduğu yerlerde.

Tek geçişte 1M token çıktı

Google'ın artış gerekçesi şu: uzun uzun düşünecek yeri olan bir model, zor bir problemi çok sayıda gidiş geliş yerine tek bir akışta çözebiliyor.

Önde olan bilgi işi, kodlama değil

En geniş farklar Harvey's Legal Agent Benchmark ve Vals Finance Agent v2'de bildiriliyor; yani sentetik görevlerde değil, gerçek hukuk ve finans analizinde.

Ayakta kalan uzun bağlam erişimi

Bir modelin 256K ile 1M arasındaki bağlamı gerçekten kullanıp kullanamadığını ölçen GraphWalks'ta Google, diğer amiral gemilerine karşı on puandan fazla fark bildiriyor.

Uzun video anlama

Uzun videolarda anlamayı ölçen LVBench'te bildirilen sonuç 91.7% — Google'ın Argon için listelediği en yüksek skor.

Harvey's Legal Agent Benchmark çubuk grafiği: Gemini 4 Argon 19.6%, Claude Fable 5.1 6.7%, GPT-6 Astra 5.4%, Claude Opus 5.5 3.8%
Uzun soluklu hukuk işi. Argon'un yüzde 19.6'lık skoru, bir sonraki modelin skorunun yaklaşık üç katı ve Google'ın yayımladığı setteki en geniş fark.
Vals Finance Agent v2 çubuk grafiği: Gemini 4 Argon 65.4%, Claude Fable 5.1 58.9%, Claude Opus 5.5 58.6%, GPT-6 Astra 53.5%
Finansal araştırma ve analiz: 65.4% ile 53.5-58.9% aralığındaki bir gruba karşı. Hukuk işindekinden daha dar bir fark, ama sıralama aynı.

Yayımlanan sayılar

Argon, Google'ın kendi benchmark'larında nerede duruyor

Bunlar üretici tarafından bildirilen sonuçlar. Google, manşet skorlar için bir thinking ya da effort ayarı yayımlamadı ve henüz hiçbir bağımsız laboratuvar bunları doğrulamadı.

Benchmark
Neyi ölçüyor
Argon
En yakın karşılaştırma
DeepSWE v1.1
Uzun soluklu yazılım mühendisliği
77.9%
Opus 5.5 74.2%, GPT-6 Astra 74.1%
CWE-bench v1
Güvenlik açıklarını bulma ve yamama
68%
Birinciliği paylaşıyor
AutomationBench
Zapier'den uçtan uca iş görevleri
51.3%
Birinci sırada
LVBench
Uzun videoyu anlama
91.7%
Google'ın Argon için bildirdiği en yüksek skor

Bunları yön gösterici olarak alın. Üretici benchmark'ları üretim iş yükleriyle karşılaştığında nadiren değişmeden kalıyor ve Bloomberg, bazı Google çalışanlarının bile benchmark üstünlüğünün gerçek işe geçtiğine kuşkuyla baktığını bildirdi.

DeepSWE v1.1 çubuk grafiği: Gemini 4 Argon 77.9%, Claude Opus 5.5 74.2%, GPT-6 Astra 74.1%, Claude Fable 5.1 67.4%
Uzun soluklu yazılım mühendisliği. Manşet rakam 77.9% ve en yakın iki rakip de onun dört puan içinde.
AutomationBench çubuk grafiği: Gemini 4 Argon 51.3%, Claude Opus 5.5 42.5%, GPT-6 Astra 41.4%, Claude Fable 5.1 31.4%
Zapier'in geliştirdiği uçtan uca iş görevleri. Argon yüzde 50'yi aşıyor; karşılaştırmadaki diğer tüm modellerse yüzde otuzlarda ya da kırkların başında kalıyor.
CWE-bench v1 sıralaması: Gemini 4 Argon, Grok ile GPT-6 Astra yüzde 68'de berabere, Claude Opus 5.5 yüzde 67'de ve tablo Inkling'in yüzde 37'sine kadar iniyor
Pass@1'de güvenlik açığı keşfi. Argon kalabalık bir tablonun zirvesini paylaşıyor, arayı açmıyor; yukarıdaki tablonun bunu birincilik beraberliği saymasının nedeni bu.
Google'ın Gemini 4 Argon için 16 benchmark genelinde yayımladığı tam sonuç tablosu; bilgi işi, ajan kodlama, ML mühendisliği, bilim ve matematik, uzun bağlam, bilgisayar kullanımı, çok modlu anlama ve siber güvenlik başlıklarında gruplanmış
Duyurudaki tablonun tamamı; Argon'un kazandığı hücreler mavi, bir rakibin önde olduğu hücreler gri. FrontierSWE v2, Terminal-Bench 4.0, PostTrainBench, Terminal-Bench Science 0.1 ve OSWorld-2.0, Argon'un önde olmadığı satırlar.
Artificial Analysis'in AA-Omniscience halüsinasyon oranını 36 model genelinde gösteren, en düşükten başlayarak sıralanmış çubuk grafik: Gemini 4 Argon (High) %15, ardından MiniMax-M3 %18, Kimi K2.5 %26 ve DeepSeek-V4 Flash'a kadar yükselerek %96
Artificial Analysis'in bağımsız ölçümü ve bu sayfadaki hiçbir sağlayıcının vermediği tek rakam: her modelin yanıt vermeyi reddetmek yerine ne sıklıkla yanlış yanıt verdiği. Argon'un %15'i, grafikteki 36 modelin en düşüğü; ölçek %96'ya kadar çıkıyor.
Arena.ai'nin Text Arena ve Code Arena: WebDev liderlik tabloları yan yana: Gemini 4 Argon Text Arena'da 1625 ile birinci, Code Arena: WebDev'de 1679 ile sekizinci
Yukarıdaki paragrafın dayandığı iki sıralama, Arena.ai'nin izleyici oyuyla oluşan liderlik tablolarından geliyor. Argon, Text Arena'da listelenen 25 modelin zirvesinde; Code Arena: WebDev'de ise sekizinci — dört Claude modelinin ve OpenAI'nin GPT-6 serisinden üç modelin ardında.

Felo'da

1M token yazan bir modelle araştırma akışı nasıl görünür

Felo aramayı belge anlamayla birleştiriyor; uzun çıktı veren bir model tek bir oturumda üretilebilecek şeyi değiştiriyor.

Belgeyle biten araştırma

Kaynakları toplayın, sonra sentezi bölüm bölüm çok sayıda istemle birleştirmek yerine modele tek geçişte yazdırın.

Tek işte koca belge setleri

Argon'un en güçlü olduğu yetenek uzun bağlam erişimi; sözleşme setlerini, resmî başvuruları ve uzun raporları işlenebilir kılan da bu.

Tonun önemli olduğu metinler

Argon'un bildirilen profili — güçlü metin, orta düzey kodlama — yazılmış gibi okunan, birleştirilmiş gibi durmayan metne ihtiyaç duyan ekiplere uygun.

Maliyet

Argon ne kadar, sonrasında ne değişiyor

Google bir başlangıç tarifesi ve daha yüksek bir liste tarifesi yayımladı, ancak geçişin ne zaman olacağını söylemedi. Bütçenizi yüksek rakama göre planlayın.

Token türü
Başlangıç
Sonrası
Girdi
2.00 $ / M
4.00 $ / M
Önbelleğe alınan girdi
%95 indirim
%95 indirim
Çıktı
10.00 $ / M
20.00 $ / M

Karşılaştırma için: başlangıç tarifesi kabaca GPT-6.1 Sol ve Sonnet 5.5 ile aynı seviyede, GPT-6 Astra'nın ise yaklaşık beşte biri kadar. Bunlar liste fiyatları, görev başına ölçülmüş maliyet değil — Argon daha zor soruları yanıtlıyor, dolayısıyla tek bir çalıştırma yine de daha pahalıya gelebilir.

Felo'da Argon ile nasıl çalışılır

01

Sorunun tamamını getirin

Felo'ya belge setinin ya da uzun yazışmanın kendisini verin, özetini değil. Argon'un avantajı bağlamın isteme sığmadığı yerde başlıyor.

02

Bitmiş çıktıyı isteyin

1M token'lık çıktı sınırıyla eksiksiz raporu ya da tam taslağı bölüm bölüm değil, tek bir talimatta isteyebilirsiniz.

03

Kaynaklara karşı kontrol edin

Felo kaynakçayı yanıtın yanında tutuyor; modelin ürettiği uzun bir belgeyi denetlenebilir kılan da bu.

Felo Arama içinde Argon erişimi hazırlanıyor. Açılana kadar Felo kadrosundaki diğer tüm modeller şu anda kullanılabilir.

Felo AI Arama'yı aç

Gemini 4 Argon: sık sorulan sorular

Genel kullanım için hayır. Google, Argon'u önce Fairwind programındaki seçili ortaklara verdi ve daha geniş erişimin ücretli API müşterileri ile Google AI Ultra aboneleriyle başlayacağını söylüyor. Bu aşama için tarih açıklanmadı ve bugün ücretli abonelik erişim sağlamıyor.

Google'ın amiral gemisi modellerini Felo'da deneyin

İşe uyan modelle arayın, okuyun ve yazın. Argon, kullanıma açılma sırası Felo'ya geldiğinde kadroya katılıyor.

Felo AI Arama'yı aç

Felo AI Arama'yı kullanmak için kredi kartı gerekmez.