Gemini 3.6 Flash — Avaliação gratuita17% menos tokens de saída
Gemini 3.6 Flash é o modelo agentivo versátil do Google DeepMind, lançado em 21 de julho de 2026. Segundo o Artificial Analysis Index, ele usa 17% menos tokens de saída que Gemini 3.5 Flash e traz uso nativo do computador, janela de contexto de 1M tokens e preços de saída menores para programação, pesquisa e trabalho em várias etapas. Inicie sua avaliação gratuita no Felo AI.
Avaliação gratuita no Felo AI — não é necessário cartão de crédito
Economia do agente
Avalie custo e capacidade
83.0%
no OSWorld-Verified
$7.50
por 1 milhão de tokens de saída
83.0%
Verificado pelo OSWorld
Referência de uso de computador agente
$7.50
Preço de saída
US$ 7,50/1 milhão de tokens, abaixo dos US$ 9,00
58.7%
SWE-Bench Pro
Codificação Agentic, acima de 55,1%
1M
Janela de contexto
Tokens de entrada por solicitação
O título não é uma referência. É o projeto de lei.
Os custos do agente são moldados tanto pelo preço do token quanto pela confiabilidade com que um modelo conclui o trabalho de várias etapas. O Gemini 3.6 Flash reduz o preço de saída de US$ 9,00 para US$ 7,50 por milhão de tokens e, de acordo com o Índice de Análise Artificial, usa 17% menos tokens de saída do que o Gemini 3.5 Flash.
17% menos tokens de saída
O Google DeepMind relata que o Gemini 3.6 Flash usa 17% menos tokens de saída do que o Gemini 3.5 Flash, de acordo com o Artificial Analysis Index. A economia real depende da tarefa e do prompt.
Resultados mais fortes dos agentes publicados
O Google DeepMind relata ganhos em relação ao Gemini 3.5 Flash no DeepSWE, OSWorld-Verified e recuperação de contexto longo. Esses são sinais úteis ao avaliar tarefas de agente de longa duração.
Mesmo contexto, mesmas modalidades
Você mantém a janela de entrada de 1 milhão de tokens e a entrada nativa de texto, imagem, áudio e vídeo, para que tarefas grandes e de mídia mista possam permanecer em um único modelo de fluxo de trabalho.
O que mudou no Gemini 3.6 Flash
Desenvolvido para a economia da operação de agentes em escala, com resultados oficiais que facilitam a avaliação conjunta de custos e capacidade.
Preço e capacidade juntos
Gemini 3.6 Flash reduz o preço de saída para US$ 7,50 por milhão de tokens, de US$ 9,00 no Gemini 3.5 Flash, enquanto o Google DeepMind relata uso de token de saída 17% menor de acordo com o Índice de Análise Artificial. Os ganhos de benchmark publicados permitem que as equipes avaliem o custo e a capacidade em conjunto, em vez de tratar o preço como o único sinal de eficiência.
Uso do computador como ferramenta nativa
O controle de um navegador ou desktop agora é uma ferramenta integrada do lado do cliente por meio da API Gemini e do Gemini Enterprise — sem um modelo separado ou estrutura integrada. No OSWorld-Verified, o uso de computadores agentes atinge 83,0%, acima dos 78,4% no Gemini 3.5 Flash.
Codificação Agente mais Forte
SWE-Bench Pro atinge 58,7% e DeepSWE v1.1 atinge 49,0%, em comparação com 55,1% e 37,0% para Gemini 3.5 Flash na comparação publicada pelo Google. Use o cartão modelo para avaliar a adequação ao seu próprio fluxo de trabalho de codificação.
Contexto Multimodal de Token 1M
Reúna grandes bases de código, documentos longos e mídia mista em uma única solicitação. A janela de entrada de 1 milhão com tokens de saída de 64 mil obteve pontuação de 91,8% no GDM-MRCR v2 com 128 mil na comparação publicada pelo Google.
Gemini 3.6 Flash contra a Fronteira
Resultados oficiais do cartão modelo Google DeepMind. O Gemini 3.6 Flash melhora o Gemini 3.5 Flash em todas as linhas abaixo; a comparação também mostra onde os modelos de fronteira maiores permanecem à frente.
Referência
Gêmeos Gemini 3.6 Flash
Gêmeos Gemini 3.5 Flash
Claude Sonnet 5
SWE-Bench Pro
58.7%
55.1%
63.2%
DeepSWE v1.1
49.0%
37.0%
54.0%
OSWorld-Verified
83.0%
78.4%
81.2%
CharXiv Reasoning (no tools)
85.2%
84.2%
77.0%
GDM-MRCR v2 (128K)
91.8%
77.3%
71.6%
Fonte: Gemini 3.6 Flash Model Card — Google DeepMind, julho de 2026.
Leia o cartão de modelo oficial do Google DeepMindEspecificações Técnicas
Tudo o que você precisa antes de integrar o Gemini 3.6 Flash ao seu aplicativo.
Janela de contexto
Entrada de 1.048.576 tokens
Produção de 65.536 tokens
Preços de API
US$ 1,50/1 milhão de tokens de entrada
Tokens de saída de US$ 7,50/1 milhão
Custo de saída reduzido de US$ 9,00 no Flash 3,5
Corte de conhecimento
Março de 2026
Raciocínio
Um modelo de raciocínio nativamente multimodal projetado para codificação, uso de computador e tarefas de longo contexto.
Uso de ferramentas e APIs
Chamada de função, saída estruturada e uma nova ferramenta integrada para uso do computador no lado do cliente por meio da API Gemini e do Gemini Enterprise.
Modalidades de entrada
Entrada de texto, imagens, áudio e vídeo; texto. Multimodal nativo, sem necessidade de pré-processamento.
Multimodal nativo – um modelo, cada tipo de entrada
Gemini 3.6 Flash lê texto, imagens, áudio e vídeo nativamente. Não há pipelines separados, nem modelos unidos.
Texto e PDF
Analisa documentos longos e dados estruturados em uma única passagem, manipulando tabelas e códigos complexos sem pré-processamento.
Imagem e gráficos
CharXiv Reasoning atinge 85,2% sem ferramentas na comparação publicada pelo Google, mostrando gráfico forte e raciocínio visual.
Análise de vídeo
Analise o vídeo juntamente com texto e imagens e, em seguida, faça perguntas fundamentadas ou solicite resumos concisos do material fornecido.
Entrada de áudio
Compreende fala, som ambiente e conversação multilíngue para transcrição, tradução e agentes acionados por voz.
Quem usa Gemini 3.6 Flash
De desenvolvedores individuais a equipes empresariais, o Gemini 3.6 Flash cabe onde quer que você execute IA em grande volume.
Codificação Agente
O cartão de modelo do Google reporta 58,7% no SWE-Bench Pro e 49,0% no DeepSWE v1.1. Avalie-o em seus próprios repositórios, processo de revisão e configuração do agente de codificação.
Análise de documentos e dados
Use a janela de contexto de token de 1 milhão para trabalhar com documentos extensos, dados estruturados e gráficos em uma única solicitação quando esse contexto for importante.
Ferramentas de design e produto
Combine informações visuais e instruções escritas para extrair informações estruturadas, elaborar alternativas ou preparar material para revisão.
Agentes de uso de computador
Com o uso do computador como ferramenta nativa e verificado pelo OSWorld em 83,0%, os agentes podem controlar navegadores e aplicativos diretamente – reservando, preenchendo formulários e navegando em interfaces de usuário de ponta a ponta.
Fluxos de trabalho de longo horizonte
Para um trabalho em várias etapas, compare a qualidade do modelo, a latência e o uso de tokens em tarefas representativas antes de escolher uma configuração de produção.
Pipelines de alto volume
Para fluxos de trabalho de extração e documentos de alto volume, meça o volume real de solicitações e a duração da saída para estimar os custos da API antes da implementação.
Duas maneiras de usar o Gemini 3.6 Flash no Felo
Pesquisa Felo AI
Abra o Felo AI Search e selecione o modelo Gemini 3.6 Flash. Faça perguntas, pesquise na web com IA e obtenha respostas citadas, com a tecnologia do mais novo modelo robusto do Google.
Abra a Pesquisa Felo AICompare as respostas na pesquisa Felo
Abra o Felo AI Search, escolha Gemini 3.6 Flash quando disponível e compare suas respostas com outros modelos suportados em seus próprios prompts.
Abra a Pesquisa Felo AIPerguntas frequentes
Sim. O Felo AI oferece uma avaliação gratuita do Gemini 3.6 Flash. Crie uma conta para começar — não é necessário cartão de crédito.
Inicie sua avaliação gratuita do Gemini 3.6 Flash
Modelo robusto do Google DeepMind, publicado em julho de 2026. Abra o Felo AI e avalie seus recursos de codificação, uso do computador e contexto longo em seu próprio trabalho.
Abra o Gemini 3.6 Flash no FeloAvaliação gratuita — não é necessário cartão de crédito