新品 · 2026 年 7 月 21 日上市 · Gemini 3 系列

Gemini 3.6 Flash — 免费试用输出代币减少 17%

Gemini 3.6 Flash 是 Google DeepMind 的主力智能体模型,于 2026 年 7 月 21 日发布。根据 Artificial Analysis Index,它比 Gemini 3.5 Flash 少使用 17% 的输出令牌,同时为编程、研究和多步骤工作带来原生计算机使用能力、1M 令牌上下文窗口和更低的输出价格。在 Felo AI 上开始免费试用。

在 Felo AI 上免费试用 — 无需信用卡

代理经济学

评估成本和能力

83.0%

经过 OSWorld-Verified

$7.50

每 1M 输出代币

当工作量大时,较低的产出定价和更强的已发布代理基准很重要。

83.0%

OSWorld-Verified

代理计算机使用基准

$7.50

产出价格

7.50 美元/100 万代币,低于 9.00 美元

58.7%

SWE-Bench Pro

代理编码,高于 55.1%

1M

上下文窗口

每个请求的输入令牌

标题不是基准。这是比尔。

代理成本由代币定价和模型完成多步骤工作的可靠性决定。 Gemini 3.6 Flash 将产出价格从每百万代币 9.00 美元降低至 7.50 美元,根据Artificial Analysis Index,与 Gemini 3.5 Flash 相比,使用的产出代币减少了 17%。

输出代币减少 17%

Google DeepMind 报告称,根据Artificial Analysis Index,Gemini 3.6 Flash 使用的输出令牌比 Gemini 3.5 Flash 少 17%。实际节省取决于任务和提示。

公布的代理结果更强劲

Google DeepMind 报告称,在 DeepSWE、OSWorld-Verified和长上下文检索方面优于 Gemini 3.5 Flash。在评估长时间运行的代理任务时,这些是有用的信号。

相同的背景,相同的方式

您可以保留 1M 令牌输入窗口以及本机文本、图像、音频和视频输入,因此大型混合媒体任务可以保留在单个模型工作流程中。

Gemini 3.6 Flash 发生了什么变化

专为大规模运营代理的经济性而构建,官方结果使成本和能力更容易一起评估。

定价和能力相结合

Gemini 3.6 Flash 将输出价格从 Gemini 3.5 Flash 的 9.00 美元降低至每百万代币 7.50 美元,而 Google DeepMind 根据Artificial Analysis Index报告,输出代币使用量降低了 17%。其公布的基准收益让团队可以一起评估成本和能力,而不是将价格视为唯一的效率信号。

计算机作为本地工具的使用

现在,通过 Gemini API 和 Gemini Enterprise 控制浏览器或桌面是内置的客户端工具,无需单独的模型或附加框架。在 OSWorld-Verified 上,代理计算机使用率达到 83.0%,高于 Gemini 3.5 Flash 的 78.4%。

更强的代理编码

SWE-Bench Pro 达到 58.7%,DeepSWE v1.1 达到 49.0%,而在 Google 发布的比较中,Gemini 3.5 Flash 为 55.1% 和 37.0%。使用模型卡来评估是否适合您自己的编码工作流程。

1M 代币多模式上下文

将大型代码库、长文档和混合媒体合并到一个请求中。在 Google 发布的比较中,具有 64K 输出标记的 1M 输入窗口在 128K 的 GDM-MRCR v2 上得分为 91.8%。

性能基准

Gemini 3.6 Flash 与 Frontier

官方 Google DeepMind 模型卡结果。 Gemini 3.6 Flash 在下面每一行都对 Gemini 3.5 Flash 进行了改进;比较还显示了较大的前沿模型在哪些方面仍处于领先地位。

基准测试

Gemini 3.6 Flash

Gemini 3.5 Flash

Claude Sonnet 5

SWE-Bench Pro

58.7%

55.1%

63.2%

DeepSWE v1.1

49.0%

37.0%

54.0%

OSWorld-Verified

83.0%

78.4%

81.2%

CharXiv Reasoning (no tools)

85.2%

84.2%

77.0%

GDM-MRCR v2 (128K)

91.8%

77.3%

71.6%

资料来源:Gemini 3.6 Flash 模型卡 — Google DeepMind,2026 年 7 月。

阅读 Google DeepMind 官方模型卡

技术规格

将 Gemini 3.6 Flash 集成到您的应用程序之前所需的一切。

上下文窗口

1,048,576 个代币输入

65,536 个代币输出

API定价

1.50 美元/100 万个输入代币

$7.50 / 1M 输出代币

Gemini 3.5 Flash 的输出成本从 9.00 美元下降

知识截止

2026 年 3 月

推理

专为编码、计算机使用和长上下文任务而设计的原生多模态推理模型。

工具使用和 API

通过 Gemini API 和 Gemini Enterprise 进行函数调用、结构化输出以及新的内置客户端计算机使用工具。

输入方式

文本、图像、音频和视频;文本输出。原生多模式,无需预处理。

原生多模态 — 一种模型,每种输入类型

Gemini 3.6 Flash 可以本地读取文本、图像、音频和视频。没有单独的管道,没有将模型缝合在一起。

文本和PDF

一次性解析长文档和结构化数据,无需预处理即可处理复杂的表格和代码。

图像和图表

在 Google 公布的比较中,CharXiv Reasoning 在没有工具的情况下达到了 85.2%,显示出强大的图表和视觉推理能力。

视频分析

分析视频以及文本和图像,然后提出有根据的问题或要求对所提供的材料进行简明摘要。

音频输入

理解语音、环境声音和多语言对话,以用于转录、翻译和语音驱动代理。

谁使用 Gemini 3.6 Flash

从个人开发人员到企业团队,Gemini 3.6 Flash 适合任何需要大量运行强大 AI 的地方。

代理编码

Google 的模型卡在 SWE-Bench Pro 上报告为 58.7%,在 DeepSWE v1.1 上报告为 49.0%。在您自己的存储库、审核流程和编码代理设置上对其进行评估。

文档和数据分析

当上下文很重要时,使用 1M 令牌上下文窗口可以在单个请求中处理冗长的文档、结构化数据和图表。

设计和产品工具

结合视觉输入和书面说明来提取结构化信息、起草替代方案或准备审查材料。

计算机使用代理

通过将计算机用作本机工具且 OSWorld-Verified率为 83.0%,座席可以直接驱动浏览器和应用程序 — 预订、填写表格和端到端导航 UI。

长期工作流程

对于多步骤工作,请在选择生产设置之前比较代表性任务的模型质量、延迟和令牌使用情况。

大容量管道

对于大容量文档和提取工作流程,在推出之前测量实际请求量和输出长度以估算 API 成本。

在 Felo 上使用 Gemini 3.6 Flash 的两种方法

Felo 人工智能搜索

打开 Felo AI 搜索并选择 Gemini 3.6 Flash 型号。提出问题,使用人工智能搜索网络,并获得引用的答案——由 Google 最新的主力模型提供支持。

打开 Felo AI 搜索

比较 Felo 搜索中的答案

打开 Felo AI 搜索,选择可用的 Gemini 3.6 Flash,然后根据您自己的提示将其答案与其他支持的型号进行比较。

打开 Felo AI 搜索

常见问题解答

可以。Felo AI 提供 Gemini 3.6 Flash 的免费试用。创建账户即可开始,无需信用卡。

开始免费试用 Gemini 3.6 Flash

Google DeepMind 的主力模型,于 2026 年 7 月发布。打开 Felo AI 并在您自己的工作中评估其编码、计算机使用和长上下文功能。

在 Felo 上打开 Gemini 3.6 Flash

免费试用 — 无需信用卡