Mới · Ra mắt ngày 21 tháng 7 năm 2026 · Dòng Gemini 3

Gemini 3.6 Flash — Dùng thử miễn phíMã thông báo đầu ra ít hơn 17%

Gemini 3.6 Flash là mô hình tác tử chủ lực của Google DeepMind, ra mắt ngày 21 tháng 7 năm 2026. Theo Artificial Analysis Index, mô hình này dùng ít hơn 17% token đầu ra so với Gemini 3.5 Flash, đồng thời có khả năng sử dụng máy tính gốc, cửa sổ ngữ cảnh 1M token và giá đầu ra thấp hơn cho lập trình, nghiên cứu và công việc nhiều bước. Bắt đầu bản dùng thử miễn phí trên Felo AI.

Dùng thử miễn phí trên Felo AI — không cần thẻ tín dụng

Kinh tế đại lý

Đánh giá chi phí và khả năng

83.0%

trên OSWorld-Đã được xác minh

$7.50

trên mỗi 1 triệu mã thông báo đầu ra

Giá đầu ra thấp hơn và điểm chuẩn đại lý được công bố mạnh hơn sẽ đóng vai trò quan trọng khi công việc được thực hiện với số lượng lớn.

83.0%

OSWorld-Đã được xác minh

Điểm chuẩn sử dụng máy tính Agentic

$7.50

Giá đầu ra

7,50 USD / 1 triệu mã thông báo, giảm từ 9,00 USD

58.7%

SWE-Băng ghế dự bị Pro

Mã hóa đại lý, tăng từ 55,1%

1M

Cửa sổ ngữ cảnh

Nhập mã thông báo cho mỗi yêu cầu

Tiêu đề không phải là một điểm chuẩn. Đó là Dự luật.

Chi phí đại lý được định hình bởi cả việc định giá mã thông báo và mức độ tin cậy của một mô hình khi hoàn thành công việc gồm nhiều bước. Gemini 3.6 Flash giảm giá đầu ra từ 9,00 USD xuống 7,50 USD trên một triệu mã thông báo và theo Chỉ số phân tích nhân tạo, sử dụng mã thông báo đầu ra ít hơn 17% so với Gemini 3.5 Flash.

Mã thông báo đầu ra ít hơn 17%

Google DeepMind báo cáo rằng Gemini 3.6 Flash sử dụng mã thông báo đầu ra ít hơn 17% so với Gemini 3.5 Flash, theo Chỉ số phân tích nhân tạo. Mức tiết kiệm thực tế phụ thuộc vào nhiệm vụ và thời gian thực hiện.

Kết quả đại lý được công bố mạnh mẽ hơn

Google DeepMind báo cáo mức tăng so với Gemini 3.5 Flash trên DeepSWE, OSWorld-Được xác minh và truy xuất ngữ cảnh dài. Đây là những tín hiệu hữu ích khi đánh giá các tác vụ tổng đài viên dài hạn.

Cùng một bối cảnh, cùng một phương thức

Bạn giữ lại cửa sổ nhập mã thông báo 1 triệu và đầu vào văn bản, hình ảnh, âm thanh và video gốc, do đó, các tác vụ đa phương tiện lớn và hỗn hợp có thể nằm trong một quy trình làm việc theo mô hình duy nhất.

Điều gì đã thay đổi trong Gemini 3.6 Flash

Được xây dựng nhằm mang lại lợi ích kinh tế cho việc vận hành các tác nhân trên quy mô lớn, với các kết quả chính thức giúp việc đánh giá cùng nhau chi phí và khả năng trở nên dễ dàng hơn.

Giá cả và khả năng cùng nhau

Gemini 3.6 Flash giảm giá đầu ra xuống còn 7,50 USD trên một triệu mã thông báo từ 9,00 USD trên Gemini 3.5 Flash, trong khi Google DeepMind báo cáo mức sử dụng mã thông báo đầu ra thấp hơn 17% theo Chỉ số phân tích nhân tạo. Mức tăng điểm chuẩn được công bố của nó cho phép các nhóm cùng nhau đánh giá chi phí và khả năng thay vì coi giá là tín hiệu hiệu quả duy nhất.

Sử dụng máy tính như một công cụ gốc

Việc kiểm soát trình duyệt hoặc máy tính để bàn hiện là một công cụ phía máy khách được tích hợp sẵn thông qua API Gemini và Gemini Enterprise — không có mô hình hoặc khung cố định riêng biệt. Trên OSWorld-Được xác minh, việc sử dụng máy tính tác nhân đạt 83,0%, tăng từ 78,4% trên 3,5 Flash.

Mã hóa tác nhân mạnh hơn

SWE-Bench Pro đạt 58,7% và DeepSWE v1.1 đạt 49,0%, so với 55,1% và 37,0% của Gemini 3.5 Flash trong so sánh được công bố của Google. Sử dụng thẻ mô hình để đánh giá mức độ phù hợp với quy trình viết mã của riêng bạn.

Bối cảnh đa phương thức mã thông báo 1 triệu

Đưa các cơ sở mã lớn, tài liệu dài và phương tiện hỗn hợp vào một yêu cầu. Cửa sổ đầu vào 1M với mã thông báo đầu ra 64K đạt 91,8% trên GDM-MRCR v2 ở mức 128K trong so sánh được công bố của Google.

Điểm chuẩn hiệu suất

Gemini 3.6 Flash vs Biên giới

Kết quả thẻ mô hình Google DeepMind chính thức. Gemini 3.6 Flash cải thiện trên Gemini 3.5 Flash ở mọi hàng bên dưới; sự so sánh cũng cho thấy các mô hình biên giới lớn hơn vẫn ở phía trước.

Điểm chuẩn

Gemini 3.6 Flash

Gemini 3.5 Flash

Claude Sonnet 5

SWE-Bench Pro

58.7%

55.1%

63.2%

DeepSWE v1.1

49.0%

37.0%

54.0%

OSWorld-Verified

83.0%

78.4%

81.2%

CharXiv Reasoning (no tools)

85.2%

84.2%

77.0%

GDM-MRCR v2 (128K)

91.8%

77.3%

71.6%

Nguồn: Thẻ mô hình Gemini 3.6 Flash — Google DeepMind, tháng 7 năm 2026.

Đọc thẻ mô hình Google DeepMind chính thức

Thông số kỹ thuật

Mọi thứ bạn cần trước khi tích hợp Gemini 3.6 Flash vào ứng dụng của bạn.

Cửa sổ ngữ cảnh

Đầu vào 1.048.576 mã thông báo

Sản lượng 65.536 token

Giá API

1,50 USD / 1 triệu mã thông báo đầu vào

7,50 USD / 1 triệu mã thông báo đầu ra

Chi phí đầu ra giảm từ $9,00 trên 3,5 Flash

Hạn chế kiến thức

tháng 3 năm 2026

Lý luận

Một mô hình lý luận đa phương thức nguyên bản được thiết kế để mã hóa, sử dụng máy tính và các tác vụ có ngữ cảnh dài.

Sử dụng công cụ & API

Gọi chức năng, đầu ra có cấu trúc và công cụ sử dụng máy tính phía máy khách được tích hợp sẵn mới thông qua API Gemini và Gemini Enterprise.

Phương thức đầu vào

Văn bản, hình ảnh, âm thanh và video trong; nhắn tin ra ngoài. Đa phương thức gốc, không cần xử lý trước.

Đa phương thức gốc - Một mô hình, mọi loại đầu vào

Gemini 3.6 Flash đọc văn bản, hình ảnh, âm thanh và video một cách nguyên bản. Không có đường ống riêng biệt, không có mô hình ghép lại với nhau.

Văn bản & PDF

Phân tích các tài liệu dài và dữ liệu có cấu trúc trong một lần duy nhất, xử lý các bảng và mã phức tạp mà không cần xử lý trước.

Hình ảnh & Biểu đồ

CharXiv Reasoning đạt 85,2% khi không có công cụ trong bài so sánh được công bố của Google, cho thấy khả năng lập luận bằng biểu đồ và trực quan mạnh mẽ.

Phân tích video

Phân tích video cùng với văn bản và hình ảnh, sau đó đặt câu hỏi có căn cứ hoặc yêu cầu tóm tắt ngắn gọn về tài liệu được cung cấp.

Đầu vào âm thanh

Hiểu lời nói, âm thanh xung quanh và cuộc hội thoại đa ngôn ngữ dành cho các tác nhân phiên âm, dịch thuật và điều khiển bằng giọng nói.

Ai sử dụng Gemini 3.6 Flash

Từ các nhà phát triển cá nhân đến các nhóm doanh nghiệp, Gemini 3.6 Flash phù hợp với mọi nơi bạn chạy AI có khả năng ở mức độ lớn.

Mã hóa đại lý

Thẻ mô hình của Google báo cáo 58,7% trên SWE-Bench Pro và 49,0% trên DeepSWE v1.1. Đánh giá nó trên kho lưu trữ, quy trình xem xét và thiết lập tác nhân mã hóa của riêng bạn.

Phân tích tài liệu & dữ liệu

Sử dụng cửa sổ ngữ cảnh mã thông báo 1M để xử lý các tài liệu dài, dữ liệu có cấu trúc và biểu đồ trong một yêu cầu duy nhất khi ngữ cảnh đó quan trọng.

Công cụ thiết kế & sản phẩm

Kết hợp đầu vào trực quan và hướng dẫn bằng văn bản để trích xuất thông tin có cấu trúc, dự thảo các lựa chọn thay thế hoặc chuẩn bị tài liệu để xem xét.

Đại lý sử dụng máy tính

Với việc sử dụng máy tính làm công cụ gốc và OSWorld-Được xác minh ở mức 83,0%, các đại lý có thể thúc đẩy trực tiếp các trình duyệt và ứng dụng — đặt chỗ, điền biểu mẫu và điều hướng giao diện người dùng từ đầu đến cuối.

Quy trình làm việc dài hạn

Đối với công việc gồm nhiều bước, hãy so sánh chất lượng mô hình, độ trễ và mức sử dụng mã thông báo trên các tác vụ đại diện trước khi chọn thiết lập sản xuất.

Đường ống khối lượng lớn

Đối với quy trình trích xuất và tài liệu khối lượng lớn, hãy đo khối lượng yêu cầu thực tế và thời lượng đầu ra để ước tính chi phí API trước khi triển khai.

Hai cách để sử dụng Gemini 3.6 Flash trên Felo

Tìm kiếm Felo AI

Mở Felo AI Search và chọn mẫu Gemini 3.6 Flash. Đặt câu hỏi, tìm kiếm trên web bằng AI và nhận câu trả lời được trích dẫn — được hỗ trợ bởi mô hình công việc mới nhất của Google.

Mở Tìm kiếm Felo AI

So sánh các câu trả lời trong Felo Search

Mở Felo AI Search, chọn Gemini 3.6 Flash nếu có và so sánh câu trả lời của nó với các mẫu được hỗ trợ khác theo lời nhắc của riêng bạn.

Mở Tìm kiếm Felo AI

Câu hỏi thường gặp

Có. Felo AI cung cấp bản dùng thử miễn phí Gemini 3.6 Flash. Tạo tài khoản để bắt đầu — không cần thẻ tín dụng.

Bắt đầu dùng thử miễn phí Gemini 3.6 Flash

Mô hình đặc trưng của Google DeepMind, được xuất bản vào tháng 7 năm 2026. Mở Felo AI và đánh giá khả năng mã hóa, sử dụng máy tính và ngữ cảnh dài của nó trên công việc của riêng bạn.

Mở Gemini 3.6 Flash trên Felo

Dùng thử miễn phí — không cần thẻ tín dụng