Gemini 3.6 Flash — Dùng thử miễn phíMã thông báo đầu ra ít hơn 17%
Gemini 3.6 Flash là mô hình tác tử chủ lực của Google DeepMind, ra mắt ngày 21 tháng 7 năm 2026. Theo Artificial Analysis Index, mô hình này dùng ít hơn 17% token đầu ra so với Gemini 3.5 Flash, đồng thời có khả năng sử dụng máy tính gốc, cửa sổ ngữ cảnh 1M token và giá đầu ra thấp hơn cho lập trình, nghiên cứu và công việc nhiều bước. Bắt đầu bản dùng thử miễn phí trên Felo AI.
Dùng thử miễn phí trên Felo AI — không cần thẻ tín dụng
Kinh tế đại lý
Đánh giá chi phí và khả năng
83.0%
trên OSWorld-Đã được xác minh
$7.50
trên mỗi 1 triệu mã thông báo đầu ra
83.0%
OSWorld-Đã được xác minh
Điểm chuẩn sử dụng máy tính Agentic
$7.50
Giá đầu ra
7,50 USD / 1 triệu mã thông báo, giảm từ 9,00 USD
58.7%
SWE-Băng ghế dự bị Pro
Mã hóa đại lý, tăng từ 55,1%
1M
Cửa sổ ngữ cảnh
Nhập mã thông báo cho mỗi yêu cầu
Tiêu đề không phải là một điểm chuẩn. Đó là Dự luật.
Chi phí đại lý được định hình bởi cả việc định giá mã thông báo và mức độ tin cậy của một mô hình khi hoàn thành công việc gồm nhiều bước. Gemini 3.6 Flash giảm giá đầu ra từ 9,00 USD xuống 7,50 USD trên một triệu mã thông báo và theo Chỉ số phân tích nhân tạo, sử dụng mã thông báo đầu ra ít hơn 17% so với Gemini 3.5 Flash.
Mã thông báo đầu ra ít hơn 17%
Google DeepMind báo cáo rằng Gemini 3.6 Flash sử dụng mã thông báo đầu ra ít hơn 17% so với Gemini 3.5 Flash, theo Chỉ số phân tích nhân tạo. Mức tiết kiệm thực tế phụ thuộc vào nhiệm vụ và thời gian thực hiện.
Kết quả đại lý được công bố mạnh mẽ hơn
Google DeepMind báo cáo mức tăng so với Gemini 3.5 Flash trên DeepSWE, OSWorld-Được xác minh và truy xuất ngữ cảnh dài. Đây là những tín hiệu hữu ích khi đánh giá các tác vụ tổng đài viên dài hạn.
Cùng một bối cảnh, cùng một phương thức
Bạn giữ lại cửa sổ nhập mã thông báo 1 triệu và đầu vào văn bản, hình ảnh, âm thanh và video gốc, do đó, các tác vụ đa phương tiện lớn và hỗn hợp có thể nằm trong một quy trình làm việc theo mô hình duy nhất.
Điều gì đã thay đổi trong Gemini 3.6 Flash
Được xây dựng nhằm mang lại lợi ích kinh tế cho việc vận hành các tác nhân trên quy mô lớn, với các kết quả chính thức giúp việc đánh giá cùng nhau chi phí và khả năng trở nên dễ dàng hơn.
Giá cả và khả năng cùng nhau
Gemini 3.6 Flash giảm giá đầu ra xuống còn 7,50 USD trên một triệu mã thông báo từ 9,00 USD trên Gemini 3.5 Flash, trong khi Google DeepMind báo cáo mức sử dụng mã thông báo đầu ra thấp hơn 17% theo Chỉ số phân tích nhân tạo. Mức tăng điểm chuẩn được công bố của nó cho phép các nhóm cùng nhau đánh giá chi phí và khả năng thay vì coi giá là tín hiệu hiệu quả duy nhất.
Sử dụng máy tính như một công cụ gốc
Việc kiểm soát trình duyệt hoặc máy tính để bàn hiện là một công cụ phía máy khách được tích hợp sẵn thông qua API Gemini và Gemini Enterprise — không có mô hình hoặc khung cố định riêng biệt. Trên OSWorld-Được xác minh, việc sử dụng máy tính tác nhân đạt 83,0%, tăng từ 78,4% trên 3,5 Flash.
Mã hóa tác nhân mạnh hơn
SWE-Bench Pro đạt 58,7% và DeepSWE v1.1 đạt 49,0%, so với 55,1% và 37,0% của Gemini 3.5 Flash trong so sánh được công bố của Google. Sử dụng thẻ mô hình để đánh giá mức độ phù hợp với quy trình viết mã của riêng bạn.
Bối cảnh đa phương thức mã thông báo 1 triệu
Đưa các cơ sở mã lớn, tài liệu dài và phương tiện hỗn hợp vào một yêu cầu. Cửa sổ đầu vào 1M với mã thông báo đầu ra 64K đạt 91,8% trên GDM-MRCR v2 ở mức 128K trong so sánh được công bố của Google.
Gemini 3.6 Flash vs Biên giới
Kết quả thẻ mô hình Google DeepMind chính thức. Gemini 3.6 Flash cải thiện trên Gemini 3.5 Flash ở mọi hàng bên dưới; sự so sánh cũng cho thấy các mô hình biên giới lớn hơn vẫn ở phía trước.
Điểm chuẩn
Gemini 3.6 Flash
Gemini 3.5 Flash
Claude Sonnet 5
SWE-Bench Pro
58.7%
55.1%
63.2%
DeepSWE v1.1
49.0%
37.0%
54.0%
OSWorld-Verified
83.0%
78.4%
81.2%
CharXiv Reasoning (no tools)
85.2%
84.2%
77.0%
GDM-MRCR v2 (128K)
91.8%
77.3%
71.6%
Nguồn: Thẻ mô hình Gemini 3.6 Flash — Google DeepMind, tháng 7 năm 2026.
Đọc thẻ mô hình Google DeepMind chính thứcThông số kỹ thuật
Mọi thứ bạn cần trước khi tích hợp Gemini 3.6 Flash vào ứng dụng của bạn.
Cửa sổ ngữ cảnh
Đầu vào 1.048.576 mã thông báo
Sản lượng 65.536 token
Giá API
1,50 USD / 1 triệu mã thông báo đầu vào
7,50 USD / 1 triệu mã thông báo đầu ra
Chi phí đầu ra giảm từ $9,00 trên 3,5 Flash
Hạn chế kiến thức
tháng 3 năm 2026
Lý luận
Một mô hình lý luận đa phương thức nguyên bản được thiết kế để mã hóa, sử dụng máy tính và các tác vụ có ngữ cảnh dài.
Sử dụng công cụ & API
Gọi chức năng, đầu ra có cấu trúc và công cụ sử dụng máy tính phía máy khách được tích hợp sẵn mới thông qua API Gemini và Gemini Enterprise.
Phương thức đầu vào
Văn bản, hình ảnh, âm thanh và video trong; nhắn tin ra ngoài. Đa phương thức gốc, không cần xử lý trước.
Đa phương thức gốc - Một mô hình, mọi loại đầu vào
Gemini 3.6 Flash đọc văn bản, hình ảnh, âm thanh và video một cách nguyên bản. Không có đường ống riêng biệt, không có mô hình ghép lại với nhau.
Văn bản & PDF
Phân tích các tài liệu dài và dữ liệu có cấu trúc trong một lần duy nhất, xử lý các bảng và mã phức tạp mà không cần xử lý trước.
Hình ảnh & Biểu đồ
CharXiv Reasoning đạt 85,2% khi không có công cụ trong bài so sánh được công bố của Google, cho thấy khả năng lập luận bằng biểu đồ và trực quan mạnh mẽ.
Phân tích video
Phân tích video cùng với văn bản và hình ảnh, sau đó đặt câu hỏi có căn cứ hoặc yêu cầu tóm tắt ngắn gọn về tài liệu được cung cấp.
Đầu vào âm thanh
Hiểu lời nói, âm thanh xung quanh và cuộc hội thoại đa ngôn ngữ dành cho các tác nhân phiên âm, dịch thuật và điều khiển bằng giọng nói.
Ai sử dụng Gemini 3.6 Flash
Từ các nhà phát triển cá nhân đến các nhóm doanh nghiệp, Gemini 3.6 Flash phù hợp với mọi nơi bạn chạy AI có khả năng ở mức độ lớn.
Mã hóa đại lý
Thẻ mô hình của Google báo cáo 58,7% trên SWE-Bench Pro và 49,0% trên DeepSWE v1.1. Đánh giá nó trên kho lưu trữ, quy trình xem xét và thiết lập tác nhân mã hóa của riêng bạn.
Phân tích tài liệu & dữ liệu
Sử dụng cửa sổ ngữ cảnh mã thông báo 1M để xử lý các tài liệu dài, dữ liệu có cấu trúc và biểu đồ trong một yêu cầu duy nhất khi ngữ cảnh đó quan trọng.
Công cụ thiết kế & sản phẩm
Kết hợp đầu vào trực quan và hướng dẫn bằng văn bản để trích xuất thông tin có cấu trúc, dự thảo các lựa chọn thay thế hoặc chuẩn bị tài liệu để xem xét.
Đại lý sử dụng máy tính
Với việc sử dụng máy tính làm công cụ gốc và OSWorld-Được xác minh ở mức 83,0%, các đại lý có thể thúc đẩy trực tiếp các trình duyệt và ứng dụng — đặt chỗ, điền biểu mẫu và điều hướng giao diện người dùng từ đầu đến cuối.
Quy trình làm việc dài hạn
Đối với công việc gồm nhiều bước, hãy so sánh chất lượng mô hình, độ trễ và mức sử dụng mã thông báo trên các tác vụ đại diện trước khi chọn thiết lập sản xuất.
Đường ống khối lượng lớn
Đối với quy trình trích xuất và tài liệu khối lượng lớn, hãy đo khối lượng yêu cầu thực tế và thời lượng đầu ra để ước tính chi phí API trước khi triển khai.
Hai cách để sử dụng Gemini 3.6 Flash trên Felo
Tìm kiếm Felo AI
Mở Felo AI Search và chọn mẫu Gemini 3.6 Flash. Đặt câu hỏi, tìm kiếm trên web bằng AI và nhận câu trả lời được trích dẫn — được hỗ trợ bởi mô hình công việc mới nhất của Google.
Mở Tìm kiếm Felo AISo sánh các câu trả lời trong Felo Search
Mở Felo AI Search, chọn Gemini 3.6 Flash nếu có và so sánh câu trả lời của nó với các mẫu được hỗ trợ khác theo lời nhắc của riêng bạn.
Mở Tìm kiếm Felo AICâu hỏi thường gặp
Có. Felo AI cung cấp bản dùng thử miễn phí Gemini 3.6 Flash. Tạo tài khoản để bắt đầu — không cần thẻ tín dụng.
Bắt đầu dùng thử miễn phí Gemini 3.6 Flash
Mô hình đặc trưng của Google DeepMind, được xuất bản vào tháng 7 năm 2026. Mở Felo AI và đánh giá khả năng mã hóa, sử dụng máy tính và ngữ cảnh dài của nó trên công việc của riêng bạn.
Mở Gemini 3.6 Flash trên FeloDùng thử miễn phí — không cần thẻ tín dụng