Gemini 3.6 Flash Family

Gemini 3.6 Flash Family

Google · 程式設計

Gemini 3.6 Flash Family 是 Google 的低延遲、省 token 系列,為規模化生產環境的 AI 代理模型而打造。這套組合橫跨三個層級:Gemini 3.6 Flash 用更少的 token 處理更高品質的程式與知識工作,Gemini 3.5 Flash-Lite 應付超高速、高吞吐量的任務,還有一款受限的 Gemini 3.5 Flash Cyber,透過 CodeMender 代理尋找並修補軟體弱點。為什麼要三個模型?因為單一尺寸幾乎無法套用整條代理流程。如果你在建的代理會連續跑好幾個小時、不斷呼叫工具,這個系列鎖定的是壓低每個完成任務的成本,而不只是每 token 的標價。

Gemini 3.6 Flash Family 的介面預覽

關於 Gemini 3.6 Flash Family

什麼是 Gemini 3.6 Flash Family

Gemini 3.6 Flash Family 是 Google 於 2026 年 7 月 21 日發表的三款模型組合,全都針對生產環境代理所需的效率調校:更低的延遲、更少的輸出 token,以及在負載下更穩定的表現。Gemini 3.6 Flash 是主力,一次就能處理程式、知識工作與多模態任務。Gemini 3.5 Flash-Lite 用原始智慧換取速度與價格,而 Gemini 3.5 Flash Cyber 是資安專門模型,只會在 CodeMender 內為政府與可信賴夥伴運行。三種工作。三個模型。

這個系列之所以存在,是因為代理的帳單漲得很快。單一代理任務就可能涉及數十個推理步驟與工具呼叫,所以每個被浪費的 token 都會被放大。Google 聲稱 3.6 Flash 是省 token 的模型,在 Artificial Analysis 指數上比 3.5 Flash 少用約 17% 的輸出 token,部分程式測試的降幅更達 65%。它還把輸出價格從每百萬 token 9 美元降到 7.50 美元。

顯而易見的限制是,這些都是 Flash 層級的模型。效率高,沒錯。但根據早期基準測試與社群討論,這並非原始推理能力的躍進,而旗艦級的 Gemini 3.5 Pro 在發表時還沒推出。如果你的任務需要最深度的推理,這個系列本身無法滿足。此外,Flash Cyber 仍鎖在有限的試點計畫裡,所以大多數開發者碰不到它。

開始使用

  1. 從 Google AI Studio、Gemini 應用程式或 GitHub Copilot 等夥伴工具取得 API 金鑰。
  2. 用簡短名稱從 Gemini API 呼叫模型,例如 gemini-3.6-flash 或 gemini-3.5-flash-lite。
  3. 為 Flash-Lite 挑一個思考層級,依任務在延遲與輸出品質之間取捨。
  4. 如果你的代理需要在螢幕上點擊,就開啟 computer use 這個內建的用戶端工具。
  5. 衡量每個完成任務的總成本,而不只是每 token 的價格,再據此調整模型層級與思考層級。

產品資訊

快速了解 Gemini 3.6 Flash Family 的定價、支援平台與效能。

免費方案是
付費方案$0.30 - $7.50 per 1M tokens
平台Web, API
開發者Google
類別程式設計
發布日期Jul 2026
最近更新Jul 2026
網站訪問量8.8M
網站全球排名8.7K
API 提供狀態是

適合對象

這項工具最適合的使用者、任務與情境。

使用者

  • 打造生產環境代理的開發者:透過更少的 token 與更短的工具迴圈,取得更低的每任務成本,前提是你願意為每項工作調整模型層級。
  • 緊盯推論支出的新創公司:把搜尋、翻譯、文件解析等高流量工作放到 Flash-Lite 上,每百萬 token 只要 0.30/2.50 美元。
  • 政府或夥伴組織的資安團隊:在 CodeMender 內用 Flash Cyber 做弱點偵測。存取權仍限定在試點計畫。

任務

  • 多步驟程式代理:讓 3.6 Flash 編輯程式時出現更少不想要的變更,執行迴圈也更短。
  • 高吞吐量批次工作:以 Flash-Lite 每秒 350 個輸出 token 的速度推進文件擷取、分類或翻譯。
  • Computer use 流程:用現在已在 Gemini API 出貨的內建用戶端工具,操作瀏覽器或應用程式畫面。

情境

  • 規模化一個連續跑好幾小時、每一步都呼叫工具的代理,此時省下的 token 會層層累積。
  • 處理大量文件集,其中吞吐量與價格比巔峰推理更重要。
  • 在與 CodeMender 合作的受控試點中,審查程式的安全問題。

主要功能

省 token 的輸出

3.6 Flash 的頭號賣點,是用更少的 token 做完同樣的工作。根據 Google 說法,它在 Artificial Analysis 指數上比 3.5 Flash 少用約 17% 的輸出 token,部分 DeepSWE 程式測試的降幅達 65%。步驟更少。工具呼叫更少。因此省下的成本會反映在整份任務帳單上,而不只是每 token 那一行。在一趟長時間的代理執行中,這個差距會迅速累積。

三個層級,一個系列

這個系列按工作分工,而不是按等級高低。3.6 Flash 處理要求高的程式與知識工作,Flash-Lite 執行便宜的高流量任務,Flash Cyber 則涵蓋資安這個利基。挑那個能跨過品質門檻的最便宜層級。這比為所有事只用一個模型更好決定。

內建 computer use

Computer use 能讓模型像人一樣操作螢幕,現在已是 Gemini API 與 Gemini Enterprise 裡的用戶端工具。Google 回報 3.6 Flash 在 OSWorld-Verified 拿到 83%,高於 3.5 Flash 的 78.4%。對需要點擊、輸入與瀏覽的代理來說,這代表更少自行搭建的管線。更少黏著程式碼。更少會壞掉的東西。

Flash-Lite 的彈性思考層級

Flash-Lite 讓你調高或調低推理。簡單任務跑最低設定以換取速度與成本,當某個子任務需要多步驟拆解時再調高。速度是這裡的賣點。Google 實測每秒 350 個輸出 token。Flash-Lite 也支援文字、圖像、音訊與影片輸入,上下文視窗最高達一百萬 token。

多模態輸入與長上下文

3.6 Flash 與 3.5 Flash-Lite 都吃文字、圖像、音訊與影片,上下文最高一百萬 token,輸出最高 64K token。這適合文件解析、圖表分析與收據翻譯,不必把工作切成細碎的小塊。Google 說 Hebbia、Harvey 等客戶在資料擷取、報告草擬等多模態任務上見到進展。那是供應商自述,所以當成訊號,而非證明。

CodeMender 資安代理

Flash Cyber 把一個專門的資安模型與 CodeMender 搭配,後者是 Google 的程式安全代理,用來找出並修補軟體弱點。Google 說這個組合在 V8 引擎中發現 55 個問題,其中 10 個是先前未知的。這是一把狹窄、受控的工具。不是一般開發者今天能接上的東西。Google 刻意把門關著。

優缺點

優點

  • 因為輸出 token 更少、工具迴圈更短,每完成任務的成本更低,而不只是每 token 費率較便宜。
  • Flash-Lite 達到每秒 350 個輸出 token,適合高吞吐量批次工作。
  • Computer use 以內建工具形式出貨,減少客製化的螢幕自動化工作。
  • 一百萬 token 的上下文與 64K 輸出視窗,一次就能涵蓋大文件。
  • 多模態輸入處理文字、圖像、音訊與影片,不必另建管線。
  • Computer use 現在是內建工具,所以你能跳過大部分的螢幕自動化黏著程式碼。
  • 三個層級讓你為每項工作搭配模型成本,而不是處處付貴。

缺點

  • 早期基準測試顯示這個系列勝在效率,而非原始推理的躍進,所以最難的任務可能仍需更大的模型。
  • Flash Cyber 仍鎖在給政府與可信賴夥伴的有限試點中,代表大多數開發者用不到。
  • Flash-Lite 的每 token 價格其實比 3.1 Flash-Lite 還高。省下的成本來自速度與任務效率,而非輸入費率。

常見問題

這是 Google 於 2026 年 7 月 21 日發表的三款模型組合:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及受限的 Gemini 3.5 Flash Cyber。全都為低延遲、更少 token 用量,以及執行生產環境代理時的穩定表現而調校。這就是全部的賣點。

相關內容

探索與 Gemini 3.6 Flash Family 相關的工具、技能與文章。

Gemini 3.6 Flash Family 替代方案

Forefront

Forefront

Forefront · 程式設計

Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。

免費 / $0 - $99/mo查看詳情
Startkit

Startkit

StartKit.AI · 程式設計

Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。

付費 / $99 - $499 one-time查看詳情
Testim

Testim

Tricentis · 程式設計

Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。

免費 / Custom pricing on request查看詳情