
Gemini 3.6 Flash Family
Google · 程式設計
Gemini 3.6 Flash Family 是 Google 的低延遲、省 token 系列,為規模化生產環境的 AI 代理模型而打造。這套組合橫跨三個層級:Gemini 3.6 Flash 用更少的 token 處理更高品質的程式與知識工作,Gemini 3.5 Flash-Lite 應付超高速、高吞吐量的任務,還有一款受限的 Gemini 3.5 Flash Cyber,透過 CodeMender 代理尋找並修補軟體弱點。為什麼要三個模型?因為單一尺寸幾乎無法套用整條代理流程。如果你在建的代理會連續跑好幾個小時、不斷呼叫工具,這個系列鎖定的是壓低每個完成任務的成本,而不只是每 token 的標價。

關於 Gemini 3.6 Flash Family
什麼是 Gemini 3.6 Flash Family
Gemini 3.6 Flash Family 是 Google 於 2026 年 7 月 21 日發表的三款模型組合,全都針對生產環境代理所需的效率調校:更低的延遲、更少的輸出 token,以及在負載下更穩定的表現。Gemini 3.6 Flash 是主力,一次就能處理程式、知識工作與多模態任務。Gemini 3.5 Flash-Lite 用原始智慧換取速度與價格,而 Gemini 3.5 Flash Cyber 是資安專門模型,只會在 CodeMender 內為政府與可信賴夥伴運行。三種工作。三個模型。
這個系列之所以存在,是因為代理的帳單漲得很快。單一代理任務就可能涉及數十個推理步驟與工具呼叫,所以每個被浪費的 token 都會被放大。Google 聲稱 3.6 Flash 是省 token 的模型,在 Artificial Analysis 指數上比 3.5 Flash 少用約 17% 的輸出 token,部分程式測試的降幅更達 65%。它還把輸出價格從每百萬 token 9 美元降到 7.50 美元。
顯而易見的限制是,這些都是 Flash 層級的模型。效率高,沒錯。但根據早期基準測試與社群討論,這並非原始推理能力的躍進,而旗艦級的 Gemini 3.5 Pro 在發表時還沒推出。如果你的任務需要最深度的推理,這個系列本身無法滿足。此外,Flash Cyber 仍鎖在有限的試點計畫裡,所以大多數開發者碰不到它。
開始使用
- 從 Google AI Studio、Gemini 應用程式或 GitHub Copilot 等夥伴工具取得 API 金鑰。
- 用簡短名稱從 Gemini API 呼叫模型,例如
gemini-3.6-flash或gemini-3.5-flash-lite。 - 為 Flash-Lite 挑一個思考層級,依任務在延遲與輸出品質之間取捨。
- 如果你的代理需要在螢幕上點擊,就開啟 computer use 這個內建的用戶端工具。
- 衡量每個完成任務的總成本,而不只是每 token 的價格,再據此調整模型層級與思考層級。
產品資訊
快速了解 Gemini 3.6 Flash Family 的定價、支援平台與效能。
適合對象
這項工具最適合的使用者、任務與情境。
使用者
- 打造生產環境代理的開發者:透過更少的 token 與更短的工具迴圈,取得更低的每任務成本,前提是你願意為每項工作調整模型層級。
- 緊盯推論支出的新創公司:把搜尋、翻譯、文件解析等高流量工作放到 Flash-Lite 上,每百萬 token 只要 0.30/2.50 美元。
- 政府或夥伴組織的資安團隊:在 CodeMender 內用 Flash Cyber 做弱點偵測。存取權仍限定在試點計畫。
任務
- 多步驟程式代理:讓 3.6 Flash 編輯程式時出現更少不想要的變更,執行迴圈也更短。
- 高吞吐量批次工作:以 Flash-Lite 每秒 350 個輸出 token 的速度推進文件擷取、分類或翻譯。
- Computer use 流程:用現在已在 Gemini API 出貨的內建用戶端工具,操作瀏覽器或應用程式畫面。
情境
- 規模化一個連續跑好幾小時、每一步都呼叫工具的代理,此時省下的 token 會層層累積。
- 處理大量文件集,其中吞吐量與價格比巔峰推理更重要。
- 在與 CodeMender 合作的受控試點中,審查程式的安全問題。
主要功能
省 token 的輸出
3.6 Flash 的頭號賣點,是用更少的 token 做完同樣的工作。根據 Google 說法,它在 Artificial Analysis 指數上比 3.5 Flash 少用約 17% 的輸出 token,部分 DeepSWE 程式測試的降幅達 65%。步驟更少。工具呼叫更少。因此省下的成本會反映在整份任務帳單上,而不只是每 token 那一行。在一趟長時間的代理執行中,這個差距會迅速累積。
三個層級,一個系列
這個系列按工作分工,而不是按等級高低。3.6 Flash 處理要求高的程式與知識工作,Flash-Lite 執行便宜的高流量任務,Flash Cyber 則涵蓋資安這個利基。挑那個能跨過品質門檻的最便宜層級。這比為所有事只用一個模型更好決定。
內建 computer use
Computer use 能讓模型像人一樣操作螢幕,現在已是 Gemini API 與 Gemini Enterprise 裡的用戶端工具。Google 回報 3.6 Flash 在 OSWorld-Verified 拿到 83%,高於 3.5 Flash 的 78.4%。對需要點擊、輸入與瀏覽的代理來說,這代表更少自行搭建的管線。更少黏著程式碼。更少會壞掉的東西。
Flash-Lite 的彈性思考層級
Flash-Lite 讓你調高或調低推理。簡單任務跑最低設定以換取速度與成本,當某個子任務需要多步驟拆解時再調高。速度是這裡的賣點。Google 實測每秒 350 個輸出 token。Flash-Lite 也支援文字、圖像、音訊與影片輸入,上下文視窗最高達一百萬 token。
多模態輸入與長上下文
3.6 Flash 與 3.5 Flash-Lite 都吃文字、圖像、音訊與影片,上下文最高一百萬 token,輸出最高 64K token。這適合文件解析、圖表分析與收據翻譯,不必把工作切成細碎的小塊。Google 說 Hebbia、Harvey 等客戶在資料擷取、報告草擬等多模態任務上見到進展。那是供應商自述,所以當成訊號,而非證明。
CodeMender 資安代理
Flash Cyber 把一個專門的資安模型與 CodeMender 搭配,後者是 Google 的程式安全代理,用來找出並修補軟體弱點。Google 說這個組合在 V8 引擎中發現 55 個問題,其中 10 個是先前未知的。這是一把狹窄、受控的工具。不是一般開發者今天能接上的東西。Google 刻意把門關著。
優缺點
優點
- 因為輸出 token 更少、工具迴圈更短,每完成任務的成本更低,而不只是每 token 費率較便宜。
- Flash-Lite 達到每秒 350 個輸出 token,適合高吞吐量批次工作。
- Computer use 以內建工具形式出貨,減少客製化的螢幕自動化工作。
- 一百萬 token 的上下文與 64K 輸出視窗,一次就能涵蓋大文件。
- 多模態輸入處理文字、圖像、音訊與影片,不必另建管線。
- Computer use 現在是內建工具,所以你能跳過大部分的螢幕自動化黏著程式碼。
- 三個層級讓你為每項工作搭配模型成本,而不是處處付貴。
缺點
- 早期基準測試顯示這個系列勝在效率,而非原始推理的躍進,所以最難的任務可能仍需更大的模型。
- Flash Cyber 仍鎖在給政府與可信賴夥伴的有限試點中,代表大多數開發者用不到。
- Flash-Lite 的每 token 價格其實比 3.1 Flash-Lite 還高。省下的成本來自速度與任務效率,而非輸入費率。
常見問題
這是 Google 於 2026 年 7 月 21 日發表的三款模型組合:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及受限的 Gemini 3.5 Flash Cyber。全都為低延遲、更少 token 用量,以及執行生產環境代理時的穩定表現而調校。這就是全部的賣點。
相關內容
探索與 Gemini 3.6 Flash Family 相關的工具、技能與文章。
Gemini 3.6 Flash Family 替代方案
Forefront
Forefront · 程式設計Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。
Startkit
StartKit.AI · 程式設計Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。
Testim
Tricentis · 程式設計Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。
