
Gemini 3 Deep Think by Google
Google · 程式設計 · 其他
Gemini 3 Deep Think 是 Google 最先進的 AI 推理模式,專門用來對付會讓標準模型卡關的艱深數學、科學與邏輯問題。它在 Gemini 應用程式裡運作,會同時探索多條思考路線,而不是一頭栽進單一解題路徑。問題出在使用門檻:Deep Think 只保留給 Google AI Ultra 訂閱者,每月 249.99 美元。

關於 Gemini 3 Deep Think by Google
Gemini 3 Deep Think 是什麼
Gemini 3 Deep Think 是架在 Gemini 3 Pro 模型之上的推理模式。Google 打造它是為了那些「快速答案不夠用」的問題,像是競賽級數學、科學分析,以及多步驟的邏輯謎題。根據 Google 的說法,它在嚴謹的基準測試中領先,例如不使用工具時在 Humanity's Last Exam 拿下 41.0%,執行程式碼時在 ARC-AGI-2 拿下 45.1%。
Deep Think 背後的核心概念是平行推理。它不會只產生一條思考鏈,而是同時探索好幾種假設、互相比較,最後選出最站得住腳、也最符合沿途蒐集到證據的那條路。這代表每個答案要耗費的運算量大得多,也因此比一般回覆更慢。面對難題,等待通常值得。面對簡單問題,就有點殺雞用牛刀了。
最大的限制是付費牆。Deep Think 不是免費功能,也不能單獨購買。你需要 Google AI Ultra 方案,而 Ultra 還綁了 Veo、更高的 Gemini 使用額度,以及 30TB 的 Google 儲存空間,所以你付的是整套方案,不只是這一個模式。
開始使用
- 在你的 Google 帳號訂閱 Google AI Ultra。
- 在網頁或手機上開啟 Gemini 應用程式,並用該帳號登入。
- 在模型下拉選單中選擇 Gemini 3 Pro。
- 在輸入列中選取「Deep Think」。
- 輸入你的問題,然後等這個模式跑完多條推理路徑。
產品資訊
快速了解 Gemini 3 Deep Think by Google 的定價、支援平台與效能。
適合對象
這項工具最適合的使用者、任務與情境。
使用者
- 研究人員與研究生:Deep Think 能處理物理、化學與數學工作中那種步驟繁多的推理,前提是你有 Ultra 方案。
- 競賽程式設計師與解謎玩家:這個模式的執行程式碼路徑,讓它適合演算法挑戰與邏輯問題,因為走錯一步就會賠掉整個結果。
- 好奇的進階使用者:任何已經付費訂閱 Ultra,並想看看頂級模型在真正困難的問題上能走多遠的人。
任務
- 鑽研奧林匹亞風格的數學題:Deep Think 是建立在曾於國際數學奧林匹亞達到金牌水準的模型變體之上。
- 逐步檢驗一項科學主張:這個模式會比較彼此競爭的解釋,再選定其中一個,適合不能容許草率猜測的分析。
- 除錯棘手的演算法:啟用執行程式碼後,它能測試推理路徑,並在 ARC-AGI-2 拿下領先同儕的分數。
- 對一個論點進行壓力測試:平行做法會浮出你可能忽略的其他解讀。
情境
- 一組標準聊天機器人老是解錯的深夜題庫:打開 Deep Think 能給模型更多推理空間。
- 檢視研究草稿的邏輯漏洞:這個模式會一一走過各項假設,而不是只回答表面問題。
- 一道你不在意等待的一次性難題:Deep Think 用速度換深度,因此適合準確度勝過快速回覆的時刻。
主要功能
平行假設探索
Deep Think 不會沿著單一推理路線走到盡頭。它會同時探索多種假設、彼此權衡,再挑出最站得住腳的那條路。這就是它在起點可能性眾多的問題上表現更好的核心原因。
領先基準的推理
根據 Google 的說法,Deep Think 在不使用工具時於 Humanity's Last Exam 拿下 41.0%,在執行程式碼時於 ARC-AGI-2 拿下 45.1%。這些是廠商自行公布的數字,但已把這個模式推到艱深推理測試的前段班。Google 另外也公布在 GPQA Diamond 科學基準測試中拿下 93.8%。
內建於 Gemini 應用程式
你不用額外安裝任何東西。Deep Think 就在網頁、Android 與 iOS 的 Gemini 應用程式裡面,可從輸入列中與 Gemini 3 Pro 模型並列選取。這樣它就待在你原本就跟 Gemini 對話的同一個地方。
執行程式碼
在 ARC-AGI-2 上,Deep Think 能把執行程式碼當成解題的一部分,而不是只在腦中抽象推演,這讓它能拿實際輸出驗證想法,而不是單憑直覺。對程式與邏輯任務來說,這代表它可以測試某個做法並加以調整,而不是憑空猜測。差別很大。
更長的思考時間
這個模式在每個答案上花的時間比標準 Gemini 回覆更多。這段多出來的時間正是重點:Google 說它讓模型在定案前能先琢磨、組合各種想法。複雜輸入請預期回應較慢,簡單輸入則大致維持正常速度。
僅限 Ultra 存取
Deep Think 是隨 Google AI Ultra 訂閱一起提供的。沒有單獨購買的選項,也沒有免費層級,所以入門代價就是每月 249.99 美元的完整 Ultra 方案。
優缺點
優點
- 根據 Google 自家數字,在數項艱深推理基準中領先。
- 平行推理適合單一思考鏈會走偏的問題。
- 就住在 Gemini 應用程式裡,所以沒有額外工具要學。
- 執行程式碼讓它在程式與邏輯任務上更實用。
- 與 Google AI Ultra 其餘內容綁在一起,包括 Veo 與 30TB 儲存空間。
缺點
- 每月要 249.99 美元,而且沒有更便宜的方式只取得這個模式。
- 沒有公開 API,所以你無法從自己的應用程式呼叫 Deep Think。
- 比一般 Gemini 回覆慢,因此不適合快速提問。
- 基準測試的勝績是廠商自行公布,而且多半針對數學、科學與邏輯,而非日常任務。
常見問題
它是架在 Gemini 3 Pro 之上的推理模式,會同時探索多種假設,來解決艱深的數學、科學與邏輯問題。你是在 Gemini 應用程式裡開啟它,而不是把它當成獨立產品使用。那麼實際上要怎麼用?選 Gemini 3 Pro,再把 Deep Think 打開。
相關內容
探索與 Gemini 3 Deep Think by Google 相關的工具、技能與文章。
Gemini 3 Deep Think by Google 替代方案
Forefront
Forefront · 程式設計Forefront 是一個用來打造開源 AI 的網頁平台。你可以用自己的資料微調主流的開源語言模型、評估它們的表現,再透過 API 執行,或匯出後自行架設。想要封閉式平台的便利、卻堅持要自己擁有模型與資料的開發者,就是這裡的目標客群。
Startkit
StartKit.AI · 程式設計Startkit 是一套用來打造 AI SaaS 與 AI 包裝產品的樣板。可以把它想成一個 AI 新創樣板,把枯燥的部分都先接好了:驗證、Stripe 與 Lemon Squeezy 付款、用量限制、交易型電子郵件,以及一套能與 OpenAI、Anthropic、Groq 或 Llama 溝通的 AI API 啟動套件。你複製儲存庫、設定價格,然後專心在產品中使用者真正願意付費的部分。它建構於 React 與 Tailwind 之上的 Next.js,所以大部分的樣板程式碼對你來說並不陌生。
Testim
Tricentis · 程式設計Testim 是專為網頁、行動與 Salesforce 應用程式打造的 AI 測試自動化平台,用來建立並執行端到端測試。它靠機器學習在介面變動時維持測試穩定,團隊因此少花時間修補壞掉的定位器。對於一款今天就能開始使用的自動化測試工具來說,這表現不算差。你透過在瀏覽器錄製動作來建立測試,需要更多控制時再補上 JavaScript。對忙碌的 QA 團隊來說,這是個可靠的選擇。
