沈寂已久的 Google Gemini 在今日(7/22)凌晨突發推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及專門處理資安漏洞的 Gemini 3.5 Flash Cyber 三款全新模型;不只追求更強的回答能力,也特別強調速度、使用成本與執行 AI 代理任務的效率。
至於大家最關注的 Gemini 3.5 Pro 具體推出時間還不得而知,而 Google 則透露 DeepMind 團隊已開始下一代模型 Gemini 4 的預訓練工作,很快就會公開細節資訊。

Gemini 3.6 Flash、3.5 Flash-Lite、 3.5 Flash Cyber 特色亮點整理
Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、 Gemini 3.5 Flash Cyber 三種模型是分別針對一般複雜任務、高流量工作與資安應用設計。
其中 Gemini 3.6 Flash 是兼顧能力與效率的主力模型、Gemini 3.5 Flash-Lite 主打速度快與低成本、Gemini 3.5 Flash Cyber 則是用來尋找並修補程式碼與資安漏洞的特殊版本。
Gemini 3.6 Flash:降低成本、執行複雜任務更有效率
Gemini 3.6 Flash 是這次更新的主力模型,根據開發者使用 Gemini 3.5 Flash 的回饋進一步改良,不只提升程式開發、知識工作與多模態分析能力,也更強調「效率」。
Google 表示在 Artificial Analysis Index 測試中,Gemini 3.6 Flash 的輸出 Token 使用量比 3.5 Flash 減少約 17%,部分程式開發測試甚至可減少最多 65%;代表 AI 可以用更少的文字完成相同任務,也能降低透過 API 使用模型時的成本。

除了效率提升,Gemini 3.6 Flash 在程式開發、機器學習研究及電腦操作等測試中,也都比 Gemini 3.5 Flash 有更好的表現;例如 DeepSWE、MLE Bench 及 OSWorld-Verified 等 Benchmark 成績都有提升。
Google 也說明企業客戶已將 Gemini 3.6 Flash 用於文件解析、圖表分析、資料整理與報告撰寫等多模態工作,適合需要同時處理文字、圖片、表格與文件的複雜任務。

Gemini 3.5 Flash-Lite:速度最快、成本最低,適合快速大量的工作
Gemini 3.5 Flash-Lite 則是目前 Gemini 3.5 系列中速度最快、價格最低的模型,主要針對需要快速處理大量工作的情境,例如 AI 搜尋、文件處理、自動化分類及客服等應用。
Gemini 3.5 Flash-Lite 每秒可輸出約 350 個 Token,API 價格也低於 Gemini 3.6 Flash,因此更適合需要高流量運作的服務;開發者還能依照需求調整模型的「思考(Thinking)」等級,若是簡單任務可優先追求速度與成本,多步驟工作則能提高推理能力,在效能與成本之間取得平衡。
雖然是 Lite 版本,但能力並沒有因此縮水;Google 表示相較前一代 3.1 Flash-Lite,3.5 Flash-Lite 在程式開發、長篇內容理解及代理任務都有明顯進步,部分測試甚至超越 Gemini 3 Flash,可說是兼顧速度、成本與效能的一款模型。

Gemini 3.5 Flash Cyber:專門找漏洞的資安模型
除了兩款通用模型,Google 也同步推出 Gemini 3.5 Flash Cyber;這是建立在 Gemini 3.5 Flash 基礎上,專門針對資安漏洞尋找與修補進行訓練的特殊版本。
Gemini 3.5 Flash Cyber 主要會搭配 Google 的 CodeMender 資安代理系統使用,可協助找出程式碼漏洞、驗證問題是否成立,並提出修補建議。
Google 說明多個 Gemini 3.5 Flash Cyber 模型可以同時分工分析同一套程式碼,再整合成一份完整的漏洞報告,因此能更有效率地檢查大型軟體專案,並在 CyberGym 等測試中展現接近大型模型的競爭力。

由於資安模型具有攻防雙重用途,Google 不會全面開放 Gemini 3.5 Flash Cyber,而是僅提供政府機構及可信任合作夥伴,透過 CodeMender 參與限制存取的測試計畫,希望能協助防守方更快找出並修補漏洞,同時降低技術遭濫用的風險。
Gemini 3.6 Flash、3.5 Flash-Lite 已全面開放使用
目前 Gemini 3.6 Flash 以及 Gemini 3.5 Flash-Lite 已直接內建在 Gemini,可透過網頁版或手機 App 使用;免費用戶也可存取 Gemini 3.6 Flash,不過會受到每日或週期性的用量限制,實際可使用次數也會依照問題複雜度、功能及對話長度而不同。
訂閱用戶可自由選擇 Gemini 3.6 Flash 或 Gemini 3.5 Flash-Lite 使用,但也要注意用量限制;尤其目前 Gemini 改用「運算量」來計算額度,執行的工作越複雜,需要的運算量也就越多。
在「設定」→「用量限制」可查看目前運算量的使用狀況與重置時間;若計劃接下來將透過 Gemini 執行大量的複雜工作,請先確認一下運算量的狀況。

目前我初步體驗感覺還不錯,幻覺確實有改善,而且幾乎都會主動上網找資料確保資訊正確性,但回應速度沒有太大的感覺,大家有興趣可以到 Gemini 試用看看,至於未來會不會「降智」?就看後續發展了。
Gemini 3.5 Pro 推出時間未知、Gemini 4 已開始預訓練
而高階定位的 Gemini 3.5 Pro,Google 表示目前仍在與合作夥伴進行測試,正式推出時間尚未公布,只說會在模型準備完成後盡快開放給更多用戶。
另一方面 Google 也同步預告,DeepMind 團隊已經啟動下一代 Gemini 4 的預訓練工作,並表示這將是目前規模最大、最具野心的一次模型訓練計畫;雖然官方尚未透露 Gemini 4 的功能、規格或推出時程,但也代表 Google 已經開始布局下一代 AI 模型,未來幾個月預計還會有更多相關消息陸續公布。
延伸閱讀》



























