Google於2026年7月21日公布三款新Gemini模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及專門處理網絡安全工作的Gemini 3.5 Flash Cyber。
今次更新的重點是進一步把AI工作拆成不同層次:3.6 Flash負責需要理解、判斷及整合的主要任務;3.5 Flash-Lite負責大量、快速及成本敏感的執行工作;Flash Cyber則針對漏洞發現、驗證與修補。
文章重點摘要
Gemini 3.6 Flash: 適合研究、文件分析、多模態資料、報告及多步驟工作。
Gemini 3.5 Flash-Lite: 適合翻譯、分類、內容延伸、客服回覆及大量文件處理。
Gemini 3.5 Flash Cyber: 專門處理網絡安全漏洞,目前只限政府及可信合作夥伴參與試點。
香港職場價值: 可用3.6 Flash制定方案,再由Flash-Lite大量執行,避免所有任務均使用成本較高的模型。
3.5 Pro尚未正式推出: Google表示正在與合作夥伴測試,未公布確切全面開放日期。
Gemini三款新模型有何分別?
面對愈來愈多正式投入企業流程的 AI 代理,模型不但要有足夠能力,亦要兼顧速度、成本及穩定性。
Google 順勢推出三款定位不同的模型:Gemini 3.6 Flash 是處理程式編寫、知識工作及多模態任務的主力模型,並進一步降低輸出 token 用量及成本;Gemini 3.5 Flash-Lite 主打高速與低成本,適合大量、重複的自動化工作;未向大眾開放的Gemini 3.5 Flash Cyber 則配合專門處理漏洞搜尋、驗證及修復。
至於 Gemini 3.5 Pro,目前仍在合作夥伴測試階段。
模型 | 定位及主要能力 | 可使用的用戶 | 使用管道 | API價格(每100萬tokens) |
|---|---|---|---|---|
Gemini 3.6 Flash | Google目前的「主力生產任務模型」,主打高效率、多模態理解、知識工作與程式編寫能力,適合處理文件、圖片、圖表、程式及多步驟任務。 | 免費及Google AI Plus、Pro、Ultra用戶 | 一般用戶: 可透過網頁版或手機版Gemini App使用,實際免費額度及模型選項以帳戶介面為準。 | 輸入約HK$11.70/輸出約HK$58.50 |
Gemini 3.5 Flash-Lite | Google目前速度最快、成本最低的3.5系列模型,主打高吞吐量與極低延遲,適合大規模、高頻率及規則清晰的自動化任務。 | 免費及Google AI Plus、Pro、Ultra用戶均可透過Gemini App使用。 | 一般用戶: 可透過Gemini App使用,並正逐步整合至Google Search。日常搜尋用戶可能會間接使用其能力。 | 輸入約HK$2.34/輸出約HK$19.50 |
Gemini 3.5 Flash Cyber | 專為網絡安全而設的特製模型,用於尋找、驗證及修補程式碼漏洞,並可在CodeMender中由多個agents協作產生安全報告。 | 政府機構及獲Google認可的可信資安合作夥伴。 | 一般用戶及常規開發者: 目前不能使用。 |
香港用戶如何使用Gemini 3.6 Flash及Flash-Lite?
免費及訂閱Google AI Plus、Pro、Ultra的用戶均可透過Gemini App使用。免費帳戶設有標準用量限制;付費方案主要提供更高使用額度、更大的context window,以及部分進階功能。
目前,3.6 Flash及3.5 Flash-Lite已經開始透過以下入口提供:
一般用戶: Gemini App;
開發及測試: Google AI Studio及Gemini API;
企業團隊: Gemini Enterprise Agent Platform;
其他支援入口: Android Studio等Google產品。
Gemini 3.6 Flash更新了甚麼?
Gemini 3.6 Flash被Google定位為新一代「workhorse model」,即日常複雜工作中的主要處理模型。它不是只追求回答速度,而是嘗試以較少tokens及工具調用完成多步驟任務。


Gemini 3.6 Flash的主要改進包括:
在Artificial Analysis Index中,輸出tokens用量較3.5 Flash減少17%。
在DeepSWE部分測試中,tokens用量最多減少65%。
減少不必要的程式修改、推理步驟及工具調用。
改善文件解析、圖表分析、資料分析及報告撰寫。
提升computer use能力,可在支援的產品及API工作流程中操作介面。
API輸出價格約為每100萬tokens HK$58.50,低於上一代3.5 Flash的官方定價。
官方案例一:分析10份QQQ財務文件
使用同一套財務文件分析工具,同時比較Gemini 3.5 Flash與Gemini 3.6 Flash。兩款模型需要分析10份與QQQ相關的SEC申報文件、業績會議逐字稿及公開聲明,再生成投資研究報告、重點摘要、圖表、深度洞察及引用來源。
結果:
模型 | 完成時間 | Token用量 |
|---|---|---|
Gemini 3.5 Flash | 153秒 | 1,854,443 |
Gemini 3.6 Flash | 64秒 | 317,209 |
Gemini 3.6 Flash的處理時間縮短約58%,速度約為3.5 Flash的2.4倍;Token用量則減少約83%,只用了約六分之一。兩款模型均能生成完整報告,但3.6 Flash以更少推理及資料處理步驟完成相同類型的工作。對香港財務、投資者關係及企業分析團隊而言,這類工作流程可用於整理上市公司公告、季度業績、電話會議逐字稿及管理層聲明,減少逐份文件搜尋及抄錄資料的時間。
官方案例二:同時派出多個 AI agent 助手,加快舊系統升級
在 Google Antigravity的程式遷移測試中,Gemini 3.5 Flash 與 Gemini 3.6 Flash 需要分析一套舊有 Express 應用程式,並為遷移至現代化 Next.js 架構制定執行方案。
Gemini 3.6 Flash 將工作拆分予四個子代理,分別審查資料模型、API 合約、商業邏輯及舊有介面架構,再整合各項結果,產生資料結構對照、API 清單、驗證計劃及遷移建議。相比之下,Gemini 3.5 Flash 雖然同樣啟動子代理,但需要設定計時器等待及重複檢查進度,令整體流程較慢。
而Gemini 3.6 Flash:
毋須額外設定計時器,便能協調及整合子代理結果
完成時間約比 Gemini 3.5 Flash 快 34%
產出的遷移文件更完整,清楚列出系統結構、測試項目及下一階段工作
除了提出修改方向,亦建立可供工程團隊繼續執行及核實的技術成果|
對香港企業而言,這類能力可應用於舊網站翻新、內部系統升級、API 遷移及大型程式庫現代化。AI 可以同時分派不同代理檢查前端、後端、資料結構及測試要求,減少工程人員逐一梳理舊系統所需的時間。
Gemini 3.5 Flash-Lite更新了甚麼?
Gemini 3.5 Flash-Lite是今次更新中的高速及成本敏感選項。Google表示,它在Artificial Analysis測試中可達約每秒350個輸出tokens,主要面向高流量、低延遲及大量重複任務。

適合的工作包括:
大量文件分類及摘要;
收據、表格及產品資料處理;
客服問題分類;
批量翻譯;
大量內容版本延伸;
已有方案下的格式轉換及渠道改寫。
其API價格約為每100萬輸入tokens HK$2.34、每100萬輸出tokens HK$19.50。若工作主要是大量分類、翻譯、摘要或格式轉換,成本通常比使用3.6 Flash低。
官方案例三:自動梳理並分類數千件電商商品
Gemini 3.5 Flash-Lite 利用多模態分析,同時理解數千份商品圖片與文字資料,從中辨認產品類型及特徵,再把商品放進相應的部門、主分類及子分類。最終整合成可搜尋及篩選的分類目錄,使用者可以按部門及產品類型快速尋找商品。
案例反映:
Gemini 3.5 Flash-Lite 的定位並非處理最複雜的策略判斷,而是以較快速度及較低成本完成大量、重複且格式相近的工作。
對香港零售及電商企業而言,可以用於:
整理供應商提供的混亂商品資料
從產品圖片及名稱提取基本特徵
自動建立商品分類與標籤
統一中英文產品目錄
改善網站搜尋、篩選及庫存管理
官方案例四:搭配3.6 flash 產出多款網站設計
案例中為紐約植物店「Stoop & Sprout」探索25種不同的網站設計方向。
Gemini 3.6 Flash 擔任主要統籌角色,先理解品牌背景及設計要求,再把工作分派給25個使用 Gemini 3.5 Flash-Lite 的子代理。每個子代理分別負責一種視覺風格,包括極簡、復古、雜誌、工業、孟菲斯設計及藝術風格等,並各自產生可直接開啟查看的網站概念。最終建立出互動式設計圖庫,能直接比較不同版面、字體、配色、圖片及視覺方向,並可逐個展開查看。
案例反映:
Gemini 3.5 Flash-Lite 及 3.6 Flash 可以按工作難度分工:
Gemini 3.6 Flash:理解要求、規劃方向、分派任務及整合成果
Gemini 3.5 Flash-Lite:快速處理大量、格式相近的製作工作
對香港市場營銷、品牌及設計團隊而言,這種工作方式可用於批量探索網站首頁、廣告視覺、活動主題、電郵版面及社交媒體創意。團隊毋須逐個方向重新下指令,可以先大量產生概念,再由人手挑選最符合品牌定位的版本深化。
Gemini 3.5 Flash Cyber是甚麼?
Gemini 3.5 Flash Cyber建基於3.5 Flash,定位是協助資安團隊快速掃描大型程式碼庫,尋找、驗證及修復潛在漏洞。
Flash Cyber 採用「快速、多次掃描」的方式探索更多程式碼路徑。配合 Google 的 CodeMender,系統可以多次調用模型,再由子代理整合結果及產生漏洞報告。因此,它較適合頻繁程式碼掃描、新版本推出前的安全檢查,以及大規模程式提交的自動化審查流程。
Google 的測試顯示,在分析複雜的 V8 JavaScript 引擎時,Gemini 3.5 Flash Cyber 發現了55個獲確認的獨特問題,高於主線Gemini 3.5 Flash的47個及Claude Opus 4.6的36個;當中有10個問題未被另外兩款測試模型發現。

目前Gemini 3.5 Flash Cyber並未向一般用戶或常規開發者開放。它將透過CodeMender,以有限試點形式提供予:
政府機構
Google認可的可信合作夥伴
獲邀參與試點的第一線資安防禦團隊
一般企業目前可透過Gemini企業代理平台,使用CodeMender的部分基礎功能及一般Gemini模型處理軟件安全工作,但不等於已取得Gemini 3.5 Flash Cyber的完整使用權限。
兩款香港可用的模型的成本相差多少?
以下以每100萬tokens的官方API價格及約US$1兌HK$7.8換算:
成本項目 | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite | Flash-Lite節省約 |
輸入成本 | HK$11.70 | HK$2.34 | 80% |
輸出成本 | HK$58.50 | HK$19.50 | 67% |
以輸出成本計算,3.6 Flash約為Flash-Lite的3倍;以輸入成本計算,約為5倍。
總結:下一階段不是尋找一個全能模型,而是建立模型分工
Gemini今次同時推出3.6 Flash、3.5 Flash-Lite及Flash Cyber,反映AI產品的競爭方向正在改變。
以往用戶習慣問:「哪一個模型最強?」
更實際的問題應該是:「哪一個工作步驟需要較強判斷,哪一個步驟只需要快速及穩定執行?」
對香港企業而言,3.6 Flash的價值在於處理資料混亂、來源分散及需要判斷的主要工作;Flash-Lite的價值則在於把已確認的結果快速延伸至不同客群、渠道與日常流程。Flash Cyber展示的,是專門模型配合受控Agent架構的企業方向,但一般用戶目前不應把它當作可直接使用的資安工具。
別等AI工作方式再次改變,才開始補課
模型更新愈來愈快,今天仍在比較單一模型,下一次更新可能已經進入多模型分工、Agent協作及跨工具執行。
真正容易被拉開差距的,不是不知道某個新模型名稱,而是團隊仍未建立一套可以重複使用的AI工作流程。當競爭對手已經用AI完成研究、內容延伸、客服整理及報告製作,你才開始逐項摸索Prompt,付出的往往不只是學習時間,還包括錯過的效率與市場機會。
AI-in-One全年AI學習通行證整合不同AI工具、模型更新及實際工作流程教學,協助你把新功能真正應用到內容、營銷、研究及企業工作之中。
DotAI Spot
AI 實戰成長社群
DotAI 全新學習體驗,陪伴您跨越 AI 學習迷惘



其他文章













