Google 於香港時間 2026 年 7 月 21 日正式宣佈,同步推出三款全新模型 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 及 Gemini 3.5 Flash Cyber,旨在協助開發者在實際應用環境中更高效地構建 AI 代理系統。三款型號均以 Gemini 3.5 Flash 為基礎,分別針對主力代理任務、超高速輕量處理及網絡安全場景而設計。旗艦型號 Gemini 3.6 Flash 在編程、知識工作及多模態效能方面均有所提升,輸出詞元用量較上代減少達 17%,輸出費用同步調降,是今次三款新型號中最受開發者關注的主角。

輸出成本較前代再降一成
多步代理任務效率顯著提升
Gemini 3.6 Flash 在代理式工作流程方面的改進是今次發布的核心重點。根據 Artificial Analysis 指數,3.6 Flash 的輸出詞元用量較 3.5 Flash 減少 17%;在特定編程基準測試 Datacurve 的 DeepSWE 中,削減幅度更高達 65%,意味著在複雜編程代理任務中,模型可以更少的回應篇幅完成相同的工作量。此外,3.6 Flash 在多步驟工作流程中所需的推理步驟及工具調用次數均有所下降,令整體代理任務的執行更為簡潔高效。對於大規模部署的開發者而言,每個輸出詞元的費用較 3.5 Flash 進一步壓低,可直接轉化為運算成本的節省。




知識庫截止日期亦由 2025 年 1 月更新至 2026 年 3 月,令模型在知識工作方面的表現更貼近當前資訊環境,對於需要調用近期事件或技術文件的應用場景尤為重要。編程方面,Google 強調 3.6 Flash 在精準度方面有所提升,能以更少的無關代碼修改完成任務,減少開發者在審閱及修正 AI 生成代碼時所花費的時間。
多模態輸入可理解多種媒體
思考深度可按需靈活調節
Flash 系列自 Gemini 3.5 Flash 起已具備 100 萬詞元語境視窗,支援在單次對話中處理大量資料,並可同時接受文字、圖像、音頻、影片及 PDF 等多種輸入格式,適合需要跨媒體理解的應用場景。思考模式(Thinking Mode)允許開發者自行設定推理預算,在回應品質、處理延遲與運算成本之間靈活取捨,令同一模型可覆蓋從快速輕量回應到深度推理的不同需求,開發者毋須為不同任務複雜度分別部署多個模型。
今次同步推出的 Gemini 3.5 Flash-Lite 在速度方面表現突出。根據 Artificial Analysis 指數,其輸出速度達每秒 350 個詞元,是 Google 目前速度最快、成本最低的 3.5 級別模型,在代理式工作流程的表現亦顯著超越歷代 Flash-Lite 型號,適合需要極低延遲及高頻次調用的應用場景,例如即時客服對話、大批量文件分類及串流式內容生成等。
定價低於同類旗艦型號
批次快取可節省九成輸入費
在定價方面,Gemini 3.6 Flash 的輸入定價為美元 $1.50 / 百萬詞元,輸出定價由 3.5 Flash 的美元 $9.00 壓低至美元 $7.50,降幅約 17%。相較之下,市場同類旗艦方案的輸入定價普遍在美元 $5.00 以上,輸出定價則多在美元 $25.00 至 $30.00 之間;Gemini 3.6 Flash 的輸出費用較市場旗艦方案低逾七成,對於需要大量生成內容的應用場景,成本優勢尤為顯著。
對於需要大量重複參考同一上下文的場景,開發者可透過快取輸入(Context Caching)進一步節省費用,快取輸入定價低至美元 $0.15 / 百萬詞元,較標準輸入費用節省約九成。此外,透過 Batch API 批次處理可在非即時任務中享有額外五折優惠,大幅降低規模化部署的總運算成本,令 Gemini 3.6 Flash 在高頻次代理應用中的整體費用更具競爭力。

三款新型號各有對應定位
輕量到企業級場景全面覆蓋
今次發布的三款型號在應用定位上各有側重。Gemini 3.6 Flash 定位為主力型號,適合需要兼顧回應品質、代理任務效率及合理成本的主流開發場景;Gemini 3.5 Flash-Lite 則以速度及低成本為優先,適合高頻次、對延遲敏感的輕量應用;Gemini 3.5 Flash Cyber 則與 Google 的 CodeMender 程式碼安全代理結合,專為網絡安全應用場景而設,在前沿網絡安全基準測試中提供具競爭力的效能,協助企業以代理方式處理程式碼安全相關任務。成功的網絡安全應用方案,需要模型與代理基礎架構之間精密協調,而 Flash Cyber 正是針對這一需求而構建。
展望後續,Google 目前正與合作夥伴測試 Gemini 3.5 Pro,並計劃在準備就緒後陸續開放;與此同時,Google 已正式展開 Gemini 4 的預訓練工作,下一代旗艦模型的研發進程正式啟動,Flash 系列的完整定位在更大的模型路線圖中亦將更加清晰。
Gemini 3.6 Flash 與 3.5 Flash 的主要分別是甚麼?
Gemini 3.6 Flash 在編程、知識工作及多模態效能方面有所提升,輸出詞元用量較 3.5 Flash 減少達 17%,在特定編程基準測試中更可削減高達 65%,同時將輸出定價由美元 $9.00 壓低至美元 $7.50(每百萬詞元計),知識庫截止日期亦更新至 2026 年 3 月。
Gemini 3.5 Flash-Lite 的速度表現如何?
根據 Artificial Analysis 指數,Gemini 3.5 Flash-Lite 的輸出速度達每秒 350 個詞元,是 Google 目前速度最快且最具成本效益的 3.5 級別模型,在代理式工作流程的表現亦顯著超越歷代 Flash-Lite 型號。
Gemini 3.5 Flash Cyber 是甚麼型號?
Gemini 3.5 Flash Cyber 是一款專為網絡安全應用而設的高效模型,與 Google 的 CodeMender 程式碼安全代理結合使用,在前沿網絡安全基準測試中提供具競爭力的效能,適合企業級網絡安全代理開發場景。
Gemini 3.6 Flash 的 API 定價是多少?
Gemini 3.6 Flash 的標準輸入定價為美元 $1.50 / 百萬詞元,輸出定價為美元 $7.50 / 百萬詞元。透過快取輸入(Context Caching)可將輸入成本降至美元 $0.15 / 百萬詞元,透過 Batch API 批次處理可在輸出費用上享有額外五折優惠。
三款新模型何時可以使用?
Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 及 Gemini 3.5 Flash Cyber 已於 2026 年 7 月 21 日正式發布,開發者可透過 Google AI Studio 及 Gemini API 存取使用。Gemini 3.5 Pro 目前仍處於合作夥伴測試階段,具體開放日期有待進一步公佈。
Gemini 3.6 Flash 支援甚麼輸入格式?
Gemini 3.6 Flash 支援文字、圖像、音頻、影片及 PDF 等多模態輸入,最大語境視窗為 100 萬詞元,適合需要跨媒體理解及長文本處理的應用場景。
Gemini 4 何時推出?
Google 已公佈 Gemini 4 預訓練工作正式展開,但目前尚未公佈具體推出時間表,詳情有待 Google 進一步宣佈。
訂閱全新生活著數優惠平台「港角」電子報,及關注「港角」 Facebook 及 Instagram ,即時收到最新生活資訊及著數優惠!想聯絡我們讓更多觀眾了解你的品牌資訊,即刻電郵我們。






















