Google 官方宣布推出最新的 Gemini 模型系列,包括 3.6 Flash、3.5 Flash-Lite 及 3.5 Flash Cyber,旨在提升 AI 代理的效率、延遲及可靠性,滿足開發者及客戶在生產環境中對高效能的需求。
Gemini 3.6 Flash 提供更高效能及質素
根據 Google 的說法,Gemini 3.6 Flash 是一款強大的模型,能在編碼、知識工作及多模態表現上提供更佳的效果。根據人工分析指數,3.6 Flash 相較於 3.5 Flash 減少了 17% 的輸出 token 使用量,並在某些基準測試中,如 Datacurve 的 DeepSWE,觀察到高達 65% 的改進,所有這些都以更低的輸出 token 成本實現。
“3.6 Flash 不僅在編碼和知識工作上有所提升,還在 token 效率上有顯著改善。”
3.6 Flash 的定價為每百萬個輸入 token 1.50 美元(約 11.70 港元),每百萬個輸出 token 7.50 美元(約 58.50 港元),這使得其在執行代理任務時的整體成本更具競爭力。
3.5 Flash-Lite 提供快速且具成本效益的解決方案
除了 3.6 Flash,Google 亦推出了 3.5 Flash-Lite,這是一款專為低延遲及高吞吐量任務設計的模型。根據人工分析,3.5 Flash-Lite 的輸出速度達到每秒 350 個 token,並且在質素上顯著優於以往的 Flash-Lite 版本。
“3.5 Flash-Lite 是 3.5 系列中最快的模型,為開發者提供了強大的性價比。”
這款模型的定價為每百萬個輸入 token 0.30 美元(約 2.34 港元),每百萬個輸出 token 2.50 美元(約 19.50 港元),適合高吞吐量的生產流量。
3.5 Flash Cyber 針對網絡安全的專業應用
在網絡安全方面,Google 推出了 3.5 Flash Cyber,這是一款專為發現及修復安全漏洞而設計的模型。該模型在 CodeMender 中運作,能夠以更低的 token 成本檢測、驗證及修補代碼安全問題。
“3.5 Flash Cyber 將專注於為政府及可信夥伴提供服務,以應對日益增長的網絡威脅。”
這款模型將在有限的訪問試點計劃中提供,旨在幫助前線防禦者在漏洞被利用之前找到並修復關鍵漏洞。
資料來源:Google 官方公告

