近日,Google 發表自家 Gemini 多款新 AI 模型,包含 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及為資安應用打造的 Gemini 3.5 Flash Cyber;提供開發者與企業級 AI 代理(Agent)更多元、彈性的應用選擇。
Gemini 3.6 Flash 作為本次發表的主力通用模型, 在前代 3.5 Flash 的基礎上,進行深度優化;帶來更好 Token 的使用效率,輸出時消耗 Token 平均降低 17%,甚至在特定場景下,擁有高達 65% 的降幅。這意味著模型在處理多步驟任務時,所需的推理與工具呼叫次數將大幅減少。
此外,3.6 Flash 在程式碼撰寫、多模態處理與知識型任務的基準測試中,皆展現出全面性的效能躍升;不僅如此,其定價也比 3.5 Flash 更為低廉,能有效降低企業部署 AI 代理的營運成本。
定位為「輕量化、高吞吐量」方案的 Gemini 3.5 Flash-Lite,是 3.5 系列中生成速度最快的版本,輸出速度高達每秒 350 個 Token,具備極佳的成本優勢。其整體效能超越了先前的 3.1 Flash-Lite,在多項 AI 代理與程式碼評測指標上,甚至優於初代的 Gemini 3 Flash。
開發者可依據需求動態調整模型的思維層級,完美契合海量文件處理、大規模檢索等低延遲、高負載的業務需求。值得一提的是,3.5 Flash-Lite 亦將「電腦操作(Computer Use)」列為內建工具,為各類自動化任務提供強大後盾。
專為資安領域打造的 Gemini 3.5 Flash Cyber,是以 3.5 Flash 為基底進行微調優化。該模型搭配了 CodeMender 程式碼安全代理,專精於識別、驗證並修復程式碼漏洞,在多項資訊安全專案的基準測試中表現極為亮眼;然而,考量到該技術潛在的濫用風險,Google 目前不打算全面開放,僅限政府機構與受信任的合作夥伴進行試點導入。
展望未來:3.5 Pro 封測中,Gemini 4 蓄勢待發
此外,Google 也說明了前瞻模型的最新進展:Gemini 3.5 Pro 目前正與合作夥伴展開內部封閉測試,未來將逐步對外開放;同時,研發團隊已正式啟動規模空前的 Gemini 4 預訓練工作,並表示目前的進展「令人振奮」。
|