Gemini 3.6 Flash被Google定位為新一代「主力模型」,在維持Flash系列速度優勢的同時,強化程式開發、知識型工作及多模態理解能力,可處理文字、圖片、影片、音訊與PDF文件。Google表示,與Gemini 3.5 Flash相比,新模型輸出Token使用量減少17%,代表處理相同工作時可降低運算量與成本。
實際應用包括解析大量文件、分析財務數據與圖表、整理會議逐字稿、撰寫報告,以及執行程式碼移轉等。Gemini 3.6 Flash支援最長100萬Token輸入與6.4萬Token輸出,現已在Gemini App、Google AI Studio、Gemini API、Google Antigravity及企業相關服務提供使用。Google DeepMind官方資料
價格方面,Gemini 3.6 Flash每100萬個輸入Token收費1.5美元(約台幣44元),輸出則為7.5美元(約台幣220元)。輸入價格與前代相同,但輸出價格低於Gemini 3.5 Flash的9美元,顯示Google持續以「更省Token」吸引開發者及企業採用。
同步亮相的Gemini 3.5 Flash-Lite,則是Gemini 3.5系列速度最快、成本最低的模型,鎖定需要低延遲及大量處理的工作,例如AI代理搜尋、文件辨識、收據翻譯、資料摘要與批次產生網頁設計。依Artificial Analysis Index測試,每秒可輸出約350個Token。
Gemini 3.5 Flash-Lite每100萬個輸入Token收費0.3美元,輸出為2.5美元,支援Google搜尋資訊、函式呼叫及電腦操作等工具。Google表示,該模型在不同思考強度下的表現均明顯超越Gemini 3.1 Flash-Lite,目前已在Gemini App、Google AI Studio與Gemini API等平台開放。
第三款Gemini 3.5 Flash Cyber則專為網路安全工作調校,能協助尋找、驗證及修補軟體漏洞。Google測試顯示,該模型在CyberGym資安評測中的漏洞發現能力,優於一般版Gemini 3.5 Flash與Gemini 3.6 Flash,並曾以Chrome及Safari等複雜軟體進行安全測試。
不過,Gemini 3.5 Flash Cyber並非一般消費者或開發者想用就能用,預計先透過限量測試計畫,提供政府機構及受信任合作夥伴使用。Google此舉也反映AI模型競爭正從單純追求「更聰明」,進一步轉向速度、成本及專業分工;說白了,就是不只要會做事,還得做得快、算得省。
點擊閱讀下一則新聞