Google今日推出Gemini 3.6 Flash,將重點放在以較少文字輸出和操作步驟完成寫程式、文件處理及多步驟AI助理工作。Google稱,新模型在Artificial Analysis Index測試中,完成工作所用的輸出token較3.5 Flash少17%,token是AI處理文字的基本單位,個別軟件工程測試的減幅更達65%。Gemini API每100萬個輸入token收費1.50美元,每100萬個輸出token收費7.50美元,Google稱相關定價低於3.5 Flash。
開發者可經Gemini API在Google AI Studio及Android Studio使用3.6 Flash,Google Antigravity亦有提供。企業可在Gemini Enterprise Agent Platform和Gemini Enterprise應用程式採用,一般用戶則可在Gemini應用程式使用。操控電腦的工具亦已加入Gemini API和Gemini Enterprise,供開發者直接使用。
Google列出的測試結果顯示,3.6 Flash在寫程式和機器學習研究方面改善較明顯。在DeepSWE軟件工程測試中,3.6 Flash的成績由3.5 Flash的37%升至49%,Google稱模型減少不必要的程式修改和反覆執行。在MLE Bench研究測試中,成績由49.7%升至63.9%。操控電腦的OSWorld-Verified測試則由78.4%升至83.0%。
今次3.6 Flash減少AI助理長時間工作所需的token和開支,理複雜工作時需要較少思考步驟,也會減少使用外部工具的次數。對長時間處理大批文件或自動完成多項工作的服務而言,token用量下降加上成本較低,可減少每項工作的整體開支。Google引述試用經驗,稱新模型在整理文件內容、閱讀圖表、解讀數據和撰寫報告方面有所改善。雖然如此,但近日對手OpenAI的GPT-5.6 Sol,以至中國大陸的Kimi K3等,已成功吸引不少外國用家使用,K3更因太多新客戶暫時拒絕新訂閱。Gemini 3.6 Flash登場後,網上有大量用戶質疑,究竟出黎做乜。在Arena.ai評分中,Gemini 3.6 Flash排名為12,比Meta推出的Muse Spark 1.1更低。
Google同日推出3.5 Flash-Lite,主打高速和低成本,按Artificial Analysis測試每秒可輸出350個token,每100萬個輸入token收費0.30美元,輸出token收費2.50美元。3.5 Flash Cyber則配合CodeMender找出和修補保安漏洞,但只會讓政府及指定合作伙伴使用。


