據 Google 官方部落格公告,Google 於 21 日正式推出新一代 Flash 系列模型,包含 Gemini 3.6 Flash、3.5 Flash-Lite 以及 3.5 Flash Cyber。新模型專为 AI 代理(AI agents)工作流打造,不僅大幅降低输出成本与代币消耗,更內建了強大的电腦操作能力,全面劍指企业級的大規模生产部署。 (前情提要:Google 傳推出全新「frozen」晶片效能狂飆 10 倍!Alphabet 市值暴增 1150 亿鎂) (背景補充:Gemini 3.5 Pro 难产數月:Google 政治派系內鬥让員工備感挫折)
本文目錄
Toggle
随著人工智慧(AI)技術邁入代理化(Agentic)时代,大型语言模型在速度、成本与推理能力上的平衡,已成为企业採用的关鍵考量。台北时间 2026 年 7 月 21 日,Google 團队产品管理资深總監 Tulsee Doshi 发表官方文章,宣布推出基於先前用戶反饋所打造的三款全新 Flash 系列模型,进一步鞏固其在 AI 代理领域的基礎设施優勢。
作为新一代的主力工作模型,Gemini 3.6 Flash 在程式碼編寫、知识工作与多模態任務上的表现獲得了顯著提升。數據顯示,該模型在电腦使用能力評測(OSWorld-Verified)中达到了 83.0% 的高分,且相关的电腦使用工具现已直接內建於 Gemini API 与企业版中。
此外,3.6 Flash 大幅優化了代币(Token)的使用效率。根據 Artificial Analysis Index 顯示,其输出代币使用量比前代減少了 17%,在某些基準測試(如 DeepSWE)中最高甚至可減少 65%。这不僅減少了多步骤工作流的推理与工具呼叫时间,也让定价更具競爭力 —— 输入为每百万代币 1.50 美元,输出为 7.50 美元。
針对需要低延遲与高吞吐量的任務(例如代理搜尋与文件處理),Google 推出了專屬的 Gemini 3.5 Flash-Lite。該模型的输出速度高达每秒 350 个代币,且输入成本極低,僅需每百万代币 0.3 美元(输出为 2.5 美元)。
儘管定位为轻量級,3.5 Flash-Lite 的品质卻远超先前的 Lite 世代。其支援可调整的「思考級別(thinking levels)」,让开发者能在低思考模式与處理複雜子代理工作流的高思考模式之间自由切換。在长上下文与代理編碼評測中,它甚至超越了標準版的 Gemini 3 Flash 模型。
在本次更新中,Google 也針对特定的安全防禦场景,发布了基於 3.5 Flash 微调的「Gemini 3.5 Flash Cyber」模型。該模型能搭配多代理系统 CodeMender 協作产生綜合报告,協助防禦者快速发现並修復網路安全漏洞。然而,考量到这類技術的雙重用途风险,目前僅限政府机構与受信任的合作夥伴透过試点计畫进行有限存取。
Doshi 在文末也预告,除了正与合作夥伴測試即將廣泛推出的 Gemini 3.5 Pro 外,Google 目前已正式啟动了 Gemini 4 的预訓練工作,並形容这是該公司「最雄心勃勃」的计畫。即日起,开发者已可透过 Gemini API 等管道存取全新的 3.6 Flash 与 3.5 Flash-Lite 模型,搶先體验 AI 代理工作流的強大潛力。
10.42万 热度
620.37万 热度
16.91万 热度
126.03万 热度
5944.81万 热度
Google 推出 Gemini 3.6 Flash 等三款新模型!3.5 Flash-Lite 飙出极速,Gemini 4 预训练已启动
據 Google 官方部落格公告,Google 於 21 日正式推出新一代 Flash 系列模型,包含 Gemini 3.6 Flash、3.5 Flash-Lite 以及 3.5 Flash Cyber。新模型專为 AI 代理(AI agents)工作流打造,不僅大幅降低输出成本与代币消耗,更內建了強大的电腦操作能力,全面劍指企业級的大規模生产部署。
(前情提要:Google 傳推出全新「frozen」晶片效能狂飆 10 倍!Alphabet 市值暴增 1150 亿鎂)
(背景補充:Gemini 3.5 Pro 难产數月:Google 政治派系內鬥让員工備感挫折)
本文目錄
Toggle
随著人工智慧(AI)技術邁入代理化(Agentic)时代,大型语言模型在速度、成本与推理能力上的平衡,已成为企业採用的关鍵考量。台北时间 2026 年 7 月 21 日,Google 團队产品管理资深總監 Tulsee Doshi 发表官方文章,宣布推出基於先前用戶反饋所打造的三款全新 Flash 系列模型,进一步鞏固其在 AI 代理领域的基礎设施優勢。
Gemini 3.6 Flash:效能大躍进,输出成本更低
作为新一代的主力工作模型,Gemini 3.6 Flash 在程式碼編寫、知识工作与多模態任務上的表现獲得了顯著提升。數據顯示,該模型在电腦使用能力評測(OSWorld-Verified)中达到了 83.0% 的高分,且相关的电腦使用工具现已直接內建於 Gemini API 与企业版中。
此外,3.6 Flash 大幅優化了代币(Token)的使用效率。根據 Artificial Analysis Index 顯示,其输出代币使用量比前代減少了 17%,在某些基準測試(如 DeepSWE)中最高甚至可減少 65%。这不僅減少了多步骤工作流的推理与工具呼叫时间,也让定价更具競爭力 —— 输入为每百万代币 1.50 美元,输出为 7.50 美元。
3.5 Flash-Lite:極致轻量化,飆出 350 tokens/s 高速
針对需要低延遲与高吞吐量的任務(例如代理搜尋与文件處理),Google 推出了專屬的 Gemini 3.5 Flash-Lite。該模型的输出速度高达每秒 350 个代币,且输入成本極低,僅需每百万代币 0.3 美元(输出为 2.5 美元)。
儘管定位为轻量級,3.5 Flash-Lite 的品质卻远超先前的 Lite 世代。其支援可调整的「思考級別(thinking levels)」,让开发者能在低思考模式与處理複雜子代理工作流的高思考模式之间自由切換。在长上下文与代理編碼評測中,它甚至超越了標準版的 Gemini 3 Flash 模型。
專攻網路安全,Gemini 4 预訓練已啟动
在本次更新中,Google 也針对特定的安全防禦场景,发布了基於 3.5 Flash 微调的「Gemini 3.5 Flash Cyber」模型。該模型能搭配多代理系统 CodeMender 協作产生綜合报告,協助防禦者快速发现並修復網路安全漏洞。然而,考量到这類技術的雙重用途风险,目前僅限政府机構与受信任的合作夥伴透过試点计畫进行有限存取。
Doshi 在文末也预告,除了正与合作夥伴測試即將廣泛推出的 Gemini 3.5 Pro 外,Google 目前已正式啟动了 Gemini 4 的预訓練工作,並形容这是該公司「最雄心勃勃」的计畫。即日起,开发者已可透过 Gemini API 等管道存取全新的 3.6 Flash 与 3.5 Flash-Lite 模型,搶先體验 AI 代理工作流的強大潛力。