Google 又出招了!而且一次出了三招。
2026 年 7 月 21 日,Google 正式發布三款全新 Gemini 模型:
- Gemini 3.6 Flash — 旗艦級通用主力模型
- Gemini 3.5 Flash-Lite — 極速高性價比輕量化模型
- Gemini 3.5 Flash Cyber — 專為網路安全打造的 AI 防禦尖兵
但在這波發布中,有一個名字明顯缺席了——Gemini 3.5 Pro 依然不見蹤影。
這到底是 Google 的策略選擇,還是技術瓶頸?讓我們一塊來看看。
三款新模型一次看懂
Gemini 3.6 Flash:新一代「苦力」模型
3.6 Flash 定位為 Google 的通用型主力模型,就像團隊裡最能幹的那個人——什麼都能做還不太花錢。
graph LR
A[Gemini 模型家族 2026] --> B[3.6 Flash<br/>⭐旗艦主力]
A --> C[3.5 Flash-Lite<br/>⚡極速輕量]
A --> D[3.5 Flash Cyber<br/>🛡️網路安全]
A --> E[3.5 Pro<br/>❓無消無息]
B --> F[代理工作流<br/>複雜編碼<br/>企業知識工作]
C --> G[即時分類<br/>文件解析<br/>子代理任務]
D --> H[漏洞掃描<br/>程式碼安全檢測<br/>政府授權使用]主要升級亮點:
| 指標 | 3.5 Flash | 3.6 Flash | 改善幅度 |
|---|---|---|---|
| Token 消耗 | 基準 | 減少 17% | 📉 更省錢 |
| DeepSWE(程式碼修復) | 37% | 49% | 📈 提升 32% |
| MLE Bench(ML 研究) | 49.7% | 提升中 | 📈 顯著進步 |
| 代理工作流步驟 | 較多步驟 | 步驟顯著減少 | ⚡ 更高效 |
對我來說,最驚豔的是 3.6 Flash 在編譯-執行循環中的表現。它不再像過去的模型那樣「改 A 卻搞壞 B」,而是更精確地只修改必要的程式碼。
這對於使用 AI 代理進行大規模軟體開發的團隊來說,是非常關鍵的進步。
Gemini 3.5 Flash-Lite:速度就是一切
如果你需要的不是最聰明、而是最快的模型——Flash-Lite 就是為你準備的。
定位: Gemini 3.5 系列中速度最快、成本效益最高的模型。
適合場景:
- 📄 大規模文件解析與分類
- 🧾 收據提取與數據輸入
- 🌐 即時翻譯
- 🏷️ 大量內容標籤與分類
- 🤖 多代理系統中的子代理角色(執行單一聚焦任務)
這其實揭示了 AI 應用的新趨勢:不需要所有任務都叫最強的模型來做。 在一個複雜的多代理系統中,讓 Flash-Lite 負責耗時但簡單的任務,讓 3.6 Flash 或少數 Pro 級模型負責需要深度推理的核心任務——這才是最有效率的成本配置。
Gemini 3.5 Flash Cyber:AI 安全的新物種
這是這波發布中最有趣的一個。
Flash Cyber 基於 3.5 Flash 微調,但專注於網路安全領域。由於這項技術具備「雙重用途」特性——既能防禦也能攻擊——Google 採取了極其謹慎的部署策略:
- 🚫 僅透過 CodeMender(Google 的程式碼安全代理)內置
- 🔒 限量訪問試點計畫(limited-access pilot program)
- 🏛️ 僅供政府和受信賴的合作夥伴使用
這其實反映了 AI 安全領域的一個棘手問題:越強大的安全 AI,同時也是越可怕的攻擊武器。
Gemini 3.5 Pro 去哪了?
這是這波發布中最讓人好奇的問題。
Google 在官方部落格中對 3.5 Pro 隻字未提。從去年底到現在,市場一直在等待 Gemini 3.5 Pro 的登場,但它就是不出現。
可能的解釋:
| 理論 | 可信度 | 說明 |
|---|---|---|
| 技術延遲 | ⭐⭐⭐⭐ | Pro 級模型對準確度和安全性要求更高,可能需要更多時間 |
| 策略轉向 | ⭐⭐⭐ | Google 可能重新思考 Pro 級模型的定位 |
| 3.6 Flash 已足夠 | ⭐⭐ | Flash 系列表現太好,Pro 的市場需求被擠壓 |
| 內部重組 | ⭐⭐ | Google AI 部門可能正在經歷架構調整 |
無論原因是什麼,3.5 Pro 的持續缺席正在成為 Google AI 策略中的一個不確定因素。
價格戰:AI 模型越來越便宜
這波發布也延續了 AI 模型價格持續下降的趨勢。3.6 Flash 不僅比 3.5 Flash 更強,還用更少的 token 完成任務——綜合成本更低。
來看 AI 模型價格的下降趨勢:
| 時間 | Gemini Flash 百萬 token 價格(估計) | 競爭對手價格 |
|---|---|---|
| 2024 年 | ~$0.35 | Claude 3 Haiku ~$0.25 |
| 2025 年 | ~$0.15 | GPT-4o mini ~$0.15 |
| 2026 年中 | 3.6 Flash 再降 17% | 競爭加劇中 |
這對開發者來說是天大的好消息。AI 的運算成本正在快速下降,更多應用場景變得經濟可行。
對開發者的實際影響
1. 代理工作流變得更實惠
3.6 Flash 的 token 效率提升 17%,意味著如果你的應用每天調用 100 萬次 API,每個月可以省下的雲端費用非常可觀。
2. 多代理架構更有吸引力
有了 Flash-Lite 作為「廉價子代理」,開發者可以設計更複雜的多代理系統,而不用擔心成本失控。
3. 安全領域的新可能
雖然 Flash Cyber 目前限制使用,但它開創了新模式:專用安全 AI 模型。未來可能出現更多針對特定安全場景的專用模型。
Google AI 策略的下一步
從這次發布可以看出 Google 的幾個策略方向:
- Flash 系列成為主力:Google 似乎認為高速、高效、低成本的通用模型才是市場主流
- 專業化模型是藍海:Cyber 模型的推出代表 Google 開始探索垂直領域專用模型
- 生態綁定加深:Flash Cyber 僅限 CodeMender 使用,這是將安全工具綁定自家生態的策略
但是,沒有旗艦級 Pro 模型始終是一個隱憂。當對手 OpenAI 有 GPT-5.6(Sol/Terra/Luna)、Anthropic 有 Claude Opus 4.8 和 Fable 5 時,Google 如果持續缺席 Pro 級戰場,在高階企業應用和專業研究領域可能會失去競爭力。
結語
Google 這次的三連發確實有亮點:
- 3.6 Flash 在程式碼生成和代理工作流上的進步是實質性的
- Flash-Lite 為低成本大規模部署提供了新選擇
- Flash Cyber 開啟了安全專用模型的新賽道
但 Gemini 3.5 Pro 的持續缺席,就像一個樂團主唱不在——樂隊其他成員表現再好,總是少了點什麼。
對於開發者來說,3.6 Flash 值得立即上手試試——尤其是如果你在開發多步驟 AI 代理應用。但對於需要最強推理能力的場景,你可能還是得看向其他家的頂級模型。
原文連結:Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber | Google Blog | Google launches Gemini 3.6 Flash and 3.5 Flash-Lite | 9to5Google
