Gemini 3.5 新特性:Flash、Flash-Lite、Computer Use 與 Pro 狀態

依據 Google 官方資料整理 Gemini 3.5 家族的新特性、可用模型、Computer Use、Flash-Lite、Flash Cyber、Gemini Spark 與 3.5 Pro 當前狀態。

Gemini 3.5 已經不是傳聞中的模型。Google 在 2026 年 5 月 19 日正式發布 Gemini 3.5 Flash,之後加入原生 Computer Use,並在 7 月推出 Gemini 3.5 Flash-Lite 和面向防禦場景的 Gemini 3.5 Flash Cyber。

不過,「Gemini 3.5 已發布」不等於「Gemini 3.5 Pro 已發布」。截至 Google 2026 年 7 月 21 日的官方公告,3.5 Pro 仍在與合作夥伴測試,尚未廣泛開放。早期流傳的 Cappuccino 代號、匿名跑分和所謂上線時間都不應繼續當作產品事實。

當前狀態:哪些已經可用

產品 當前狀態 主要定位
Gemini 3.5 Flash 已正式發布 Agent、程式設計、多模態理解和長任務
Gemini 3.5 Flash Computer Use 已提供 瀏覽器、行動端和桌面環境的介面操作
Gemini 3.5 Flash-Lite 已正式發布 低延遲、高吞吐、文件處理和 subagent
Gemini 3.5 Flash Cyber 已公布,結合 CodeMender 使用 漏洞發現、驗證與修復等防禦任務
Gemini 3.5 Pro 合作夥伴測試中 尚未廣泛發布

Gemini 3.6 Flash 已在 2026 年 7 月成為更新的 Flash 主力型號。新專案不應只因為「3.5」數字較大就預設選擇 3.5 Flash,需要同時比較 3.6 Flash 的品質、成本和工具支援。

新特性一:更適合 Agent 和長時間任務

Gemini 3.5 Flash 的主線不是單純提高聊天回答分數,而是讓模型更穩定地完成多步驟工作。Google 將其定位為面向 agentic workflows 的 Flash 模型,重點包括程式設計、工具呼叫、複雜任務拆解和跨較長時間執行。

適合的工作包括:讀取程式碼庫後修改和測試;呼叫搜尋、程式碼執行或自訂函式;分析多份文件並輸出結構化結果;讓主 Agent 把提取和驗證工作分派給 subagent。

「更適合 Agent」不表示模型可以脫離權限控制。涉及寫檔案、傳送訊息、付款、刪除資料或操作正式環境時,仍應設定工具白名單、執行確認和可恢復邊界。

新特性二:多模態理解不只用於看圖

Gemini 3.5 Flash 延續原生多模態路線,可把文字、圖像、影片、音訊和文件放進同一任務。Google 的發布材料也強調,它能根據複雜圖表、視覺素材和任務說明產生更豐富的圖形或互動介面。

實際工作流程可以先讀取 PDF 和表格截圖,提取欄位並檢查不一致資料,再呼叫程式碼執行完成計算,最後輸出結構化結果或互動展示。上線前仍要用自己的檔案測試 OCR、圖表理解、長影片定位和結構化輸出的錯誤率。

新特性三:Computer Use 併入主模型

2026 年 6 月 24 日,Google 將 Computer Use 作為 Gemini 3.5 Flash 的內建工具推出。模型可以根據畫面截圖規劃滑鼠、鍵盤和介面動作,不再只依賴獨立的 2.5 Computer Use 預覽模型。

執行循環通常是:應用送出目前截圖和目標;模型回傳點擊、輸入或導覽動作;客戶端在隔離環境中執行;再把新截圖和結果交回模型;敏感動作則暫停等待人工確認。

真正執行介面操作的是開發者提供的客戶端,因此必須限制可存取網域、檔案和帳號,隔離測試工作階段,並防範網頁中的提示詞注入。登入、購買、發布、刪除和權限變更不應預設自動確認。

新特性四:Flash-Lite 面向低成本規模化執行

Gemini 3.5 Flash-Lite 的穩定模型 ID 是 gemini-3.5-flash-lite。官方模型頁列出 1,048,576 tokens 輸入上限和 65,536 tokens 最大輸出,支援文字、圖像、影片、音訊和 PDF 輸入,輸出為文字。

它適合大批量文件解析、欄位提取、分類、輕量 subagent、路由和結構化 JSON。2026 年 7 月官方定價為每百萬輸入 tokens 0.30 美元、每百萬輸出 tokens 2.50 美元。預設 thinking_levelminimal;多步驟工具呼叫可測試 mediumhigh,但要重新測量延遲和成本。

Google 的 Computer Use 文件已把 3.5 Flash-Lite 列入支援模型,但不同能力表和地區上線節奏可能有更新延遲。正式環境應以專案中實際可呼叫的模型和工具回傳為準。

新特性五:Flash Cyber 是防禦專用分支

Gemini 3.5 Flash Cyber 建立在 3.5 Flash 之上,目標是幫助防禦者更快發現、驗證和修復漏洞。Google 將它與 CodeMender 程式碼安全 Agent 結合介紹,而不是當作一般聊天或通用程式設計模型。

不要把 Flash Cyber 當作已向所有 Gemini API 專案開放的通用模型 ID。漏洞驗證也必須限定在已授權的程式碼庫、測試環境和資產範圍內。

Gemini Spark 是應用 Agent,不是 3.5 Pro 的代號

Google 在 Gemini 應用更新中公布 Gemini Spark:它是面向個人任務的持續執行 Agent,可在使用者授權後處理研究、規劃和其他長時間工作。

Spark 屬於產品層能力,不應和底層模型名稱混為一談。選型時要分別確認底層呼叫哪個 Gemini 模型,以及使用的是 Gemini App、AI Mode、Antigravity、Gemini API 還是企業 Agent 平台。

Gemini 3.5 Pro 目前仍不能寫成「已發布」

Google 5 月發布 3.5 Flash 時表示正在開發 3.5 Pro;到 7 月 21 日,官方更新仍稱它正在與合作夥伴測試,會在準備好後廣泛提供。Google DeepMind 模型頁也繼續顯示「3.5 Pro coming soon」。

可以確認的是 3.5 Pro 確實正在推進,但還沒有供所有開發者使用的穩定模型 ID 和正式 GA 說明。Cappuccino 代號、具體基準和確定上線日期不應寫入使用指南。

現在應該怎麼選擇 Gemini 模型

需求 更合適的起點
新建複雜 Agent、程式設計或多模態專案 先比較 Gemini 3.6 Flash
維護已使用 3.5 Flash 的專案 保留穩定型號並做回歸測試,必要時遷移 3.6 Flash
大批量提取、分類、路由或 subagent Gemini 3.5 Flash-Lite
自動操作瀏覽器、行動端或桌面 UI 選擇目前 Computer Use 文件列出的模型並使用沙箱
防禦型漏洞發現和修復研究 確認 Flash Cyber 與 CodeMender 的實際開放範圍
需要 3.5 Pro 等待官方 GA,不使用傳聞型號占位

模型選擇至少應記錄模型 ID、API 類型、thinking level、工具設定、輸入長度、輸出 tokens、成功率、P95 延遲和單任務成本。

開發者遷移和呼叫注意事項

1
2
3
4
5
6
7
8
from google import genai

client = genai.Client()
response = client.models.generate_content(
    model="gemini-3.5-flash-lite",
    contents="Extract the invoice fields and return valid JSON.",
)
print(response.text)

遷移時要為不同任務設定 thinking_level;清理已棄用的 temperaturetop_ptop_k;不要以預填的 model turn 結束對話;分別測試 Function calling、Computer Use 和程式碼執行的權限與恢復流程;正式環境使用明確的穩定模型 ID,不要無審計地跟隨 latest alias。

遷移前用固定樣本保存舊模型結果,再比較欄位準確率、工具呼叫次數、輸出長度、延遲和費用。請求回傳 200 不代表遷移已完成。

使用邊界

長任務可能中途偏離目標,Computer Use 可能點錯控制項,多模態解析也可能遺漏細節。正式使用至少要保留外部寫操作的人工確認、工具呼叫日誌、隔離帳號、提示詞注入與越權檢查,以及模型升級後的固定回歸集和回滾方案。

Gemini 3.5 的真正變化,是 Flash 系列開始承擔更多 Agent 執行、多模態處理和介面操作,而不是一個尚未發布的 Pro 代號。

官方資料