Gemini 3.6 Flash 正式發布:API 價格、模型差異與 AI Agent 任務成本一次看懂
Google 推出 Gemini 3.6 Flash 與 3.5 Flash-Lite,並公布 Flash Cyber。本文比較 API 價格、模型定位與適用任務,解析企業該如何計算 AI Agent 的實際成本。
Google 在 2026 年 7 月 21 日推出 Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite,同時公布資安專用模型 Gemini 3.5 Flash Cyber。前兩款模型已可透過 Gemini API 等服務使用;Flash Cyber 則預計透過 CodeMender 啟動限量試辦,現階段並不是一般開發者可以直接呼叫的公開模型。 表面上,這又是 Gemini 系列的又一次版本更新,但對正在導入 AI Agent 的企業來說,更值得注意的是, 新模型能否用較少的 token、推理步驟與工具呼叫,完成同一項工作。 這不代表企業導入後一定能省下固定比例的費用,因為真正影響成本的,還包括任務失敗後要重跑幾次、是否需要人工修改,以及不同模型之間如何分工。 因此,企業不能只問模型單價是多少,更應該追蹤一個 AI Agent 成功完成一次任務,總共要花多少錢。這也是 Gemini 3.6 Flash 這次最值得討論的地方。 Gemini 3.6 Flash 更新重點快速看 Google 這次公布的三款模型,不只是效能由高到低的排列,它們分別承擔不同工作。 3.6 Flash 負責較複雜的規劃與執行,Flash-Lite 承接大量重複工作;Flash Cyber 則把高風險資安能力放在受控環境中。 模型 目前狀態 主要定位 適合的工作 Gemini 3.6 Flash 已開放使用 品質、速度與成本平衡的主力模型 寫程式、文件分析、多步驟 Agent、複雜工具操作 Gemini 3.5 Flash-Lite 已開放使用 高吞吐、低延遲、低成本 大量分類、資料抽取、搜尋、翻譯與簡單子任務 Gemini 3.5 Flash Cyber 即將限量試辦 程式碼資安專用模型 找出、驗證與修補軟體漏洞 Gemini API 文件目前將 3.6 Flash 與 3.5 Flash-Lite 列為 stable 模型。3.6 Flash 的模型代號是 gemini-3.6-flash,Flash-Lite 則是 gemini-3.5-flash-lite。 Gemini 3.6 Flash 價格與效能,企業該如何控管 AI 成本? Gemini 3.6 Flash 與 Flash-Lite 的 API 價格差多少? Gemini 3.6 Flash 的 Gemini API 標準價格為: 每 100 萬輸入 token:1.50 美元 每 100 萬輸出 token:7.50 美元 Gemini 3.5 Flash-Lite 的價格則是: 每 100 萬輸入 token:0.30 美元 每 100 萬輸出 token:2.50 美元 兩款模型都支援約 100 萬 token 的上下文視窗,以及最長約 6.5 萬個輸出 token。 只看價目表,…