跳至主要內容
← 返回文章列表

Google 推出 Gemini 3.8 Flash:低單價背後的 Token 成本與資安限制

GenAI 新聞觀察 Gemini Cybersecurity

重點摘要

Google 同時推出 Gemini 3.8 Flash 與限可信防禦者使用的 Flash Cyber;新模型維持入門單價,但更長的推理可能增加實際帳單。

Google 推出 Gemini 3.8 Flash:低單價背後的 Token 成本與資安限制

Gemini 3.8 Flash 能否降低代理工作流的總成本,不能只看 API 單價。未來三個月若相同任務的平均輸出 Token 或工具呼叫次數升幅超過任務成功率的改善,低單價假設就不成立。Google 在 2026-09-02 發布 Gemini 3.8 Flash 與 Gemini 3.8 Flash Cyber,前者已進入 API、企業及消費產品,後者只開放給經審核的防禦者。

Google 把一般版定位為軟體工程、代理任務和多步推理模型。入門價格為每百萬輸入 Token $0.75、每百萬輸出 Token $3.75,與三週前推出的 3.7 Flash 相同。公司也明說,3.8 在複雜任務會增加推理步驟、反覆呼叫工具,高 effort 設定可能消耗更多 Token;重視運算效率的開發者可降低 effort,或繼續使用仍受支援的 3.7 Flash。The Verge 因此提醒,單位價格相同不代表每個任務的帳單相同。

這次發布把效能提升與使用成本綁在同一個可檢查的變數上。Google 稱 3.8 Flash 在 HLE-Verified 得到 54.9%,並在 DeepSWE v1.1、金融與法律代理評測優於 3.7 Flash;這些數字仍主要來自供應商公布的測試。文章沒有提供不同 effort 設定的平均 Token 數、延遲或完整任務成本,企業無法只靠排行榜估算自己的推論預算。入門價也只到 2026-12-31;自 2027-01-01 起,公告價格將升至每百萬輸入 Token $1.50、輸出 Token $7.50。

Flash Cyber 的防禦邊界

Gemini 3.8 Flash Cyber 使用相同基礎能力,但針對漏洞發現與自動修補。Google 稱模型在涵蓋 20 種程式語言的內部漏洞測試成功率超過 70%,在外部 CWE-Bench 的 pass@1 為 47.2%,接近另一個前沿模型的 47.8%。Chrome Security 團隊取得的正確修補數是大型商用模型的 2.6 倍;這些實際案例仍由 Google 與合作夥伴提供,外部團隊尚未公開重現完整條件。

權限設計限制了產品可及性。一般版依 Google 的 Frontier Safety Framework 加入化學、生物、放射、核與網路攻擊防護;Cyber 版因網路安全限制較寬,只透過 Fairwind Program 提供給政府機關、關鍵基礎設施營運者與軟體維護者。這代表多數開發者今天能測一般版,卻無法自行驗證 Cyber 版的漏洞修補成績或比較誤報率。

接下來三到六個月,採購方可記錄固定任務在 3.7 與 3.8 的成功率、總 Token、工具呼叫次數及延遲,再用 2027 年正式價格重算成本。Cyber 版則要看 Fairwind 核准多少外部機構,以及是否出現獨立重現的漏洞發現與修補結果;目前公告沒有提供這兩項資料。

來源:

訂閱最新分享

加入電子報,第一時間獲取關於金融 AI Agent 實戰與架構設計的最新文章。不訂閱你會慢別人一個週期!

絕不發送垃圾信。隨時皆可取消訂閱。