Google 於 2026 年 9 月 2 日發表 Gemini 3.8 Flash,升級重點放在長時間軟體工程、自主代理與多步驟推理。它沿用 Flash 的速度與成本定位,符合資格的既有訂閱戶可直接使用,詳情見Google官方發布公告。
PTT Stock 板這串討論集中在 Flash 與 Pro 的體感差異、程式除錯、價格,以及錯誤資訊等問題。原始討論串反映使用情境,不能當成效能測試。想建立比較框架,可讀站內的AI模型選型與成本、資料、部署檢查,把「哪顆比較強」拆成任務、延遲、成本與驗收條件。
Gemini 3.8 Flash 這次更新了什麼
Gemini 3.8 Flash 建立在 3.7 Flash 之上,支援文字、圖片、影片、音訊與 PDF,輸入脈絡上限為 1,048,576 token,最大文字輸出為 65,536 token。它支援程式執行、函式呼叫、搜尋 grounding、檔案搜尋與三種思考等級,細節以模型文件為準。
和 Gemini 3.7 Flash 差在哪
Google 宣稱 3.8 Flash 維持 3.7 Flash 的速度與低成本,API 入門價格到 2026 年 12 月 31 日前為每 100 萬輸入 token 0.75 美元、每 100 萬輸出 token 3.75 美元。Google DeepMind 公開的比較資料中,Vals Finance Agent v2 為 61.4% 對 59.0%,HLE-Verified 為 54.9% 對 53.6%,兩組結果都是 3.8 Flash 高於 3.7 Flash,詳見官方效能頁面。
Google對升級原因的描述是,複雜任務會多做推理步驟,並反覆呼叫工具檢查與修正。高思考等級可能消耗更多 token;追求效率的工作,官方仍保留 3.7 Flash 作為選項。
一般使用者怎麼用得到
消費端目前由 Google 公告列出的使用資格是 AI Pro 與 Ultra 訂閱戶,可在 Gemini App、Google 搜尋 AI Mode 與 Google Sheets 使用 3.8 Flash。開發者可從 AI Studio、Gemini API、Google Antigravity 開始,企業入口是 Gemini Enterprise。額度與地區條件應以Google公告的入口清單為準。
先試哪一類工作
開發者可先拿低風險工作測試,例如讓模型讀取小型程式庫、列出修改計畫、補測試,再檢查是否誤解需求。企業若接上長任務代理,還要記錄 token 用量、失敗重試與人工修改時間;AI agent 的預算控管設計已整理為什麼「叫模型省一點」不足以控制帳單。一般用戶可先從文件整理、表格轉換與程式碼解說開始。
常見問題
Gemini 3.8 Flash 可以免費用嗎?
Google 公告目前明確列出 AI Pro 與 Ultra 訂閱戶可在 Gemini App、Google 搜尋 AI Mode 與 Google Sheets 使用,免費帳號資格沒有在該公告中清楚列出。開發者可查看 Gemini API 模型文件與控制台方案。
Gemini 3.8 Flash 比 3.7 Flash 快嗎?
Google 將兩者定位在相同速度與低成本條件,這次主要提升複雜程式工程、代理任務與多步驟推理。高思考等級會多做推理與工具呼叫,實際等待時間和 token 消耗仍會依任務而變。
Gemini 3.8 Flash 適合直接拿來寫完整專案嗎?
它的公開定位包含長時間軟體工程與自主代理,適合拿來協助規畫、撰寫、測試與除錯。Google DeepMind 模型卡也列出幻覺、偶發延遲與逾時等限制,因此完整專案仍應保留測試、版本控管與人工審核。
參考來源
- Google 官方發布公告:Gemini 3.8 Flash 與 3.8 Flash Cyber (Google)
- Google AI for Developers:Gemini 3.8 Flash 模型文件 (Google)
- Google DeepMind:Gemini 3.8 Flash 模型卡 (Google DeepMind)
- PTT Stock 板:Google 發表 Gemini 3.8 Flash 討論串 (批踢踢實業坊) 論壇推文作為使用情境線索,不作為模型效能證據。