Gemini 3.7 Flash 提速上線,寫程式更強
Google 只隔三週推出 Gemini 3.7 Flash,主打寫程式、網頁開發與文件工作分數提升,還把 API 價格砍半到 2026 年底。

Google 在三週內推出 Gemini 3.7 Flash,主打寫程式、網頁開發和文件工作分數升高,API 價格也降到一半。
Google 這次出手很快。Gemini 3.7 Flash 距離上一版只隔三週。對開發者來說,這代表 Flash 系列更新節奏已經進入高頻模式。
更直接的訊號是數字。DeepSWE v1.1 從 49.0% 跳到 65.3%。FrontierCode 1.1 Main 也從 34.4% 升到 43.6%。Gemini app、Google AI Studio、Android Studio 都會跟著吃到這波更新。
| 指標 | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| DeepSWE v1.1 | 49.0% | 65.3% |
| FrontierCode 1.1 Main | 34.4% | 43.6% |
| WebDev Arena Elo | 1538 | 1588 |
| GDP.pdf | 22.0% | 34.0% |
| AutomationBench | 17.0% | 30.4% |
| 每 100 萬 token 價格 | $1.50 input / $7.50 output | $0.75 input / $3.75 output |
Google 把 Flash 更新節奏拉很快
訂閱 AI 趨勢週報
每週精選模型發布、工具應用與深度分析,直送信箱。不定期,不騷擾。
不會寄垃圾信,隨時可取消。
這次最醒目的地方,不是單一分數,而是發佈速度。三週一版,代表 Google 想把 Flash 做成快速迭代的產品線。這種節奏很像軟體團隊在推主分支,而不是一年才換一次大版本。

對開發者來說,這件事很現實。你不能只看一次 benchmark 就下結論。你得把模型更新、價格變動、部署環境一起納入評估。尤其是已經把 Flash 放進 production 的團隊,回歸測試會變成固定成本。
Google 官方也把這版定位得很清楚。它說 3.7 Flash 來自開發者回饋和演算法調整。這句話翻成工程語言,就是模型在往實用場景靠,而不是只追求榜單數字。
- 更新間隔:3 週
- DeepSWE v1.1:49.0% → 65.3%
- FrontierCode 1.1 Main:34.4% → 43.6%
- WebDev Arena Elo:1538 → 1588
這些數字很像在講一件事:Google 把資源壓在開發者常碰到的任務上。除錯、修 bug、產生前端骨架、補齊功能流程,都是每天會遇到的活。
如果你在做產品,這種更新速度會逼你改習慣。以前可能一季測一次模型,現在更像每幾週就要看一次成本和品質曲線。
寫程式能力是這版最明顯的亮點
Gemini 3.7 Flash 在軟體工程任務上進步最明顯。Google 提到 debugging 和 issue resolution 的表現更好。這很重要,因為除錯不是看起來厲害就好,而是要少走彎路。
模型如果能更快抓到真正的問題,開發者就少花時間在來回試錯。少一次重送 prompt,省的不只是 token,還有工程師的注意力。這對高頻使用 AI 的團隊很有感。
網頁開發也是同樣邏輯。Google 說這版更常產生功能完整的 app 和更實用的 layout。對前端團隊來說,這種能力比空泛的「會寫程式」更有價值,因為你要的是可跑、可改、可接 API 的結果。
“This new model is a direct result of developer feedback and algorithmic innovations that we look forward to bringing to future models.”
Google,Gemini 3.7 Flash 公告
這段話很直白。Google 把 Flash 當成回饋循環的一環。先收集開發者怎麼用,再用模型和演算法調整去修正,接著快速上線。這種玩法很適合產品化場景。
如果你是台灣團隊,這波特別要注意的是中文與英文混用的工作流。很多內部工具、客服流程、文件摘要,最後都會落到中英夾雜。模型在這種場景的穩定度,往往比單一 benchmark 更重要。
文件工作和商務流程也一起升級
Google 這次不只談 coding。它也把 Gemini 3.7 Flash 推進 finance、law、biosciences 這類文件密集的工作。對這些場景來說,模型要能讀長文件、抓重點、跟著流程走。

GDP.pdf 從 22.0% 升到 34.0%。AutomationBench 從 17.0% 升到 30.4%。這兩個數字很像在說,模型在多步驟任務上少卡關了。對企業來說,這比單純會聊天更值錢。
Google 也提到它更會處理 roadblock、會在需要時釐清意圖,還能更準確地跟指令走。這種能力聽起來普通,實際上很吃工程細節。因為商務流程最怕的就是卡在第 3 步,然後整條鏈斷掉。
- GDP.pdf:22.0% → 34.0%
- AutomationBench:17.0% → 30.4%
- Launch 價格:input $0.75、output $3.75 / 1M tokens
- 應用場景:finance、law、biosciences、enterprise workflows
這裡還有一個很實際的點。價格也一起降了,而且是直接砍半。到 2026 年底前,Gemini API 的 Flash 價格是每 100 萬 input tokens 0.75 美元,output 3.75 美元。
這會影響很多試算表。原本覺得太貴的 agent、文件處理、批次摘要,現在可能突然能上線了。便宜 50%,對高頻呼叫的產品不是小事。
價格、平台和競爭對手都會被拉進來
Flash 這條產品線的定位很清楚,就是要在品質、延遲、成本三者之間找平衡。這次價格下修後,它更像是 Google 要拿來打量產市場的主力,而不是展示用模型。
Google 也沒有把它鎖在單一介面。除了 Gemini app,它還進了 Google AI Studio、Vertex AI、Android Studio,還有企業工具。這種鋪法很像在把同一顆模型塞進不同銷售管道。
競爭壓力也很直接。OpenAI、Anthropic、Meta 都在盯著同一批開發者。誰能在成本和品質上先站穩,誰就更容易拿到 production 流量。
如果把這版和前一版對照,可以看出幾個很務實的差異。
- DeepSWE v1.1 提升 16.3 個百分點
- FrontierCode 1.1 Main 提升 9.2 個百分點
- GDP.pdf 提升 12.0 個百分點
- AutomationBench 提升 13.4 個百分點
- Launch 價格降低 50%
這種組合很危險,也很有吸引力。因為它會逼其他平台跟進價格,或者拿出更強的工具整合能力。不然開發者很容易直接轉單。
對台灣團隊來說,最實際的做法不是先追新聞,而是先跑測試。把你現在的 coding assistant、文件摘要、客服 agent 拉出來,拿 3.7 Flash 重跑一遍。看 token 成本、延遲、錯誤率,答案會比宣傳稿誠實得多。
這波更新放進整個 AI 產品節奏裡看更有意思
Google 這次的節奏,透露出一個很明顯的方向。它想把 Flash 做成高頻更新、快速驗證、快速商用的模型線。這種產品思維很像雲端服務,不像傳統大模型那種一年一版的節拍。
這也會改變開發者的使用方式。以前你可能把模型當靜態依賴。現在你得把它當會變動的基礎設施。版本、價格、行為、工具支援,都可能在短時間內改寫你的成本結構。
從產業脈絡看,這對整個 LLM 市場是好事。因為競爭會從「誰的模型最會講」轉向「誰的模型最適合上線」。對真正做產品的人,後者才是每天要面對的問題。
我的判斷很簡單:如果你現在有用 Flash 系列,這週就該重跑 benchmark。若你還沒用,先從一個小流程試起,像是程式碼補全、PR 摘要,或文件抽取。等數據出來,再決定要不要擴大。
這版 Gemini 3.7 Flash 的重點很清楚。它把速度、價格和實用性一起拉上來。接下來真正重要的,不是 Google 還會不會再發新版本,而是你的產品有沒有跟上這個更新節奏。