[MODEL] 7 分鐘閱讀OraCore 編輯部

Gemini 3.7 Flash 提速上線,寫程式更強

Google 只隔三週推出 Gemini 3.7 Flash,主打寫程式、網頁開發與文件工作分數提升,還把 API 價格砍半到 2026 年底。

分享 LinkedIn
Gemini 3.7 Flash 提速上線,寫程式更強

Google 在三週內推出 Gemini 3.7 Flash,主打寫程式、網頁開發和文件工作分數升高,API 價格也降到一半。

Google 這次出手很快。Gemini 3.7 Flash 距離上一版只隔三週。對開發者來說,這代表 Flash 系列更新節奏已經進入高頻模式。

更直接的訊號是數字。DeepSWE v1.1 從 49.0% 跳到 65.3%。FrontierCode 1.1 Main 也從 34.4% 升到 43.6%。Gemini appGoogle AI StudioAndroid Studio 都會跟著吃到這波更新。

指標Gemini 3.6 FlashGemini 3.7 Flash
DeepSWE v1.149.0%65.3%
FrontierCode 1.1 Main34.4%43.6%
WebDev Arena Elo15381588
GDP.pdf22.0%34.0%
AutomationBench17.0%30.4%
每 100 萬 token 價格$1.50 input / $7.50 output$0.75 input / $3.75 output

Google 把 Flash 更新節奏拉很快

訂閱 AI 趨勢週報

每週精選模型發布、工具應用與深度分析,直送信箱。不定期,不騷擾。

不會寄垃圾信,隨時可取消。

這次最醒目的地方,不是單一分數,而是發佈速度。三週一版,代表 Google 想把 Flash 做成快速迭代的產品線。這種節奏很像軟體團隊在推主分支,而不是一年才換一次大版本。

Gemini 3.7 Flash 提速上線,寫程式更強

對開發者來說,這件事很現實。你不能只看一次 benchmark 就下結論。你得把模型更新、價格變動、部署環境一起納入評估。尤其是已經把 Flash 放進 production 的團隊,回歸測試會變成固定成本

Google 官方也把這版定位得很清楚。它說 3.7 Flash 來自開發者回饋和演算法調整。這句話翻成工程語言,就是模型在往實用場景靠,而不是只追求榜單數字。

  • 更新間隔:3 週
  • DeepSWE v1.1:49.0% → 65.3%
  • FrontierCode 1.1 Main:34.4% → 43.6%
  • WebDev Arena Elo:1538 → 1588

這些數字很像在講一件事:Google 把資源壓在開發者常碰到的任務上。除錯、修 bug、產生前端骨架、補齊功能流程,都是每天會遇到的活。

如果你在做產品,這種更新速度會逼你改習慣。以前可能一季測一次模型,現在更像每幾週就要看一次成本和品質曲線。

寫程式能力是這版最明顯的亮點

Gemini 3.7 Flash 在軟體工程任務上進步最明顯。Google 提到 debugging 和 issue resolution 的表現更好。這很重要,因為除錯不是看起來厲害就好,而是要少走彎路。

模型如果能更快抓到真正的問題,開發者就少花時間在來回試錯。少一次重送 prompt,省的不只是 token,還有工程師的注意力。這對高頻使用 AI 的團隊很有感。

網頁開發也是同樣邏輯。Google 說這版更常產生功能完整的 app 和更實用的 layout。對前端團隊來說,這種能力比空泛的「會寫程式」更有價值,因為你要的是可跑、可改、可接 API 的結果。

“This new model is a direct result of developer feedback and algorithmic innovations that we look forward to bringing to future models.”

Google,Gemini 3.7 Flash 公告

這段話很直白。Google 把 Flash 當成回饋循環的一環。先收集開發者怎麼用,再用模型和演算法調整去修正,接著快速上線。這種玩法很適合產品化場景。

如果你是台灣團隊,這波特別要注意的是中文與英文混用的工作流。很多內部工具、客服流程、文件摘要,最後都會落到中英夾雜。模型在這種場景的穩定度,往往比單一 benchmark 更重要。

文件工作和商務流程也一起升級

Google 這次不只談 coding。它也把 Gemini 3.7 Flash 推進 finance、law、biosciences 這類文件密集的工作。對這些場景來說,模型要能讀長文件、抓重點、跟著流程走。

Gemini 3.7 Flash 提速上線,寫程式更強

GDP.pdf 從 22.0% 升到 34.0%。AutomationBench 從 17.0% 升到 30.4%。這兩個數字很像在說,模型在多步驟任務上少卡關了。對企業來說,這比單純會聊天更值錢。

Google 也提到它更會處理 roadblock、會在需要時釐清意圖,還能更準確地跟指令走。這種能力聽起來普通,實際上很吃工程細節。因為商務流程最怕的就是卡在第 3 步,然後整條鏈斷掉。

  • GDP.pdf:22.0% → 34.0%
  • AutomationBench:17.0% → 30.4%
  • Launch 價格:input $0.75、output $3.75 / 1M tokens
  • 應用場景:finance、law、biosciences、enterprise workflows

這裡還有一個很實際的點。價格也一起降了,而且是直接砍半。到 2026 年底前,Gemini API 的 Flash 價格是每 100 萬 input tokens 0.75 美元,output 3.75 美元。

這會影響很多試算表。原本覺得太貴的 agent、文件處理、批次摘要,現在可能突然能上線了。便宜 50%,對高頻呼叫的產品不是小事。

價格、平台和競爭對手都會被拉進來

Flash 這條產品線的定位很清楚,就是要在品質、延遲、成本三者之間找平衡。這次價格下修後,它更像是 Google 要拿來打量產市場的主力,而不是展示用模型。

Google 也沒有把它鎖在單一介面。除了 Gemini app,它還進了 Google AI StudioVertex AIAndroid Studio,還有企業工具。這種鋪法很像在把同一顆模型塞進不同銷售管道。

競爭壓力也很直接。OpenAIAnthropicMeta 都在盯著同一批開發者。誰能在成本和品質上先站穩,誰就更容易拿到 production 流量。

如果把這版和前一版對照,可以看出幾個很務實的差異。

  • DeepSWE v1.1 提升 16.3 個百分點
  • FrontierCode 1.1 Main 提升 9.2 個百分點
  • GDP.pdf 提升 12.0 個百分點
  • AutomationBench 提升 13.4 個百分點
  • Launch 價格降低 50%

這種組合很危險,也很有吸引力。因為它會逼其他平台跟進價格,或者拿出更強的工具整合能力。不然開發者很容易直接轉單。

對台灣團隊來說,最實際的做法不是先追新聞,而是先跑測試。把你現在的 coding assistant、文件摘要、客服 agent 拉出來,拿 3.7 Flash 重跑一遍。看 token 成本、延遲、錯誤率,答案會比宣傳稿誠實得多。

這波更新放進整個 AI 產品節奏裡看更有意思

Google 這次的節奏,透露出一個很明顯的方向。它想把 Flash 做成高頻更新、快速驗證、快速商用的模型線。這種產品思維很像雲端服務,不像傳統大模型那種一年一版的節拍。

這也會改變開發者的使用方式。以前你可能把模型當靜態依賴。現在你得把它當會變動的基礎設施。版本、價格、行為、工具支援,都可能在短時間內改寫你的成本結構。

從產業脈絡看,這對整個 LLM 市場是好事。因為競爭會從「誰的模型最會講」轉向「誰的模型最適合上線」。對真正做產品的人,後者才是每天要面對的問題。

我的判斷很簡單:如果你現在有用 Flash 系列,這週就該重跑 benchmark。若你還沒用,先從一個小流程試起,像是程式碼補全、PR 摘要,或文件抽取。等數據出來,再決定要不要擴大。

這版 Gemini 3.7 Flash 的重點很清楚。它把速度、價格和實用性一起拉上來。接下來真正重要的,不是 Google 還會不會再發新版本,而是你的產品有沒有跟上這個更新節奏。