Gemini 3.8 Flash 上線:距上一版只有 20 天,價格沒漲,但定位變了
Google 在 2026 年 9 月 2 日正式推出 Gemini 3.8 Flash(正式版 GA,model id gemini-3.8-flash),距離 8 月 13 日的 3.7 Flash 只隔 20 天。價格一毛沒動,規格數字也差不多——真正變的是官方替它寫的那句定位。
這篇不整理規格表。作為一家實際用 AI 代理人跑日常營運的公司,我們關心的是另一件事:這個改版對「把工作交給 AI 跑」的人,到底有沒有意義。
Gemini 3.8 Flash 到底改了什麼?
先把可查證的事實放上來。
| 項目 | Gemini 3.7 Flash | Gemini 3.8 Flash |
|---|---|---|
| 發布日 | 2026-08-13 | 2026-09-02 |
| 狀態 | GA | GA |
| 官方定位 | 日常編碼、代理式工具調用、可靠的多步驟執行 | 長時程軟體工程、自主代理、複雜企業工作流程 |
| 上下文長度 | 100 萬 token | 100 萬 token |
| 最大輸出 | — | 64k token |
| 推理強度 | 可調 | 可調(低/中/高) |
| 導入價(每百萬 token) | 輸入 $0.75/輸出 $3.75 | 輸入 $0.75/輸出 $3.75 |
| 2027/1/1 起 | 輸入 $1.50/輸出 $7.50 | 輸入 $1.50/輸出 $7.50 |
資料來源:Gemini API 最新模型說明、API 更新紀錄、定價頁。
看得出來,這次改版的重點是定位位移,而非性能躍進。 兩個版本的價格與上下文長度完全一樣,Google 換掉的是那句描述——從「日常編碼」換成「長時程軟體工程與自主代理」。
為什麼「定位變了」比效能數字重要?
因為那句話是廠商在告訴你它希望你把這個模型用在多長的任務上。
「日常編碼」的意思是:你問一段、它答一段,你來組裝。 「長時程自主代理」的意思是:你交代一件事,它連續跑幾十個步驟,中途自己處理例外,最後把結果交給你。
這兩件事對使用者的要求完全不同。第一種你隨時在旁邊看著,錯了當場改;第二種你不在旁邊,所以錯誤會累積。
Google 把 Flash 這條產品線往第二種推,代表的是整個產業的重心正在從「AI 幫你寫」移到「AI 自己跑」。這也是為什麼發布時機值得注意——《華爾街日報》先前報導這個模型內部代號 Skimaki,重點就是補上代理式編碼這塊 Google 落後的能力(Yahoo Finance 轉載)。
內部測試「贏過 Claude Opus」該怎麼看?
《華爾街日報》的報導提到:在 Google 自家的 Jetski 開發平台做內部對測時,工程師傾向選擇這個新模型勝過 Anthropic 的 Claude Opus。
這句話值得知道,但不該拿來當選型依據,理由有三個:
- 這是廠商自己在自己的平台上測自己的模型。 任何公司的內部對測都不是獨立評測。
- 目前沒有公開的第三方基準結果。 到本文發布為止,Google 沒有公布 3.8 Flash 對外的評測數字。
- 社群早期回饋的說法是「改良而非革命」,主要進步在輸出變得不那麼囉嗦——這跟「贏過旗艦模型」是兩種量級的敘述。
一個更實際的判準:你自己的任務跑一次,比十份評測榜有用。 模型排行榜測的是別人的題目,你的公司只有一種題目——你的。
20 天一版,這個節奏在告訴你什麼?
把最近三版排出來看:
- 3.6 Flash → 3.7 Flash:約 3 週
- 3.7 Flash → 3.8 Flash:20 天
而 3.7 Flash 上線時,導入價是 3.6 Flash 原價的一半(Google 官方發表文);這一版價格則持平。降價與改版都變成常態動作,不再是大事。
對台灣中小企業老闆,這個節奏有一個很不舒服但很重要的含意:
任何「我們評估很久,選定了最強的那個模型」的決定,壽命大約是一個月。
去年花三個月比較、開會、簽核選定的模型,今年三週就被自家新版取代,而且價格還可能對半砍。這裡沒有人決策失誤,變的是產業節奏本身。
這對台灣中小企業意味著什麼?
我的立場很明確:不要追版本,要讓自己換得動。
三件具體的事,難度由低到高:
1. 把模型名稱變成設定值,不要寫死在程式裡。 這是成本最低、回報最高的一件事。模型代號應該放在設定檔,換模型改一行、不動任何邏輯。做不到這點的系統,每次改版都要重新開發一次,久了就乾脆不換——然後你付著舊價格用著舊模型。
2. 準備一組自己的驗收題目,換版後跑一次。 十到二十題就夠,取自你公司真正在做的事:你的報價單長什麼樣、你的客戶問句怎麼問、你的資料有多亂。換版後跑一輪、看結果有沒有退步。這件事花一個下午做完,之後每次改版只要半小時。
3. 把「省下來的錢」與「多出來的能力」分開評估。 價格戰對你有利,但降價省下的是成本,不會自己變成營收。真正的問題永遠是:這條流程如果 AI 跑得動,我敢不敢讓它自己跑? 而那取決於出錯時多久會被發現,跟模型是 3.7 還是 3.8 沒有關係。
我們自己會不會換?
會,但不是今天,而且不是因為它比較新。
我們的判斷順序是這樣的:先看價格有沒有變(沒有)、再看上下文與輸出上限有沒有變(沒有實質差異)、最後看定位轉向的那條線是不是我們正在做的事(是——長時程自主代理正好就是我們每天在跑的形狀)。
所以它會進入我們的驗收題庫排隊,用自己的任務跑過再決定,而不是看到版本號變大就換。版本號是廠商的里程碑,不是你的。
常見問題
Gemini 3.8 Flash 什麼時候上線?價格多少?
2026 年 9 月 2 日正式發布(GA),model id 為 gemini-3.8-flash。導入價為每百萬 token 輸入 0.75 美元、輸出 3.75 美元(含思考 token),有效至 2026 年 12 月 31 日;2027 年 1 月 1 日起調整為輸入 1.50 美元、輸出 7.50 美元。與前一版 3.7 Flash 價格完全相同。
Gemini 3.8 Flash 跟 3.7 Flash 差在哪裡?
官方定位不同。3.7 Flash 的描述是「日常編碼、代理式工具調用與可靠的多步驟執行」,3.8 Flash 則是「長時程軟體工程、自主代理與複雜企業工作流程」。規格上同為 100 萬 token 上下文、最大輸出 64k token,並支援低/中/高三段可調推理強度。價格未變。
Gemini 改版這麼快,中小企業要一直跟著換模型嗎?
不需要追版本,但要讓自己換得動。3.6 到 3.7 隔三週、3.7 到 3.8 隔 20 天,任何「挑一個最強的模型然後綁死」的做法都會在一個月內過期。務實做法是把模型名稱做成設定值而非寫死在程式裡,換模型只改一行;並保留一組自己的驗收題目,換版後跑一次比看任何評測榜都準。
「長時程自主代理」對一般公司有什麼實際意義?
差別在於任務長度。過去的模型適合「問一次答一次」,長時程代理針對的是需要連續執行數十個步驟、中途要自己處理例外的工作,例如把一份雜亂資料整理成報表並產出結論。實務上這類任務的難點不是模型聰不聰明,而是它做錯時多久會被發現,因此放手前要先有可驗證的結果與告警。
Gemini 3.8 Flash 的編碼能力真的贏過 Claude 嗎?
目前沒有可公開查證的第三方評測。《華爾街日報》報導 Google 內部在自家 Jetski 開發平台測試時,工程師傾向選擇這個模型勝過 Anthropic 的 Claude Opus,但那是廠商內部測試,不是獨立評測。實務判斷應以自己的任務跑過再說。