2026 年 7 月 21 日,Google 推出了 Gemini 3.6 Flash,把這顆主力的「workhorse」模型向所有 Gemini App 使用者佈署,成為多數人與 Gemini 互動時真正用到的引擎。這種改版最容易被略過,因為它不像新功能會跳出提示,它只是安靜地把你的問題交給另一個模型回答。偏偏決定「AI 要不要提到你的品牌、要引用哪些網站」的,正是這個你看不到、也選不了的引擎。對每天都在追蹤 AI 能見度的行銷人來說,背後模型一旦換了,策略也要趕快跟著調整。
重點摘要
簡單來說:Gemini 背後的主力模型正在換成 Gemini 3.6 Flash,你上個月量到的 AI 能見度,很可能已經是舊引擎留下的數字了。
- 根據 Google 官方公告,Gemini 3.6 Flash 在 2026 年 7 月 21 日正式上線,官方稱它為主力的「workhorse model」,而且明講是「for everyone via the Gemini app」,一般台灣用戶打開 App 現在就會用到它。
- 根據 DeepMind Gemini Flash 模型頁公布的數據,做同一份工作它比 3.5 Flash 少用約 17% 的輸出 token,定價為每百萬輸入 token 1.50 美元、輸出 token 7.50 美元,比 3.5 Flash 更便宜。
- 官方數據顯示,幾項能力分數都往上走:DeepSWE 程式修復從 37% 到 49%,OSWorld-Verified 操作驗證從 78.4% 到 83.0%。
- 換了一顆模型,答案會不一樣,引用的來源也可能不一樣。也就是說,如果你量的不是使用者真正拿到的那顆模型,那其實是在拿舊數據猜現在。
Google 在 7 月 21 日到底換了什麼?
根據 Google 的官方公告,那天一次推出三顆模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,還有一顆專攻資安的 3.5 Flash Cyber。對多數人來說,真正有感的是 3.6 Flash,因為它坐在產品線的中間,負責處理日常大部分的問答。
它現在已經正式開放,代號 gemini-3.6-flash,Google 透過 Gemini API、AI Studio、Android Studio、Gemini Enterprise 的代理平台一路鋪開,並且用官方自己的說法,是「for everyone via the Gemini app」(Google 官方公告)。同一份公告裡,Google 也把話講在前面:「We have started our most ambitious pre-training run yet, for Gemini 4」,換句話說,多數人用到的那顆模型還會再換,而且不會太久。
Gemini 3.6 Flash 是什麼?為什麼多數人會用到它?
Google 把它定位成「workhorse model」,主打更好的程式、知識工作與多模態表現。根據 DeepMind 的模型頁,公開版本帶著 100 萬 token 的脈絡長度、最多 6.4 萬 token 的輸出、可調整的思考控制,以及一整組內建工具。
它會被推成主力的原因其實很平淡:跑起來比 3.5 Flash 便宜,分數又比 3.5 Flash 好,所以 Google 自然把流量導到它身上,也讓自家的服務優先呼叫它。每一代 Flash 都是這個套路,最新、最省的那一版最後都會變成多數人用到的那顆:Gemini 3 Flash 上線時,Google 說它取代了 2.5 Flash、成為 Gemini App 的預設;輪到 3.5 Flash,它也成了 App 與搜尋 AI 模式的全球預設。你的客戶不會特地去選它,他們就只是被分到了它。
模型換了,為什麼你看到的 AI 答案就跟著變?
AI 的答案是當下生成的,不是從一張固定的網頁抓下來的。同一個問題、同樣的字,換兩顆不同的模型去跑,你會拿到不同的措辭、不同的推理,甚至一組不同的引用來源。當模型自己決定要不要搜尋、相信哪些頁面、怎麼把它們濃縮成一句話,答案裡的引用就會跟著模型一起移動。
也就是說,這個月被推薦點名的品牌,不保證下個月還在名單上,就算你的網站一個字都沒改也一樣。真正變動的變數,是那顆模型。想更完整了解引擎是怎麼挑選要引用誰,我們在如何擠進 AI 的推薦候選名單那一篇拆解過。
模型換版,真的會動到你的 AI 能見度嗎?
先說老實話。我沒辦法給你一張 Google 的圖表,寫著「3.6 Flash 比 3.5 Flash 更常提到某個品牌」,因為 Google 從來不公布單一品牌的引用行為,我也不打算自己編一個數字出來。
但 Google 有公布的是,這顆模型的改變是可以量的。程式、推理、操作電腦的分數都動了,輸出效率也進步了約 17%。一顆推理和檢索方式都不一樣的模型,摘要和引用的方式當然也會不一樣。合理的推論是,你在 Gemini 答案裡的存在感是一個會浮動的數字,而不是一個固定的事實,它會在背後模型換版的時候跟著移動。上個月跑的那一次掃描,比較像一張保存期限很短的快照,不能當成一直成立的結論。
| 改了什麼 | Google 公布的數字 | 對你的 AI 能見度代表什麼 |
|---|---|---|
| 新的主力 Flash 模型 | Gemini 3.6 Flash,2026 年 7 月 21 日正式上線 | Gemini App 裡幫你寫答案的引擎換了一顆 |
| 輸出效率 | 同一份工作少用約 17% 的輸出 token | 答案更便宜,越多流量會被導到它身上 |
| 輸出價格 | 每百萬輸入 token 1.50 美元、輸出 token 7.50 美元,比 3.5 Flash 便宜 | 成本下降,越有可能被推成多數人用到的主力 |
| 任務表現 | DeepSWE 從 37% 到 49%,OSWorld 從 78.4% 到 83.0% | 行為不同,就可能引用不同的來源 |
| 下一顆模型 | Gemini 4 已經開始預訓練 | 主力還會再換,這不是最後一次 |
這只是 Gemini 一家的問題嗎?
不是。Gemini 只是這週剛好換了引擎的那一家。每一個主要的 AI 助理都照自己的節奏在更新背後的模型,而免費版通常就是搭著當下那顆最省的預設在跑。「現在到底是哪顆模型在回答我的客戶」這個問題,套在 ChatGPT、Claude、Perplexity 身上一樣成立。Gemini 這次給了我們一個乾淨、有明確日期的例子,剛好可以趁機檢查一件事:你的量測,是跟著模型一起走,還是還在默默量一個早就退役的版本。各家引擎找資料的方式差多少,我們在台灣行銷人必懂的 AI 搜尋引擎比較整理過一份地圖。
那到底該怎麼量,才量得到使用者真正拿到的答案?
答案是用你的客戶會經歷的方式去量:拿買家真正會打的那些提問,對著每一個引擎背後那顆指定的模型,用固定的排程重複跑,然後追蹤你到底有沒有出現、又是跟誰一起出現。
這正是 Kuroma 在做的事。GEO / AIO / AISEO 這個領域還在很早期、還很混亂的階段,Kuroma 率先把它拆成可以操作的量測:我們直接掃 Gemini 3.6 Flash,把模型版本釘住,讓你清楚知道每一筆結果是哪一顆模型跑出來的;我們把提問重複跑很多次,讓你看到的是變異的區間,而不是一次剛好幸運或不幸的快照;我們也把跟你一起被引用的來源一路記錄下來。等 Google 把下一顆模型扶正成預設,你會在儀表板上看著自己的數字移動,而不是從一筆丟掉的訂單才後知後覺。
台灣品牌這週可以先做這幾件事
- 趁 3.6 Flash 剛上線,把你最重要的幾個提問重新跑一次,跟上一次的紀錄比對看看。
- 別再相信單獨一次的掃描。看的是你在多次重複裡出現的頻率,不是某一次的結果。
- 盯住那些跟你一起被引用的第三方頁面,因為讓你被點名的,大半是它們在出力。
- 把今年的內容更新和平台經營,對齊 AI 引擎的引用習慣,而不是只顧傳統搜尋排名。
- 假設下一次換版正在路上。Gemini 4 已經在預訓練了,所以請建立一個可以重複跑的量測,而不是一份做完就歸檔的一次性稽核。
常見問題
Gemini 3.6 Flash 是什麼?
簡單來說,Gemini 3.6 Flash 是 Google 在 2026 年 7 月 21 日推出的 AI 模型,官方稱它為負責程式、知識工作與多模態任務的「workhorse model」。根據 DeepMind 的模型頁,它做同一份工作比 3.5 Flash 少用約 17% 的輸出 token,定價為每百萬輸入 token 1.50 美元、每百萬輸出 token 7.50 美元。
Gemini 3.6 Flash 是 Gemini App 的預設模型嗎?
根據 Google 官方公告,上線當天就用「for everyone via the Gemini app」的說法把它鋪給所有人,也把它設成自家代理平台的預設。跟過去每一代 Flash 一樣,最新、最省的那一版會變成多數人被回答時用到的模型,而使用者其實沒有特地去選它。
換了新的預設模型,AI 推薦的品牌會不會跟著變?
有可能。不同的模型,推理和檢索的方式不一樣,所以它引用的來源、答案裡點名的品牌,都可能在你的網站沒有任何改動的情況下就變了。Google 不會公布單一品牌的引用數據,所以務實的做法是自己去量自己目前的存在感,而不是假設它會一直穩定。
這和傳統 SEO 有什麼不同?
傳統 SEO 是在搜尋結果頁面上,替一排藍色連結爭排名。AI 能見度指的是生成式模型會不會在答案裡提到你、引用你,也就是常說的 GEO(AI 搜尋引擎最佳化)、AEO、AISEO、AIO。因為那個答案是由一顆會隨時間換版的模型產生的,所以 AI 能見度是要持續監測的東西,不是設定一次就固定的排名。
Kuroma 怎麼在 Gemini 3.6 Flash 上量測 AI 能見度?
Kuroma 拿你真正的買家提問去跑 Gemini 3.6 Flash 以及其他主要引擎,把確切的模型版本釘住,重複跑以捕捉變異,再追蹤你有沒有出現、以及有哪些來源被引用在你旁邊。等預設模型又換了,這個變動會直接出現在你目前的報告裡,而不是等它先給你一個措手不及。