Flash-Lite 是 Gemini 應用程式中最小的模型。由 2026 年 10 月 9 日(星期四)起,免費用戶只能使用它。如果你習慣用免費 Gemini 處理長篇報告或多步分析,答案質素很快會明顯下降,因為你的提示原本是為大模型而寫的。
不付費也能維持實用的輸出,關鍵是不再寫一大段提示、期望模型自行拆解步驟。本文說明改動內容、輕量模型的強項、一套可直接複製的「輕量簡報」,以及判斷何時值得付費的簡單規則。
Gemini 在 10 月 9 日有甚麼改變?
由 2026 年 10 月 9 日起,沒有訂閱 Google AI 方案的個人帳戶,在 Gemini 應用程式中只能使用 Flash-Lite,Flash 與 Pro 均會從免費版移除。AI Plus 保留 Flash-Lite 及 Flash,但失去 Pro;AI Pro 與 AI Ultra 保留全部三個模型,AI Pro 更新增 Deep Think。
消息由 9to5Google 於 10 月 3 日率先報道,來源是 Google 一篇名為「Gemini 模型存取權與限制變更」的說明文章。報道指免費模型為 Gemini 3.5 Flash-Lite。
--- 免費:只有 Flash-Lite。
--- AI Plus(美國售價每月 4.99 美元):Flash-Lite 及 Flash,生效日期以電郵通知。
--- AI Pro(每月 19.99 美元):三個模型齊全,另加 Deep Think。
此外,每個模型本月將加入低、中、高三級「思考強度」,強度越高,消耗的用量越多。根據 Notebookcheck 的整理,今次改動只涉及個人帳戶,公司及學校帳戶並未提及。
Flash-Lite 擅長甚麼?弱點在哪裡?
Flash-Lite 是 Google 最細小、最快的 Gemini 模型,專為大量而低成本的任務而設。實際使用時,它處理改寫、短摘要、分類,以及根據你提供的資料撰寫草稿都相當可靠;但面對長篇多步推理、冷門知識,以及指令繁多的提示時,表現明顯較弱。
可以把三個模型想像成三位同事:Flash-Lite 是手腳快、需要清楚指示的新人;Flash 是能獨當一面的主力;Pro 則是處理複雜難題的資深顧問。
免費版的工作空間亦較小。Notebookcheck 引述 Google 的限制頁面,指無方案帳戶的上下文視窗為 32,000 個 token,約等於二十多頁英文。貼入一份六十頁的標書,部分內容根本不會被讀取。
怎樣為 Flash-Lite 寫出有效的提示?
為 Flash-Lite 寫提示,原則是由你負責思考,只交給模型一項清晰任務。直接提供所需資料,而非要它憑記憶回答;寫明輸出格式並附一個範例;最後要求它按規則自我檢查才回覆。小模型擅長遵循結構,卻不擅長自行推斷結構。
以往在 Pro 上有效的提示,往往依賴模型填補空白,例如讀者是誰、怎樣才算好。大模型猜得準,小模型則猜得快而且自信,結果反而更糟。解決方法是一套固定的五段式「輕量簡報」:
--- 任務:一句話,一項任務。出現兩個「並且」,就應拆成兩條提示。
--- 資料:貼上答案所需的全部資料,並註明不得使用其他資訊。
--- 格式:字數、結構及語氣,盡量用數字表達。
--- 範例:一小段你想要的輸出樣本。
--- 檢查:要求它按規則覆核草稿,修正後才輸出。
試用這個提示:
任務:撰寫一則活動通知,發布於公司 Facebook 專頁。
資料(只可使用以下內容,不得自行補充):
- 活動:「AI 辦公室效率工作坊」
- 日期:2026 年 10 月 25 日(星期六)下午 2 時至 4 時
- 地點:觀塘辦公室
- 名額:30 人,免費,需網上登記
格式:繁體中文書面語,不多於 100 字,分三段,最後一句為登記提示,不用表情符號。
範例語氣:「想讓日常文書工作快一倍?這個週末,我們一起試試。」
檢查:輸出前確認日期、時間、地點及名額與資料完全一致,字數不超過 100 字,且沒有加入資料以外的內容。修正後只輸出最終版本。
留意這條提示沒有「寫得吸引一點」或「自行判斷」之類的指示。所有決定已經做好,小模型自然能一次寫出可用的初稿。
哪些工作需要 Flash 或 Pro?何時值得付費?
短而清晰的工作留在免費的 Flash-Lite;只有當日常工作經常涉及長文件、多步推理或無法拆分的分析時,才考慮付費。每月 4.99 美元的 AI Plus 可取回 Flash,應付日常質素;每月 19.99 美元的 AI Pro,適合每週都依賴 Pro 或 Deep Think 的用戶。
--- 留在免費版:改寫、縮短文字、按要點起草電郵及貼文、按你定義的類別分類意見、摘要較短的文件。
--- 考慮 AI Plus:需要模型自行組織論點的報告初稿、講求準確度的日常資料查詢。
--- 考慮 AI Pro:超出免費上下文視窗的合約或數據、涉及取捨及計算的策略問題。
簡單的判斷方法:記錄一星期內,即使用了輕量簡報,Flash-Lite 仍然不合格的次數。少於三次,繼續免費;每週都出現,AI Plus 是划算的保險;若失敗多屬長文件或推理任務,則直接選 AI Pro。以上為 Google 美國定價,請以你所在地區的方案頁面為準。跨品牌的模型分工思路,可參考我們的 GPT-6 Sol 與 Luna 選用指南。
改用 Flash-Lite 後最常見的錯誤是甚麼?
最常見的錯誤有四個:原封不動沿用為 Pro 而寫的舊提示、貼入超出免費上下文視窗的長文件、簡單任務也開最高思考強度,以及相信模型對你未提供的事實所作的自信回答。這些錯誤不是浪費每週用量,就是產生看似正確的錯誤。
--- 沿用舊提示:本週先把最常用的五條提示改寫成輕量簡報格式。
--- 文件過長:超過約二十頁便應分段摘要,再整合成總摘要。
--- 強度一律開高:改寫及分類用低,草稿用中,高強度留給每天最重要的一項工作。
--- 要求它憑記憶作答:小模型較易編造內容。請貼上原始資料,並要求缺少資料時回覆「資料未提及」。
另外,Google 未說明舊對話會否自動轉用 Flash-Lite。依賴 Pro 的工作請在 10 月 9 日前完成,並可在 gemini.google.com 的「設定」中查看「用量限制」。想進一步鎖定輸出結構,可配合我們的 輸出合約指南使用。
怎樣用二十分鐘測試 Flash-Lite 是否夠用?
選一項你最近用大模型完成的真實工作,先用舊提示在 Flash-Lite 上執行一次,再用輕量簡報執行一次,然後與你實際採用的版本比較。二十分鐘已足以分辨哪些工作可以留在免費版,哪些值得付費。
--- 第 0 至 5 分鐘:挑選一封客戶電郵、一份會議摘要或一段報告,保留最終版本。
--- 第 5 至 10 分鐘:選用 Flash-Lite,執行原有提示。
--- 第 10 至 15 分鐘:改寫為任務、資料、格式、範例、檢查五段,再執行一次。
--- 第 15 至 20 分鐘:按準確度、結構及需修改程度,為兩份草稿各評一至五分。
得分低於三分的工作類型,就是你需要 Flash 或 Pro 的清單。模型變小,並不代表你的 AI 能力退步;它只是獎勵清晰的任務、完整的資料和明確的完成標準。懂AI,更懂你 UD相伴,AI不冷。
由 UD AI 團隊審閱。方案資料以 2026 年 10 月 3 至 5 日報道的 Google 說明文章為準,價格為美國定價,各地或有不同。資料來源:9to5Google、Notebookcheck、Gemini 應用程式說明。
看看你的 AI 判斷力處於甚麼水平
從小模型取得好結果是一種技能。試試 UD 免費的 AI Battle Staff,在真實香港職場情境中比較人類判斷與 AI 的表現。當你準備把這些習慣變成團隊可依賴的工作流程,UD 團隊手把手帶你完成每一步,從工具配置、流程設計到實際部署。