10 月 9 日(周四)起,免费版 Gemini 只剩下最小的 Flash-Lite 模型。如果你平时用免费 Gemini 处理长报告、做多步骤分析,接下来的回答会明显变“薄”。问题不在模型本身,而在于你的提示词原本是为大模型写的。
不花钱也能继续拿到好结果,前提是别再写一大段提示词、指望模型自己拆步骤。本文讲清楚改了什么、轻量模型擅长什么,给你一套可直接复制的“轻量简报”,再附上一条判断是否值得付费的简单规则。
Gemini 在 10 月 9 日有哪些变化?
从 2026 年 10 月 9 日开始,没有订阅 Google AI 方案的个人账号,在 Gemini 应用里只能使用 Flash-Lite,Flash 和 Pro 都从免费版移除。AI Plus 保留 Flash-Lite 和 Flash,但不再包含 Pro;AI Pro 和 AI Ultra 保留全部三个模型,AI Pro 还新增 Deep Think。
这一变化由 9to5Google 在 10 月 3 日首先报道,依据是 Google 新发布的帮助文章。报道称免费模型为 Gemini 3.5 Flash-Lite。
--- 免费:仅 Flash-Lite。
--- AI Plus(美国每月 4.99 美元):Flash-Lite 和 Flash,生效日期以邮件通知为准。
--- AI Pro(每月 19.99 美元):三个模型全有,外加 Deep Think。
另外,本月每个模型都会加入低、中、高三档“思考强度”,档位越高,消耗的额度越多。据 Notebookcheck 的梳理,这次调整针对个人账号,企业和学校账号未被提及。
Flash-Lite 擅长什么,短板在哪里?
Flash-Lite 是 Google 体积最小、速度最快的 Gemini 模型,面向大批量、低成本的任务。实际用下来,它做改写、短摘要、分类,以及根据你提供的材料写初稿都很稳;但遇到长链条推理、冷门知识和指令堆叠的提示词时,表现明显吃力。
打个比方:Flash-Lite 像动作很快、需要明确指令的新同事;Flash 是能独立扛活的骨干;Pro 则是专门处理复杂问题的资深顾问。
免费版的“工作台”也更小。Notebookcheck 引用 Google 限额页面称,无方案账号的上下文窗口为 32,000 个 token,大约二十多页英文。把一份六十页的招标文件整个贴进去,后半部分很可能根本没被读到。
怎样给 Flash-Lite 写出好用的提示词?
给 Flash-Lite 写提示词,核心是你先把思考做完,只交给模型一项明确任务。直接提供所需材料,不要让它凭记忆作答;写清输出格式并附一个示例;最后要求它对照规则自查后再回复。小模型很会照着结构做,却不擅长自己推断结构。
以前在 Pro 上好用的提示词,往往靠模型自己补全空白:读者是谁、什么叫“好”。大模型补得准,小模型补得又快又自信,结果更糟。解决办法是一套固定的五段式“轻量简报”:
--- 任务:一句话一件事,出现两个“并且”就拆成两条。
--- 材料:贴上答案需要的全部信息,并注明不得使用其他信息。
--- 格式:字数、结构、语气,尽量用数字说明。
--- 示例:一小段你想要的输出样本。
--- 自查:要求它对照规则检查草稿,改好后再输出。
试试这条提示词:
任务:把下面的会议记录整理成发给团队的行动清单。
材料(只能使用以下内容,不得补充):
- 10 月 6 日周会,参会:Kelvin、Joyce、Sam
- Joyce 负责在 10 月 10 日前更新官网产品页
- Sam 负责联系两家印刷供应商报价,10 月 13 日前回复
- 下次周会:10 月 13 日上午 10 点
格式:简体中文,标题一行,接着用“负责人 | 事项 | 截止日期”逐行列出,最后一行写下次会议时间,总字数不超过 80 字。
示例:“Joyce | 更新官网产品页 | 10 月 10 日”
自查:输出前确认所有人名、事项和日期与材料完全一致,没有新增内容,字数不超标。修正后只输出最终清单。
注意,这条提示词里没有“写得专业一点”“你自己判断”这类说法。所有决定都已做好,小模型自然能一次给出可用的结果。
哪些工作需要 Flash 或 Pro?什么时候值得付费?
短小、边界清楚的工作留在免费的 Flash-Lite;只有当日常工作经常涉及长文档、多步推理或拆不开的分析时,才考虑付费。每月 4.99 美元的 AI Plus 能找回 Flash,满足日常质量;每月 19.99 美元的 AI Pro,适合每周都离不开 Pro 或 Deep Think 的人。
--- 继续用免费版:改写和压缩文字、按要点起草邮件和文案、按你定义的类别给反馈打标签、摘要较短的文档。
--- 考虑 AI Plus:需要模型自己搭框架的报告初稿、对准确度有要求的日常查询。
--- 考虑 AI Pro:超出免费上下文窗口的合同或数据表、涉及取舍和计算的策略问题。
一个简单的判断方法:记录一周内,用了轻量简报后 Flash-Lite 依然不合格的次数。少于三次,继续免费;每周都有,AI Plus 是划算的保险;如果失败多是长文档或推理类任务,直接上 AI Pro。以上为 Google 美国定价,请以所在地区的方案页面为准。跨厂商的模型分工思路,可参考我们的 GPT-6 Sol 与 Luna 选用指南。
切换到 Flash-Lite 后最容易犯哪些错?
最常见的错误有四个:原样沿用为 Pro 写的旧提示词、贴入超出免费上下文窗口的长文档、简单任务也开最高思考强度,以及相信模型对你没提供的事实给出的自信回答。这些错误要么浪费每周额度,要么产出看似正确的错误内容。
--- 沿用旧提示词:这周先把最常用的五条改写成轻量简报格式。
--- 文档太长:超过约二十页就分段摘要,再汇总成总摘要。
--- 强度一律拉满:改写和分类用低档,初稿用中档,高档留给每天最重要的一项任务。
--- 让它凭记忆回答:小模型更容易编造。请贴上原始材料,并要求缺少信息时回复“材料未提及”。
此外,Google 没有说明旧对话是否会自动切换到 Flash-Lite。依赖 Pro 的工作请在 10 月 9 日前完成,也可以在 gemini.google.com 的“设置”中查看“用量限制”。想进一步锁定输出结构,可搭配我们的 输出合约指南使用。
怎样用 20 分钟测试 Flash-Lite 够不够用?
挑一项你最近用大模型完成的真实工作,先用旧提示词在 Flash-Lite 上跑一次,再用轻量简报跑一次,然后与你实际采用的版本对比。20 分钟就足以分清哪些工作可以留在免费版,哪些值得付费。
--- 第 0 至 5 分钟:选一封客户邮件、一份会议纪要或一段报告,保留最终版本。
--- 第 5 至 10 分钟:切换到 Flash-Lite,运行原来的提示词。
--- 第 10 至 15 分钟:改写成任务、材料、格式、示例、自查五段,再运行一次。
--- 第 15 至 20 分钟:从准确度、结构和修改量三方面,给两份结果各打一至五分。
低于三分的任务类型,就是你真正需要 Flash 或 Pro 的清单。模型变小,并不代表你的 AI 水平倒退;它只是奖励清晰的任务、完整的材料和明确的完成标准。懂AI,更懂你 UD相伴,AI不冷。
由 UD AI 团队审阅。方案信息以 2026 年 10 月 3 日至 5 日报道的 Google 帮助文章为准,价格为美国定价,各地区可能不同。资料来源:9to5Google、Notebookcheck、Gemini 应用帮助中心。
看看你的 AI 判断力在什么水平
用小模型拿到好结果是一项技能。试试 UD 免费的 AI Battle Staff,在真实的香港职场场景里比较人类判断与 AI 的表现。当你准备把这些习惯变成团队可依赖的工作流程时,UD 团队手把手带你完成每一步,从工具配置、流程设计到实际部署。