2026 年 9 月 2 日,Google 没有开发布会,只发了一篇博客加一次 API 灰度,Gemini 3.8 Flash 就这么上线了。距离上一代 3.7 Flash 只有三周——Google 自己把这次称作「六周内第三代 Flash」。隔壁 Meta 同一天发布了 Muse Spark 1.3,两边几乎掐着同一个钟点放模型,2026 年的模型军备竞赛已经卷到按周计算。
这篇文章不讲发布会,讲三件实在事:3.8 Flash 比 3.7 强在哪、价格有没有变、普通用户和开发者各怎么用上它。
太长不看
| 关注点 | 结论 |
|---|---|
| 这是什么 | Gemini 3 系列的新一代 Flash,Google 官方定位「最聪明的干活模型」 |
| 发布时间 | 2026-09-02,距 3.7 Flash 仅三周(六周内第三代 Flash) |
| 最大变化 | 编码、智能体任务、多步推理大幅提升,官方称「常逼近更高价旗舰」 |
| API 价格 | 输入 $0.75 / 输出 $3.75 每百万 Token(含思考 Token),与 3.7 持平,优惠到 2026-12-31 |
| 免费入口 | AI Studio 网页直接体验,有免费额度,不用绑卡 |
| 谁该看 | 被旗舰模型价格劝退的开发者、想升级 Gemini 免费体验的用户 |
六周三代 Flash:Google 在卷什么
先看节奏。Gemini 3 系列 Flash 的发布间隔越来越短:
| 版本 | 发布时间 | 距离上一代 |
|---|---|---|
| 3.6 Flash | 7 月下旬 | — |
| 3.7 Flash | 8 月 13 日 | 约三周 |
| 3.8 Flash | 9 月 2 日 | 三周 |
三周一代,Flash 已经成了 Google 的「打点工具」:既不是挤牙膏式小修,也不是憋大招式跳票,而是把每一轮训练的后训练成果尽快塞给用户。这次 3.8 的定位很明确——用接近 3.7 的成本,干接近旗舰模型的活。官方原话是「often approaching the performance of higher-cost frontier models」(常逼近更高成本旗舰模型的性能)。
选在同一天发模型的 Meta 也不含糊:Muse Spark 1.3 主打编程与智能体能力,官方称是「史上最大一次性能跃升」,下一步要推「24 小时替你工作」的个人智能体。第三方榜单 Artificial Analysis 的公开档位数据里,Muse Spark 1.3 xhigh 档 61 分、Gemini 3.8 Flash high 档 59 分,咬得很紧;另一边有消息称 Google 内部编程工具测试里,工程师更愿意用 3.8 Flash 而不是 Claude Opus。三巨头同一天隔空对打,谁是第三名已经没人关心了。
3.8 Flash 强在哪
Google 给 3.8 Flash 列的提升集中在三个词:软件工程、智能体任务、专业领域多步推理。挑几个有代表性的数字:
| 评测 | 3.8 Flash 表现 |
|---|---|
| DeepSWE v1.1(长程软件工程) | 端到端自主解决复杂工程问题,超过多数更大的旗舰模型,「成本只是零头」 |
| Vals Finance Agent V2 / Harvey 法律智能体榜 | 量化与专业领域超过 3.7 Flash 和其他前沿模型 |
| HLE-Verified(人类最后考试) | 54.9%,覆盖 STEM、人文、专业领域多步推理 |
翻译成大白话:让它自己读完一个代码仓库、定位问题、改完、跑通测试这种「长程任务」,3.8 Flash 已经能跟比自己贵好几倍的模型掰手腕;金融分析、法律文书这类需要多步推理加工具调用的场景,它也不再是「便宜但笨」的替补。
性能提升背后有个值得知道的设计取舍——3.8 Flash「更愿意多干活」。复杂任务下它会主动多走几步推理、反复调用工具确认结果,所以高 effort 档位下 token 消耗可能比 3.7 多。反过来,如果你的场景就是追求低延迟低消耗,可以把 effort 调低,或者继续用 3.7 Flash——Google 明确说了 3.7 会继续完整支持,专供效率优先的场景。
另外两个小提升:知识截止时间部分领域到 2026 年 3 月(部分领域仍停留在 2025 年 1 月);prompt injection(提示注入)抗性据 Gray Swan 评测有明显进步,对做 Agent 应用的人来说这个比跑分更实在。
顺带一提:3.8 Flash Cyber
同批发布的还有面向网络安全的 3.8 Flash Cyber(取代 3.5 Flash Cyber):自主漏洞发现达到前沿水平,20 种语言代码库的内部评测成功率超过 70%,CWE-Bench 漏洞修复 pass@1 47.2%(头部前沿模型 47.8%),Chrome 安全团队实测它产出的正确补丁是最强商业模型的 2.6 倍。不过它只通过 Fairwind Program 对受信任的防御方开放,普通开发者拿不到,知道有这么回事就行。
价格:跟 3.7 一模一样
这是 3.8 Flash 最「反常」的地方——性能涨了一截,价格一分没涨:
| 计费项 | 价格(每百万 Token) | 备注 |
|---|---|---|
| 输入 | $0.75 | 优惠价,2026-12-31 截止 |
| 输出(含思考 Token) | $3.75 | 优惠价,2026-12-31 截止 |
| 上下文缓存 | $0.075 | 缓存命中的输入更便宜 |
注意输出价格包含思考 Token——很多模型把思考过程单独计费,3.8 Flash 没有这个坑。2027 年 1 月 1 日起输入恢复到 $1.50、输出 $7.50,所以年底前是明显的接入窗口:现在把应用切过来,等于用三折价格跑几个月正式版模型。
免费用户也不用慌:AI Studio 里有免费额度,输入输出都不收费(有限流),想尝鲜完全不用绑卡。付费档额外给上下文缓存、Batch API 半价、以及 Google 搜索/地图 grounding 的免费额度。
上手:四条路径
1. Gemini App(订阅用户)
Google AI Pro 和 Ultra 订阅用户打开 gemini.google.com 或手机 App,模型选到 Gemini 3.8 Flash 就能直接用。普通免费用户暂时只能在新模型灰度范围的子集里体验,想要完整 3.8 建议直接走下面的 AI Studio。
2. AI Studio 免费体验(最推荐先试)
浏览器打开 aistudio.google.com,左侧模型列表选 gemini-3.8-flash,直接在对话框里试。适合先感受它跟 3.7 的差距——丢一段你平时写不顺的代码让它重构,或者扔一篇长文档让它做多步分析,比看跑分直观得多。
3. Gemini API 接入(开发者)
在 AI Studio 里点 Get API key 生成密钥,然后按 OpenAI 兼容思路调用(endpoint 不同,但都是 REST):
1 | curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \ |
模型名写 gemini-3.8-flash 即可。生产环境建议开付费档:上下文缓存能把长对话成本打下来,Batch API 再省 50%。国内团队如果不想直连 Google 的 API,可以留意各家云厂商的模型网关是否已上架——通常发布会后一两周内就会跟进。
4. Antigravity(Agent 编程场景)
Antigravity 是 Google 的 Agent-first 编程环境(antigravity.google),3.8 Flash 发布当天就接入了。想体验「模型 + 长程代码智能体」完整效果的同学,直接用它比裸调 API 省事——官方演示里一个简单 prompt 加一条循环指令,模型自己就把一个小游戏做出来了。
选型建议
| 你的情况 | 建议 |
|---|---|
| 重度 API 用户,在乎成本 | 年底前切 3.8 Flash,intro 价是 3.7 的水平,性能高一截 |
| 追求最低延迟/极致省 token | 保留 3.7 Flash 或调低 effort 档位 |
| 做金融/法律/分析类 Agent | 3.8 Flash 是当前性价比最优解之一,专业领域评测直接对标旗舰 |
| 免费体验 Gemini | AI Studio 选 3.8 Flash,别再用默认旧模型 |
| 与 Claude Opus / GPT-5.6 / Muse Spark 1.3 对比 | 各有胜负:追求绝对顶配看旗舰,追求「八成能力两成价格」看 3.8 Flash |
一句话:3.8 Flash 不是来取代旗舰的,是来把旗舰的能力门槛打下来的。如果你的应用过去因为 API 成本放弃了长程 Agent 方案,现在值得重新算一遍账。
FAQ
Q1:Gemini 3.8 Flash 免费吗? AI Studio 有免费额度,输入输出不收费但有限流;Gemini App 里 AI Pro/Ultra 订阅用户可直接用。API 付费档 2026 年底前是 $0.75/$3.75 每百万 Token 的优惠价。
Q2:和 3.7 Flash 有什么区别? 同一价格,编码、智能体、专业推理全面提升;代价是高 effort 档可能多用 token。追求省 token 可以继续用 3.7,官方会持续支持。
Q3:输出价格含思考 Token 是什么意思? 很多模型的思考过程单独计费,3.8 Flash 的输出价 $3.75 已包含思考 Token,不会出现「回答 1 分钱、思考 5 毛钱」的账单惊吓。
Q4:3.8 Flash Cyber 普通人能用吗? 不能。它只通过 Fairwind Program 对政府、关键基础设施运营方等受信任防御方开放,普通开发者用不到。
Q5:国内能用 Gemini 3.8 Flash 吗? AI Studio 和 Gemini API 在国内无法直接访问,需要稳定的国际网络环境;接入后注意用支持跨境访问的线路。文末列了几家我自己在用的加速服务。
Q6:现在切换会不会不稳? 新模型刚发布的前几天偶有限流和灰度波动,生产环境建议先小流量验证再全量切换;个人体验完全没影响。
总结
Gemini 3.8 Flash 是 Google「三周一代」节奏下最务实的一次更新:不涨价、不加戏,把编码和智能体能力实打实往前推了一档,还留了 3.7 当省电模式。年底前的 intro 价格让它的性价比暂时没有对手——开发者现在切过去,等于用 3.7 的预算提前跑上接近旗舰的能力。
Gemini 系列之前的文章也整理好了,按需取用:Gemini 2026 年 7 月大更新(3.6 Flash + 任务自动化)、Gemini 入门指南、2026 主流 AI 编程工具对比。
最后提醒一句:用 Google 系模型 API 和工具,稳定的国际网络是刚需——下面几家跨境网络加速服务我自己在用,按需选:
| 服务商 | 特点 | 直达 |
|---|---|---|
| 光速云 | IEPL 专线 + IEPL专线 多路复用,晚高峰稳,主力推荐 | 👉 访问光速云官网 |
| 飞猫云 | IEPL + 住宅 IP,多区解锁表现好 | 👉 访问飞猫云官网 |
| 飞猫云 | 自有机房 IEPL,老牌稳定,年付划算 | 👉 访问飞猫云官网 |
| 微风网络 | 低价入门,¥6.99/月起,全球 80+ 地区 | 访问微风网络官网 |