2026 年 9 月 2 日,谷歌在 Google DeepMind 网站上线了 Gemini 3.8 Flash 模型。截至当天发稿,谷歌没有通过新闻稿或社交媒体官宣这一模型。它基于 Gemini 3.7 Flash,官方称其在软件工程与智能体知识工作流方面有性能提升,并支持可定制的努力水平,用于控制质量、成本与延迟的组合。
模型规格
- 上下文窗口最高 1M token,文本输出支持 64K token
- 知识截止日期为 2026 年 3 月;部分领域信息更新更晚,另一些领域仍停留在 2025 年 1 月,与 Gemini 3 模型家族一致
- 官方公布的基准测试覆盖编程、知识处理、多模态、长上下文、计算机使用与科学推理六类能力
适用场景
Gemini 3.8 Flash 面向个人用户、开发者和企业,定位是以较低成本大规模部署通用型、可直接用于生产环境的智能体。典型用途包括软件工程、智能体任务以及复杂的知识处理流程。
已知局限
谷歌同时披露了模型的局限:可能产生幻觉;偶尔出现响应较慢或超时;在较高推理强度下会消耗更多 token。公司表示正在持续提升模型抵御越狱攻击的能力,并加强了前沿安全领域的防护。
小结
Gemini 3.8 Flash 是谷歌 Flash 系列的新一代轻量模型:1M 上下文窗口、64K 输出、知识截止 2026 年 3 月,主打低成本部署生产级智能体。开发者在软件工程与智能体类任务上做模型选型时,可以把它的成本与性能组合作为实测对象,同时接受幻觉、响应波动等基础模型的固有局限。