谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景
📌 概要
谷歌9月2日在DeepMind官网低调上线Gemini 3.8 Flash模型,基于3.7 Flash,主打软件工程与智能体知识工作流性能提升,支持最高1M token上下文和64K输出,可定制努力水平以平衡质量、成本与延迟。官方尚未正式官宣,模型知识截止2026年3月,仍存在幻觉与响应超时等局限。
⚡ 关键要点
- ▸Gemini 3.8 Flash在DeepMind网站低调上线,官方暂未官宣
- ▸主打软件工程、智能体任务与复杂知识处理,适合低成本大规模生产部署
- ▸支持1M token上下文窗口、64K输出,可定制努力水平控制质量与成本
- ▸仍存幻觉、响应超时等局限,知识截止2026年3月
IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。
不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。
Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。
截至 2026 年 9 月的结果如下:

根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括软件工程、智能体任务以及复杂的知识处理流程。
Gemini 3.8 Flash 也存在可能产生幻觉等基础模型常见的一些局限。谷歌正持续提升模型抵御越狱攻击的能力,近期还进一步加强了前沿安全领域的防护措施。
模型偶尔可能出现响应较慢或超时的情况。为了获得更好的性能,Gemini 3.8 Flash 有时会消耗更多 token,尤其是在较高推理强度下。
Gemini 3.8 Flash 的知识截止日期为 2026 年 3 月。部分领域的信息可能更新得更晚,另一些领域的知识则可能仍停留在 2025 年 1 月,与 Gemini 3 模型家族一致。
参考