IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。
不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。
Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。
截至 2026 年 9 月的结果如下:

根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括软件工程、智能体任务以及复杂的知识处理流程。
Gemini 3.8 Flash 也存在可能产生幻觉等基础模型常见的一些局限。谷歌正持续提升模型抵御越狱攻击的能力,近期还进一步加强了前沿安全领域的防护措施。
模型偶尔可能出现响应较慢或超时的情况。为了获得更好的性能,Gemini 3.8 Flash 有时会消耗更多 token,尤其是在较高推理强度下。
Gemini 3.8 Flash 的知识截止日期为 2026 年 3 月。部分领域的信息可能更新得更晚,另一些领域的知识则可能仍停留在 2025 年 1 月,与 Gemini 3 模型家族一致。
参考
广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家包含外链的文章均包含本声明。