谷歌于9月2日在Google DeepMind网站上线了Gemini 3.8 Flash模型。该模型基于Gemini 3.7 Flash开发,在软件工程和智能体知识工作流方面实现性能提升,并延续了可定制的努力水平功能,允许用户根据需求调整质量、成本和延迟的组合。截至发稿时,谷歌尚未通过官方新闻稿或社交媒体渠道正式宣布该模型的存在。
Gemini 3.8 Flash支持最高1M token的上下文窗口,文本输出能力为64K token。谷歌公布了多项基准测试评估结果,覆盖编程、知识处理、多模态能力、长上下文处理、计算机使用及科学推理等领域。模型面向个人用户、开发者和企业,定位为低成本、大规模部署通用型生产级智能体,典型应用场景包括软件工程、智能体任务及复杂的知识处理流程。
官方介绍指出,Gemini 3.8 Flash仍存在基础模型常见的幻觉局限。谷歌方面正持续提升模型抵御越狱攻击的能力,并加强了前沿安全防护措施。模型偶尔可能出现响应较慢或超时情况,且在高推理强度下会消耗更多token。该模型的知识截止日期为2026年3月,部分领域信息可能更新较晚,另一些领域则停留在2025年1月,与Gemini 3模型家族保持一致。
此次低调发布延续了谷歌在AI模型迭代上的高频节奏。Gemini 3.8 Flash的推出进一步丰富了其Flash系列产品线,为开发者和企业用户提供了在性能与成本之间更灵活的选择空间。随着模型逐步被市场采用,其在软件工程和智能体场景中的实际表现将受到关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。