快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期四 · 09-03 23:31 约 2 分钟读完

谷歌低调发布Gemini 3.8 Flash,聚焦软件工程与智能体任务

摘要

谷歌于9月2日悄然上线Gemini 3.8 Flash模型,基于3.7 Flash升级,优化软件工程与智能体工作流性能,支持1M token上下文。官方尚未正式官宣,但已公布多项基准测试结果,面向个人、开发者与企业用户提供低成本大规模部署能力。

谷歌于9月2日在Google DeepMind网站悄然发布了Gemini 3.8 Flash模型,未通过新闻稿或社交媒体进行正式官宣。该模型基于此前推出的Gemini 3.7 Flash,主要针对软件工程和智能体知识工作流场景进行了性能优化,并延续了可定制的努力水平机制,允许用户在质量、成本和延迟之间灵活取舍。

在技术规格方面,Gemini 3.8 Flash支持最高1M token的上下文窗口,文本输出能力上限为64K token。谷歌同步公布了涵盖编程、知识处理、多模态理解、长上下文推理、计算机使用以及科学推理等多个维度的基准测试结果,数据截至2026年9月,但未在发布页面中展示具体数值明细。

该模型定位明确,面向个人开发者、企业客户以及各类智能体应用场景,主打以较低成本进行通用型、生产级智能体的大规模部署。典型用途包括软件工程辅助、复杂知识处理流程以及各类自动化任务执行,强调可直接投入实际业务环境的生产力属性。

谷歌同时坦承了该模型存在的局限性,包括基础模型常见的幻觉问题,以及在高推理强度下可能出现的响应延迟或超时现象。为提升安全性,谷歌表示正持续加强模型对越狱攻击的防御能力,并在前沿安全防护领域追加了更多技术投入。

值得注意的是,Gemini 3.8 Flash在较高推理强度下可能会消耗更多token资源,这意味着用户在实际部署中需根据任务复杂度权衡推理成本与输出质量。目前该模型已可在Google DeepMind平台访问,但官方尚未发布完整的开发者文档或API接入指南。

谷歌GeminiAI模型智能体
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词