Google发布Gemini 3.6 Flash等新模型 提升效率降低成本助力AI代理

6 阅读3分钟前沿
Google发布Gemini 3.6 Flash等新模型 提升效率降低成本助力AI代理

新模型概览

  • Gemini 3.6 Flash:定位为工作马力模型,提升编码、知识工作和多模态表现,输出令牌使用比 3.5 Flash 下降 17%。
  • Gemini 3.5 Flash‑Lite:3.5 系列中最快的模型,吞吐达 350 token/秒,成本最低。
  • Gemini 3.5 Flash‑Cyber:专为网络安全设计,搭配 CodeMender 安全代理,面向政府和可信合作伙伴的限量试点。

性能提升

  • Artificial Analysis Index 基准上,3.6 Flash 在 DeepSWE 等测试中提升 65% 效率。
  • 3.5 Flash‑Lite 在 Terminal‑Bench 2.1GDM‑MRCR v2 等任务中分别提升 54%12%
  • 3.5 Flash‑Cyber 在业界主流安全基准 CyberGym 上达到前沿水平,能够快速定位并修复代码漏洞。

价格与成本优势

  • Gemini 3.6 Flash:$1.50/1M 输入令牌,$7.50/1M 输出令牌,整体成本低于前代模型。
  • Gemini 3.5 Flash‑Lite:$0.3/1M 输入令牌,$2.5/1M 输出令牌,适合高吞吐生产环境。
  • Gemini 3.5 Flash‑Cyber:针对安全场景定制价格,限量向政府及受信合作伙伴开放。

安全与合规

  • 3.6 Flash 引入了针对化学、生物、放射、核(CBRN)以及网络攻击的前沿安全防护,显著提升抗越狱能力。
  • 模型内置计算机使用工具,可在 Gemini API 与 Gemini Enterprise 平台上安全调用,实现代码执行、文档解析等多模态任务。

生态与可用性

  • 3.6 Flash 与 3.5 Flash‑Lite 已在 Gemini API、Google AI Studio、Android Studio 以及 Gemini Enterprise 应用中上线。
  • 3.5 Flash‑Cyber 将通过 CodeMender 在政府和可信合作伙伴的限定试点中提供,帮助前线防御者提前发现并修复关键漏洞。

“我们希望通过更高的令牌效率和更低的延迟,让开发者能够在大规模代理工作流中实现更佳的性价比。”——Tulsee Doshi,Gemini 项目高级总监

随着 Gemini 4 的前期预训练已启动,Google 正在为下一代模型奠定基础,业界可期待在多模态理解与安全合规方面的持续突破。

本文是对第三方新闻源的主观解读。消息可能出现过时、不准确、歧义或错误的地方,仅供参考使用。点击此处查看消息源。