


我们推出了新的 Gemini 模型,包括 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。我们最新的 Gemini 模型提供了构建大规模 AI 智能体所需的效率、低延迟和可靠性。
Gemini 3.6 Flash 系列是谷歌推出的全新 AI 模型系列,包括 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。这些模型旨在提供构建大规模 AI 智能体所需的高效性、低延迟和可靠性。基于 Gemini 3.5 Flash 的成功经验,该系列专注于更高的 Token 效率、更低的延迟以及更可靠的性能,适用于生产级智能体工作流。
Gemini 3.6 Flash 在编码、知识工作和多模态性能方面均有提升,同时相比 3.5 Flash 将输出 Token 使用量减少了 17%。它通过更少的推理步骤和工具调用实现这一目标,使多步骤工作流更具成本效益,输入 Token 价格为 $1.50/百万,输出 Token 价格为 $7.50/百万。
根据 Artificial Analysis 指数,该模型每秒可输出 350 个 Token,是 3.5 级别中最快的模型。它在智能体工作流中的表现显著优于之前的 Flash-Lite 版本,同时保持低成本。
这是一款专注于网络安全的专业模型,与 CodeMender 代码安全智能体配合使用,专为需要将模型与智能体基础设施精心协调的成功网络安全应用而设计。它在代码安全前沿领域展现出具有竞争力的性能。
"与 3.5 Flash 相比,3.6 Flash 将输出 Token 使用量减少了 17%,同时每个输出 Token 的成本更低。"
这一效率提升令人瞩目,因为它伴随着多个基准测试的性能改进。3.6 Flash 在代码编辑的 DeepSWE 上达到 49% vs. 37%,在机器学习研究的 MLE Bench 上达到 63.9% vs. 49.7%,在计算机使用的 OSWorld-Verified 上达到 83.0% vs. 78.4%。更低的成本、更少的 Token 和更好的结果相结合,使该系列特别适合在生产环境中扩展智能体工作流。
你正在构建生产级 AI 智能体,并且需要一个在效率、延迟和可靠性之间取得平衡的模型系列。如果你从事编码任务、知识工作、多模态应用或网络安全工作流,且 Token 效率和成本控制至关重要,那么 Gemini 3.6 Flash 系列尤其值得探索。
其他您可能感兴趣的工具
Loading comments…
制作者
sandbyte
访问网站
blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
项目信息
产品关键词