Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber
摘要
Google DeepMind 发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,旨在以更高效率和更低成本支持 AI Agent 的规模化构建。
核心要点
- Gemini 3.6 Flash 输出 token 消耗比 3.5 Flash 减少 17%,价格降至 $1.50/1M 输入 token 和 $7.50/1M 输出 token。
- 3.6 Flash 在 DeepSWE 基准上从 37% 提升至 49%,在 MLE Bench 上从 49.7% 提升至 63.9%,OSWorld-Verified 从 78.4% 提升至 83.0%。
- Gemini 3.5 Flash-Lite 输出速度达 350 token/秒,价格为 $0.3/1M 输入 token 和 $2.5/1M 输出 token,在 Terminal-Bench 2.1 上从 31% 提升至 54%。
- 3.5 Flash-Lite 支持配置思考级别,以平衡延迟和成本,并内置计算机使用工具。
- Gemini 3.5 Flash Cyber 是专用网络安全模型,与 CodeMender 代理结合,提供前沿性能。
原文佐证
- 3.6 Flash consuming 17% fewer output tokens than 3.5 Flash.
AI 洞察
DeepMind 此次发布标志着模型竞赛从单纯追求性能转向兼顾效率与成本,尤其是 Agent 场景下的 token 优化。这一趋势将加速 AI 应用的规模化落地,并可能促使其他厂商跟进类似策略。同时,安全的强化表明前沿模型正更注重防御滥用。