摘要
一口气三连,谷歌这波是真的不装了。 今天,谷歌DeepMind连放大招,一次性摆出三张王牌: Gemini 3.6 Flash Gemini 3.5 Flash-Lite Gemini 3.5 Flash Cyber 一个更强的主力、一个更快的轻量款、一个专修漏洞的安全特种兵。 三款Gemini指向的是同一件事:让跑在生产环境里的AI Agent,更快、更聪明、更便宜。 而就在发布的同一天,谷歌还顺手扔下了一枚更大的雷—— 谷歌DeepMind「史上最激进的一次预训练已经开始」,目标是下一代模型Gemini 4。 一边是Gemini三连发,一边是Gemini 4开跑。 谷歌传递的信号再清晰不过,AI这场终极牌局,好戏才刚刚开始。 谷歌深夜放大招 三款Gemini齐发 三款Gemini,接下来一一拆解。 Gemini 3.6 Flash,暴省65% Token 先来看这次真正的「C位」——Gemini 3.6 Flash。 它这次主打一个亮点,巨省Token。 按Artificial Analysis Index的测算,相比上一代3.5 Flash,它的输出Token少用17%。 在DeepSWE这类编码基准上,最高能省下65%。 不光少吐字,它完成一个多步任务需要的推理步骤和工具调用也更少,绕的弯路更短,等于又快又省。 不仅如此,Gemini 3.6 Flash在省Token的同时,价格还更低了: 输入1.5美元、输出7.5美元每百万 Token,比3.5 Flash更便宜。 更省、更便宜,还得更能打,这才叫诚意。3.6 Flash在几条关键测试上,都甩开了前代—— DeepSWE:编程测试 37% ➔ 49% MLE Bench:机器学习研究测试49.7% ➔ 63.9% OSWorld-Verified:让模型直接操作电脑测试78.4% ➔ 83% GDPVal-AA v2:知识型工作任务拿下了1421份,比上一代高出70多分 如下demo中,3.6 Flash大秀多智能体编排绝活,不仅轻松拿下复杂的代码迁移任务,更在响应速度、代码质量上对3.5 Flash完成了降维打击。