谷歌表示,Gemini 3.6 Flash 在维持 Gemini 3.5 Flash 定价的同时提升了效率和代码能力,而 Gemini 3.5 Flash-Lite 则面向高并发工作负载。与此同时,桑达尔·皮查伊为更广泛的 Gemini 路线图辩护。
谷歌于 7 月 22 日发布 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite,为其产品线新增了一个效率更高的 Flash 模型,以及一个面向高并发工作负载的更快选项。谷歌表示,Gemini 3.6 Flash 在与 Gemini 3.5 Flash 相同价格下提升了输出质量,将平均 token 消耗降低约 17%,在 DeepSWE 场景中最高可减少 65% 的使用量,并将智能体任务平均耗时从 2.7 分钟缩短至 1.3 分钟,同时将单任务成本从 $0.59 降至 $0.50。Alphabet 首席执行官桑达尔·皮查伊还在财报电话会上表示,Gemini 3.6 Flash 在一项代码基准测试中的表现提升超过 10 分,同时使用了更少的 token;他并强调,Flash 系列适用于网络安全、客服智能体、数据分析和企业软件。Gemini 3.5 Flash-Lite 的定位是高并发任务,输出速度最高可达每秒 350 个 token。此次发布正值投资者关注 Gemini 3.5 Pro 延期之际;该产品原定于 6 月推出,但错过计划时间后仍处于合作伙伴测试阶段。投资者同时也关注皮查伊关于 Gemini 4 发布可能接近按月推进的表态。