旗舰模型能力不达标而跳票,不仅让股价承压,也让外界对谷歌的AI竞争力捏了一把汗。但谷歌没有停下脚步——它转头连发三款新模型,试图在另一个战场上稳住阵脚。
主力Flash升级:更省Token,更好用
新发布的核心是Gemini 3.6 Flash,在上一代基础上重点提升了代码编写、知识工作和多模态理解能力。它最大的变化不是参数,而是“效率”——根据Artificial Analysis Index的测算,3.6 Flash的输出Token使用量比3.5 Flash减少了17%,在复杂的编码任务中最多可节省65%。
价格也相应下调:输入每百万Token 1.50美元,输出7.50美元,较前代输出价格降低约17%。性能提升同样明显:DeepSWE编程测试得分从37%升至49%,MLE-Bench机器学习基准从49.7%提升至63.9%。
专用模型补齐安全短板
另外两款模型各有侧重。Gemini 3.5 Flash-Lite主打高吞吐、低延迟场景,每秒可生成350个输出Token,面向需要大规模部署AI智能体的企业用户。Gemini 3.5 Flash Cyber则是针对网络安全漏洞检测与修复进行微调的专用模型,初期仅向政府机构和经认证的合作伙伴开放。
旗舰Pro缺席,内部焦灼
三款模型齐齐亮相,唯独不见旗舰Gemini 3.5 Pro的身影。据彭博社报道,该模型原计划今年6月发布,但因编程能力未达内部预期而数次推迟,目前已比原计划落后数月。谷歌上月底更新了训练数据以提升编程表现,但效果并不理想。消息公布后,谷歌母公司Alphabet股价一度跌超4%。
多名现任及前员工透露,延期已引发内部不满,担忧谷歌正在被Anthropic和OpenAI拉开差距。谷歌庞大的组织架构也拖慢了节奏——搜索、地图、YouTube等多部门需层层协调,云、DeepMind和Android团队各自推进AI编程工具,资源竞争加剧了效率问题。
下一步:Gemini 4已启动预训练
谷歌发言人在回应中表示,公司正在“快速推出一系列模型”,同时兼顾成本效益,3.5 Pro正在与合作伙伴测试。更值得关注的是,谷歌DeepMind团队透露,下一代模型Gemini 4的预训练工作已经启动。旗舰Pro仍在赶工,下一代已悄然起跑——谷歌的AI牌局,还在继续。

