Gemini 3.5 Pro还在“即将上线”的状态里悬着,谷歌已经确认下一件更重要的事:Gemini 4的预训练已经启动。

7月21日,Alphabet Q2 2026财报电话会议上,CEO桑达尔·皮查伊披露了Gemini 4的最新进展。这不是画饼——训练已经开始,被内部定义为“迄今最雄心勃勃的训练项目”和“史上最激进的一次预训练”。

算力优先供给AGI:TPU分配的第一优先级

当分析师问及如何平衡内部研发与外部客户对TPU的需求时,皮查伊的回答非常直接:在TPU算力分配上,谷歌的首要任务是确保前沿AGI开发所需的资源。AGI研发是“一切工作的基础”。

这背后的逻辑很清晰:谷歌正在将算力资源向下一代模型倾斜,而非在Gemini 3.5 Pro上继续消耗时间。皮查伊表示,Gemini 4将需要一个“更大的基础模型”来参与前沿竞争。结合谷歌将2026年资本开支预期上调至2050亿美元,算力投入正在加速转化为模型能力的储备。

目标:几乎每月发布一个新模型

皮查伊同时给出了一个明确的迭代节奏目标——实现“几乎每月发布一个新模型”的交付频率。

这个目标在当前的AI竞赛中并不激进。OpenAI和Anthropic都在以类似节奏推送新版本,谷歌3.x Flash系列已经在按季度更新:3.5 Flash(5月)→ 3.6 Flash(7月)。Flash-Lite和Cyber作为补充线也在同步推进。

为什么是现在?Gemini 3.5 Pro的延期与战略转向

Gemini 3.5 Pro原定6月发布,至今仍停留在“与合作伙伴测试”阶段。彭博社此前报道,3.5 Pro因代码能力不达标被内部压住,团队尝试补救后结果仍不理想。

在Pro延期的情况下直接宣布Gemini 4开练,释放的信号很明确:谷歌正在把资源从“修补当前代际”转移到“押注下一代”。Flash系列负责抢占AI Agent市场,Gemini 4负责守住AGI前沿。这是战略重心的一次明确转移。

Flash三连发:为Agent时代铺路

与Gemini 4消息同步,谷歌发布了三款Flash系列模型:

Gemini 3.6 Flash:主力生产基座,输出Token消耗比3.5 Flash平均降低17%,编码场景最高降65%。DeepSWE编码基准从37%提升至49%。定价输入$1.5/百万Token、输出$7.5/百万Token。原生内置Computer Use能力。

Gemini 3.5 Flash-Lite:极致低成本,峰值生成速度350 Token/秒。定价输入$0.3/百万Token、输出$2.5/百万Token。

Gemini 3.5 Flash Cyber:网络安全垂直模型,基于3.5 Flash微调,初期仅面向政府和可信企业。

三款Flash系列覆盖了高吞吐批量任务、通用智能体生产和垂直安全三个赛道,为AI Agent规模化落地铺路。

Gemini 4何时亮相?业内预计2026年11月至12月。按谷歌典型的6个月训练周期推算,时间窗口吻合。距离现在大约4到5个月。

谷歌传递的信号很清晰:不再纠结于Gemini 3.5 Pro的延期,而是把算力和注意力集中在下一代。Flash系列负责当下的Agent市场,Gemini 4负责未来的AGI前沿。当训练周期从“年”压缩到“月”,AI行业的竞争节奏正在被重新定义。