摘要:8月10日,谷歌Python GenAI SDK的GitHub页面出现“gemini-3.7-flash”模型选项,距3.6 Flash正式发布(7月21日)不到一个月。内部员工试图通过Copybara工具同步代码被拒绝,但下一代Flash模型已在准备中。Flash系列平均约两个月迭代一代,外界推测3.7 Flash或于近期亮相。
7月21日,谷歌刚刚将Gemini 3.6 Flash推向市场。不到三周后,下一代产品的踪迹就已经出现在了公开代码库里。
8月10日,科技媒体TestingCatalog发现,谷歌Python GenAI SDK的GitHub页面中,悄然出现了一行新代码——"gemini-3.7-flash"被添加到了模型选项枚举中。
一名谷歌内部员工试图通过Copybara工具将这一改动同步至公开代码仓库,但因模型命名错误被系统直接拒绝并关闭了提交。提交被拦下了,但“3.7 Flash正在路上”这个信号已经留在了公开记录里。
不到三周,从3.6到3.7
Gemini 3.6 Flash于7月21日正式发布,是谷歌当日一口气推出的三款新模型中的主力款。相比前代,3.6 Flash在编码基准DeepSWE上从37%提升至49%,多模态OSWorld从78.4%提升至83.0%。这款模型主打的是“效率、低延迟与稳定性”,面向大规模AI智能体运行场景。
从3.6到3.7,间隔不到一个月。外界推测这与谷歌Flash系列的高频迭代节奏有关——该系列平均约两个月更新一代。如果按这个节奏推算,3.7 Flash可能在9月至10月之间正式亮相。
但3.7 Flash的“冒头”也引出了一个尴尬的事实:Gemini 3.5 Pro至今仍未发布。
这款旗舰模型最初计划6月推出,此后一再延期。有爆料称3.5 Pro原定8月10日发布,但可能连8月也赶不上了。彭博此前披露,3.5 Pro目前仍在与合作伙伴进行测试。
一边是旗舰模型迟迟无法交付,另一边是轻量级产品线以每月一代的速度向前推进。谷歌在模型发布节奏上的两线策略,正在形成越来越大的时间差。
为什么Flash系列需要跑这么快?
Flash系列是谷歌Gemini家族中主打高性价比与快速响应的轻量级产品线。它的定位很明确:不是跟Claude Opus或GPT-5.6 Sol争“最强模型”的头衔,而是在保证可用智能水平的前提下,把延迟和成本压到最低。
TestingCatalog在报道中写了一句很直白的判断:“鉴于OpenAI和其他实验室最近发布的众多产品,Gemini Flash要想取得成功,就必须大幅提高标准。”
这句话点出了Flash系列必须高速迭代的外部压力。OpenAI在7月31日刚刚将GPT-5.6 Luna降价80%,输入价格砍到每百万Token 0.2美元。降价后的Luna在性价比上直接对标甚至反超了DeepSeek V4 Pro。而Flash系列恰恰是谷歌在“高性价比、快速响应”这个象限里的主力产品——这个象限的竞争,正在变得比“最强模型”的战场更加激烈。
一次“失败”的提交,提前三个月泄露了路线图
一个被拒绝的代码提交,本身不值一提。但它暴露的信息比一次正式发布更多:3.7 Flash不是“在考虑中”,而是已经进入了SDK级别的准备阶段。模型名称、API枚举、代码结构都已经就位,只差最后的测试和官宣。
从3.6到3.7,间隔不到一个月。谷歌正在用Flash系列的高速迭代,向市场传递一个信号:在“够快、够便宜”这个战场上,它不打算给竞争对手留下任何喘息的空间。至于3.5 Pro什么时候能赶上这趟车——那是另一个问题。

