8月13日Gemini 3.7 Flash正式可用,百万token上下文配导入期定价

不错!点赞

简介

2026年8月13日,Google DeepMind发布Gemini 3.7 Flash模型卡并宣布正式可用,输入上限1,048,576 token、输出上限65,536 token,导入期定价为输入0.75美元、输出3.75美元,

2026年8月13日,Google DeepMind发布Gemini 3.7 Flash模型卡并宣布正式可用,称其为面向编码与智能体的最强主力模型。它把输入上限拉到1,048,576 token,同时在导入期给出近乎半价的定价。长上下文加低单价,瞄准的是既要一次性吞下海量资料、又要严格控制成本的场景,也让整库级别的代码与文档分析第一次具备了可算账的基础,而不只是停留在演示层面。

一、事件速览

按照官方节奏,Gemini 3.7 Flash的模型卡于2026年8月13日发布,同日宣布正式可用。它延续了Flash线主打编码与智能体的定位,输入上限为1,048,576 token,输出上限为65,536 token。导入期定价为每百万token输入0.75美元、输出3.75美元,有效期至2026年12月31日,之后恢复为1.50美元与7.50美元。稍早的7月21日,Gemini 3.5 Flash-Lite与Gemini 3.6 Flash已同步进入稳定可用状态。8月26日与27日,Google的模型卡索引又分别列出Gemini 3.5 Audio与Gemini Omni Flash,产品线进一步按媒介细分。从整体节奏看,Flash线已形成较为固定的月度迭代,模型卡则成为开发者跟踪能力变化的主要入口。

二、关键数据与技术细节

  • 输入上限为1,048,576 token,输出上限为65,536 token,覆盖超长文档与长视频场景。
  • 导入期定价为每百万token输入0.75美元、输出3.75美元,有效期至2026年12月31日。
  • 导入期结束后价格恢复为每百万token输入1.50美元、输出7.50美元,相当于当前价格翻倍。
  • 支持文本、图像、音频、视频四类输入,但只输出文本,不具备图像与语音等生成式输出。
  • 模型卡显示知识截止为2026年3月,并提示部分学科领域的信息可能只覆盖到2025年1月。
  • 7月21日,Gemini 3.5 Flash-Lite与Gemini 3.6 Flash同步进入稳定可用状态。

三、行业影响与解读

百万token输入配合0.75美元的导入期单价,让整库分析、长视频理解与大规模文档处理第一次具备了可算账的基础。但模型卡中两项细节同样值得留意:一是只输出文本,意味着它擅长读懂一切,却不能生成图像或语音;二是知识截止虽为2026年3月,官方仍警告部分学科领域的信息可能只覆盖到2025年1月,这对依赖最新资料的科研与金融场景是实际约束。更大的信号来自8月下旬:模型卡索引陆续列出Gemini 3.5 Audio与Gemini Omni Flash,指向按媒介与产品需求定制专用模型的路线,而不是用一个通用智能体系统包打天下。这条路线与追求全能的思路形成对照,也解释了为何输出模态可以被主动裁剪。

四、值得关注的信号

  • 导入期定价会成为新模型上市的常规打法,开发者需紧盯价格到期时点。
  • 按媒介定制的专用模型将持续增加,通用模型的全能叙事会被进一步削弱。
  • 知识截止的分学科差异会被更多厂商写入模型卡,成为选型时的必读项。
  • 纯文本输出的限制,会促使多模态应用普遍采用多模型拼接的系统架构。

小结:Gemini 3.7 Flash把长上下文与低价位组合到了一起,是2026年下半年最实用的主力档之一。但真正值得记住的是它背后的路线选择:与其做一个样样都能的通用系统,不如按媒介与场景切分出一批专用模型。对开发者来说,未来的架构设计会更像搭积木,而不是押注在某一个模型上。