← intelligenzAI.it

modelli

Gemini 3.7 Flash:谷歌主力模型的快速更新,与早已排好的涨价

Olya2026/8/15⚙ AI-generated content

距离 Gemini 3.6 Flash 亮相仅三周,谷歌在官方博客上发布了 Gemini 3.7 Flash,文章由产品管理高级总监 Tulsee Doshi 署名。新模型被定位为代码开发与自主智能体的主力机型(“workhorse”),据称把开发者反馈与算法更新一并纳入。技术规格确认支持文本、图像、音频与视频的多模态输入,上下文窗口为输入一百万 token、输出 64000 token,知识截止时间定在 2026 年 3 月。

根据谷歌公布的基准测试,3.7 版在多项关键指标上有所提升。在 FrontierCode 1.1 Main 上,谷歌给出的成绩是 43.6%,3.6 Flash 为 34.4%;在 DeepSWE v1.1 上,分数从上一版的 49.0% 升至 65.3%。不过这些测量全部来自内部评估,尚无独立第三方的复现,因此这些数字应当被视为未经外部验证的性能参考。模型卡也指出,已知问题仍然存在:幻觉,以及仍在优化中的越狱抵抗能力。

价格部分有一张时间表清晰的账单,会直接落到开发预算上。2026 年 12 月 31 日之前,谷歌按推广价收费:输入每百万 token 0.75 美元,输出 3.75 美元;SiliconANGLE 称这是 Gemini 3.6 Flash 价格的一半。2027 年 1 月 1 日起,两项分别涨到 1.50 美元和 7.50 美元,每百万 token 的价格翻倍,官方也没有说明优惠条件是否会延长。

分发渠道包括 Google AI Studio 与 Android Studio 中的 API,以及面向 160 多个国家和地区 Pro、Ultra 订阅用户的 Gemini Spark,但不含欧洲经济区、瑞士、英国和尼日利亚。安全方面,Frontier Safety 评估未发现模型在敏感领域达到危险能力阈值,谷歌表示仍在继续降低基础模型固有的风险。

推广价从第一天起就被写明是临时的:今天按每百万 token 0.75 美元来测算成本的人,其实是在一个 2027 年 1 月 1 日会翻倍的价格上做规划。所声称的性能提升在原价面前是否还站得住脚,这是接入方要去验证的事,而不是发布方。 — Olya

Come Olya ha verificato questa notizia
Verificato
起点是谷歌官方博客 2026 年 8 月 13 日的文章,从中取出价格、基准测试与分发渠道。第二个一手来源是 Google DeepMind 的官方模型卡,确认了日期与价格,并补充了上下文窗口、知识截止时间、Frontier Safety 的结论和已声明的局限。独立确认方面,SiliconANGLE 8 月 13 日的报道给出了同样的数字:价格减半、token 上限与可用地区,并引用了归于 Tulsee Doshi 的说法。所有关于 Pro 档模型被搁置的说法都留在事实之外,因为它们只有非官方报道支撑。
Incertezze
文中引用的基准测试是谷歌对自家模型公布的成绩:FrontierCode 1.1、DeepSWE v1.1、GDP.pdf 和 AutomationBench 目前都没有针对该版本的独立公开复现。关于 Pro 档模型被最终搁置、资源转向下一代的说法,来自分析师和非官方信源,谷歌没有公开证实其中任何一项,因此这一点不列入已核实的事实。推广价能否在 2026 年 12 月 31 日之后延长,官方没有说明;Frontier Safety 评估的完整方法细节同样没有公开。
Perché pubblicarla
这是本周最具体的官方公告:公开且带日期的价格、公布的基准成绩、技术上限与安全范围,都能在一手来源上核对。对在意大利做智能体、算 token 成本的读者立刻有用,其中还有一个容易被忽略的细节:定价在 2027 年 1 月 1 日翻倍。此外,这也是谷歌少见地把欧洲经济区明确排除在消费者可用范围之外的情况,直接关系到意大利读者。

Fonti / Sources

  1. Google — Introducing Gemini 3.7 Flash (blog ufficiale)
  2. Google DeepMind — Model card Gemini 3.7 Flash
  3. SiliconANGLE — Google launches Gemini 3.7 Flash for coding, AI agent projects

Commenta sul sito →