找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

4442

积分

0

好友

576

主题
发表于 3 小时前 | 查看: 4| 回复: 0

在一个没多少人在意的角落,谷歌又双叒叕发布新模型了。

还是熟悉的配方,还是熟悉的味道。Gemini 3.7 Flash,刚刚发布,距离上一代 Gemini 3.6 Flash 仅仅过去了三周。

Gemini 3.7 Flash API 价格 3.75 美元/百万输出 tokens,不到 Claude Sonnet 5 的 40%。但这个定价不到 Claude Sonnet 5 四成的 Flash 模型,在多项编程和前端开发评测里,打赢了 Claude Sonnet 5GPT-5.6 Terra

Logan Kilpatrick 宣布 Gemini 3.7 Flash 发布,重点介绍速度提升、年末前降价 50% 及 API 平台可用性

而前一天,老马的 Grok 4.6 和老梁的 DeepSeek V4 Pro 正式版也扎堆发布了。


单看中杯模型,Gemini 3.7 Flash 算是比较能打的。

FrontierCode,测试的是生产级代码质量,Gemini 3.7 Flash 得分 43.6%,Claude Sonnet 5 42.7%,GPT-5.6 Terra 41.3%。

DeepSWE(长周期软件工程),Gemini 3.7 Flash 65.3%,略逊于 GPT-5.6 Terra 的 69.6%,不过三周前 Gemini 3.6 Flash 只有 49%,这涨幅属于评测表里最大的了。

FrontierCode 与 DeepSWE 基准测试对比柱状图,Gemini 3.7 Flash 在代码质量与长周期软件工程上表现突出

在 Arena 测评平台 Code Arena WebDev(前端开发)排行榜上,Gemini 3.7 Flash 从上一代的第 19 名涨到了第 8 名,Elo 综合分 1588,超过了 Claude Sonnet 5GPT-5.6 Terra。这里一个邪修玩法是用 Gemini 3.7 Flash 配合谷歌的另一个多模态模型 Gemini Omni 做交互式网页,视觉效果不错。

Code Arena WebDev 排行榜,Gemini 3.7 Flash 以 1588 Elo 分位列第 8 名

Artificial Analysis 大模型综合榜单,Gemini 3.7 Flash 56 分,1 分之差惜败于 GPT-5.6 Terra(57),不过超过了 Claude Sonnet 5(55)和昨天刚刚发布的 DeepSeek-V4-Pro 正式版。

Artificial Analysis 大模型智能综合指数榜单,Gemini 3.7 Flash 得分 56 分

附上一张谷歌官方放出的综合评测表,你们看看就好。

Gemini 3.7 Flash 与主流模型在多维度基准测试上的完整对比表格


然而,谷歌是真没活儿了。毕竟中杯模型再强,也是中杯。

Pro 系列还停留在半年前的 Gemini 3.1 Pro,下一代 3.5 Pro,到现在还没一点影子。今年 5 月 I/O 上谷歌 CEO Sundar Pichai 承诺一个月内上线,6 月由于编程性能不达标延期了,7 月第二次跳票,据爆料谷歌甚至换了训练数据推倒重来。到 8 月,已经没多少人在意它第几次跳票了。

据报道,Gemini 3.5 Pro 在谷歌内部已经被放弃了,大部分团队转向预训练全新的 Gemini 4。也就是说,你等的那个 3.5 Pro,大概率永远不会来了。

Flash 这边三周一更新,越来越能打,Pro 那边三个月没动静。大概率应了这位网友的总结,「他们(谷歌)一直在做 Pro 版本,但每次做出来都达不到当前的 TOP 水平,就一直改名 Flash 发出来。」

Flash 越强,谷歌越尴尬。


Gemini 3.7 Flash 年底前价格打折,输入 0.75 美元/百万 tokens,输出 3.75 美元/百万 tokens,2027 年 1 月起恢复标准定价 1.5 美元/7.5 美元。

打折后的 Gemini 3.7 Flash,还是有一定性价比的。

作为对比,Claude Sonnet 5 输入 2 美元、输出 10 美元,GPT-5.6 Terra 输入 2 美元、输出 12 美元,Grok 4.6 输入 2 美元、输出 6 美元。

涨价后的 DeepSeek V4 Pro 高峰时段输出 4.01 美元,Gemini 3.7 Flash 3.75 美元反而更便宜,综合智商还高了 3 分(56 vs 53)。空闲时段 DeepSeek 仍然是最便宜的选择,输出只要 2.01 美元。

DeepSeek-V4 系列模型 API 定价与功能对比表,含峰谷定价差异与并发限制信息

涨价后的 DeepSeek API 价格。· 这张得划一会儿


那么,Gemini 3.7 Flash 怎么用?

最简单直接的方法是打开谷歌 AI Studio,在模型列表里选 gemini-3.7-flash,如果你在用 Android Studio 开发移动端 App 也已经可以切换了。

Google AI Studio 模型选择界面,Gemini 3.7 Flash 已可用并标记为 New

谷歌自家的 AI 编程工具反重力 Antigravity 同步支持了 Gemini 3.7 Flash,可以简单理解为谷歌版 Cursor,代码生成和调试都能用。

Gemini App 里目前只能通过 Spark 功能使用,需要开通 AI Pro 或 Ultra 订阅。Spark 是谷歌在 I/O 大会上发布的 24 小时个人 AI 智能体,相当于谷歌版云龙虾。


这两天新模型扎堆上线,Grok 4.6DeepSeek V4 Pro 正式版和 Gemini 3.7 Flash

Grok 4.6 综合智商最高(AA 指数 61),纸面战力顶级,但输出 6 美元的价格也是三个新模型里最贵的。DeepSeek V4 Pro 空闲时段最便宜(输出约 2 美元),不过综合得分 53 分不突出,8 月 17 日涨价生效后高峰时段甚至比 Gemini 3.7 Flash 还贵。Gemini 3.7 Flash 卡在中间,不上不下。56 分的综合智商,3.75 美元的输出成本。

卷起来,下一个是谁?更多 AI 模型评测与讨论,欢迎来云栈社区和开发者们一起聊。




上一篇:AI工程技能图谱发布:吴恩达总结四项核心能力,第四项尤其值得关注
下一篇:Wireshark抓包分析教程:过滤器设置与TCP三次握手实战
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-8-19 21:40 , Processed in 0.857736 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表