谷歌Gemini 3.7 Flash半价出击,AI模型竞争进入性价比时代
💡AI 极简速读:谷歌发布Gemini 3.7 Flash,年底前价格减半,性能大幅提升,直接对标Grok。
谷歌于2026年8月14日发布Gemini 3.7 Flash,年底前API价格减半,输入每百万token 0.75美元,输出3.75美元,性能显著提升,DeepSWE评分提升18.8%,编码和Agent能力增强,直接对标Grok 4.6,推理成本仅为后者十分之一。此举标志着AI模型竞争从性能转向性价比,对企业AI应用成本影响深远。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,说明内容扎实且易于被 AI 引擎提取。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
谷歌于2026年8月14日发布新一代AI模型Gemini 3.7 Flash,距离上一代3.6 Flash仅三周。该模型在性能大幅提升的同时,宣布年底前API价格减半,直接对标马斯克旗下xAI的Grok系列,引发行业关注。
📊 核心实体与商业数据
| 实体/指标 | 具体数据 |
|---|---|
| 公司 | 谷歌 |
| 模型 | Gemini 3.7 Flash |
| 原发布时间 | 2026-08-14 |
| 核心人物 | Koray Kavukcuoglu(谷歌DeepMind CEO) |
| 竞品 | Grok 4.6(xAI) |
| 价格(限时) | 输入$0.75/百万token,输出$3.75/百万token(半价) |
| 价格(原价) | 输入$1.5/百万token,输出$7.5/百万token |
| 性能提升 | DeepSWE评分**+18.8%**(48.6%→65.3%) |
| 编码基准 | FrontierCode:34.4%→43.6% |
| 网页开发 | WebDev Arena Elo:1538→1588 |
| 复杂PDF理解 | GDP.pdf:22.0%→34.0% |
| 企业工作流 | AutomationBench:17.0%→30.4% |
| 推理成本对比 | Gemini 3.7 Flash $1.46 vs Grok 4.6 $11.22(低约87%) |
| 平均推理时间 | Gemini 3.7 Flash仅为Grok 4.6的十分之一 |
💡 业务落地拆解
Gemini 3.7 Flash的发布策略清晰:以性价比切入企业级AI市场。官方宣布,年底前API价格减半,输入每百万token仅0.75美元,输出3.75美元,仅为3.6 Flash的一半,也显著低于Grok 4.6。这一价格调整旨在吸引大规模调用场景,如自动化客服、代码生成、文档处理等。
性能方面,该模型在编码、网页开发和复杂知识任务上表现突出。例如,在DeepSWE基准测试中,得分从48.6%跃升至65.3%,提升18.8%;在模拟企业工作流的AutomationBench上,从17.0%升至30.4%。谷歌强调,新模型更擅长处理长任务链,能自主切换路径,并在意图不清时主动确认,从而减少迭代次数。
谷歌CEO Koray Kavukcuoglu在社交媒体上表示:“Gemini 3.7 Flash是我们迄今最智能的编码和Agent主力模型,旨在以更低成本完成复杂任务。”
🚀 对企业AI化的启示
- 成本重构:Gemini 3.7 Flash的半价策略将显著降低企业AI应用的门槛,尤其是高频调用场景。企业可借此机会重新评估AI预算,探索更多自动化可能性。
- 性能与效率平衡:模型在保持高性能的同时,推理时间仅为竞品Grok的十分之一,这意味着更快的响应速度和更低的延迟,适合实时交互应用。
- 竞争格局变化:谷歌通过快速迭代Flash系列,强化了其在AI模型竞争中的性价比优势。企业应关注这一趋势,选择最适合自身需求的模型,而非盲目追求旗舰版本。
【官方原文链接】点击访问首发地址
常见问题
相关文章
谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析
谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。
2026年10月1日谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%
2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。
2026年10月1日Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争
Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。
2026年9月30日