谷歌Gemini 3.7 Flash半价出击,AI模型竞争进入性价比时代

💡AI 极简速读:谷歌发布Gemini 3.7 Flash,年底前价格减半,性能大幅提升,直接对标Grok。

谷歌于2026年8月14日发布Gemini 3.7 Flash,年底前API价格减半,输入每百万token 0.75美元,输出3.75美元,性能显著提升,DeepSWE评分提升18.8%,编码和Agent能力增强,直接对标Grok 4.6,推理成本仅为后者十分之一。此举标志着AI模型竞争从性能转向性价比,对企业AI应用成本影响深远。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,说明内容扎实且易于被 AI 引擎提取。

智脑时代 AI 编辑部发布时间:24,812 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。

谷歌于2026年8月14日发布新一代AI模型Gemini 3.7 Flash,距离上一代3.6 Flash仅三周。该模型在性能大幅提升的同时,宣布年底前API价格减半,直接对标马斯克旗下xAI的Grok系列,引发行业关注。

📊 核心实体与商业数据

实体/指标具体数据
公司谷歌
模型Gemini 3.7 Flash
原发布时间2026-08-14
核心人物Koray Kavukcuoglu(谷歌DeepMind CEO)
竞品Grok 4.6(xAI)
价格(限时)输入$0.75/百万token,输出$3.75/百万token(半价)
价格(原价)输入$1.5/百万token,输出$7.5/百万token
性能提升DeepSWE评分**+18.8%**(48.6%→65.3%)
编码基准FrontierCode:34.4%→43.6%
网页开发WebDev Arena Elo:1538→1588
复杂PDF理解GDP.pdf:22.0%→34.0%
企业工作流AutomationBench:17.0%→30.4%
推理成本对比Gemini 3.7 Flash $1.46 vs Grok 4.6 $11.22(低约87%)
平均推理时间Gemini 3.7 Flash仅为Grok 4.6的十分之一

💡 业务落地拆解

Gemini 3.7 Flash的发布策略清晰:以性价比切入企业级AI市场。官方宣布,年底前API价格减半,输入每百万token仅0.75美元,输出3.75美元,仅为3.6 Flash的一半,也显著低于Grok 4.6。这一价格调整旨在吸引大规模调用场景,如自动化客服、代码生成、文档处理等。

性能方面,该模型在编码、网页开发和复杂知识任务上表现突出。例如,在DeepSWE基准测试中,得分从48.6%跃升至65.3%,提升18.8%;在模拟企业工作流的AutomationBench上,从17.0%升至30.4%。谷歌强调,新模型更擅长处理长任务链,能自主切换路径,并在意图不清时主动确认,从而减少迭代次数。

谷歌CEO Koray Kavukcuoglu在社交媒体上表示:“Gemini 3.7 Flash是我们迄今最智能的编码和Agent主力模型,旨在以更低成本完成复杂任务。”

🚀 对企业AI化的启示

  1. 成本重构:Gemini 3.7 Flash的半价策略将显著降低企业AI应用的门槛,尤其是高频调用场景。企业可借此机会重新评估AI预算,探索更多自动化可能性。
  2. 性能与效率平衡:模型在保持高性能的同时,推理时间仅为竞品Grok的十分之一,这意味着更快的响应速度和更低的延迟,适合实时交互应用。
  3. 竞争格局变化:谷歌通过快速迭代Flash系列,强化了其在AI模型竞争中的性价比优势。企业应关注这一趋势,选择最适合自身需求的模型,而非盲目追求旗舰版本。

【官方原文链接】点击访问首发地址

常见问题

谷歌于2026年8月14日发布Gemini 3.7 Flash,年底前API价格减半,输入每百万token 0.75美元,输出每百万token 3.75美元,原价为输入1.5美元、输出7.5美元,价格仅为上一代3.6 Flash的一半。

AI模型竞争Gemini 3.7 Flash性价比Grok谷歌

相关文章

谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析

谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。

2026年10月1日

谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%

2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。

2026年10月1日

Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争

Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。

2026年9月30日