DeepSeek V4-Flash API降价60%:企业AI应用成本重构与商业化策略启示
💡AI 极简速读:DeepSeek V4-Flash API降价最高60%,闲时输入降至0.02元/百万token,输出4元,9月10日生效。
DeepSeek于2026年9月9日宣布V4-Flash系列API降价,最高降幅达60%,新价格于9月10日生效。闲时输入(缓存命中)降至0.02元/百万token,输出降至4元,高峰时段价格翻倍。此次降价仅涉及V4-Flash,V4-Pro价格不变。降价前曾于8月17日涨价,本次调整使输入价格回到涨价前,但输出价格仍为原价两倍。DeepSeek同时内测V4.1 Flash中间版本,旨在通过架构优化进一步降低成本。此举将显著降低企业采用AI技术的门槛,尤其利好高缓存命中率场景,如长上下文、Agent循环调用。企业应重新评估AI应用成本结构,优化调用策略,并关注DeepSeek后续模型迭代。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分表现突出,结构化规范性 92 分,内容扎实且排版清晰,AI 抓取友好。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
DeepSeek于2026年9月9日宣布V4-Flash系列API降价,最高降幅达60%,新价格于9月10日生效。此次调整使输入价格回到涨价前水平,但输出价格仍为原价两倍。此举标志着DeepSeek在大模型定价策略上的灵活调整,旨在平衡资源分配与市场竞争力,对企业AI化进程具有深远影响。
📊 核心实体与商业数据
| 实体/指标 | 详情 |
|---|---|
| 公司 | DeepSeek |
| 事件 | API降价 |
| 涉及模型 | V4-Flash系列 |
| 最高降幅 | 60% |
| 闲时价格(输入,缓存命中) | 0.02元/百万token |
| 闲时价格(输入,缓存未命中) | 1元/百万token |
| 闲时价格(输出) | 4元/百万token |
| 高峰时段价格 | 缓存命中0.04元、未命中2元、输出8元 |
| 生效时间 | 2026年9月10日12:00(北京时间) |
| 高峰时段定义 | 周一至周五 9:00-12:00, 14:00-18:00 |
| 原发布时间 | 2026-09-09 |
| 信源 | 机器之心(36氪授权发布) |
💡 业务落地拆解
降价背景与市场反应
此前,DeepSeek于8月17日对V4-Flash进行涨价,引发广泛讨论。官方解释为合理调配资源,鼓励错峰使用,而外界普遍认为涨价源于V4 Flash 0731的高性价比导致全球调用量激增,以及算力不足。此次降价后,输入侧价格完全回到涨价前,输出价格仍为涨价前的2倍(高峰时段为4倍)。用户实际成本节省取决于三个变量:缓存命中率、输入输出比例、任务可错峰程度。对于长上下文、固定系统提示词、Agent循环调用等高缓存命中率场景,降幅显著;对于生成输出为主的场景,感受有限。DeepSeek API的缓存命中率较高,市场反应乐观。
技术优化与成本控制
降价同日,DeepSeek宣布V4.1 Flash中间版本开启内测(模型名:deepseek-v4.1-flash-expires-on-0910),该模型具备原生多模态、极快推理速度,并通过架构升级进一步降低成本。这表明DeepSeek正通过工程优化持续改进推理成本,为AI商业化铺路。
🚀 对企业AI化的启示
成本重构与策略调整
企业应重新评估AI应用的成本结构,利用降价窗口优化调用策略。对于高缓存命中率的场景,如智能客服、文档处理,可加大调用量;对于输出密集型应用,需权衡成本与收益。同时,错峰调用可进一步降低成本。
模型选型与供应商锁定
DeepSeek的定价调整显示其市场策略的灵活性,企业应关注模型迭代(如V4.1)带来的能力提升与成本优化,避免单一供应商锁定。建议建立多模型评估机制,以应对市场波动。
长期成本趋势
大模型推理成本持续下降是长期趋势,企业应关注技术前沿,将AI嵌入核心业务流程,以获取竞争优势。DeepSeek此次降价是AI商业化进程中的标志性事件,预示着更广泛的行业成本重构。
【官方原文链接】点击访问首发地址
常见问题
相关文章
从遥控到自主:具身智能的终极关卡与商业落地路径
2026年机器人马拉松和运动会显示,具身智能正从遥控向自主过渡,但当前仍处L2-L3阶段,泛化能力不足是核心瓶颈。宇树科技等企业产品分级,遥控操作积累数据驱动进化,标准化评测推动产业从技术验证迈向商业落地。
2026年9月9日TeleAgent 实测:中国电信星辰大模型驱动的办公 Agent 如何重塑企业 AI 落地路径
中国电信推出基于星辰大模型的桌面办公Agent TeleAgent,实测显示其能处理复杂长任务,支持400K Token上下文,通过Model Router优化成本,并设置安全护栏。产品定位高质价比,面向无技术背景用户,有望成为国民级AI办公助理,为传统企业AI化提供参考。
2026年9月9日镭萌科技获千万天使轮融资:AI陪伴机器人bibo的具身智能新路径
2026年9月9日,AI机器人公司镭萌科技宣布完成千万级天使轮融资,由时尚传媒集团与弘颐资管联合领投。其核心产品AI陪伴机器人bibo采用具身智能架构,已进入全球16个国家和地区,用户日均互动超60次。本轮融资将用于全球渠道拓展、周边开发及IP合作,标志着AI陪伴机器人赛道向科技与时尚融合方向演进。
2026年9月9日