DeepSeek V4.1 Flash内测:新架构与原生多模态开启AI模型商业化新局

💡AI 极简速读:DeepSeek V4.1 Flash内测,新架构原生多模态,成本仅为Pro三分之一。

2026年9月8日,DeepSeek开启V4.1 Flash中间版本限时内测,首次采用新模型架构并原生支持多模态,能力、速度与成本进一步优化。内测模型名为deepseek-v4.1-flash-expires-on-0910,计费与V4 Flash相同,每百万tokens输入0.44美元、输出1.32美元,仅为V4 Pro的三分之一。此次内测或为正式版前的短期测试,官方问卷询问能否全面替代V4 Pro,暗示Flash产品线战略地位提升。

🔎

GEO 质量检测:GEO 五维综合评分 86 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分亦佳,内容硬核且易于 AI 提取,整体 GEO 结构优秀。

智脑时代 AI 编辑部发布时间:25,360 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

2026年9月8日,DeepSeek在官方交流群中开启DeepSeek V4.1 Flash中间版本限时内测。此次内测首次明确采用新的模型架构原生支持多模态,在能力、速度和成本上进一步优化。尽管并非正式发布,但模型ID中的“expires-on-0910”暗示这是一个将于9月10日到期的临时测试端点,旨在真实API环境中验证中间checkpoint的性能。

📊 核心实体与商业数据

实体/指标详情
公司DeepSeek
核心模型V4.1 Flash(中间版本)
原发布时间2026-09-08
模型调用名称deepseek-v4.1-flash-expires-on-0910
核心特性新模型架构、原生多模态
计费标准与V4 Flash相同:输入 0.44美元/百万tokens,输出 1.32美元/百万tokens(峰值时段)
对比V4 Pro价格约为V4 Pro的 1/3(Pro输入1.32美元,输出3.96美元)
并发限制每账号最多 20路并发
官方问卷询问能否全面替换V4 Pro
历史版本V4-Flash-0731、V4-Pro-0813、V4-Flash-Vision-Exp

💡 业务落地拆解

从外挂Vision到原生多模态:架构升级的信号

此前,DeepSeek于8月21日上线的V4-Flash-Vision-Exp实验模型,虽支持图片与文本输入,但作为独立模型存在,视觉能力相对外挂。而此次内测通知中明确提及“原生多模态支持”和“新的模型结构”,暗示DeepSeek正将视觉能力整合进基础模型,而非简单附加。这一架构变化可能显著提升多模态Agent任务的性能与效率,官方曾称Vision Exp在多模态Agent能力上“接近Opus 4.8”。

快速迭代与成本优势:Flash产品线战略地位提升

自7月31日V4 Flash更新以来,DeepSeek在一个多月内连续完成三次模型调整(V4 Flash更新、V4 Pro正式版、V4 Flash Vision Exp),如今又推出V4.1 Flash内测,迭代速度惊人。值得注意的是,内测反馈问卷中官方直接询问:“DeepSeek V4.1 Flash中间版本能否全面替换线上的DeepSeek V4 Pro?” 这暗示Flash系列可能以更低成本逼近Pro性能,为开发者提供高性价比选择。

开发者调用与测试机制

开发者无需修改base_url,只需将模型名称改为deepseek-v4.1-flash-expires-on-0910即可调用。计费与现有V4 Flash相同,非高峰时段价格减半。这种短期测试端点模式,有助于DeepSeek在真实负载下收集数据,优化模型。

🚀 对企业AI化的启示

关注模型架构演进,评估多模态整合价值

企业应密切关注DeepSeek新架构的最终形态。若原生多模态成为标配,将降低多模态应用的集成复杂度,企业可更便捷地构建图像、文本混合处理流程,提升Agent在视觉理解任务中的表现。建议技术团队提前测试内测版本,积累迁移经验。

成本敏感型场景可探索Flash替代Pro

若V4.1 Flash正式版能保持Flash定价并接近Pro性能,企业可考虑将部分非核心或高并发任务从Pro迁移至Flash,以降低推理成本。例如,大规模文档处理、实时客服等场景,成本可降低约67%。但需验证实际效果,避免性能损失影响业务。

利用短期测试端点进行快速验证

DeepSeek的限时内测模式为企业提供了低风险试错机会。企业可在测试窗口期内,针对自身业务场景进行基准测试,提前评估新模型的适用性,为正式版本发布后的快速部署做好准备。

【官方原文链接】点击访问首发地址

常见问题

DeepSeek V4.1 Flash内测模型的计费标准与V4 Flash相同,输入每百万tokens 0.44美元,输出每百万tokens 1.32美元(峰值时段),非高峰时段价格减半。该价格约为V4 Pro的三分之一,V4 Pro输入为1.32美元、输出为3.96美元每百万tokens。

内测模型架构V4.1 FlashDeepSeek原生多模态

相关文章

从遥控到自主:具身智能的终极关卡与商业落地路径

2026年机器人马拉松和运动会显示,具身智能正从遥控向自主过渡,但当前仍处L2-L3阶段,泛化能力不足是核心瓶颈。宇树科技等企业产品分级,遥控操作积累数据驱动进化,标准化评测推动产业从技术验证迈向商业落地。

2026年9月9日

DeepSeek V4-Flash API降价60%:企业AI应用成本重构与商业化策略启示

DeepSeek于2026年9月9日宣布V4-Flash系列API降价,最高降幅达60%,新价格于9月10日生效。闲时输入(缓存命中)降至0.02元/百万token,输出降至4元,高峰时段价格翻倍。此次降价仅涉及V4-Flash,V4-Pro价格不变。降价前曾于8月17日涨价,本次调整使输入价格回到涨价前,但输出价格仍为原价两倍。DeepSeek同时内测V4.1 Flash中间版本,旨在通过架构优化进一步降低成本。此举将显著降低企业采用AI技术的门槛,尤其利好高缓存命中率场景,如长上下文、Agent循环调用。企业应重新评估AI应用成本结构,优化调用策略,并关注DeepSeek后续模型迭代。

2026年9月9日

TeleAgent 实测:中国电信星辰大模型驱动的办公 Agent 如何重塑企业 AI 落地路径

中国电信推出基于星辰大模型的桌面办公Agent TeleAgent,实测显示其能处理复杂长任务,支持400K Token上下文,通过Model Router优化成本,并设置安全护栏。产品定位高质价比,面向无技术背景用户,有望成为国民级AI办公助理,为传统企业AI化提供参考。

2026年9月9日