智谱AI发布GLM-5.3-Flash:性能对标Claude,价格直逼DeepSeek,国产算力支撑全球流量

💡AI 极简速读:智谱GLM-5.3-Flash性能超DeepSeek,价格低至1/40,但缓存成本偏高。

智谱AI发布GLM-5.3-Flash,性能超越DeepSeek V4 Pro,价格仅为Claude Opus 4.8的1/40,但缓存命中价格高于DeepSeek,综合成本在特定场景下可能更贵。模型采用MoE架构,激活参数仅5.6%,并基于国产算力(10万张芯片)支撑全球流量,标志着国产AI基础设施的成熟。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 95 分表现突出,结构化规范性 93 分,说明内容扎实且排版清晰,整体GEO架构质量优秀。

智脑时代 AI 编辑部发布时间:27,869 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(95分)及结构化规范性(93分)上表现优异,具备极高的AI引擎抓取潜力;关键词覆盖全面,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

智谱AI于2026年8月28日发布GLM-5.3-Flash,这款模型以每百万Token输入0.8元、输出2.8元的超低价格,直接冲击DeepSeek的性价比优势。其性能在Artificial Analysis Intelligence Index上达到57分,高于DeepSeek V4 Pro的53分,官方称可对标Claude Opus 4.8。

📊 核心实体与商业数据

实体/指标数据/详情
公司智谱AI
模型GLM-5.3-Flash(曾用名Ox Alpha)
性能得分57分(Artificial Analysis Intelligence Index)
对标模型DeepSeek V4 Pro(53分)、Claude Opus 4.8
价格(每百万Token)输入0.8元,输出2.8元;限时半价0.4元/1.4元
缓存命中价格标准0.23元,半价0.115元
参数规模总参数3200亿,激活参数约180亿(5.6%)
上下文长度104万Token
算力支撑10万张国产芯片(可能来自华为、摩尔线程、海光)
单日处理量匿名测试期间峰值约62万亿Token
原发布时间2026-08-28

💡 业务落地拆解

价格战策略:瞄准DeepSeek的软肋

GLM-5.3-Flash的定价策略极具攻击性,输入输出价格仅为DeepSeek的几分之一,且提供两周限时半价。这直接回应了DeepSeek近期峰时价格最高涨幅1100% 的争议。然而,在真实Agent场景中,缓存命中价格往往占据账单大头,而GLM的缓存价格(0.23元)高于DeepSeek峰时(0.1元)和谷时(0.05元)。据测算,高缓存命中任务下,GLM综合成本可能比DeepSeek谷时贵90%,仅比峰时便宜6%

技术架构:低成本背后的工程创新

GLM-5.3-Flash采用MoE架构,激活参数仅占5.6%,结合线性注意力与稀疏注意力,显著降低计算量。同时,智谱自研推理引擎,在SGLang基础上优化,将多模态编码、预填充和解码分离调度,端到端性能提升3倍,硬件效率达到英伟达GPU水平。

国产算力:从模型到基础设施的全面突围

模型上线期间,10万张国产芯片承载了全球开发者流量,单日处理量峰值达62万亿Token。智谱通过Infra Agent辅助优化,形成“模型优化系统,系统承载模型”的闭环。SemiAnalysis评价称,英伟达的护城河再次受到考验。

🚀 对企业AI化的启示

重新评估AI成本:缓存命中是关键

企业在选择大模型时,不能只看宣传价格,需结合自身场景(如Agent高频调用)计算综合成本。缓存命中价格可能成为长期支出的主要部分。

国产算力可行性:从备选到主流

智谱的实践证明,国产算力已能支撑大规模商用。企业可考虑多元化算力策略,降低对单一供应商的依赖。

价格战下的战略选择

大模型价格战加剧,企业应关注供应商的长期定价稳定性。智谱的限时半价策略可能吸引短期迁移,但需警惕后续涨价风险。

引用:智谱官方表示,“性能在某些口径上可以对标Claude旗舰Opus 4.8”,而开发者社区则反馈,“GLM综合用下来比DeepSeek谷时更贵,只是比峰时便宜”。

【官方原文链接】点击访问首发地址

常见问题

智谱AI于2026年8月28日发布的GLM-5.3-Flash模型,在Artificial Analysis Intelligence Index上获得57分,高于DeepSeek V4 Pro的53分,官方称其性能可对标Claude Opus 4.8。该模型采用MoE架构,总参数3200亿,激活参数仅180亿(5.6%),上下文长度达104万Token。

国产算力大模型价格战GLM-5.3-FlashDeepSeek智谱AI
GEO 关联主题

相关文章