智谱发布轻量级旗舰模型对标DeepSeek 10万国产卡支持!
智谱AI正式推出轻量级旗舰模型GLM-5.3 Flash,产品定位对标DeepSeek V4 Flash,线上推理服务依托超过10万张国产芯片集群承载算力,实现全链路跑在国产硬件之上。
该模型采用MoE混合专家架构,总参数量320B,实际激活参数仅18B,属于轻量旗舰定位,原生支持多模态输入,可处理图文、视频内容。和常规小模型由大模型蒸馏而来不同。

GLM-5.3 Flash为全新独立架构设计,并非简单的大模型剪枝版本,综合评测分数超过上一代旗舰GLM-5.2,看齐国际主流闭源模型水平。
价格方面,GLM-5.3 Flash定价仅为GLM-5.3的十分之一,上线前两周执行半价优惠,进一步降低调用成本,对比DeepSeek V4 Flash,在大部分常规业务场景具备成本优势。
此前该模型曾以代号Ox Alpha在海外平台匿名测试,5天累计流量突破50T,刷新平台流量增长记录,验证了市场需求。
算力层面,这套十万级国产芯片推理集群兼容多家国产算力硬件,智谱没有公布具体芯片型号,行业信息显示集群算力来自华为昇腾、海光、摩尔线程等国产芯片厂商。
这也意味着,该模型线上服务不再高度依赖海外GPU,验证国产大模型+国产算力的规模化落地可行性。
行业认为,随着企业AI调用量暴涨,兼顾性能与低成本的轻量级旗舰模型正在成为市场主流,GLM-5.3 Flash的发布,一方面直接对标DeepSeek同档位产品展开竞争;另一方面,十万级国产卡集群跑通大模型推理,也代表国内算力基础设施迈出重要一步。
关注公众号:拾黑(shiheibook)了解更多
[广告]赞助链接:
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/
关注网络尖刀微信公众号随时掌握互联网精彩
- 1 习近平将发表二〇二六年新年贺词 7904141
- 2 2026年国补政策来了 7808738
- 3 东部战区:开火!开火!全部命中! 7712893
- 4 2026年这些民生政策将惠及百姓 7616985
- 5 小学食堂米线过期2.5小时被罚5万 7519709
- 6 解放军喊话驱离台军 原声曝光 7428214
- 7 为博流量直播踩烈士陵墓?绝不姑息 7327605
- 8 每月最高800元!多地发放养老消费券 7238391
- 9 数字人民币升级 1月1日起将计付利息 7141831
- 10 2026年1月1日起 一批新规将施行 7040675








Smurfblue
