首页 AI 智谱开源GLM-5.3-Flash,寒武纪等完成国产算力同日适配

智谱开源GLM-5.3-Flash,寒武纪等完成国产算力同日适配

8月26日智谱发布并开源GLM-5.3-Flash(320B/激活18B),寒武纪同日完成适配;券商梳理称国产算力上半年营收高增,芯模协同加速。

中国商业网讯 据券商研报与公开信息梳理,智谱于 8 月 26 日正式发布并开源 GLM-5.3-Flash,为 GLM-5 系列首个原生多模态模型,总参数 320B、激活参数 18B。同日,寒武纪完成对该模型的适配。新浪财经转引国联民生等研报称,模型已在国产芯片集群上实现大规模推理服务。

导语

开源模型与国产算力软件栈同日对齐,把「能跑」进一步推向「可规模化推理」的工程验证。

事件背景

智谱开源GLM-5.3-Flash,寒武纪等完成国产算力同日适配-中国商业网
报道配图:事件与数据图示

公开介绍称,GLM-5.3-Flash 综合能力超过 GLM-5.2,在 AA 综合智能指数获 57 分,与 Claude Opus 4.8 持平;采用稀疏注意力与线性注意力混合架构,支持视觉编码及办公、金融、法律等专业任务。定价为 GLM-5.3 的 1/10,限时折扣为 1/20。

研报称,寒武纪 Neuware 软件栈原生支持 PyTorch、vLLM 等框架,MLA、MHC、MoE、MTP 等适配基础设施可开箱使用。另据同一梳理,国产算力相关龙头 2026 年上半年收入与利润高增:寒武纪营业收入 59.96 亿元,同比增长 108.13%;海光信息营业收入 90.99 亿元,同比增长 66.52%。

核心看点

智谱开源GLM-5.3-Flash,寒武纪等完成国产算力同日适配-中国商业网
报道配图:结构与影响示意

一是模型侧开源多模态 Flash 版本,降低调用成本。

二是芯片侧强调软件栈与主流推理框架兼容,缩短适配周期。

三是业绩数据反映算力需求高景气与国产芯片放量并行。

行业影响

对应用开发者,更低价的多模态接口有利于办公与专业场景试用。对国产算力厂商,模型同日适配是生态完整度的公开考试。对云与推理服务商,单位 Token 成本与稳定性将成为竞争焦点。

延伸分析

对政企采购,除基准测试外,更应核查日志留存、数据驻留与运维响应级别。

评测分数与开源发布不能替代生产环境的时延、吞吐与故障率。芯模协同若停留在「演示集群」,企业仍会观望迁移成本。

结语

GLM-5.3-Flash 开源与国产算力适配同步推进。下一程要看推理服务的稳定供给,以及行业客户是否把流量真正迁到国产集群。

上一篇
下一篇

为您推荐

发表回复

您的电子邮箱地址不会被公开。 必填项已用*标注

联系我们

联系我们

13269869772

在线咨询: QQ交谈

邮箱: zqxwwjob@qq.com

工作时间:周一至周五,9:00-17:30,节假日休息

关注微信

微信扫一扫关注我们

关注微博
返回顶部