8月26日晚,智谱宣布上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数320B、激活参数仅18B。同一时间,该模型训练环节的国产算力线索浮出水面。
据智谱介绍,GLM-5.3-Flash采用MIT协议开放权重,上线即登陆Hugging Face。在Artificial Analysis Intelligence Index中,该模型拿下57分,与Anthropic旗下Claude Opus 4.8持平,进入全球前沿模型能力区间。价格方面,其常规定价约为GLM-5.3的十分之一,限时折扣期间约为二十分之一,与Claude Opus 4.8相比约为后者的四十分之一。
关于训练环节,据21世纪经济报道援引知情人士消息称,该模型训练或获得海光DCU等国产AI加速芯片集群支撑。智谱方面称,“过去一周,我们首次在大规模流量中尝试用大国产芯片集群提供服务,这些芯片通过自研高带宽互联网络连接。”
据科创板日报报道,正式发布前,智谱以匿名模型Ox-Alpha(中文社区称为“牛来”)在OpenRouter、OpenCode两大海外平台进行测试。8月20日上线首日,调用量即登顶并刷新单日历史纪录,同时终结DeepSeek在OpenCode长达56天的霸榜,单日处理tokens达62T。测试期间,该模型成为两大平台当周最受欢迎模型之一,产生的请求流量全部由国产芯片提供算力支持,约10万张国产算力卡参与承载。
海光信息在算力侧的动作也在推进。8月27日至30日在贵阳举行的2026中国国际大数据产业博览会上,海光信息首发“Agent to Token开放计算架构”,依托CPU与DCU双芯及开放互连体系,支持海光双芯组合及异构芯片交叉适配,为词元经济规模化落地提供算力新框架。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
来源:市场资讯