牛来推理流量全部由国产算力支持!效率接近英伟达
过去一周,智谱【首次】在【大规模流量】中尝试用大【国产芯片集群】提供服务,这些芯片通过自研高带宽互联网络连接。为克服单张芯片算力与内存容量相对有限的问题,智谱在SGLang 基础上构建了专用的推理引擎。
[烟花]GLM-5.3-Flash 已在大规模国产 AI 芯片集群上实现【接近】 NVIDIA GPU 的推理效率
我们认为,GLM-5.3 Flash作为高性价比的前沿智能模型,对国产算力的支持将再次带动国产AI芯片的需求!
[烟花]性能跃升,比肩国际顶尖模型
GLM-5.3-Flash 总参数量达 3200 亿(320B-A18B),是 GLM-5 系列首个原生多模态模型。AA综合智能指数得分与 Anthropic 旗舰模型 Claude Opus 4.8 持平。
[烟花]极致性价比,价格仅为 1/40
GLM-5.3-Flash 的定价策略堪称颠覆性:
1)定价为 GLM-5.3 的 1/10
2)限时折扣价低至 GLM-5.3 的 1/20,仅为 Opus 4.8 的 1/40,意味着以 1/40 的成本即可获得同等前沿智能
[烟花]重点方向
[玫瑰]超节点服务器:浪潮信息、联想集团、华勤技术(电子)、中科曙光、紫光股份(通信)
[玫瑰]AI芯片:华为昇腾、寒武纪、海光信息、天数智芯、壁仞科技、摩尔线程、壁仞科技
[玫瑰]连接器(部分军工):华丰科技、胜蓝股份、中航光电、航天电器、立讯精密
作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。