- 类型
- 模型
- 来源
- AIHOT · X / 公众号精选
- 发布
- 2026年8月26日 14:11
- 状态
- 单一信源
发生了什么
智谱开源 GLM-5.3-Flash(320B 总参数,18B 激活),这是 GLM-5 系列首个原生多模态模型。其 AA 综合智能指数为 57 分,与 Claude Opus 4.8 持平。定价为 GLM-5.3 的十分之一,限时折扣下仅为 Opus 4.8 的四十分之一。模型已接入 ZCode 等平台开放 API,采用稀疏注意力与线性注意力混合架构,推理服务运行在国产芯片集群上。
为什么重要
这是 GLM-5 系列首次推出原生多模态模型,并在智能指数上对标顶级模型,同时以极低定价策略切入市场。开源免费获取模型权重,配合低价 API,显著降低了企业和开发者采用高性能多模态模型的门槛,可能影响现有模型选型和成本结构。
底层逻辑
模型采用稀疏注意力与线性注意力混合架构,在总参数 320B 的情况下控制激活参数至 18B,从而在保持性能的同时降低推理计算量。定价与 GLM-5.3 和 Opus 4.8 挂钩,通过价格锚点突出性价比,吸引开发者转向该模型。推理服务部署于国产芯片集群,可能进一步降低运营成本。
产品与商业机会
对产品团队而言,该模型以更低价格提供接近顶级模型的智能水平,可显著降低多模态功能的调用成本,尤其在限时折扣内。对研发团队,开源发布便于本地部署和微调,但需适配稀疏/线性注意力混合架构。接入 ZCode 等平台简化了 API 集成流程。
- 将 GLM-5.3-Flash 集成到现有产品,利用低价优势提供多模态能力,降低 API 成本。
- 基于开源模型进行本地部署或微调,开发针对特定行业场景的定制应用。
- 利用 ZCode 等平台快速试点多模态功能,评估其与现有模型的性能差异。
- 在预算敏感的场景中(如高频调用)替换高价模型,以 1/40 价格获得相近智能水平。
仍待确认
- AA 综合智能指数的具体评测维度和测试集未公开,与 Opus 4.8 持平的说法缺乏独立验证。
- 模型在实际业务场景中的表现(如多模态任务准确性)尚不明确。
- 限时折扣结束后的正式定价未披露,长期成本优势存疑。
- 国产芯片集群的推理吞吐与稳定性缺少第三方基准数据。