97AI.PRO
2026-08-27 · AI 资讯

智谱GLM-5.3-Flash开源:架构优化带动成本大幅下降

智谱GLM-5.3-Flash开源:架构优化带动成本大幅下降
智谱GLM-5.3-Flash开源:架构优化带动成本大幅下降

智谱AI日前开源了GLM-5.3-Flash(320B-A18B),这是其系列中首款原生多模态模型。该模型在保持与Claude Opus 4.8同等性能水平的前提下,定价却实现了数量级的跨越,仅为后者的四十分之一,极大地降低了前沿AI技术的调用门槛。

智谱GLM-5.3-Flash开源:架构优化带动成本大幅下降

技术架构的迭代是实现极致成本控制的关键。GLM-5.3-Flash采用了稀疏注意力与线性注意力混合架构,并引入流形约束超连接技术。相较前代,模型将注意力计算量大幅缩减,KV缓存容量也显著优化,在处理长上下文任务时具备极高的推理效率。

与此同时,智谱团队针对国产硬件进行了深度适配,通过EPD分离架构与自研推理引擎,使硬件使用效率比肩主流GPU,成功支撑起大规模的开源推理流量。目前,该模型已同步上线智谱清言及Z.ai平台,支持全球开发者进行二次开发与应用部署。

相关模型(97AI 可直接调用)