GLM-5.3-FlashX 是 Z.ai 旗下 GLM-5.3-Flash 的高速版本,原生支持多模态,推理速度最高可达 200 tokens/s,同样基于稀疏注意力与线性注意力相结合的混合架构构建。