仅管理员可管理讨论分类。

讨论分类列表 - glm-4.7-flash:针对GLM-4.7-Flash模型在Ascend NPU上的vLLM适配,解决MLA维度不兼容问题,实现Head Padding和算子替换方案,支持长上下文,ACLGraph模式吞吐量提升5.4-7.7倍。【此简介由AI生成】 - AtomGit AI社区