Qwen3-30B-A3B-base-mla-topk8-rank128:可用于在 MHA2MLA-V2 流程中为 Qwen3-30B-A3B-Base 注入低秩 MLA 注意力改造。仅含注意力相关增量权重,约 0.80 GiB,配合基础模型加载完成 topk8/rank128 变体集成,非完整模型。【此简介由AI生成】 - AtomGit AI社区