Qwen2.5-7B-base-mla-topk8-rank512:可用于 Qwen2.5-7B 的 MLA 注意力转换,加载注意力增量权重而无需完整模型重训。提供 attention-only delta、配置与清单,需基于固定基座并用 MHA2MLA-V2 加载。【此简介由AI生成】 - AtomGit AI社区