Xiaomi MiMo
/
MiMo-V2.5
like
7
关注
Xiaomi MiMo
0
加入合集
TensorFlow
Transformers
Safetensors
英文
汉语
MIT
video-understanding
audio
multimodal
agent
long-context
vision-language
模型介绍
文件和版本
Pull Requests
讨论
分析
下载
Notebook 快速开发
讨论列表
/
讨论分类管理
仅管理员可管理讨论分类。
讨论分类列表 - MiMo-V2.5:MiMo-V2.5 是一款具备强大智能体能力的原生全模态模型,在统一架构下支持文本、图像、视频及音频理解。该模型基于 MiMo-V2-Flash 骨干网络构建,并扩展了专用的视觉和音频编码器,在多模态感知、长上下文推理及智能体工作流方面均展现出卓越性能。 - AtomGit AI社区