让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
发现、分享、部署最先进的AI模型、数据集和应用
GLM-5.3-Flash
GLM-5.3-Flash (320B-A18B),是GLM-5系列的首个原生多模态模型。320B总参数,能力超过GLM-5.2
Qwen3.8-Flash-Next
可用于部署开源视觉语言模型,完成图文理解、长上下文推理和智能体任务。项目提供Transformers格式权重与配置,兼容vLLM、SGLang等,采用稀疏注意力、门控残差、N-gram嵌入和MoE,提升长上下文效率。
Qwen3.8-27B
可处理多步复杂任务,支持图像与长视频理解,提供灵活思考控制与深度可调推理,适配主流开发工具链,适用于编码、专业工作及科研场景,部署友好且支持百万级上下文。
Qwen3.8-27B-GGUF
可用于构建高效的AI Agent应用,支持图像视频理解、长文本处理及灵活推理控制,适合复杂编码、研究等任务。基于Qwen架构,原生支持26万token上下文,可扩展至百万token,推理深度可调,部署友好。
WeMM-Embedding-9B
可用于构建文本、图像、视频及图文混合内容的统一检索与多模态搜索。基于Qwen3.5与Transformers,支持多种输入组合,输出4096维归一化向量,兼容Matryoshka降维与vLLM/SGLang部署。














