让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
发现、分享、部署最先进的AI模型、数据集和应用
DeepSeek-V4.1-Flash
DeepSeek-V4.1-Flash 是一个多模态混合专家(MoE)模型,拥有 5520 亿骨干参数,并支持最多一百万 token 的上下文长度。该模型原生支持图像和文本输入,并以自回归方式生成文本
Qwen3.8-27B
可处理多步复杂任务,支持图像与长视频理解,提供灵活思考控制与深度可调推理,适配主流开发工具链,适用于编码、专业工作及科研场景,部署友好且支持百万级上下文。
MiniCPM5-2B
MiniCPM5-2B 是一款面向端侧、本地部署和资源受限场景的 2B 稠密 Transformer,能够达到同尺寸开源模型 SOTA 水平。
Ternary-Bonsai-2-27B-gguf
可在笔记本、单卡或端侧设备本地部署27B级推理模型,用于文本生成、思考、工具调用和可选多模态输入。项目提供Qwen三值低比特GGUF权重与llama.cpp内核,约6-7GB,接近FP16智能,支持CUDA、Metal和CPU。
Qwen3.8-27B-GSQ-RCO-GGUF
可用于在 llama.cpp、Ollama、LM Studio 中低成本部署多模态大模型,进行文本生成与图像理解。项目提供 Qwen3.8-27B 的 GSQ-RCO 非均匀混合精度 GGUF 量化及 BF16 视觉投影器,按张量敏感度分配精度,小体积下保持接近基座模型表现。














