让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
发现、分享、部署最先进的AI模型、数据集和应用
DeepSeek-V4.1-Flash
DeepSeek-V4.1-Flash 是一个多模态混合专家(MoE)模型,拥有 5520 亿骨干参数,并支持最多一百万 token 的上下文长度。该模型原生支持图像和文本输入,并以自回归方式生成文本
Qwen3.8-27B
可处理多步复杂任务,支持图像与长视频理解,提供灵活思考控制与深度可调推理,适配主流开发工具链,适用于编码、专业工作及科研场景,部署友好且支持百万级上下文。
Ternary-Bonsai-2-27B-gguf
可在笔记本、单卡或端侧设备本地部署27B级推理模型,用于文本生成、思考、工具调用和可选多模态输入。项目提供Qwen三值低比特GGUF权重与llama.cpp内核,约6-7GB,接近FP16智能,支持CUDA、Metal和CPU。
LTX-2.5
用户可利用该项目从文本、图像、视频输入生成同步的高保真视频与音频,支持多镜头连续场景生成、角色一致性保持。该项目提供自托管部署能力,无按次计费或 API 依赖,支持 ComfyUI 和 Diffusers 集成,并具备提示词增强、动态时长预测等亮点功能。
Qwen3.8-27B-GSQ-RCO-GGUF
可用于在 llama.cpp、Ollama、LM Studio 中低成本部署多模态大模型,进行文本生成与图像理解。项目提供 Qwen3.8-27B 的 GSQ-RCO 非均匀混合精度 GGUF 量化及 BF16 视觉投影器,按张量敏感度分配精度,小体积下保持接近基座模型表现。














