SmolVLM-256M-Instruct:可用于图像描述、视觉问答等多模态任务,支持图像与文本任意序列输入生成文本。该模型为全球最小多模态模型,架构轻量,适合设备端应用,仅需1GB以下GPU内存即可运行推理。【此简介由AI生成】 - AtomGit AI社区