讨论分类列表 - InternVL3-1B-Instruct:可用于轻量部署图文对话、OCR、图表文档理解、多图像视频理解与多模态推理。该模型是1B规模的SFT指令版本,采用ViT-MLP-LLM架构,支持动态分辨率、多图像和视频输入,并通过Transformers提供加载与推理能力。【此简介由AI生成】 - AtomGit AI社区