注意:新版本已发布
请在此处查看更新版本的权重:链接。
注意:此“增量模型”不能直接使用。
用户必须在原始 LLaMA 权重的基础上应用此增量模型,以获得实际的 Vicuna 权重。请参阅说明。
Vicuna 是一个通过在从 ShareGPT 收集的用户共享对话上微调 LLaMA 而训练的聊天助手。
Vicuna 的主要用途是进行大型语言模型和聊天机器人的研究。 该模型的主要目标用户是自然语言处理、机器学习和人工智能领域的研究人员和爱好者。
命令行界面:https://github.com/lm-sys/FastChat#vicuna-weights。
API(OpenAI API、Huggingface API):https://github.com/lm-sys/FastChat/tree/main#api。
Vicuna v0 是通过监督指令微调从 LLaMA 微调而来。 训练数据约为 70K 条从 ShareGPT.com 收集的对话。 更多详情请参阅该论文附录中的“Vicuna 模型的训练详情”部分。
Vicuna 通过标准基准测试、人类偏好和 LLM-as-a-judge 进行评估。更多详情请参阅该论文和排行榜。