第一个通过RLHF训练的大规模开源聊天机器人
StableVicuna是Stability AI推出的开源聊天机器人模型,基于Vicuna v0 13B和LLaMA 13B构建,并通过指令微调与基于人类反馈的强化学习(RLHF)训练,提升了对话理解、指令遵循和回答质量。
适合智能聊天、知识问答、内容创作、教育辅助、对话模型研究和开源AI应用开发。