LLaVA

开源视觉指令微调框架,让大语言模型通过投影层连接 CLIP 视觉编码器,实现看图对话和多模态推理能力

Stars25.0k
Forks2.8k
主语言Python
分类模型与框架
作者haotian-liu
LicenseApache-2.0

加载项目详情…