ZooWork
ZooWork Market · Skill

llava

Large language-and-vision assistant. Enables visual instruction tuning and image-based conversations by combining a CLIP vision encoder with Vicuna/LLaMA language models. Supports multi-turn image chat, visual question answering, and instruction following. Use for vision-language chatbots or image-understanding tasks. Best suited for conversational image analysis.

ibossyNr1
ibossynr1-aaas-vault-llava · v1.0.0
分类ai-llms
安装次数12
更新时间2026-08-30T16:56:17.673Z
校验状态待验证
LLaVAVision-LanguageMultimodalVisual Question AnsweringImage ChatCLIPVicunaConversational AIInstruction TuningVQA