ZooWork
ZooWork Market · Skill

blip-2-vision-language

Vision-language pre-training framework bridging frozen image encoders and LLMs. Use when you need image captioning, visual question answering, image-text retrieval, or multimodal chat with state-of-the-art zero-shot performance.

◇
Clay-HHK
clay-hhk-claude-config-blip-2 · v1.0.0
分类ai-llms
安装次数9
更新时间2026-09-02T08:14:26.351Z
校验状态待验证
MultimodalVision-LanguageImage CaptioningVQAZero-Shot