Hugging Face Blog·· 2023-02-15精选AI 评分62
用 BLIP-2 实现零样本图像到文本生成
Zero-shot image-to-text generation with BLIP-2
AI 导读
Hugging Face 发布指南,介绍 Salesforce Research 的 BLIP-2 视觉语言模型已集成到 Transformers,并演示图像描述、提示图像描述、视觉问答和对话式提示四种用法。
推荐理由
以 New Yorker 漫画为例演示 BLIP-2 的零样本图像描述、提示描述、视觉问答和对话式提示四种用法,附可运行代码。
来源:Hugging Face Blog · huggingface.co