跳到正文
原文
Hugging Face Blog·· 2023-02-15精选AI 评分62

用 Hugging Face Transformers 上手 BLIP-2 零样本图像到文本生成

Zero-shot image-to-text generation with BLIP-2

AI 导读

Hugging Face 博客介绍 Salesforce Research 的 BLIP-2 已集成进 Transformers,可在冻结图像编码器与大语言模型之间加入轻量 Q-Former 完成视觉语言预训练。

推荐理由

以 New Yorker 漫画为例演示 BLIP-2 的零样本图像描述、提示续写与视觉问答,可据此快速上手多模态推理。

来源:Hugging Face Blog · huggingface.co