看得懂图片,又一个多模态大模型MiniGPT4发布,仅用4块A100训练10小时
最新发布的MiniGPT4是一个多模态大模型,可以理解图片并利用文本描述生成内容。它是通过整合BLIP-2和Vicuna来将图片转化为文本描述并根据这些描述创建内容。仅使用了4块A100 GPU训练10小时。通过冻结大部…
主题标签
最新发布的MiniGPT4是一个多模态大模型,可以理解图片并利用文本描述生成内容。它是通过整合BLIP-2和Vicuna来将图片转化为文本描述并根据这些描述创建内容。仅使用了4块A100 GPU训练10小时。通过冻结大部…