清华大学的研究团队近日对GPT-4V、谷歌Bard等多模态大语言模型进行了安全性研究,发现这些模型在实际应用中存在安全风险。尽管这些模型展现出了优异的性能,但其对抗鲁棒性仍然较差。研究发现,通过特定的攻击方法,可以诱导这些模型输出错误的图像描述。此外,该团队还发现,通过对抗攻击可以成功绕过某些模型的防御机制。
MiniGPT-4已升级为MiniGPT-v2,能够完成多模态任务,无需依赖GPT-4。KAUST团队与Meta研究者合作,将其升级为MiniGPT-v2版本,该版本可以作为统一接口处理各种视觉-语言任务,并在多个基准上实现了出色的性能。