News Image

清华团队揭示GPT-4V、谷歌Bard等大模型的安全隐患

清华大学的研究团队近日对GPT-4V、谷歌Bard等多模态大语言模型进行了安全性研究,发现这些模型在实际应用中存在安全风险。尽管这些模型展现出了优异的性能,但其对抗鲁棒性仍然较差。研究发现,通过特定的攻击方法,可以诱导这些模型输出错误的图像描述。此外,该团队还发现,通过对抗攻击可以成功绕过某些模型的防御机制。