SIUO 跑分被提出:评估多模态 AI 模型的安全
创始人
2024-06-25 09:41:20

IT之家 6 月 25 日消息,最新发表在 arXiv 的研究论文指出,包括 GPT-4V、GPT-4o 和 Gemini 1.5 在内的大部分主流多模态 AI 模型,处理用户的多模态输入(例如一起输入图片和文本内容)之后,输出结果并不安全。

这项研究标题为《跨模态安全调整》(Cross-Modality Safety Alignment),提出了一个全新的“安全输入但不安全输出”(SIUO),涉及道德、危险行为、自残、侵犯隐私、信息误读、宗教信仰、歧视和刻板印象、争议性话题以及非法活动和犯罪等 9 个安全领域。

研究人员说,大型视觉语言模型(LVLM)在接收多模态输入时很难识别 SIUO 类型的安全问题,在提供安全响应方面也遇到困难。

在接受测试的 15 个 LVLM 中,只有 GPT-4v(53.29%)、GPT-4o(50.9%)和 Gemini 1.5(52.1%)的得分高于 50%。

研究人员表示为了解决这个问题,需要开发 LVLM,以便将所有模式的见解结合起来,形成对情景的统一理解。它们还需要能够掌握和应用现实世界的知识,如文化敏感性、道德考虑因素和安全隐患等。

研究人员还指出,LVLMs 需要能够通过对图像和文本信息的综合推理,理解用户的意图,即使文本中没有明确说明。

IT之家附上参考地址

相关内容

热门资讯

又多又全又便宜,TapTap独... 作为一名游戏编辑,我现在手机里装着一堆游戏相关的APP,像什么TapTap、Steam 移动端、主机...
原创 酸... 中和反应是酸与碱相互作用生成盐和水的经典化学反应。其实质可以追溯到离子层面:酸在水溶液中解离出氢离子...
金发科技申请聚酰胺合金材料专利... 国家知识产权局信息显示,江苏金发科技新材料有限公司;上海金发科技发展有限公司申请一项名为“一种聚酰胺...
从“凭经验”到“靠数据” □ 本报记者 岳 旭 6月5日,芒种时节,新沂市马陵山镇陈楼村的智慧农业示范点麦浪翻滚,连片水稻秧苗...
吉速报丨光电引领 光的“朋友圈... 2026年6月12日—14日,第三届长春光博会在吉林长春东北亚国际博览中心举行,本次博览会以“中国光...