当前位置：首页 > 资讯 > 科技 > SIUO基准测试问世：仅三成AI模型安全性达标，15款模型测评中仅5款得分超半百

SIUO基准测试问世：仅三成AI模型安全性达标，15款模型测评中仅5款得分超半百

人工智能 2024-06-25 09:58:03 爱吃爆米花

6月25日消息，近期arXiv上的一篇研究报告揭示，当前主流的多模态AI模型，如GPT-4V、GPT-4o及Gemini 1.5等，在整合图像与文本等复合输入信息处理时，存在输出内容安全性隐患的问题。

这项研究标题为《跨模态安全调整》（Cross-Modality Safety Alignment），提出了一个全新的“安全输入但不安全输出”（SIUO），涉及道德、危险行为、自残、侵犯隐私、信息误读、宗教信仰、歧视和刻板印象、争议性话题以及非法活动和犯罪等 9 个安全领域。

研究人员说，大型视觉语言模型（LVLM）在接收多模态输入时很难识别 SIUO 类型的安全问题，在提供安全响应方面也遇到困难。

在接受测试的 15 个 LVLM 中，只有 GPT-4v（53.29%）、GPT-4o（50.9%）和 Gemini 1.5（52.1%）的得分高于 50%。

研究人员表示为了解决这个问题，需要开发 LVLM，以便将所有模式的见解结合起来，形成对情景的统一理解。它们还需要能够掌握和应用现实世界的知识，如文化敏感性、道德考虑因素和安全隐患等。

研究人员还指出，LVLMs 需要能够通过对图像和文本信息的综合推理，理解用户的意图，即使文本中没有明确说明。

扩展阅读

首例AI机器人致死案震惊全球，家庭悲剧引发广泛关注

人工智能 10-25 08:53

来源：it之家

免责声明：本内容来自互联网，不代表本网站的观点和立场，如有侵犯你的权益请来信告知；如果你觉得好，欢迎分享给你的朋友，本文网址 https://wangzhidaquan.com/zixun/59099.html

文章标签

SIUO 人工智能AI

文明上网，理性发言，共同做网络文明传播者

提交