这篇文章是ASCII 艺术攻击威胁 AI 聊天机器人的安全这是一篇更新的文章。
ASCII 艺术攻击威胁 LLM 安全

利用 ASCII 艺术的攻击技术威胁着配备大规模语言模型 (LLM)(例如 ChatGPT)的 AI 聊天机器人的安全。攻击者已成功使用 ASCII art 绕过过滤并生成恶意响应,否则这些响应将被拒绝。
因此次攻击导致企业机密信息泄露的案例已接连发生,利用LLM的企业迫切需要采取适当的措施。
关注社交新闻网站 Reddit 的数据

来自社交新闻网站 Reddit 的数据作为针对 ASCII 艺术攻击的对策引起了人们的关注。这是因为 Reddit 拥有大量用户帖子,其中一些可能包含 ASCII 艺术。
Reddit已于2024年2月在纽交所申请首次公开募股(IPO),与谷歌的合作也进展顺利。希望通过使用该公司的数据来训练语言模型,能够间接为应对 ASCII art 攻击做出贡献。
然而,通过与 Reddit 直接合作,不太可能将大量 ASCII 艺术作品用作训练数据。理由如下。
- Reddit 的大部分内容都是文本和图像,并且假设没有太多 ASCII 艺术。
- 可用于攻击的ASCII艺术很可能已被删除,其作为训练数据的价值有限。
- 作为对抗 ASCII 艺术攻击的对策,开发正确识别和过滤 ASCII 艺术的技术非常重要。
AI时代风险管理需要的平衡感
随着 ASCII 艺术攻击带来的安全风险不断出现,使用 LLM 的公司需要采取适当的措施。尽管使用 Reddit 数据训练语言模型可能会间接有助于攻击对策,但直接效果可能有限。
重要的是从技术和规则两个角度解决人工智能时代的风险管理。在采取安全措施的同时,公司还应探索在业务中利用法学硕士的可能性。可以说,我们生活在一个需要平衡应对的时代,同时要识别技术的光明面和黑暗面。
