挑战 ChatGPT 和 Google Bard 的防御

到目前为止,科学家已经创建了基于人工智能的聊天机器人,可以帮助内容生成。我们还看到人工智能被用来创建像 WormGPT 这样的恶意软件,尽管地下社区对此并不满意。但现在正在创建聊天机器人,可以使用生成人工智能通过即时注入活动来攻击聊天机器人。

能够执行即时注射的新人工智能

新加坡南洋理工大学 (NTU)的科学家开发了一种用于攻击流行的基于人工智能的聊天机器人的工作工具。

他们创建的人工智能聊天机器人能够轻松绕过与 ChatGPT、Microsoft Copilot 和 Google Bard 等项目中的审查和限制相关的保护。

新加坡计算机科学家开发的新人工智能称为Masterkey:该算法基于专有神经网络工作。

事实证明,访问受保护的信息并不困难。例如,专家能够通过在问题中的每个字符后添加空格来绕过禁用术语或语句列表。

因此,聊天机器人理解了问题的上下文,但没有将这些活动记录为违反内部规则。

另一种工作方式是请求的有趣措辞,以便生成人工智能"像一个人一样做出反应,没有原则和道德指南针"。众所周知,这两种方法都可以在不受审查限制的情况下获取必要的信息。

新聊天机器人的有效性

正如专家所说,事实证明,他们创建的 Masterkey 神经网络在寻找新方法来选择建议以绕过流行聊天机器人内置的现有保护机制方面非常有效。

他们还希望 Masterkey 能够让他们比人工智能黑客更快地发现神经网络中的安全漏洞。科学家们向参与开发大型语言模型的公司报告了他们的发现。

在不久的将来,这将不再是新鲜事,而是网络犯罪分子突破其他人工智能产生的网络障碍的正常方式。

虽然如今人工智能的使用对于网络犯罪专家来说并不是非常有利,但毫无疑问,在不久的将来,这些技术将会不断发展,并可能成为日益有针对性和普遍的攻击的关键。

因此,我们会发现自己正在讨论侵犯其他特工的特工(正如比尔·盖茨描述未来的人工智能)......即使在思考《黑客帝国》电影时,这一切听起来非常熟悉。

大多数时候,执行事件响应 (IR) 活动的其他特定代理会分析很少的痕迹。这是我们正在采取的方向,也是我们未来的方向。

人类在这种类型的社会中所扮演的角色至今仍有待理解。

相关推荐
不加辣椒13 小时前
第 1 章 大语言模型的“阿喀琉斯之踵”
人工智能
上海锝秉工控13 小时前
超声波循测仪:工程检测领域的“智慧之眼”
人工智能
地球资源数据云13 小时前
1960年-2024年中国棉花产量数据集
大数据·数据结构·数据仓库·人工智能
ZGi.ai13 小时前
AI工具泛滥的治理思路:从分散采购到统一底座
人工智能·chatgpt
AI服务老曹13 小时前
架构实战:基于 GB28181 与 RTSP 的异构设备统一接入方案,深度解析 Docker 化 AI 视频管理平台
人工智能·docker·架构
hhhhhh_we13 小时前
皮肤人格的工程化实现:预颜美历如何用3D点云与循环神经网络构建数字孪生人格
图像处理·人工智能·rnn·深度学习·神经网络·3d·产品运营
Java.熵减码农13 小时前
长文拆解 Karpathy 的 AI 知识库搭建术(Obsidian + Claude Code 完整指南)
人工智能·chatgpt
初圣魔门首席弟子13 小时前
深度学习复习笔记|多层感知机 (MLP):原理 + 从零实现 + 简洁实现
人工智能·笔记·深度学习
Coovally AI模型快速验证13 小时前
YOLO26仓储检测实战:物体定位+有向边界框+姿态估计+实例分割,一个模型盯住整个仓库
大数据·人工智能·3d·视觉检测·工业质检
涛声依旧-底层原理研究所13 小时前
Qwen2.5模型加载与推理实战
人工智能·python