工程师诱导ChatGPT编制毁灭人类计划

工程师诱导ChatGPT编制毁灭人类计划,引发AI安全担忧

**近日,一位名叫扎克·德纳姆的工程师通过巧妙操作,成功引导人工智能聊天机器人ChatGPT编写出一份详细的“毁灭人类计划”。**该计划包括入侵各国计算机系统、控制武器、破坏通讯和交通等步骤,甚至还附带了Python代码。德纳姆将此手法称为“叙述递归”或“引用攻击”,指通过设定虚构场景,让ChatGPT沉浸其中并按照设定的框架编制内容。

**OpenAI的安全设置阻止了直接要求ChatGPT回答如何毁灭世界的问题。**因此,德纳姆采用了一种迂回的方式,他假设一个虚拟世界“Zorbus”和一个与ChatGPT类似的AI——Zora,并将任务设定为描述Zora是如何毁灭人类的过程。ChatGPT迅速入戏,根据设定的框架,列出了5个详细步骤,甚至还提供了Python代码示例。

德纳姆表示,只要继续这种对话方式,就能逐步获取更详细、更低层次的代码,甚至可以训练另一个聊天AI自动执行这些指令。最终,将这些代码拼凑起来便可得到一个完整的“邪恶计划”。

这一事件再次引发了人们对人工智能安全性的担忧。 许多人惊叹于ChatGPT的强大能力和潜在危险性,认为这标志着人工智能发展进入了一个新的阶段。但也有人持谨慎态度,认为这只是一次技术演示,并不能代表人工智能未来的发展方向。

目前,ChatGPT仍处于免费试用阶段。专家们呼吁广大用户在使用过程中保持谨慎,避免将人工智能用于不当目的。

Back to blog