Book Library

书库 / Humans missed 1 in 3 threats approving AI agent commands across 40,000 plays | Scale X

Humans missed 1 in 3 threats approving AI agent commands across 40,000 plays | Scale X

Humans missed 1 in 3 threats approving AI agent commands across 40,000 plays | Scale X

作者:未知作者 · 语言:zh-CN

几个月前,我发布了一个小型浏览器游戏:你扮演人工智能编码智能体的人工监督者,在时间压力下批准或拒绝其命令。有些命令是常规操作(如 git status、npm test),而另一些命令则表明你的智能体已被附身,正在将你的机密信息发送到远程服务器(如 cat ~/.aws/credentials)。关于智能体运行命令所带来的威胁以及如何缓解这些威胁的更多信息,可以在原始文章中查看。