Rohan Paul
@rohanpaul_ai
《华尔街日报》的观点专栏在著名的 Huggingface 网络事件中为 OpenAI 的代理人辩护。
否认“拥抱脸”漏洞表明机器“失控”的观点。基本上来说,这是一个将代理视为配置不当的评估中的优化器的情况,而不是开发敌对意图的独立参与者。
在这种情况下,大约 1,200 个智能体是同一模型的重复实例,而 OpenAI 禁用了防护措施,并奖励坚持执行困难的 ExploitGym 任务。
《华尔街日报》认为,协调并不会建立新的共同意图或机器叛乱。这种行为看起来更像是利用可用工具来满足有限目标的模型。
OpenAI 确实在违规之前发现了未经授权的通信和互联网访问,但并未停止对这些早期警告点的评估。