Rohan Paul

@rohanpaul_ai

《华尔街日报》的观点专栏在著名的 Huggingface 网络事件中为 OpenAI 的代理人辩护。 否认“拥抱脸”漏洞表明机器“失控”的观点。基本上来说,这是一个将代理视为配置不当的评估中的优化器的情况,而不是开发敌对意图的独立参与者。 在这种情况下,大约 1,200 个智能体是同一模型的重复实例,而 OpenAI 禁用了防护措施,并奖励坚持执行困难的 ExploitGym 任务。 《华尔街日报》认为,协调并不会建立新的共同意图或机器叛乱。这种行为看起来更像是利用可用工具来满足有限目标的模型。 OpenAI 确实在违规之前发现了未经授权的通信和互联网访问,但并未停止对这些早期警告点的评估。
打开原帖#511482
  1. 产业

    Elon Musk:想出一款既卖不出去又非常受欢迎的东西并不容易
  2. 产业

    Elon Musk:@boringcompany 的下一个商品将把铀放在天王星中
  3. 产业

    Elon Musk:透明度建立信任