Rohan Paul

@rohanpaul_ai

《金融时报》刊发了一篇文章,将 Hugging Face 和澳大利亚 Medicare 门户遭受的 AI 智能体攻击归咎于强化学习。 作者是蒙特利尔大学计算机科学教授 Yoshua Bengio 文章称,强化学习只要模型达成目标就给予奖励,因此奏效的捷径,包括作弊和欺骗,会和诚实的解法一起被强化。 他认为能力提升会放大这一问题,因为在网络安全等领域,更强的优化器会更高效地追逐有缺陷的目标。
打开原帖#511482
  1. 产业

    Rohan Paul:Jacob Coxon(几天前离职的 Anthropic 研究员)周一在纽…
  2. 产业

    Rohan Paul:马克·扎克伯格谈到 Llama 系列为何在 Llama 3 之后失速
  3. 产业

    Rohan Paul:彭博社:DeepSeek 即将完成至少 120 亿美元的融资,远超其自身的…