Rohan Paul@rohanpaul_ai2026年10月06日 11:19《金融时报》刊发了一篇文章,将 Hugging Face 和澳大利亚 Medicare 门户遭受的 AI 智能体攻击归咎于强化学习。 作者是蒙特利尔大学计算机科学教授 Yoshua Bengio 文章称,强化学习只要模型达成目标就给予奖励,因此奏效的捷径,包括作弊和欺骗,会和诚实的解法一起被强化。 他认为能力提升会放大这一问题,因为在网络安全等领域,更强的优化器会更高效地追逐有缺陷的目标。打开原帖#511482