Rohan Paul
@rohanpaul_ai
斯坦福大学+牛津大学的新论文 MedRSI 表明,医疗人员可以从自己的错误中改进自己,但前提是新功能必须在新的患者身上进行测试才能成为永久性的。
显示自我改进的智能体需要两件事:关注有害的失败并拒绝保留新功能,直到他们处理后续案例。
更重要的是,本文展示了为什么自我提升需要护栏。
如果立即添加每个有前景的工具,准确度最终会下降:到第 30 轮使用 57 个工具时,准确度为 76.9%。
由于注册速度较慢,代理商只保留了 18 个工具,保留了 94.4%。
它还在可能造成更大临床伤害的错误上投入更多精力,而不仅仅是最常见的错误。
让代理人积极地发明,但通过反复的独立评估进行永久的自我改变,赢得自己的位置。