Rohan Paul

@rohanpaul_ai

斯坦福大学+牛津大学的新论文 MedRSI 表明,医疗人员可以从自己的错误中改进自己,但前提是新功能必须在新的患者身上进行测试才能成为永久性的。 显示自我改进的智能体需要两件事:关注有害的失败并拒绝保留新功能,直到他们处理后续案例。 更重要的是,本文展示了为什么自我提升需要护栏。 如果立即添加每个有前景的工具,准确度最终会下降:到第 30 轮使用 57 个工具时,准确度为 76.9%。 由于注册速度较慢,代理商只保留了 18 个工具,保留了 94.4%。 它还在可能造成更大临床伤害的错误上投入更多精力,而不仅仅是最常见的错误。 让代理人积极地发明,但通过反复的独立评估进行永久的自我改变,赢得自己的位置。
打开原帖#511482
  1. 产业

    Qwen:感谢@arena的认可! 🏆 Qwen-Image-2.1 现在是图像编辑…
  2. 产业

    Tencent Hy:ComfyUI ✖️ Hy Image3.5 预览
  3. 产业

    Rohan Paul:– https://arxiv.org/abs/2608.24961 标题…