Rohan Paul
@rohanpaul_ai
来自谷歌的漂亮论文。
ScientistTwo展示了人工智能研究中递归自我改进的另一个进展:它可以改进人类的方法,然后以自己的发现作为基线并再次改进。
研究助理成为研究循环:它自主改进了 107 个人类定义的 ML 问题中的 86 个,这表明实验可以在科学判断之前实现自动化。
ScientistTwo 不是帮助完成一项任务,而是运行一个循环:提出想法、测试它们、删除无用的内容,然后使用审阅者反馈开始另一轮。
在基于 ICLR、ICML 和 NeurIPS 论文的问题中,它报告了 80.4% 的成功率,并且比原始人类基线平均相对改进了 25.2%。