Rohan Paul
@rohanpaul_ai
别再让你的AI代理辩论和投票了
新建斯坦福+ AI论文一起展示了学习检查对方工作的团队解决了问题,其中没有一个能单独解决问题.
许多特工的设置只是有模型辩论,然后投票. 这大多是某人已经得到的答案。
在这里,一名模特回顾了过去的团队聊天,并改写了团队的游戏本,比如谁对谁和谁扮演魔鬼的代言人进行双重检查. 学习这仅仅经历了15个练习问题。
在数学和物理测试方面,3型球队的平均成绩为66.7%,而仅其最佳型号为48.8%. 它甚至能完美地在模特儿自己的答案中做出选择, 所以团队合作创造了一个正确的答案, 没有人有。
所以跳过辩论和投票的脚本:给代理商明确的工作,比如检查员和挑战者,让过去运行来改进它们.