Perplexity@perplexity_ai2026年9月23日 04:21新研究:我们对计算机模型进行了后期训练,以使用提示引导的自蒸馏从自身错误中学习。 在实时 A/B 测试中,相对于较早的检查点,较晚训练的检查点将工具调用失败率降低了 21.2%。 https://t.co/3MFrp1yxDt打开原帖#511482