François Chollet@fchollet2026年10月07日 08:13如果参差不齐的能力前沿主要就是数学 + 代码(借助 RLVR 可以把它们推到任意远),而其他一切都开始进入平台期,因为它仍然受制于人类生成的数据呢? 模型在不可验证领域的表现一直在稳步提升,尽管比数学和代码慢得多。但这种稳步提升,是更高的 G(其本身由 RLVR 驱动)带来的副作用,还是仅仅取决于注入训练的新人类数据量(这种注入仍在以大规模持续进行)? 很多事情都取决于这个问题的答案打开原帖#511482