Gary Marcus

@GaryMarcus

真正的新闻不在于结果,而在于我们没有被告知的东西。 1. AI 曾经试图成为一门科学。如今我们得到的却是像下面这样来自 OpenAI 的完全含糊其辞的报告,以及一大堆不懂得如何批判性思考的人提出的无知问题。 “相同的流程”?“使用一个未发布的模型”? 这绝不可能通过同行评审。 我们不知道流程是什么。 我们对架构一无所知(例如,证明是一次性生成、然后由 Lean 验证的吗?有没有迭代过程?)。 我们对失败率一无所知。我们对训练/后训练/数据增强一无所知。 2. 因此,我们完全不知道这一结果在数学之外的可推广性如何。 3. X 上很大一部分已经沦为无知的啦啦队,在不知道自己在为什么鼓掌、也不知道它可能意味着什么的情况下鼓掌——从不提出基本的科学问题。 这个新系统可能是迈向 AGI 的合理一步,也可能只是在一个可验证领域里巧妙地利用了 Lean 和合成数据、却毫无通用性可言;从这份报告中,我们几乎什么都看不出来。
打开原帖#511482
  1. 产业

    Rohan Paul:– https://arxiv.org/abs/2610.08144 标题…
  2. 产业

    Rohan Paul:一篇新论文表明,当 AI 把一个数学证明翻译成 Lean 时,通过 Lea…
  3. 产业

    Rohan Paul:Emad Mostaque:AI 模型“基本上已经达到了人脑的效率”