Perplexity

@perplexity_ai

在智能体搜索中,一个使用该 9B 模型的 GPT-OSS-120B 智能体正确回答了 64.0% 的 BrowseComp+ 问题,比排名第二的 ColBERT 模型高 4.9 个百分点,且搜索次数少于所有基线。https://t.co/hFngH5ES7D
打开原帖#511482
  1. 产业

    Rohan Paul:– https://arxiv.org/abs/2610.08144 标题…
  2. 产业

    Rohan Paul:一篇新论文表明,当 AI 把一个数学证明翻译成 Lean 时,通过 Lea…
  3. 产业

    Rohan Paul:Emad Mostaque:AI 模型“基本上已经达到了人脑的效率”