Perplexity

@perplexity_ai

通过提示,未更改的模型在 93.7% 的情况下避免了最初的失败,高于 75.1% 在单独的实时测试中,经过训练的版本之间的工具调用失败率从 2.24% 下降到 1.77%,并且没有提示推理时间。 https://t.co/qfwW1y1nql
打开原帖#511482
  1. 前沿

    AI 风险走上安理会:DeepSeek 受邀与 OpenAI、Anthropic 同场简报
  2. 前沿

    答案对、过程错:LogicTrack 用定理证明器给推理链做“逐步审计”
  3. 前沿

    4.36 万亿 Token:GLM-5.3-Flash 登顶 OpenRouter 日榜,开发者用调用量投票