Mark Chen

@markchen90

GPT-6 Astra 来了!这对我们的研究团队是一个重要时刻——多年在预训练、强化学习和后训练上的工作,汇聚成我们迄今最强且对齐更好的模型。它能编写并测试软件、跨应用操控电脑,甚至协助攻克开放科学问题! 几年前还像重大挑战的能力,如今已变成人们真正能用的工具。以 Computer Use 为例——如果你以前试过觉得太慢或不够好,建议再试一次。我们自 Operator 以来进步很大,现在已经「开箱可用」。 我们也在让这些系统代表你完成更关键的工作。Agent 需要与你的目标与价值观保持一致、思考过程更透明,并在任务变难时仍能接受监督。我们在 Astra 上这些行为有显著进展,并配合更强的监控以阻止潜在未授权操作。这些工作是本次发布成为可能的一部分。 我认为对齐是 AI 最重要的研究前沿之一,远未解决。理解并对齐模型的能力必须跟上模型能力的提升。我们希望让人有更多空间去思考、构建与发现,同时让越来越强的工具仍*处于人的控制之下*。 非常感谢把我们带到这里的研究者与团队。前方还有大量工作,我对近期能实现什么感到非常兴奋!
打开原帖#728545
  1. 前沿

    10 亿美元给水厂和市政府:OpenAI 的 Daybreak 前线防御计划
  2. 研究

    五百万美元买尺子:Anthropic 把 AI 用户福祉评测交给外部专家
  3. 前沿

    最对齐,却更难盯:Astra 的思维链监视性在下降