Mark Zuckerberg
@finkd
上个月我写过,我们如何能为所有人建设一个积极且安全的未来:http://meta.com/thefutureisforeveryone
每个实验室都有责任和动力,以训练模型所需的安全节奏推进,并有能力自行采取行动确保这一点发生。
现实是:
- 人们不会想用与自己不对齐、不按要求行事的智能体,因此实验室有强烈的自然动力去提升模型对齐。
关于在对齐跟上之前放慢能力进展,存在很多争论。我的观点是,信任与对齐正迅速成为区分智能体和模型的最重要能力。任何不专注对齐的实验室都会落后。
- 如果模型造成伤害,实验室面临重大责任,因此他们同样有强烈动力去防止这种情况。
Meta 推迟了几个月才发布 Muse,以便专注于安全与安保。我们并没有要求其他所有人先这样做我们才做。我们只是把它作为日常工作的一部分去做,因为这对人们和对我们来说显然是正确的事。我为我们打下的安全基础感到自豪。
- 引入独立评估方和建议者是行业最佳实践。MSL 今天已在若干领域这样做,因为这有助于产出更好的工作。其他实验室也可以这样做。总体而言,拥有更大、更多样的评估方生态会有帮助。
- 把绝大部分算力用于服务人,而不是竞速递归自我改进,是确保我们安全发展这项技术的最佳方式之一。Meta 已经做出这一承诺,其他实验室也可以这样做。
我相信,为所有人建设积极未来的关键,是保持正确的权力平衡。这是我们力所能及的。