Alexandr Wang
@alexandr_wang
我们坚信有必要投资对齐。
1. 个人和企业只会使用与其意图和价值观对齐的智能体。如果我们不构建与个人和企业对齐的模型,他们就会转向更对齐的选项。
2. 每个实验室都应在训练与部署上拥有强治理框架。这应包括外部评估方(透明性的最佳实践),以及对模型发布安全标准等事项的独立监督。
3. 每个实验室都需要在民主国家的制度保护下运营。这意味着如果模型造成伤害,实验室将面临重大责任。这将以正确的方式推动生态。
4. 该领域的进展最终取决于算力与资源分配。竞速递归自我改进,是强大模型可能失控的最危险路径之一。Meta 正把绝大部分算力用于服务人,而不是竞速 RSI,其他实验室也可以选择这样做。
AI 是非常强大的技术,在正确的制衡下安全地发展它,责任重大。