Alexandr Wang
@alexandr_wang
我们坚信必须大力投入对齐。
1. 人们和企业只会使用与自己意图和价值观对齐的智能体。如果我们不构建与人、与企业对齐的模型,他们就会转向更对齐的选项。
2. 每个实验室都应在训练和部署上建立强有力的治理框架。这应包括外部评估方(透明度的最佳实践),以及在模型发布安全标准等方面的独立监督。
3. 每个实验室都需要在民主国家的制度保护下运营。这意味着如果模型造成伤害,实验室将面临重大法律责任。这将以正确的方式推动整个生态。
4. 该领域的进展最终取决于算力与资源配置。在递归自我改进上竞速,是可能导致对强大模型失控的最危险路径之一。Meta 正把绝大部分算力投入服务人,而不是竞速 RSI,其他实验室也可以做出同样选择。
AI 是非常强大的技术,在正确的制衡之下安全地发展它,责任重大。