Rohan Paul
@rohanpaul_ai
Alexandr Wang(@alexandr_wang,Meta 首席 AI 官):还没人知道如何解决对齐问题
「我认为,这是人工智能领域在科学上最开放的问题之一。我认为没有人确切知道该怎么解决,但已经有一些想法。」
他的方案是「可扩展监督」(scalable oversight):
「随着 AI 变得更聪明,我们用另一组 AI 去观察它们在做什么,并把它们管住。」
观察者 AI 必须跟着被观察的模型一起变强,所以实验室也需要打造「越来越聪明的监管代理」。
Meta 的 Muse 已经在用类似做法:另有一个哨兵代理检查主代理在做什么。
----
完整视频在 Cleo Abram 的 YouTube 频道(链接见评论)