斯坦福大学教授、World Labs 联合创始人李飞飞周二(9 月 22 日)在彭博电视采访中表示,AI 的安全评估不能只由开发这些系统的公司负责:企业内部研究员可以评测单个模型的能力与安全属性,但这无法替代由政府、行业和学术机构共同制定的更广泛标准。"我仍然相信独立机构和学术界等公共部门制定基准的重要性,以及产业界和政府共同承担责任的重要性。」
[1][2]nut graf:李飞飞这番表态踩在"AI 减速"论战的正上方——过去两周,Anthropic CEO 公开呼吁放缓前沿模型节奏、两名知名安全研究员离职加入评估机构 METR;而李飞飞的立场微妙地不同:她不要求减速,她要求"第三方打分"。把"是否该慢下来"的争论翻译成"谁来给考卷打分"的治理问题,等于给这场辩论换了一个更可操作的落点。
李飞飞的核心论点是评估主体问题。企业拥有最直接的技术细节与运行数据,但内部评测体系与商业目标深度绑定,难言完全中立;当模型能力持续增强,把安全评估完全交给开发者,既削弱公众信任,也难以形成跨企业、跨行业的统一基线。她的药方是"多利益相关方":独立机构与公共部门制定基准,产业界与政府共同承担责任。这与她作为 World Labs CEO 的身份并不矛盾——她反对的从来不是企业做安全研究,而是企业垄断"自己出题、自己批卷"的权力。放在更大的时间线上,这条立场与最近几周 OpenAI 成立独立数学咨询小组(IAS 主办、允许公众质疑)、与 Anthropic 磋商互测协议的动向同向:无论减速与否,行业正在把"自我评估"推向"外部评估"。
需要分清的口径:李飞飞在采访中的表述是对"AI 系统性风险最终取决于人类……"判断的延伸,原话引用应以媒体报道为准;她呼吁的是"更多监督"与"独立基准",并没有给出具体的立法或监管方案,也没有点名批评任何一家公司或政府。这篇文章把它当作一位有影响力的研究者对治理框架的公开表态来报道,不涉及对任何国家监管政策的评价。它值得关注的原因在于时间点:一边是实验室之间为"减速还是加速"争吵,一边是安全研究人员流向独立的评估机构,李飞飞的发言恰好为"独立评估"这条中间路线提供了最响亮的名人背书。
[1][2]