把过去 48 小时 OpenAI 的动作排在一起,会看到一条清晰的线:9 月 21 日,成立独立数学咨询小组,把成果评审交给外部数学家;同一天,发布政策提案《为 AI 下一阶段建立标准》,呼吁美国牵头制定前沿 AI 全球技术标准,并把"递归自我改进"(RSI)正式放进标准讨论;9 月 22 日,The Information 报道它与 Anthropic 正谈判互相压力测试的协议。三件事同向叠加——OpenAI 正在把"安全"从口号变成机构。

[1][2]

先看提案本身的分量。OpenAI 在这份政策文件中把重点放在两个方向:一是建立能衔接各国与国际层面的前沿 AI 标准机制,二是推动统一的 AI 能力测量、风险评估与事故报告机制。文件特别点名 RSI——AI 系统在无人干预情况下设计开发下一代系统的过程——要求把"自动化 AI 研究人员的收益-风险管理"纳入标准。它甚至给出了具体抓手:参考美国商务部下属的 AI 标准与创新中心(CAISI),以及韩国、新加坡、印度、英国等国的现有机构。这不是一份空谈的愿景声明,而是一份有机构名、有机制设计、有分工路线的政策清单。

把这三件事连起来看,才能看清 OpenAI 的安全策略发生了怎样的位移。过去半年,它的安全叙事靠"我们很重视安全"这种话支撑,被批评为营销;而这一周,它开始把信任问题外包给外部机构:数学成果交给独立数学家小组评审,行业标准交给多国机构协商,模型漏洞交给竞争对手测试。这三者共享同一个逻辑——"自我报告的公信力已经耗尽,需要外部锚点"。数学咨询小组的"有声音无刹车"设计、互测协议里"不保留对方数据"的条款,都在用制度设计对冲单方作恶的动机。

当然,要泼一盆冷水。提案呼吁的是"美国牵头"的全球标准——在欧盟 AI Act、中国《全球人工智能治理倡议》并行推进的当下,"美国主导"本身就是地缘叙事的一部分,其他地区未必买账;互测协议还在谈判中,尚未确认落地;数学咨询小组对内部研究节奏没有权力,能影响的是"怎么说"而不是"做什么"。真正要盯的不是这些文件本身,而是接下来的执行证据:RSI 标准是否进入实际监管流程、互测协议是否产生公开的对等披露、咨询小组是否真的对 OpenAI 的争议结果说过"不"。制度化转向的成色,只能用之后的行动来验收。

[1][2]
清晨的政府办公大楼走廊,一名政策官员背影抱着文件夹快步走向会议室,玻璃门内长桌旁围坐着多国代表,门楣上一盏绿灯亮起,窗外晨光
安全制度化, AI 生成插画,非新闻照片