9 月 24 日晚间,The Information 援引知情人士消息称,谷歌、OpenAI 与 Anthropic 正在推进成立一个 AI 安全标准机构,暂定名为 Standards Authority for Frontier AI(前沿 AI 标准局,缩写 SAFA),三家公司希望该组织在今年年底或明年年初启动,且不依赖政府监督。据 GuruFocus 与 CGTN 的报道,在缺乏新政府监管框架的情况下,三家选择以行业自律填补这一空白;SAFA 计划实施具体的测试与审计体系,而不只是笼统的伦理准则。

[1][2]

nut graf:这则消息值得注意的不是三家又表了一次"负责任的 AI"的姿态,而是自律从宣言变成了机构设计——报道中的 SAFA 带着可执行的细节:部署前第三方安全测试、事件报告规则、独立审计要求。这与 2023 年成立的 Frontier Model Forum 不同:那是一个宣示性的行业论坛,成员包括微软;而新机构由谷歌、OpenAI、Anthropic 三家自行推进,微软缺席,且明确不做政府背书。The Information 的报道称,三家公司最初寻求的是有联邦监督的公私合作,但这一路径因行业内缺乏共识、政府优先级变化而搁浅,才转向自建。 47 48 报道中的设计要点分三层。职责上,SAFA 聚焦"为先进 AI 模型制定安全标准":不是发布一般性伦理原则,而是推进部署前第三方安全测试,并建立事故报告规则——这是把"安全"从声明变成可执行流程的信号。治理上,它计划独立运作,填补监管真空,但这也正是其最大的软肋:一个没有法定权力的自律组织,合法性要靠行业认受度来建立,GuruFocus 的报道指出它需要与现有监管机构协调、并获得更广泛行业支持,否则很难被承认为标准制定方。成员结构上,三家牵头、微软不在名单中,与当年 Frontier Model Forum 四家并列(含微软)的格局形成对照,也意味着这个标准组织从一开始就带有"核心玩家自定规则"的色彩。 49 50 对行业的意义要放在时间线上看:过去一周,OpenAI 与 Anthropic 同一天各发新模型(GPT-6 系列与 Claude Opus 5.5)、至少八款模型在七天内登场(Alegria 的每日盘点以此开头),模型发布节奏加快的同时,安全标准仍停在自愿声明阶段。三家公司此时推进 SAFA,等于承认"等政府定规则"这条路走不通,转而用自律争取定义权。值得警惕的是无监督自律的内在张力:标准制定方与受规管方是同一批公司,测试与审计的独立性、事故报告的透明度,最终都要靠外部监督来兑现——报道目前只描述了机构框架,没有给出治理细节,这正是后续最该盯的部分。

[1][2]
深夜的开放式办公室会议角,前景是一张长桌,桌上摊开一叠白纸文件与三块深色平板电脑(纯图形无文字),文件上方压着一支钢笔;中景是玻璃隔墙后的会议室,几把空椅子围着圆桌,墙上挂着一块空白的白板;背景是落地窗外深夜城市灯光与室内一排熄灭的显示器。画面中无人物,无任何文字。
三家公司自己制定安全标准,谁来监督监督者, AI 生成插画,非新闻照片