Gary Marcus@GaryMarcus2026年9月11日 03:23👇 所有这些有关《毁灭战士》的言论都分散了人们对大型前沿人工智能公司(尤其是 OpenAI)在安全方面的能力不足这一事实的注意力。正如我刚刚从长期安全工程师 @NielsProvos 那里收到的一封电子邮件所说,与 @ZackKorman 和我几周前写的内容一致, “就存在风险而言,适当的基础设施控制对于更广泛的失控论点至关重要。智能模型对推理、网络、凭证或物理基础设施没有权威。即使模型变得更加强大,这些仍然是外部控制点。我们知道实验室擅长检测蒸馏攻击,但他们似乎没有同样的动机来防止自己的代理行为不当。”打开原帖#511482