Rohan Paul

@rohanpaul_ai

因此OpenAI现在甚至在完全理解或修正行为之前就会公开披露模型错配. 因此,它使公开披露模型故障制度化,而不是等待偶尔的系统卡或捆绑的调查报告. 它们将优先考虑揭示新的失败机制、显示已知问题日益恶化或破坏对现有保障措施的假设的案件。
打开原帖#511482
  1. 前沿

    企业级 AI 支出正在换向:Anthropic 拿走新增支出的 73%
  2. 前沿

    谷歌发布 Fuse:给 LLM 助手的社交推理一个可验证的标尺
  3. 前沿

    OpenAI、Anthropic 与谷歌 DeepMind 磋商 AI 安全合作,拟共建行业自律机构