Scale AI@scale_AI2026年9月19日 00:17人工智能安全不能一对一地翻译。 我们与韩国人工智能安全研究所合作,开发了ROK-FORTRESS,这是我们共同的第一个基准测试,用于测试语言和地缘政治背景如何影响人工智能安全。 在14个前沿模型中,我们发现仅靠翻译可能会错过模型行为的显著差异。 https://t.co/VnHnMNvWJ2打开原帖#511482