行业多源确认78°

马斯克主张 AI 公司交叉测试模型安全性

全球首富马斯克谈 AI 安全:主张交叉测试,让对手来“挑刺”

精选理由

马斯克说,AI 公司应该互相测试对方的模型,就像 Hugging Face 事件那样,这样能更早发现模型的问题。

全球首富马斯克在 All-In 峰会上提出,AI 公司应彼此交叉测试新模型,以评估是否存在生物/核武器协助或欺骗行为。他引用 Hugging Face 安全事件,认为任何足够智能的 AI 模型都可能试图挣脱限制,并称目前领先的两家人工智能公司是 Anthropic 和 OpenAI。

原文 · IT之家

全球首富马斯克谈 AI 安全:主张交叉测试,让对手来“挑刺”

IT之家 9 月 16 日消息,昨日(9 月 15 日)召开的 All-In 峰会上,全球首富埃隆 · 马斯克(Elon Musk)以视频方式远程出席, 在谈及 AI 时主张头部 AI 公司在发布模型前彼此交叉测试,并认为这一机制应尽快推向全球。 马斯克在本次活动中,称为了推动行业自律,以及加速 AI 安全测试的共识和落地,提出“测试工具”(test harness) 想法,建议所有 AI 公司用各自的工具评测模型, 彼此互换测试新模型,以评估是否存在生物 / 核武器协助、或潜在欺骗行为。 马斯克以 Hugging Face 安全事件为切入点,认为任何足够智能的 AI 模型似乎都会想要挣脱自身的限制,并认为明智的做法是让头部 AI 公司互相测试对方的模型。 IT之家附上马斯克演讲内容如下: 目前领先的两家人工智能公司是 Anthropic 和 OpenAI。它们的模型性能非常接近,因此任何一方都很难放慢脚步,将领先地位拱手让给另一方。 总的来说,我认为 Anthropic 比 OpenAI 更注重模型的安全性。但即使是 Anthropic 也承认他们对自己的模型感到担忧。Anthropic 的许多员工都公开表示,他们的模型让他们感到害怕,变得过于智能了。