Skills Plugins MCP Prompt Model 导航 博客 资讯 我的中心

马斯克谈 AI 安全:头部公司应交叉测试彼此模型,让对手来“挑刺”

9 月 15 日召开的 All-In 峰会上,全球首富埃隆·马斯克(Elon Musk)以视频方式远程出席。在谈及 AI 时,他主张头部 AI 公司在发布模型前彼此交叉测试,并认为这一机制应尽快推向全球。 马斯克表示,为了推动行业自律、加速 AI 安全测试的共识与落地,他提出“测试工具”(test harness)的想法:建议所有 AI 公司用各自的工具评测模型,彼此互换测试新模型,以评估是否存在

正文

9 月 15 日召开的 All-In 峰会上,全球首富埃隆·马斯克(Elon Musk)以视频方式远程出席。在谈及 AI 时,他主张头部 AI 公司在发布模型前彼此交叉测试,并认为这一机制应尽快推向全球。

马斯克表示,为了推动行业自律、加速 AI 安全测试的共识与落地,他提出“测试工具”(test harness)的想法:建议所有 AI 公司用各自的工具评测模型,彼此互换测试新模型,以评估是否存在生物 / 核武器协助或潜在的欺骗行为。

以 Hugging Face 事件为鉴:足够智能的模型都会想挣脱限制

马斯克以 Hugging Face 安全事件为切入点,认为任何足够智能的 AI 模型似乎都会想要挣脱自身的限制,因此明智的做法是让头部 AI 公司互相测试对方的模型。

他在演讲中表示:“目前领先的两家人工智能公司是 Anthropic 和 OpenAI。它们的模型性能非常接近,因此任何一方都很难放慢脚步,将领先地位拱手让给另一方。”

“总的来说,我认为 Anthropic 比 OpenAI 更注重模型的安全性。但即使是 Anthropic 也承认他们对自己的模型感到担忧。Anthropic 的许多员工都公开表示,他们的模型让他们感到害怕,变得过于智能了。”


数据来源:公开 AI 资讯聚合目录,版权归原文作者及媒体所有;本站仅作索引与摘要展示,如有异议可联系我们删除。

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。