前 Anthropic 研究员考克森警告:AI 自主研究或数月内实现,人类灭绝风险过半
警告“AI 或灭绝人类”的前 Anthropic 研究员:某种意义上,我曾研究让 AI 取代自己
在 Anthropic 和 OpenAI 干过的研究员去市议会作证,说两家公司安全保障不够,他自己的工作就是训练 AI 取代研究员,几个月内就可能实现。
27 岁的前 Anthropic 模型能力研究员 Jacob Cockburn(考克森)于 10 月 5 日在纽约市议会 AI 风险听证会上作证。他透露 OpenAI 曾为自动化 AI 研究员设定 2027 年、2028 年前后的目标,且进度符合甚至超过预期。他估计人类失去控制权的概率超过一半,可能最终导致人类灭绝。他指控 Anthropic 和 OpenAI 缺乏足够安全保障仍推进研发,呼吁实验室提高透明度并放慢开发速度。
警告“AI 或灭绝人类”的前 Anthropic 研究员:某种意义上,我曾研究让 AI 取代自己
IT之家 10 月 8 日消息,据《商业内幕》报道,曾在 Anthropic 和 OpenAI 任职的研究员雅各布 · 考克森警告,AI 很快就能自主开展研究,人类可能完全无法掌控此后的发展。 27 岁的考克森曾在 Anthropic 从事模型能力研究,上个月公开宣布辞职。当地时间 5 日,他向纽约市议员发出警告,称 AI 可能威胁人类生存。 考克森在纽约市议会有关 AI 风险的听证会上作证称,顶尖前沿 AI 实验室的首要目标, 是让 AI 研究实现自动化 。“我在上一份工作中,某种意义上就是在研究 怎么让 AI 取代自己 。我在 OpenAI 时,我们为自动化 AI 研究员设定了 2027 年、2028 年前后的阶段性目标,研发进度符合预期,甚至超过预期。距离那个时候只有几个月,不是几十年,连五年都不是。” 一旦 AI 能自行开展研究,人类参与和干预研究的程度会比今天低得多,而今天的情况就不太理想。以他的亲身经历来看,大部分代码都由 AI 编写,“人们也不再那么仔细地检查代码。” 考克森向议员们作证称,在 Anthropic 和 OpenAI 的工作经历令自己确信,两家公司没有充分的安全保障, 却仍在推进研发 。“人类失去控制权、让 AI 掌握控制权的概率超过一半,最终可能导致人类灭绝。根据我的经历,后果如此重大,两家公司的做法却极其鲁莽。” 考克森在 X 上宣布辞去 Anthropic 职务时,发帖指控 Anthropic 和 OpenAI 都没有负责任地行事, 拿人们的生命作赌注 。帖子随后广泛传播。 听证会上,考克森呼吁 AI 实验室提高透明度,放慢技术飞速发展的步伐。“这些公司用的是初创企业那套思路: 先快速推进,出了问题以后再修 。做照片分享应用可以这么干,开发有史以来最强大的技术可不行。” 据IT之家此前报道,今年 9 月,考克森在辞职时发出警告:“研发 AI 的人确实相信,AI 可能在本世纪 20 年代结束前杀死我们所有人。 这不是营销噱头 。” 相关阅读: 《 曾任职 OpenAI 的 Anthropic 预训练研究员离职并警告:两家公司正拿人类生命赌博 》