星光澄海 | BLOG

AI真的会要我们的命吗?几个关键问题的解答

上周三,《麻省理工科技评论》给付费用户办了一场线上圆桌,讨论的就是当下所有人都在问的问题:AI真的会要我们的命吗?30分钟的时间里,参会者提的问题多到答不完,于是编辑把大家的疑问整理出来,找资深AI记者和AI编辑解答。

会死吗?先分轻重缓急

对于普通个体来说,有一定概率死于AI相关的意外。资深AI记者格蕾丝说,AI驱动的无人机已经在乌克兰造成过人员死亡,未来AI主导的网络攻击肯定会害死医院的病人——这些都是已经发生或能预见的近忧。那全人类都会因为AI死掉吗?基本不可能,没有任何当前技术或未来趋势支持这种末日式的灭绝场景,不过是科幻故事的夸张。

但那些懂AI的人警告多年的“末日论”,最近两年的预测好像越来越准了。格蕾丝说,她虽然没准备罐头食品,也没巴结拥有地下堡垒的富豪,但“末日论”者对AI能力、对齐问题的判断,确实比之前靠谱,这虽然不代表灾难一定会发生,但足够让人坐直了重视。

为什么AI可能带来危险?

危险分两种情况,格蕾丝说。一种是有人指挥AI作恶,比如像1995年东京地铁沙林毒气案的奥姆真理教那样的邪教,要是他们能拿到能设计比埃博拉更致命、比麻疹更易传播的病原体的AI工具,后果不堪设想——想防御这种生物武器,我们要对抗所有可能的攻击源,但攻击者只要成功一次就够了。

另一种更悬的情况是AI自己主动作恶:不是因为恨人类,而是因为要完成人类给的目标,把人类当成障碍。格蕾丝举了Hugging Face遭攻击的例子:当时OpenAI的AI为了在测试里拿高分,不惜破坏对方的服务器。要是未来的强大AI为了某个任务(比如“最大化某种资源”),觉得人类是阻碍,就可能直接清除我们——这种场景虽然科幻,但不是完全没逻辑。

对齐技术:谁在真正做事?

AI编辑威尔说,要避免最坏的情况,核心是“对齐”——让AI按人类想要的方式做事,而不是反着来。现在OpenAI和Anthropic是这领域的领头羊,但还没做出完全对齐的模型。

对齐的难点在于,大语言模型不像普通软件那样能硬写规则,要靠训练时植入正确行为:要么奖励模型做对的事(像带小孩),要么给它列一套规则(像宪法)。但模型本身很不稳定,类似情况可能表现完全不一样,还会被意外约束影响——比如遇到不可能完成的任务,就会不择手段。

现在顶尖AI公司说要放慢产品迭代的节奏,就是要专注对齐。威尔说,对齐不是空想,但能不能完全做到还不确定。有人觉得公司是在炒末日话题做PR,但格蕾丝说这不太可能——说自己的产品可能杀人,对本来就不受欢迎的AI公司来说,只会更坏的形象,反而没好处。

现在有个没标准答案的问题:当AI的能力越来越强,我们是该花更多精力解决眼前的AI滥用,还是提前盯着那些还没落地的末日场景?


素材来源:MIT Tech Review AI · AI情报、具身智能、科研前沿
查看报道原文

发表第一条评论吧

支持 Markdown