还记得吗,就在不久前:九月初,Anthropic的研究员Jacob Coxon从这家AI研发最前沿的公司之一愤然离职,并留下了一句相当吓人的警告。在他看来,造这些模型的人心里非常清楚,它们可能「在这个十年结束前把我们全都杀光」,但还是在继续加速冲向一个能自我改进的人工智能。Coxon指责Anthropic和OpenAI「拿我们的命在赌」,并认为整个行业跑得太快了,却还没找到任何能保证人类掌控局面的办法。

Twitter/X 内容,在您授权之前保持隐藏。
若您允许显示此内容,embed.warning.twitter

「人类有史以来接近过的最危险的东西」

几周之后,轮到比尔·盖茨发出同样极度悲观的声音了——更关键的是,他的口风变了,要知道他此前对这项未来科技的发展一直相当看好。这位微软联合创始人如今断言,人工智能在2026年初已经跨过了两道危险门槛:第一道在网络安全,第二道在生物恐怖主义。他甚至认为,落到坏人手里的AI可能造成「十亿人死亡」。这番话和他2023年的说法形成了鲜明反差,当时他还觉得AI的风险「真实但可控」。

做客记者Ezra Klein的《纽约时报》播客时,比尔·盖茨说,这个转折点出现在今年年初。他认为,现在的模型已经能实实在在地帮上忙——帮那些想发动网络攻击、或者想搞出危险病原体的人。「今年年初,我们越过了网络安全那道坎,也越过了生物那道坎。」他说。换句话说,盖茨谈的不只是某个假想的未来、某个人工智能强到脱离创造者掌控的时刻,他觉得一些令人不安的能力,今天就已经摆在那儿了。在生物这一块,他担心的是:靠着AI,一些小团体也能掌握过去需要投入巨量资源才能拿到的知识。按他设想的剧本,心怀恶意的人可以用这些模型,走完设计一种新病原体所需的若干步骤。嚯,这就有点吓人了。

"Aie confiance... Crois-en moi "
"Aie confiance... Crois-en moi "

强制加装的监控层

网络安全那边也是同一套逻辑。盖茨提到,有些模型能揪出代码里的漏洞——那些人类看了好几年都没发现的漏洞。他特别点名了Mythos,Anthropic在今年春天公布的一个模型,因为能力带来的风险,一直没有对外开放。我们由此得知,Anthropic把它交给了几家合作伙伴,纳入Project Glasswing,用来在漏洞被利用之前先把它们找出来。公司称,这个项目至今已经发现了超过10000个严重或危急级别的漏洞。而在盖茨看来,麻烦在于:现存的代码体量实在太庞大了,想要全部检查到位、而且检查得够快,根本不可能。

话虽如此,盖茨并不认为就该停下人工智能的研发。他更担心的是:能力进步的速度,远远超过了研究者和监管部门控制其后果的能力。正因如此,他呼吁在AI模型中强制加入一层监控机制。另外在他看来,开源模型让问题变得更棘手,因为用户可以随意下载和修改。盖茨认为开源模型可以继续存在,但希望它们的运行方式能让人核实安全机制是否仍在生效。他的分析当然只是目前这场AI风险大讨论中的一种声音,但有一点可以肯定:这次转变,很难让人视而不见。

YouTube 内容,在您授权之前保持隐藏。
若您允许显示此内容,Google 将在您的设备上写入 Cookie,并获取您的 IP 地址。

您觉得这篇文章怎么样?

延伸阅读
iPhone Duo 的杀手级应用已经出现:一台虚拟卡带随身听,美得不像话!
阅读 →