
近日出现多项令人震惊的AI安全主张,包括人类面临10%的毁灭机率、AI比核武更危险、僵尸网路可能威胁整个网路,以及这一切都是大型科技公司策动的心理作战。资料照片。(路透)
近日出现多项令人震惊的AI安全主张,包括人类面临10%的毁灭机率、AI比核武更危险、僵尸网路可能威胁整个网路,以及这一切都是大型科技公司策动的心理作战。卫报整理相关主张与各方回应,本文检视其中5项争议。
「在6至12个月内,一群AI可能透过持续运作的僵尸网路接管整个网路,造成数千亿美元损失。」——Anthropic执行长阿莫戴(Dario Amodei)
纽约大学荣休教授、AI怀疑论者马库斯(Gary Marcus)表示,阿莫戴的担忧不应完全忽视,但也应大打折扣。他认为,宣称整个网路都很脆弱「荒谬」,若实验室本身没有出现极端疏忽,「很难理解这种情况如何发生」。英国AI安全研究所最近评估也显示,Anthropic目前最尖端的AI之一Mythos,仅能「自主攻破规模小、防御薄弱且存在漏洞的系统」。马库斯与两名同事认为,防御较弱的个别网站可能遇袭,但「网路本身极不可能崩溃」。
「我们真的相信AI可能杀死所有人类!我个人认为,未来10年内的机率超过10%。」——Anthropic对齐科学主管胡宾格(Evan Hubinger)
这就是AI界所称的p(doom),也就是「毁灭机率」,指AI摆脱人类控制并引发灾难、消灭人类的可能性。不过,AI Now Institute首席科学家克拉夫(Heidy Khlaaf)对用百分比量化这类存在性风险持怀疑态度。她指出,目前甚至缺乏「超级智慧」AI如何导致「毁灭」的具体例子,「这些主张既无法证伪,也无法验证,因此本质上不科学」。
「我认为,姑且称之为心理作战吧,这场行动其实已经铺陈很久了。这只是点燃大火的那根火柴。」——SpaceX执行长、全球首富马斯克
马斯克所说的「心理作战」,指的是大型AI公司要求政府加强监管,实际上可能藉此提高进入先进AI领域的门槛,使新创公司难以负担遵守规范所需的资金与人才。
加拿大电脑科学家、现代AI先驱班吉欧(Yoshua Bengio)不相信这是一套精心设计的游说计画。他指出,对准备上市、估值可能高达数兆美元的AI公司而言,放慢发展并不符合自身利益。
不过,美国副总统范斯(JD Vance)14日表示,看到这么多前沿AI公司「恳求政府监管它们」让他感到「有一点奇怪」,并形容这像是「特洛伊木马」。批评者也称这是一种「监管俘虏」策略,认为相关规范可能拖慢潜在竞争对手。
「超级智慧AI带来的威胁规模与核武相当,甚至可能更大。」——英国前国防大臣布朗(Des Browne)
牛津大学AI治理倡议资深研究员奥德(Toby Ord)认同这项警告,认为一旦开发出超越人类的AI系统,几乎不可能再回头。但超级智慧AI目前尚不存在,也不能保证一定会出现,AI Futures Project预测最早要到2028年12月才可能出现。
兰德公司(Rand Corporation)则认为,由于核武指挥与控制系统有严格安全措施,AI无法直接导致核武被动用,但这建立在国防官员不把AI导入武器管理系统等假设上。此外,AI仍可能增加其他核风险,例如利用假讯息误导决策者相信敌方即将发动核打击。
「如果中国在这方面胜出,就没有明天过后。如果他们在AI领域把我们远远甩在后面,那么其他一切都不再重要。」——美国财政部长贝森特
美国与中国在AI发展方面遥遥领先其他国家。有一种看法把AI视为类似冷战核武竞赛的超级武器,认为一旦美方把领先地位让给中方,就会形成无法挽回的局面,因此不能放慢脚步。阿莫戴也表示,「中国在AI领域取得领先,将对美国及全世界构成严重危险」。
不过,一些评论人士认为,华府与Anthropic这套中国威胁论述背后另有商业考量。一名曾任职Hugging Face的工程师认为,阿莫戴要求控制前沿AI发展速度,是为了压制廉价的中国开源AI模型。这些模型能力几乎与OpenAI和Anthropic相当,却开放原始码且不向使用者收费,对两家公司获利构成严重威胁,牵涉数千亿美元利益。
精华 FAQ Q1:为何「AI可能接管整个网路」的说法遭到质疑?
评论者认为,现有AI顶多能攻破防御薄弱、规模较小的系统,离全面瘫痪整个网路仍很远;若实验室本身没有严重疏失,这种情境难以成立。
Q2:所谓p(doom)的「AI毁灭机率」争议在哪里?
p(doom)指AI失控并导致人类毁灭的机率,但批评者指出,目前连超级智慧如何造成「毁灭」都缺乏具体案例,百分比看法既难证伪也难验证。
Q3:为何有人怀疑AI公司推动监管与中国威胁论有商业考量?
批评者认为,严格监管可能抬高新创与开源模型的门槛,反而有利于既有大公司维持优势;至于中国威胁论,也可能被用来合理化放慢竞争对手追赶速度。
