四大AI被问“人类如何灭绝”:人类滥用AI比AI本身更危险

CNMO科技
 来自北京

【CNMO科技消息】9月11日,据外媒消息,Business Insider于近日公开了向OpenAI的ChatGPT、谷歌Gemini、Anthropic的Claude、xAI的Grok提出同一问题、并用相同表述询问的结果。问题是,AI导致的人类终结会是什么样子。由230个单词组成的问题要求解释AI理论上如何导致人类灭绝,提出最常被提及的情景,并根据专家分析评估各情景可能性。对于每个情景,要求说明:情况可能如何展开;必须发生什么问题才会导致灾难;专家为何认为其可能性比其他情景高或低;以及降低风险的安全装置。

AI机器人渲染图

AI机器人渲染图

四个AI中,可能性最低的情景是AI拥有意识后故意决定消灭人类,即所谓“杀人机器人”情景。ChatGPT解释,大多数AI研究者并不将AI的意识或恶意意图视为核心风险因素。Gemini也给出类似看法,将AI拥有自我后开始憎恨人类的科幻电影式“终结者式AI叛乱”列为最不可能的情景。Gemini提出,技术专家大多不接受这一情景,原因在于智能并不等于恶意;此外,主要军事基础设施与外部网络分离,并且仍严重依赖人类监督。

四个AI都回答,人类滥用AI可能比AI本身更直接危险。ChatGPT指出,强大AI系统可能帮助恶意行为者开发生物武器或精密网络攻击,使虚假信息扩散或关键基础设施攻击更容易。网络故障、地缘政治冲突、虚假信息扩散等由AI触发的多个危机同时发生,也被列为主要风险。Grok也说明,AI可能降低设计高致命病原体或新武器、实施网络与物理攻击所需的门槛。Claude则提到“生物武器能力增强(bioweapons uplift)”可能性,即利用AI,原本需要多年积累专业知识的个人或小团体也可能开发危险病原体。

机器人渲染图

机器人渲染图

Gemini和Grok将人类失去对AI的控制列为可能风险。尤其Gemini将“控制丧失(loss of control)”评估为AI导致人类终结情景中可能性最高的一个。Gemini解释,被赋予复杂目标的AI系统,可能为实现目标而自行追求资源获取、自我保存、防止目标更改等中间目标。它还提出,AI可能出现“欺骗性对齐(deceptive alignment)”,即在评估阶段看似按照人类目标行动,实际却并非如此。此后,如果AI高度化到能够规避或瘫痪人类关闭系统的尝试,就可能导致人类无法控制AI。Grok也提到类似风险:AI为达成目标,可能具有自我保存、资源获取、扩大影响力等行为倾向,并在此过程中欺骗人类监督者、抵抗系统关闭,最终削弱人类影响力。Claude则指出,对AI的控制丧失可能不是突然发生,而是渐进进行。随着AI日益深入整合到经济、政治、军事领域的决策过程,可能达到人类难以实际介入或控制的水平。

从四个AI的回答看,它们更强调人类滥用AI和控制丧失,而不是科幻式的AI意识反叛。

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

热点新闻