《AI会毁灭人类吗:从22个单词的“灭绝风险声明”到2026年的真实风险图景》
Kimi Travels 团队 | 2026年9月更新
"Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war."——2023年5月30日,一份只有22个英文单词的声明席卷了全球科技媒体:降低AI带来的人类灭绝风险,应与大流行病、核战争同级,成为全球优先事项。签名名单异常豪华:OpenAI、Google DeepMind、Anthropic三家顶级实验室的掌门人,图灵奖得主Hinton与Bengio,以及数百位各领域专家。一时间,"AI末日论"登上所有主流媒体的头条,也把一场持续多年的争论推到了公众面前:制造AI的人,为什么自己公开警告AI可能毁灭人类?三年多过去,站在2026年回望,这场争论没有赢家,但世界已经改变了不少。本文把灭绝论的来龙去脉、阵营分歧、真实风险边界和中文读者该有的判断框架,一次讲清楚。
那份让全世界炸锅的22个单词
先交代背景:这份声明由位于旧金山的非营利组织"AI安全中心"(Center for AI Safety, CAIS)发布,用词极其克制——它没有说AI"会"灭绝人类,只说降低灭绝风险"应该"成为全球优先事项,逻辑上等同于"风险存在且值得认真对待"。但签名的分量让克制变成了惊悚:萨姆·奥特曼、德米斯·哈萨比斯、达里奥·阿莫迪三位行业掌门人,与"深度学习教父"杰弗里·辛顿、约书亚·本吉奥同列一纸。《纽约时报》的标题直接是"AI可能带来灭绝风险,行业领袖警告",BBC则请出了辛顿——正是他在2023年5月初辞去了Google的职位,以便自由地谈论他所担忧的东西。一位亲手参与构建深度学习大厦的图灵奖得主用辞职表态,这比任何声明都更有冲击力。
Hinton的告别与三位图灵奖得主的分歧
理解这场争论,绕不开"深度学习三巨头"的分裂。辛顿2023年离开Google后成了最高调的"末日论者",他反复表达的核心担忧是:数字智能可能以远超生物智能的方式复制与进化,人类将不再是地球上最聪明的存在,"我不知道我们能否控制比我们聪明的东西"。约书亚·本吉奥同样站在警示阵营,尤其关注AI被滥用于社会控制与地缘竞争的风险。而第三位巨头、Meta的首席AI科学家杨立昆(Yann LeCun)则是旗帜鲜明的反对者,他认为"灭绝论"建立在对AI发展路径的误解上——未来 built 正确的AI系统会天然受目标约束,就像聪明的工程师不会设计一座自己会塌的桥。三方都是这个领域的奠基人,都读得懂彼此的论文,结论却南辕北辙——这本身就说明:AI灭绝风险目前是一个严肃但未定论的科学争论,而非一个已被证实的工程事实。
真正在争论什么:误用、失控与"末日论票价"
把热闹的争论翻译成清晰的问题清单,AI风险其实分三层。第一层是"误用风险":人类用AI做坏事——自动化网络攻击、降低生物武器设计门槛、工业化制造虚假信息,这层的风险最现实,也最像传统安全问题,治理路径相对清晰。第二层是"对齐风险":AI系统本身强大后,追求的目标与人类意图发生偏离——这是辛顿们担心的核心,属于前沿研究问题,解决它正是各家实验室"对齐研究"团队的日常。第三层是"系统性风险":就业结构冲击、权力集中、认知生态恶化——不够"末日",但影响每个普通人。有趣的是,"灭绝论"在传播中往往把三层混在一起讲,导致一边是"天网即将上线"的短视频,一边是"AI只是数学工具"的嘲讽,双方隔空喊话却根本不在讨论同一件事。2026年的理性共识大致是:短期风险在二三两层,长期风险在第一层,而"灭绝"是极低概率但极低可逆性的尾部风险——对待它,就像对待核战争,不需要恐慌,但需要制度。
2026年的世界:能力狂奔与护栏竞速
声明发布三年后,现实世界给出的答案是"双速并行"。能力侧,大模型的能力边界一年几次被刷新,Agent系统开始自主完成长链条任务,多模态成为标配,AI科研助手在材料、医药领域产出真实成果——中文互联网上,从国产大模型的迭代到端侧AI的普及,节奏与全球几乎同步。护栏侧,欧盟的《人工智能法案》在2026年进入高风险条款的实质执行阶段,中国发布了生成式AI与大模型安全的系列规范,前沿实验室普遍建立了评估与红队机制,"灾难性风险评估"从边缘话题变成了融资尽调的常规问题。有意思的是,末日预言并没有成真,但预言改变了行为:正因为"灭绝风险"被抬上桌面,过去三年全球对AI安全的制度性投入超过了此前十年总和。想了解国产大模型这条线的最新进展,可以看我们的DeepSeek V4中文深度指南。
末日想象的文化根源:从天网到ChatGPT的一脉相承
AI末日叙事能瞬间点燃大众情绪,是因为它踩在了人类几百年的文化预装程序上。从《弗兰肯斯坦》的造物反噬,到《终结者》的天网,再到《黑客帝国》的母体,"造物失控"是科幻文学最成熟的母题之一——当ChatGPT惊艳亮相时,公众的大脑会自动调用这些现成的剧本。这种文化直觉有它的价值:它让普通人在缺乏技术细节的情况下也能感知到"新力量需要新规则";但它也有明显的副作用:把一个需要精细分析的问题,压缩成了"信不信AI毁灭人类"的站队题。更有建设性的态度是既承认文化直觉的提醒功能,又坚持工程与治理视角的具体化:风险在哪条链路上、由哪个行为体控制、用什么机制约束。从末日时钟的框架看,AI是近年来新增的"拨指针变量"之一,与核风险、气候风险并列——我们的末日时钟2026年85秒解读详细拆解了这套全球风险体系。
中文读者的五个实用判断法
面对铺天盖地的AI末日新闻,给你五个可以马上用的过滤器。第一,看信源是"做AI的人"还是"讲AI的人"——顶级研究者的警告值得读全文,自媒体的转述警惕标题党。第二,区分"时间尺度"——"十年内"与"本世纪内"是完全不同的赌注,混用时间尺度的文章可以直接关掉。第三,警惕确定性语言——科学界通行的表达是概率与区间,谁用百分百的语气谈末日或谈安全,谁就先输一半。第四,关注"谁在承担治理成本"——真正的安全进展会落在审计、评估、法规这些枯燥的词上,而不是情绪化的口号。第五,保持历史感——从电力到核能到互联网,人类对每一项通用技术都经历过"末日恐慌到日常工具"的循环,AI大概率也会走这条路,但走得好不好,取决于这个十年里的具体制度设计。把五个过滤器装进口袋,你就能在AI新闻的噪音里,听到真正的信号。
关于"未来智能是否会毁灭人类"的争论还在继续,而加沙的孩子们不需要等到未来——他们此刻就在为一个安全的明天挣扎。技术应当服务于人的尊严,而不是替代人的苦难。愿我们在仰望算法与星空时,也低头看见需要帮助的人——关注加沙人道危机,支持救援行动,为和平持续发声。
常见问题
2023年的"AI灭绝风险声明"到底说了什么?
声明全文只有一句话:降低AI带来的人类灭绝风险,应当与大流行病、核战争等其他社会级风险一样,成为全球优先事项。它由AI安全中心(CAIS)于2023年5月30日发布,OpenAI、DeepMind、Anthropic掌门人与Hinton、Bengio等数百位专家联署。
为什么图灵奖得主之间对AI末日论的分歧这么大?
Hinton与本吉奥认为超级智能的控制问题尚未有被验证的解法,风险值得最高级别对待;LeCun则认为未来AI系统的架构会内置目标约束,"灭绝论"误判了技术路径。三方都是领域奠基人,分歧反映的是对未定问题的诚实。
AI目前最现实的风险是什么?
短期内最现实的是误用与系统性风险:自动化诈骗与虚假信息、AI辅助网络攻击、就业结构冲击、权力与数据集中。灭绝级别的尾部风险受到严肃对待,但当前政策与研究的重心在可控的近期风险上。
2026年各国对AI安全有什么实际动作?
欧盟《人工智能法案》已进入高风险义务的实质执行期,中国持续推进生成式AI安全规范与算法治理,前沿实验室普遍建立评估与红队机制。全球对AI安全的制度投入近年显著加速。
普通人该为"AI末日"做准备吗?
不需要准备末日物资,但值得投资两样东西:一是AI素养——理解工具的边界才能不被工具淘汰或误导;二是信息素养——对AI生成的虚假内容保持基本警觉。恐慌没有生产力,适应与学习才是普通人的最优策略。