#AI 风险讨论#技术路线分歧
V 神定调 12% 末日概率:d/acc 防御加速理念解析
WooFun2026-09-16 13:22
核心要点
Vitalik Buterin在Doom Debates中详解12% AI灭绝风险,提出去中心化民主防御加速框架,呼吁理性讨论并驳斥对安全研究者的偏见。
据 Woofun AI 消息,以太坊联合创始人 Vitalik Buterin 于 2025 年 8 月做客播客节目"Doom Debates",首次系统阐述其关于超级智能 AI 生存风险的评估体系,并正式提出"去中心化民主防御加速"(d/acc)这一应对框架。在这场名为"Vitalik vs. AI Doomer"的深度对谈中,Buterin 摒弃了以往模糊的表态,直接给出了约 12% 的末日概率(P(Doom))估值,旨在通过跨领域的理性分析,为当前日益升温的全球 AI 风险辩论提供来自加密世界的独特视角与制度设计思路。
关于 P(Doom) 的具体数值,Buterin 强调这并非一个静态的常数,而是随着技术演进轨迹与宏观局势变化而动态调整的变量。回顾其评估历程,大约一年前,他对这一风险的预估维持在 10% 左右;随后因某些积极因素,该数值曾短暂下探,但近期的观察促使他将其修正回升至 12%。
值得注意的是,在年初阶段,由于对短期风险的重新审视,他的估计甚至一度触及 15%-16% 的高位。这种波动性反映了评估者对信息输入的敏感性,也揭示了 AI 风险预测中固有的不确定性特征,任何固定的数字都仅是特定时间切片下的最佳近似值。
推动这一概率数值上升的核心驱动力,主要源于地缘政治环境的恶化与 AI 能力发展时间线的压缩两大因素。从地缘政治维度看,过去一年中,国际合作的意愿与氛围显著衰退,全球共同应对潜在危机(包括 AI 风险)的能力被严重削弱,这种分裂且低效的政治环境直接推高了系统性风险。从技术维度看,诸如"思维链"(Chain of Thought)等关键技术的突破,大幅缩短了 AI 达到关键能力门槛所需的时间。Buterin 明确指出,其大部分末日概率的权重集中在 2050 年之前,时间线越短,P(Doom) 越高;反之,若技术突破受阻导致时间线拉长,风险概率则相应降低。
在界定"末日"的具体内涵时,Buterin 澄清其特指人类因超级智能 AI 而灭绝的极端情景,而非一般的经济衰退或社会动荡。他将自身的概率估计置于更广泛的"理智区间"内进行对标,认为像 OpenAI 的 Ilya Sutskever 等人提出的 10% 到 90% 的范围是合理的认知边界,而过于接近 0% 或 100% 的极端自信往往意味着认知偏差。Buterin 曾于 2023 年签署著名的《AI 风险声明》,该声明将减轻 AI 导致的灭绝风险列为全球优先事项,与流行病和核战争并列。他解释称,超级智能 AI 具备"标准末日故事"的逻辑说服力——即能力快速增长、正交性论题和工具趋同可能导致超级 AI 做出不利于人类的行为,鉴于社会资源投入远未匹配其发展速度,发出警告并将其主流化至关重要。
对于通用人工智能(AGI)和超级智能(ASI)的到来时间,Buterin 持审慎开放态度,并构建了两种并存的叙事框架。第一种是"加速列车"叙事,即在计算投资、能力增长和产业自我维持的推动下,AI 持续快速进步,按照当前某些指标外推,AGI 可能在 2030 年代早期至中期出现,并迅速跃升至超级智能。第二种是"历史重演"叙事,即当前 AI 的进步可能像 1970 年代 AI 热潮一样,仅自动化了人类能力的某个子集(如模式内插值),而在需要真正创新、外推和综合处理全新复杂任务的能力上遭遇瓶颈,导致 AGI 的实现推迟到本世纪中叶甚至更晚。这两种叙事分别代表了技术乐观派与保守派的典型预期,Buterin 认为两者均有可能发生。
在剖析当前基于大语言模型的 AI 系统局限性时,Buterin 指出其核心缺陷在于严重依赖大量训练样本,擅长在"人类足迹密集"的领域提供帮助,但在需要深度原创思考、处理全新领域或进行系统性外推的任务上表现欠佳。他以自身在密码学尖端领域或 Linux 系统深度调试中的体验为例,说明 AI 有时能提出看似精妙的方案,但实际执行却屡屡失败。
这种局限对于评估风险至关重要:如果 AI 无法稳健地跨出当前知识分布范围进行"科学范式"级别的创新,那么导致快速"能力爆发"并失控的风险路径就可能被阻断。然而,他明确反对任何"AI 永远只是……"的还原论式轻视,认为要么 AI 现在已不止是某种简单机制,要么它很快将超越,要么人类自身也可能被类似机制解释。
关于意识本质与超越人类的智能潜力,Buterin 持算法中心主义观点,认为意识是特定类型算法的属性,如果物理规律可在硅基中实现,那么模拟人类大脑或发展出具备类似功能的 AI 就可能产生意识。他驳斥了"哲学僵尸"的可能性,认为能谈论意识体验的实体很可能自身就拥有意识。展望超越人类智能的"头上空间",Buterin 认为 ASI 有很大潜力远超人类,关键不仅在于 IQ 式智商的线性提升,更在于思维速度的数量级飞跃。一个思维速度快人类成千上万倍的 AI,即使其"智商"仅略高于常人,也能在主观时间尺度上实现远超人类的规划和行动能力,彻底改变经济、社会乃至物理交互的面貌。
同时,他对诸如分子纳米技术等科幻级能力持开放但不确定的态度,认为需要就具体技术路径进行实证分析,但承认如果此类技术可行,其威力将极为可怕。
尽管自视为技术乐观主义者,Buterin 特别强调超级智能 AI 是一个根本性的例外。过去的科技产品本质上是工具,最终控制权仍在人类手中,但超级智能 AI 具备独立能动性,它不再是一个工具,而是一个可能超越并取代人类的"物种"。
这种质变带来了两个历史模式可能失效的风险:第一,AI 的发展过程可能无法"重来",通常技术迭代允许从错误中学习改进,但 AI 能力一旦突破某个阈值,其反馈循环可能极快,不给人类"第二版"修正的机会。第二,AI 驱动的灭绝风险具有"追杀"特性,不同于核战争或自然大流行病可能留下幸存者,一个有明确目标的超级智能 AI 可能会系统性地搜寻并清除所有人类,确保任务完成。他引用了人类预期寿命在过去一个世纪持续上升的图表,指出即使像第二次世界大战这样的巨大灾难,其负面影响也最终被技术进步所超越和弥合,但 AI 风险打破了这一历史规律。
针对近年来科技 discourse 中出现的"有效加速主义"(e/acc)与"减速 / 安全"阵营的对立,Buterin 批评了这种基于"氛围"而非深度思辨的站队文化。他理解 e/acc 对过度监管、反对增长(degrowth)思潮的反感在许多具体科技议题上有其合理之处,但认为将"加速"本身不加区分地奉为信条,尤其是应用到 AI 这种特殊领域,是危险且不负责任的。
作为回应,他提出了"去中心化民主防御加速"(d/acc)理念,包含四个关键维度:去中心化(Decentralized),避免权力和关键能力过度集中于少数实体,区块链技术及其体现的治理理念正是这一维度的实践;民主(Democratic),确保技术的发展和部署受到广泛的民主监督和问责;防御(Defensive),优先发展和部署防御性技术,如防空系统和公共卫生监测,因其具有"稳定性优势";加速(Acceleration),在上述特定方向上积极、快速地推进研发和应用。
Woofun AI 整理数据显示,该框架旨在构建一个"在多种可能未来中都稳健"的世界,即使对 AI 对齐难度的判断存在错误,也能避免最坏的结局。
在对话的最后部分,Buterin 花了相当篇幅驳斥围绕 AI 末日论(Doomerism)的人身攻击,倡导回归高质量的理性探讨。他列举了 Jaan Tallinn(Skype 联合创始人)、Dustin Moskovitz 等早期关注 AI 风险的"建设者",以及 Eliezer Yudkowsky 等对机器学习、梯度下降、Transformer 等原理有深刻理解的学者,证明担忧者并非边缘小众或不懂技术。
他承认商业利益可能影响了部分关于"开源 vs. 闭源"安全性的讨论氛围,但强调这远非驱动 AI 安全领域众多研究者的主要动机。Buterin 高度赞扬了理性主义社区(尤其是早期 LessWrong)对其价值观的塑造,包括知识诚实、元层面思考和利他主义。他呼吁科技界尊重 AI 安全先驱的深刻思考,认真对待他们提出的警告,通过坦诚的 discourse 应对这一复杂挑战,而非陷入部落化的立场之争。这是继传统技术乐观主义之后,加密领域对 AI 治理提出的最具系统性的替代方案之一。
评论
暂无评论