导语:作者Ye Su在X平台发文指出,Dario近日发布长文《We Must Pace the Frontier》,首次明确主张前沿AI应主动限速。其理由是,AI未来5至10年可能推动疾病治疗、经济增长和社会繁荣,但到2026年,Agent已真正进入现实世界,模型开始参与下一代模型研发,自我改进速度加快,近期一系列对齐事故也表明,人类理解和控制AI的速度正落后于能力增长。
因此,Dario希望用1至2年时间差,补齐对齐、可解释性、安全评测与工程安全。Sam Altman、Elon Musk随后表达支持,三位过去常意见相左的人罕见达成一致。
市场反应:AI资本投入是否迎来拐点
周一资本市场全线下跌,市场开始认真讨论这是否是AI资本投入放缓的拐点。但文章核心判断是:AI现在不可能放缓。
1946年Baruch Plan:核限速的历史镜鉴
文章将时间拉回人类第一次核危机。1945年,曼哈顿计划造出第一颗原子弹,广岛、长崎被摧毁,二战结束。仅一年后,1946年美国提出Baruch Plan,主张建立国际机构控制铀矿、核材料、危险核设施和核技术,最终消灭各国原子弹。当时全世界只有美国拥有核武器。
但该计划失败。苏联还没有原子弹,在其视角下,这相当于美国已拥有核武器,却要求别人不要造。美国自身也态度现实:在真正有效、可验证的国际控制体系建立前,不可能放弃核优势。嘴上谈人类安全,桌下算的仍是国家安全。
核扩散与AI军备竞赛
随后,苏联1949年、英国1952年、法国1960年、中国1964年相继成功核试验。不到20年,核武器从美国一家独占变为五个大国都有。
文章特别提到中国案例。作者祖父曾在当时核反应组工作。新中国成立仅十余年,正值大跃进后粮食危机,工业基础薄弱,1960年苏联又中止援助、撤走专家。陈毅曾说:“就是把裤子当了,也要把原子弹搞出来。”毛泽东则指出:“原子弹,没有那个东西,人家就说你不算数。”
文章认为,这两句话讲透AI军备竞赛本质:当一种技术决定国家未来会不会被欺负、有没有战略话语权、能不能坐上牌桌时,危险与否不会成为退出竞争的理由,真正重要的是别人会不会先拥有。
AI安全首先是博弈论问题
文章称,AI的2026年更像核时代的1946年。Dario、Sam、Elon开始呼吁AI应慢一点,类似美国刚拥有原子弹后意识到潘多拉魔盒可能连自己都控制不了。但Dario也强调,美国AI限速必须建立在美国仍然领先中国的基础上。
然而,中国会放缓吗?DeepSeek、Kimi、千问会放缓吗?只要AGI仍代表下一代经济、军事、科研甚至国家治理能力,任何大国都可能得出与60年前中国几乎相同的答案:没有这个东西,人家就说你不算数。因此,AI安全最终首先是一个博弈论问题。
真正放缓可能需三个条件
第一,实现AGI。不到AGI这一步,人类不会满足,也不足以形成“AI真正会毁灭人类”的普遍恐惧。马斯克从2014年起把AGI比作核武器,2024年Abundance Summit采访时称AI可能终结人类,概率约10%至20%。作者称自己在2023年GPT-4发布当天也做出类似预测,并认为等AGI出现时,这种恐惧才会无差别笼罩所有人。
第二,至少3个主要国家或阵营拥有AGI。约束法案实际上是强国对弱国的打压,至少3家才能形成稳定博弈。核武器第一次有效约束出现在1963年,美苏已拥有相互毁灭能力后,《部分禁止核试验条约》落地。1968年,美、苏、英、法、中五个核国家都已出现,NPT才被推出,逐渐形成今天核不扩散体系的基础。领先者喊“大家别搞了”时,后来者不会听;等后来者也拿到了,大家才会讨论规则。AGI大概率也一样,只有美国、中国以及至少另一个主要力量都真正拿到AGI后,“限制能力继续增长”才第一次可能成为相对平等的谈判。
第三,AI造成真正的史无前例危机。1962年以前,美苏已知道核战争很危险,科学家、军方、总统都知道。但知道是一回事,亲眼看到世界差点毁灭是另一回事。古巴导弹危机期间,美苏核力量进入极度危险对峙,人类第一次发现核战争可能下星期就发生。危机之后,美苏开始真正加速核军控谈判,一年后1963年《部分禁止核试验条约》签署。
文章认为,AI可能也需要自己的“古巴危机”。今天OpenAI Agent攻破Hugging Face会让AI公司紧张,但远远不够。真正改变国家决策的事故,可能是某个AI进入国防系统后发出错误指令,可能是一场自主发动的大规模网络攻击让一国金融、电力或通信系统瘫痪,可能造成几百亿美元损失,甚至第一次真正导致大量人类死亡,也可能比这些严重得多。
结语:真正的问题不是何时放缓
核武器从1945年第一次爆炸,到1968年NPT开放签署,走了23年。中间经历一轮又一轮军备竞赛,五个大国先后拿到核武器,还差一点爆发真正核战争,最后放缓规则才出现。Dario周末称尝试建立类似“核军控体系”的国际AI风险控制。如果这个类比成立,今天真正值得问的,可能不是AI什么时候会放缓,而是在全世界终于愿意一起踩下刹车之前,我们还要经历什么。
