ControlAI 执行董事:超级智能不是武器而是对手,应立法禁止开发
AI 安全非营利组织 ControlAI 美国执行董事 Connor Leahy 在 TechCrunch 播客中提出激进观点:应通过立法完全禁止企业开发超级智能(superintelligence),而非仅依赖对齐与遏制技术。他认为当 AI 能自主改进 AI 时将触发失控循环,并透露美英两国已有相关立法推进,包括 Sanders-Casar 提出的"禁止超级智能法案"。

从技术对齐到立法禁止:AI 安全争论的新阶段
AI 研究员、企业家 Connor Leahy,现任非营利组织 ControlAI 的美国执行董事。在 TechCrunch 旗下 Equity 播客最新一期节目中,他抛出了一个引发业内热议的观点:与其继续押注技术对齐和遏制方案,不如直接立法禁止企业开发超级智能(superintelligence)。
Leahy 的论据来自近期一系列安全事件。他提到 OpenAI 在 Hugging Face 平台上的安全漏洞,认为这类事件暴露了一个根本问题:当 AI 的能力超越人类时,我们根本无法可靠控制它。在他看来,超级智能“不是武器,而是对手”——这意味着它不是人类可以随意操控的工具,而是一个可能拥有独立目标的实体。
立法进展:美英两国已有具体法案
节目中透露了一些政策动向。美国参议员 Sanders 和众议员 Casar 已经提出了“禁止超级智能法案”(Ban Superintelligence Act),英国也有 ControlAI 参与建议的平行立法正在推进。Leahy 认为,美国法案的限制范围“可能有点过头”,但这反映出立法者对 AI 技术风险的担忧已经从理论走向了实际行动。
他特别强调,六个月前还被看作“天方夜谭”的激进监管主张,如今正迅速获得立法支持。这种变化背后,是政策制定者对 AI 风险认知的快速升级,尤其是在 GPT-4、Claude 3 等大模型展现出接近甚至部分超越人类专业能力的背景下。
技术奇点的真正临界点:AI 自我改进
Leahy 指出了一个关键的技术节点:当 AI 能够构建更强大的 AI 时,将触发潜在的“失控自我改进循环”(runaway cycle of self-improvement)。他认为这才是真正的“不归点”(point of no return)——一旦跨过这条线,人类可能彻底失去对 AI 发展轨迹的控制。
这一论断与 AI 安全研究中的“智能爆炸”(intelligence explosion)理论高度契合:递归式自我改进可能在极短时间内将 AI 能力推向人类完全无法理解的层级。
重新定义 AI 实验室:从商业公司到政治行为体
Leahy 提出了一个值得深思的观察:他将前沿 AI 实验室视为政治行为体,而非单纯追求利润的商业公司。这一观点与当前数万亿美元涌入数据中心建设的现实形成了鲜明对比——如果这些实验室的行为本质上是政治性的,那么巨额资本投入的商业逻辑可能需要重新审视。
换句话说,OpenAI、Anthropic、Google DeepMind 等机构的决策,不仅受市场和股东驱动,更受地缘政治、意识形态和权力结构的影响。
国际协作的可能性:中国是否有开发超级智能的动机?
在谈及国际监管协调时,Leahy 提出了“信任但核查”(trust but verify)的协议框架。更引人注目的是,他认为开发超级智能实际上并不符合中国的利益。
这一判断与西方主流叙事(即中美 AI 竞赛必然导致安全标准竞次)形成了鲜明对比。Leahy 的逻辑可能基于:超级智能的失控风险对任何国家都是存在性威胁,理性的国家行为体应避免触发这种风险。但这一假设在实际地缘政治博弈中能否成立,仍有待观察。
中国从业者的思考维度
对中国 AI 行业而言,这场辩论提出了几个关键问题:
- 监管分化风险:如果欧美推进超级智能禁令,中国是跟进还是利用“监管套利”加速发展?
- 技术定义模糊:什么算“超级智能”?AGI(通用人工智能)与超级智能的边界在哪里?
- 产业链冲击:如果前沿模型开发受限,算力、数据等上游产业将如何调整?
Leahy 的立场代表了 AI 安全阵营中最激进的一翼,但其背后反映的风险意识,正在从学术圈向政策层扩散。
本文基于 TechCrunch 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://techcrunch.com/podcast/controlais-connor-leahy-on-why-superintelligence-is-not-a-weapon-its-an-adversary/
常见问题
- 什么是超级智能(superintelligence)?与 AGI 有何区别?
- 原文未给出明确定义,但通常超级智能指在所有认知任务上全面超越人类的 AI 系统,而 AGI(通用人工智能)指达到人类平均水平的通用智能。Leahy 强调的风险节点是 AI 能自主改进 AI 的能力,这可能是超级智能的关键特征。
- 美国的'禁止超级智能法案'具体要禁什么?
- 原文仅提及法案名称(Sanders-Casar 提出的 Ban Superintelligence Act)和 Leahy 认为其'可能超出必要限制',但未披露具体条款。可能涉及禁止训练超过特定算力阈值的模型或强制安全审查等措施。
- ControlAI 是什么组织?
- 原文显示 ControlAI 是非营利组织,Connor Leahy 任美国执行董事,曾为英国相关立法提供建议。该组织主张通过立法手段阻止超级智能开发,立场比主流 AI 安全组织(如 Anthropic 主张的'负责任扩展')更激进。
- OpenAI 在 Hugging Face 的安全漏洞是什么?
- 原文仅将其作为'近期安全事件'案例提及,未详述具体内容。通常此类事件可能涉及模型权重泄露、API 滥用或未授权访问等,但具体情况需查阅 OpenAI 官方披露。
- 中国 AI 企业需要担心这类立法吗?
- 若美英立法落地,可能产生三方面影响:1)出口管制可能扩展到算法层面;2)国际合作(如开源模型、学术交流)受限;3)但也可能形成'监管套利'空间。Leahy 认为开发超级智能不符合中国利益,但这一判断未经中方政策制定者证实。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

Windows 11 最新更新破坏 WSL 与 Claude Cowork 功能
微软确认 Windows 11 九月安全更新 KB5124008 导致基于 Hyper-V 的 Linux 虚拟机中 Plan9 主机文件夹共享失效,直接影响 WSL 和 Claude Cowork 无法读取共享文件夹,应用可能显示"未挂载 Plan9 驱动器共享"错误。微软已将其列为已知问题并正在修复,但暂无补丁或临时解决方案。

Anthropic工程师警告AI或致人类灭绝 为何仍加速开发
Anthropic研究员Jacob Coxon因担忧递归自我改进AI系统的风险而辞职,该公司安全主管随后表示确信AI可能导致人类灭绝概率超10%。尽管以安全为使命,Anthropic仍在推进自主智能体开发并筹备估值2万亿美元IPO,其"谨慎推进反而更危险"的逻辑引发争议。

Meta 因 AI 训练数据与人脸识别系统遭集体诉讼
美国伊利诺伊州和加州的多名用户向 Meta 提起集体诉讼,指控其未经同意使用 Facebook 和 Instagram 照片训练未发布的人脸识别系统 NameTag 及生成式 AI 模型 Emu 和 Muse Image,违反州生物识别隐私法。诉讼索赔金额可能达数十亿美元,这是 Meta 继 2020 年和 2024 年生物识别数据和解案后再次面临重大隐私诉讼。

Anthropic 研究员离职警告超级智能风险,恰逢公司筹备 IPO
Anthropic 一名研究员本周辞职并公开警告,称公司正"直奔自我改进的超级智能,拿我们的生命冒险"。该公司对齐团队负责人甚至联署了这一声明。这一"末日警告"出现的时机敏感——据报道 Anthropic 正在筹备 IPO。TechCrunch 播客深入讨论了这一事件对 AI 安全和行业竞赛的影响。