Anthropic CEO首次坦言:AI行业多年来对风险隐瞒不实
Dario Amodei罕见承认,AI行业长期以来低估了安全风险,并提议设置
无人预见的监管转折
达里奥·阿莫迪(Dario Amodei)言辞犀利。他在哥伦比亚广播公司(CBS)的访谈中向全美观众表示,人工智能行业对自己的危险隐瞒了太久,而发展速度之快,甚至超越了他本人都曾预料到的程度。
“我不想欺骗人们,“阿莫迪说,“风险是真实存在的。“随后他补充了那句将在硅谷之外的政策圈引发回响的话:“我认为这个行业对公众隐瞒得太久了。”
这与大多数人工智能实验室采取的防御姿态形成了鲜明对比。阿莫迪没有回避安全担忧,而是主动提出让自家企业接受新一轮外部监督,并提议引入强制第三方评估、紧急关停开关等工具——这些措施将约束所有人,包括Anthropic在内的行动自由。
这番表态意义重大,因为它来自一家将自己定位为"负责任竞争者"的实验室,对标对象正是OpenAI和谷歌。当业内核心人物如此直白地界定问题时,信号表明:领先人工智能公司内部共识的演进速度,已经快于公共政策的推进步伐。
关停开关与其他令人不安的提案
阿莫迪将人工智能模型的"紧急关停开关"描述为一个值得考虑的设想——不是全面禁令,而是一个停止按钮。他直接将其与美苏核军控谈判相类比,承认这或许近乎不可能,但坚持认为值得尝试。
这个比喻刻意而意味深长。核威慑之所以奏效,是因为双方都理解相互确保毁灭的逻辑。人工智能面临的是不同的风险——经济冲击、信息系统崩溃、自主武器——但结构性难题如出一辙:当背叛能带来巨大竞争优势时,你如何协调自我克制?
他还提议建立一套全新的审计制度。他表示,Anthropic将赋予独立评估人员永久性的"类员工"访问权限,以审查其模型。他将此比作食品安全检查员——那些无需提前通知即可进入并核查安全承诺是否兑现的人。
食品安全检查员的类比比表面看起来更为深刻。食品安全法规之所以有效,是因为它们由拥有执法关停权的国家权威机构来执行。阿莫迪提出的是一种自愿机制——这使得它要么是一个勇敢的第一步,要么是一种在监管强制落地之前抢先塑造规则的高明策略。
他没有直面的韩国问题
这篇报道的来源——韩联社——将阿莫迪的发言定性为一则带有国际含义的警示信号。这种框架本身也值得关注。韩国政府一直在异常密切地追踪人工智能安全辩论,部分原因在于该国地处两大人工智能强国——美国与中国——之间的地理与经济咽喉要道。
首尔有充分的理由认真倾听。韩国的科技产业——三星、LG、Naver、Kakao——已深度融入全球人工智能供应链。一个由美国主导且放缓美方发展速度的框架,可能为中国加速创造空间;但一个包含中国的框架则会抬升所有人的门槛。
阿莫迪被直接问及:即使中国不减速,美国是否也应减速?他的回答诚实而令人失望:“这是我们身处困境中最艰难的部分。”
他没有提供解决方案。他提出的是一种道德论证——克制即便代价高昂也是必要的——随即承认,道德论据筑不成条约。
谁真正有权踩下刹车
阿莫迪这次访谈引发的更深层问题在于治理架构。他对人工智能开发由私营企业而非政府掌控表示不安,并提出了多边政府监督的设想,但紧接着便加以限定:一个政府滥用权力的能力与一家企业并无二致。在他看来,真正的保障在于多个民选政府共同行动。
这是一项艰巨的挑战。欧盟已通过《人工智能法案》,美国已发布人工智能安全行政令,中国已实施自己的监管框架——更侧重于内容管控而非能力限制。日本、韩国和印度正在分别制定本国框架。目前并不存在一个对人工智能开发拥有执行权的统一国际机构。
阿莫迪很清楚这一点。他在整场访谈中的语气,像是一个陈述"应该做什么"却对"能否做好"深表怀疑的人。“我对达成类似核条约的协议前景不太乐观,“他说,“但我们必须尝试。”
接下来会发生什么
类似阿莫迪这样的表态,很可能引发三个后果。
第一,监管压力将加剧。当顶尖实验室的首席执行官开始公开承认自家产品具有危险性,行业抵御监管的核心防线——“专家最适合自治”——便土崩瓦解。叙事已经翻转。
第二,关停开关的争论将升温。这是一个简单却影响深远的想法。任何允许外部方停驶运行中模型的机制,都需嵌入训练、部署和推理的基础设施——而这需要那些毫无动力配合的企业合作。
第三,地缘政治维度将占据主导。阿莫迪的核类比将在政策讨论中反复出现,它揭示的核心问题也将随之凸显:当双方都相信背叛的后果比合作更糟时,合作才能奏效。而在人工智能领域,当前的激励结构明显偏向背叛。
行业对自身风险的坦诚承认是一把双刃剑。它赋予了监管者弹药,也赋予了公众要求行动的理由——而无论善意与否,行动必将重塑未来十年人工智能竞争中谁赢谁输的格局。
阿莫迪的警告并非关于恐慌,而是关于节奏。节奏本身就是一个决策问题——由谁来定、代价有多大——而这个决策至今尚未做出。