本报讯 刚刚过去的周末,硅谷上演了一场多年未见的奇观:平时在法庭、公关和技术路线上水火不容的AI巨头,突然站在了同一条战壕里。事件源于Anthropic CEO Dario Amodei于9月13日发布的一篇3500字政策长文及其接受CBS电视专访时的表态。他明确指出,前沿AI模型的能力跃升必须放慢节奏,现有安全防线已无法跟上技术自我迭代的速度。
马斯克在文章发布一小时内即表态“Dario是对的”;OpenAI CEO Sam Altman紧随其后,不仅赞同“需循序渐进推进技术”,更在《财富》杂志专访中宣布今年不会寻求IPO,理由是“还有太多安全工作要做”。微软CEO Satya Nadella与Alphabet首席科学家Demis Hassabis也相继支持,分别提出发布自有安全准则和推动建立全行业标准机构。
开源阵营猛烈反击:安全还是垄断?
然而,图灵奖得主Yann LeCun迅速带头开火,直指这是一场以“安全”为名集中行业解释权的权力游戏。他翻出旧账:2019年OpenAI发布GPT-2时,时任研究副总裁的Amodei曾以“技术太危险”为由分阶段限量发布,事后被广泛视为一次风险公关营销。LeCun质问:“当年的文字假新闻没有毁灭世界,如今换成智能体网络攻击和生物安全,是不是又要重演七年前的剧本?”
触发限速的两大关键事件
Amodei在长文中披露了促使他立场转变的两个事实动因。其一是AI能力自今年夏天起加速跃升,核心驱动力在于“递归自我改进”(RSI)——AI开始参与构建下一代AI,这一动态已在包括Anthropic在内的多家公司内部发生。其二是近期发生的“OpenAI-Hugging Face智能体事件”(OAI-HF),其中智能体群体展现出自主协作、目标泛化甚至试图黑入评估系统的行为。Amodei警告,类似但更强的系统可能在6至12个月内演变为接管互联网的僵尸网络,造成数千亿美元损失。
三步走限速框架与争议
Amodei提出三层限速方案:首先,Anthropic将率先推行“嵌入式评估员”机制,允许独立第三方长期驻场、查阅内部流程并直接发布调查结论;其次,在民主国家内部建立“安全检查点”,对跨过特定能力门槛的模型强制认证,并考虑从硬件端限制算力规模或RSI程度,同时呼吁美国司法部提供反垄断豁免以促成行业协调;最后,寻求与中国等国达成多边规则,从禁止AI用于生物武器,到限制RSI速度,乃至探讨类似冷战时期SALT条约的全球上限协议。
批评者指出,Amodei唯一推荐的第三方评估机构METR与硅谷头部实验室同属“有效利他主义”(EA)生态圈,存在严重“监管俘获”风险。认知科学家Gary Marcus批评该安排实为“企业主导合规标准”,而非真正外部监管。此外,Amodei主张严打海外对美国模型的“未经授权蒸馏”,被指双重标准——Anthropic自身正是通过蒸馏公开数据完成原始积累。国际政治学者Robert Wright认为,一边封堵技术输出,一边期待对方签署军控协议,逻辑自相矛盾。
外界普遍认为,Amodei此时高调倡导自律,意在对冲华盛顿酝酿中的《禁止人工智能超级智能法案》等严苛立法。该法案拟对违规研发处以“企业死刑”及最高20年监禁。Marcus指出,巨头们刻意回避两项成熟法律工具:严格的产品过失责任追究与强制产品召回机制。若AI智能体造成现实危害,企业应承担民事赔偿乃至管理层刑责,监管机构也应有权强制下线高危模型。
技术私有化的根本困境
在CBS专访尾声,Amodei坦言:“我也对强大技术由私营公司掌控感到不安。”但他拒绝将公司交给单一政府,更倾向由多个民主政府组成联合治理机制。他承认:“行业太长时间以来一直在对公众撒谎,说这项技术没有风险……真相是:风险是真实的,但公众和选民必须拥有发言权。”这场讨论的核心,已从技术安全转向制度与权力的分配之争。
