
生成式人工智能(AI)在不到四年前问世,却已引发一系列“斯普特尼克”(Sputnik,指苏联人造卫星)时刻。正如1957年苏联将首颗人造卫星送入地球轨道,并促使美国紧急升级航天计划一样,ChatGPT这款展现出前所未有复杂程度的大型语言模型在2022年11月的发布,也在全球引发赞赏与恐惧情绪。尽管包括AI先驱约书亚·本希奥和杰弗里·欣顿在内的专家警告,这项技术可能带来“灭绝性风险”,但其他科技公司却争相开发类似工具。
下一个斯普特尼克时刻出现在2025年1月,当时中国一家初创企业发布前沿模型DeepSeek-R1,它的计算成本仅为美国同类系统的一小部分。这挑战美国拥有不可撼动技术领先地位的假设,也动摇所谓控制晶片供应就能减缓竞争的信念。
然而,Anthropic公司在今年4月推出Mythos模型,或许是最令人不安的斯普特尼克时刻。Mythos能够识别金融系统、支付网络及其他关键基础设施的漏洞,似乎标志着AI模型能力发生质的飞跃。它使AI更接近于“超级智能”:各类自主学习功能似乎触手可及,而人类对AI的控制力也可能因此逼近极限。由Anthropic而非某个政府机构决定采取分阶段发布策略的事实,则凸显AI治理的严重缺失——美国政府直到Mythos公开发布后的近一段时期才采取行动。
由此产生的后果可能极其严重。以“永恒之蓝”(EternalBlue)这个美国国家安全局开发的软件漏洞利用工具为例。黑客在该软件于2017年泄露后不久,便用它对英国国家医疗服务体系发动WannaCry勒索软件攻击,导致近7000个就诊预约被取消。“永恒之蓝”还曾被用于针对全球航运巨头马士基的NotPetya网络攻击,由此造成的损失估计达100亿美元。如果这还仅仅是一个工具泄露带来的后果,那试想一下已发现超过1万个漏洞的Mythos落入不法之徒手中将是何种景象。
政府对这些事态发展的应对措施显然远远不够。当然,各大国际组织一直在努力引导AI的负责任使用,发布包括联合国教科文组织《AI伦理问题建议书》、欧洲委员会《AI与人权、民主与法治框架公约》、经合组织《AI原则》以及联合国《全球数码契约》等相关文件。这些我们曾为之做出贡献的工作都认识到:所有与人权和人类尊严相违背的创新都毫无价值。
然而,于2024年颁布《人工智能法》的欧盟,却是迄今唯一将这一教益转化为法律的司法管辖区。但它的实施却已偏离原定轨道。旨在帮助科技公司遵守该法(包括针对具有系统性风险的模型提供商的具体特定承诺)的《实践守则》变成自愿执行。此外,欧盟的《数码综合法案》则将与高风险独立系统相关的约束性义务的生效时间,从2026年8月推迟到2027年12月。
由英国、法国和印度联合召开的AI安全峰会取得有益成果,特别是建立多个安全研究所,并授权它们在全球网络中开展合作。此外,美国前总统拜登于2023年签署的行政命令也出台多项明智政策,以确保AI系统内部的安全与保障。但这些努力都在特朗普政府上台后遭遇严重挫折,它撤销行政命令,并加倍押注于从一开始就助推AI竞赛的激励因素——对利润和地缘政治优势的争夺。
Mythos的出现凸显本届政府前后不一且摇摆不定的做法。特朗普在今年6月签署的、旨在扩大联邦政府对前沿模型监管的行政命令,是一项明智之举。但行政命令中关于发布前框架的规定(要求各机构与开发者就网络安全测试开展合作),却只是自愿遵守性质的。
美国商务部则在几周后对Anthropic的最新模型实施出口管制。这个缺乏明确证据且未进行磋商的举措,被包装成一项国家安全措施,却限制民主监督,疏远合作伙伴,并增加开源模型的吸引力——这无异于给中国送上一份大礼。此外,美国政府未能解释为何仅针对Anthropic的模型予以管制,却对OpenAI同样强大的模型视而不见。这在两家公司排队准备上市之际,招致外界质疑。
所有这些事件的最引人注目之处,就是前瞻思维的缺失。政策制定者非但没有为未来的冲击做好准备,反而在忙于应对刚刚发生的冲击。但前沿模型的自主学习能力显示,未来的突破不会是渐进式的,相反它们很可能突然出现并产生累积效应,留给人们调整的时间也将比以往更少。那些自愿性框架、行业自我评估,以及仅产生宣言而非具有约束力承诺的峰会,并未让我们为即将到来的挑战做好准备。
最初的斯普特尼克时刻曾引发优先事项、体制和资源的真正重新定位。美国政府因此成立美国国家航空航天局,增加对科技的公共投资,并在11年后将人类送上月球。
当然,当今的地缘政治环境与冷战时期截然不同。但政策制定者必须汲取这些AI事态发展的教训——更何况每一项发展都比前一个影响更为重大。为了确保各类AI模型,尤其是那些似乎即将颠覆劳动力市场并重塑医疗和教育体系的模型,与社会价值观保持一致,各国政府必须推动民主辩论,并建立切实有效的防护措施。这些做法的任何缺失都必将招致灾难。
作者Gabriela Ramos是不平等与社会相关财务披露工作组联合主席,曾任联合国教科文组织社会及人文科学助理总干事、经济合作与发展组织幕僚长以及负责对接二十国集团、七国集团及亚太经合组织的事务代表;Emilija Stojmenova Duh是斯洛文尼亚卢布尔雅那大学电气工程系副教授、全球伦理基金会董事会成员、欧盟AI科学专家组成员,曾任斯洛文尼亚数码化转型部长。
英文原题:Enforce AI Guardrails Before It’s Too Late
版权所有:Project Syndicate, 2026.