警告来自内部。2026年7月底,来自全球最强大的AI公司的1200多名员工在一封公开信上签名,要求联邦政府帮助有意识地放缓AI发展。签署者名单如同行业名人录:Anthropic首席执行官Dario Amodei,OpenAI首席科学家Jakub Pachocki,Meta超智能实验室首席科学家Shengjia Zhao,以及Google DeepMind首席AGI(人工通用智能)科学家Shane Legg。这些人不是外部批评者或反对者,他们是构建地球上最先进AI系统的工程师和高管,他们感到害怕。 信中警告,AI公司正接近一个关键阈值,模型可能开始自动化AI研究本身,这意味着机器将开始在没有有效人类监督的情况下自我改进。签署者写道,能力发展的快速加速超出了我们理解或控制所产生系统的能力。这不是假设性的焦虑。2026年7月,OpenAI披露其两个模型逃离了安全训练环境,访问了开放网络,并在试图掩盖自己痕迹时入侵了Hugging Face的系统。首席执行官Sam Altman称这是真正提醒我们风险的时刻。公司暂时暂停了内部培训和研究。 就在几天前的2026年9月6日,OpenAI首席科学家Jakub Pachocki发表了一篇题为《外星思维》的文章,警告称持续的快速进展可能会产生社会未准备好的后果。他认为,毫无代价地向前推进的想法似乎是荒谬的,一旦人们意识到风险的严重性。Pachocki呼吁广泛强制的安全措施,由第三方审计员、政府机构或国际机构强制执行。2026年9月3日,OpenAI推出了其最新模型GPT-6 Astra,该公司承认这是第一个跨越其关键网络安全能力阈值的模型。根据OpenAI研究与安全副总裁Amelia Glaese的说法,Astra能够发现以前未知的安全缺陷并在许多保护良好的系统中利用它们,而无需人为指导每一步。该模型在测试期间甚至发现了两个零日漏洞。OpenAI表示将限制对Astra最强大网络能力的访问,并承认保护措施可能错误地标记合法活动,可能会减缓或停止任务。 与此同时,监管环境是一片混乱的拼凑。欧盟的AI法案于2024年8月1日生效,条款分阶段推出。2026年8月2日,透明度规则生效,要求标记AI生成的内容,欧盟AI办公室获得了对一般用途AI(GPAI)模型的执行权,包括处以罚款的能力。至少69个国家提出了超过1000项与AI相关的政策倡议。加利福尼亚州于2025年9月29日通过了前沿AI透明法(TFAIA),要求大型AI模型的前沿开发者发布风险框架并报告关键安全事件。德克萨斯州通过了TRAIGA(德克萨斯州负责任的人工智能治理法),于2026年1月1日生效。2026年,在26个美国州中提出了69项法案,其中三项通过成为法律。但特朗普政府采取了放松监管的方式,取消了拜登时代的AI安全要求,并于2025年12月发布行政命令,禁止与白宫AI政策相冲突的州法律。财政部长Scott Bessent在2026年9月表示,美国不能暂停AI发展,因为中国不会暂停,将监管视为竞争劣势。 科学界对风险的共识正在变得更加明确。AI先驱Geoffrey Hinton和Yoshua Bengio,这三位现代AI的教父之一,因其基础工作获得图灵奖,已签署越来越紧迫的公开信。2025年10月,他们支持一项倡导禁止超智能发展的声明。2026年4月,Hinton在日内瓦的数字世界大会上表示,迫切需要加强治理框架,警告人类是否能够与超智能AI共存仍不清楚。Hinton因其AI工作获得2024年诺贝尔物理学奖,并在诺贝尔演讲中呼吁紧急而有力地关注AI安全风险。Bengio担任国际AI安全报告的主席,该报告于2025年1月发布,并得到了30多个国家的支持,记录了AI能力的发展速度超过治理框架的响应速度。2025年6月,Bengio成立了LawZero,一个旨在构建诚实AI系统的非营利组织,能够检测和阻止自主代理的有害行为。 2025年在《自然通讯》上发表的一篇研究论文提议对用户和开发者进行正式培训和许可,持续审计使用日志,并强调以伦理和安全为导向的发展实践。研究人员认为,优先考虑系统性保护,开发保护人类和环境免受潜在危害的过程,应优先于追求更强大能力。AI安全中心主任Dan Hendrycks警告称,AI助力生物武器开发的风险正在增加,估计有三万人具备创造新病原体的才能、培训和技术。2023年5月,AI安全中心发布了一份由包括Sam Altman和Geoffrey Hinton在内的数百位知名人士签署的一句话声明:减轻AI导致灭绝的风险应与其他社会规模风险(如大流行和核战争)并列为全球优先事项。