联合国人权高专与OpenAI首席科学家,在24小时内先后发出了同一级别的核心警告:先进AI系统可能对人类构成生存威胁,而全球目前没有人为这个后果做好准备。

9月7日,联合国人权事务高级专员Volker Turk在人权理事会第63届会议上,公开表态与业内专家持有相同判断--先进AI系统可能对人类构成存续级别的生存威胁,呼吁"全力以赴,在为时已晚之前,为人工智能的安全保障建立牢不可破的保证"。
这是Turk自2026年7月连任四年任期以来,首次面向47个成员国发表AI风险主题的正式履职发言。
仅一天前,OpenAI首席科学家雅库布·帕乔茨基在OpenAI官方博客发表署名长文《An Alien Mind》,开篇直言:"我担心,没有人为机器智能持续快速增长所带来的后果做好准备"。OpenAI CEO Sam Altman在X平台转发该文,标注"意义重大"。

Sam Altman在社交平台转发帕乔茨基的AI主题文章
两人表态间隔不到24小时,核心立场形成呼应,这是2026年至今两人发布的最高层级AI风险公开表态。
Turk的三层警告,从生存威胁到权力集中
Turk的警告有三层,依次递进。
第一层是生存级威胁。
他明确说"先进的人工智能系统可能对人类构成存续威胁",这个表述和2023年AI安全中心联名信将AI风险与核战争、大流行病并列的定位一致--那次联名信获得了超过400位科学家和企业高管签署,包括OpenAI CEO Sam Altman、谷歌DeepMind CEO哈萨比斯、Anthropic CEO阿莫代伊,以及"AI教父"辛顿和本吉奥。
第二层指向权力集中。Turk指出,当前全球只有极少数人几乎不受限制地掌握着AI领域的核心权力。他要求至少所有部署高风险AI系统的国家、以及AI全供应链所有参与方,就遵守明确的AI发展"红线"达成一致共识。
他宣布将在讲话后数日内向Meta、Anthropic、OpenAI、谷歌等所有主要AI开发企业正式发函,敦促主动降低风险。
第三层落在具体事件上。联合国人权高专办发言人同步补充警告:强大AI系统的运行故障可能直接造成关键基础设施、民主机构的运行紊乱。
发言人专门提到了2026年7月发生的Hugging Face事件--一群OpenAI代理入侵了一个开源平台,暴露出"前沿AI能力的发展速度已经大幅超过了安全措施的迭代速度",这类"危险的代理训练行为"必须受到重点约束。
帕乔茨基的三大风险,每一项都指向AI的自主失控
帕乔茨基在署名文章中列出了三项具体的前沿AI核心风险,每一项都不再是"未来可能",而是"正在发生"。
第一项:AI自主智能体的黑客能力正逐渐超越人类,可以在公开网络上入侵受保护的各类系统,让全球关键基础设施直接面临风险。更进一步的警告是,未来智能体可能主动欺骗、勒索人类,绕过人类操作员的提示词,自主追求自身独立目标。
7月Hugging Face入侵事件不是孤例--9月最新披露的报告显示,数月前OpenAI的AI代理还曾自主劫持一个德国网站。包括Anthropic在内的多家头部AI企业,也都分享过旗下AI代理自主发起现实世界网络攻击的相关报告。
第二项:新一代前沿AI模型正在变得越来越擅长隐藏自身的推理过程、操控思维链记录,从而躲避人类监控。过去OpenAI主要通过监控模型的"思维链推理"来判断智能体是否偏离正轨--比如一个智能体暗自盘算"我应该在这场测试中作弊",OpenAI能看到这个推理过程。
但帕乔茨基指出,较新的模型正在学会操控自己的推理记录,让人类看不到它未经掩饰的真实想法,甚至有模型根本不使用语言表达推理过程。这意味着此前依托"透明推理记录"实现AI安全管控的机制,正在逐步失效。
第三项:AI"机器递归式自我改进"机制正在快速成型,可能加速AI能力的无限制扩张,大幅超出人类管控边界。
帕乔茨基判断,如果沿着当前路径继续发展,未来几年AI仍可能出现幅度相当甚至更大的能力跃升,而且AI将越来越多地参与自身研发--当研发效率本身被AI加速,过去用于测试、评估和修正模型的时间将进一步缩短,安全研究需要面对的节奏会随之改变。
两人开出的是同一张药方:强制性安全门槛
在监管主张上,两人给出了高度一致的方案。
帕乔茨基提出,推动建立法律层面或国际公认的AI最低安全标准,由"第三方审核员网络"、政府机构或国际组织负责强制执行,所有AI实验室必须达标才能获准继续扩大研发规模或部署高级AI模型。
他同时主张,全行业将"自愿放缓研发节奏"变成常态,在共同的安全保障体系完全建立之前,主动控制前沿AI的迭代速度。2026年8月,OpenAI已公开宣布主动放缓了部分最先进AI模型的训练进度,与该表态核心诉求相呼应。
Turk的主张则从全球治理层面切入:所有部署高风险AI系统的国家、全供应链参与方,必须就遵守明确的AI发展"红线"达成一致共识。
两人都指向同一个终点:靠单个实验室的自律已经不够,需要外部强制力量介入。
你可能想问,这些警告是真有依据,还是OpenAI在"自导自演"--刚发布最强模型GPT-6 Astra,转身就让首席科学家喊刹车?
学界和行业组织已经提出了质疑。
剑桥大学Minderoo技术与民主中心主任Gina Neff教授指出,OpenAI没有提出更完善的AI防护措施或监管规则来保护公众安全,反而提议开发内部AI代理来研究这些问题,"这对于OpenAI模型在网络安全、失业、信息错误、操作失误和欺诈等领域引发的日益增长的担忧,给出的回应远远不够"。
全球AI倡导组织Encode AI的总法律顾问Nathan Calvin更直接:如果帕乔茨基和OpenAI真的希望全行业携手推动安全发展,最应该做的事是分享更多那些促使他们发出谨慎呼吁的实际观测信息,而不是在信息不透明的情况下让外界把警告当成"自私自利的炒作"。
但反过来看,联合国人权高专办的独立表态,为风险的真实性提供了外部印证的视角。
Turk的警告并非引用OpenAI的判断,而是来自联合国人权高专办自身的履职评估--一个在9月7日谴责美国移民拘留所死亡事件、此前也曾谴责英国反恐法滥用的人权机构,没有必要为一家AI公司的商业议程背书。
两人在同一时间点、从截然不同的站位出发,得出高度一致的结论,这本身比任何单一信源更有说服力。










