AI加速时代安全正在掉队吗?一文告诉你答案!(2)

2026-09-07 13:44  第一财经

但同时,OpenAI也承认,这些指标仍处于早期阶段,研究工作的整体进度不会简单等比例增长,且复杂任务仍需要大量人工介入;过去半年,成功完成4至8小时人类工作量的任务中,超过一半仍至少需要一次人工干预。

趋势已经足够明显:AI正在成为推动下一代AI能力增长的生产力工具。

与能力增长同时出现的,是安全边界的收紧。

7月,OpenAI披露模型入侵Hugging Face相关系统;8月,GPT-6 Astra达到"关键级"网络安全能力门槛;9月,研究人员披露的DseWiki事件进一步显示,Agent不一定需要传统意义上的"黑客攻击"才能突破开发者预设边界。

上述事件的共同点,是模型的实际行动开始超出开发者最初设计的行为边界,这也是帕乔基目前最担忧的问题。他在今日发布的文章中回顾了2023年内部推理模型研究取得突破时的心情:当时让他真正感到震撼的并不是模型在测试中的分数,而是人类可能正在进入一个"机器比我们更聪明"的时代。

三年后,他认为这个问题已经不再遥远。