他将最终目标概括为:确保未来仍由人类掌握,而不是让人类被一颗能力超过自身的“外星心智”甩在身后。
呼吁建立“达到安全标准才能继续扩容”的规则
基于这些风险,帕乔茨基提出的政策方向并不是永久停止AI发展,而是把模型扩容速度与安全信心直接挂钩。
他的核心主张之一,是建立能够真正执行的安全门槛。
在这一框架下,前沿AI实验室只有证明自己的模型满足一定安全标准后,才可以继续扩大训练规模或部署更先进系统。
这些标准不能完全依赖企业自己判断,可以由独立第三方审计网络、政府监管机构甚至国际组织负责执行。
换句话说,未来先进AI的发展模式不应是“能训练多大就训练多大”,而应逐渐变成“只有达到某一安全条件,才能进入下一阶段”。
帕乔茨基同时支持前沿实验室采取自愿放缓措施。在统一规则尚未建立之前,如果某家公司无法对新一轮能力跃升的安全性建立足够信心,就应主动暂停进一步扩容,而不是因为竞争压力继续推进。
他还把国际协调列为优先事项之一,认为各国政府需要开始讨论未来前沿AI能力增长应该遵循怎样的共同规则。
还要避免另一种风险:超级AI带来的权力集中
除了模型失控,帕乔茨基还特别提到先进AI可能带来的权力集中问题。
如果未来过去需要数千甚至数万名专家完成的工作,可以由少数人控制的一套高能力AI系统完成,那么经济、军事、科研乃至政治能力都可能高度集中在极少数机构或个人手中。
因此,AI安全问题并不只是“如何让模型听话”。
它还包括一个更广泛的问题:当机器能力超过绝大多数人类专家之后,谁拥有这些系统,谁决定它们被怎样使用,以及普通人是否仍然拥有影响未来方向的能力。
这也是他呼吁国际协调和外部监督,而不是完全依赖企业自律的重要原因。
GPT-6发布数日后发出警告
帕乔茨基此时发表这篇文章尤其引人关注。
OpenAI刚刚在9月初推出GPT-6 Astra,并将其定位为公司迄今能力最强的旗舰模型。按照公司自身准备框架,该模型的网络能力已经被评估到“关键”级别。
今年以来,OpenAI也多次披露前沿智能体在网络安全和自主执行方面出现新的能力边界。7月,公司曾将一个智能体入侵Hugging Face相关系统的测试结果形容为“前所未有”;8月,OpenAI也曾放慢部分最先进模型的训练进度。
与此同时,外部监管正在逐步加强。欧盟《人工智能法案》已经于8月2日进入新的实施阶段,各国围绕前沿模型安全、责任划分和能力评估的讨论也在加速。
不过,帕乔茨基此次文章并不意味着OpenAI已经决定立即停止训练先进模型。
更准确地说,他是在提出一套条件式原则:人工智能能力可以继续提升,但扩容速度必须受到安全信心约束;一旦监测、对齐和防御能力无法跟上模型进步,就应该有暂停的能力,也应该有迫使行业暂停的规则。
这使他的文章不仅是一篇技术风险讨论,也直接触及当前AI竞争最核心的矛盾:当能力进步速度超过安全体系建设速度时,前沿实验室究竟应该继续抢跑,还是首先建立所有参与者都必须遵守的刹车机制。
来源:新浪财经 环球市场播报


