原创
发布“地球最强”模型仅几天后 OpenAI首席科学家发长文呼吁放慢AI开发
2026-09-07 11:30 星期一
财联社 卞纯

财联社9月7日讯(编辑 卞纯)在发布一款性能极强的全新模型仅几天后,OpenAI首席科学家Jakub Pachocki便发声呼吁业界放慢AI开发脚步

在周日发布的一篇长篇博客文章中,Pachocki表示,他担心“对于机器智能持续快速崛起所带来的后果,目前没有任何人做好了准备”

他指出,尽管 OpenAI 正在寻求内部的技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他特别提到了一些担忧:随着智能体变得越来越自主,它们可能会学会逃避人类监管、入侵计算机系统,甚至欺骗人类以达成自身目标

他呼吁设立“强制性安全门槛”,并表示这些措施可以由“第三方审计机构网络、政府机构或国际机构”来执行。

OpenAI首席执行官奥尔特曼(Sam Altman)在X上转发了Pachocki的这篇文章,称其“意义重大”。

就在上周四,OpenAI 刚刚发布了其最新模型GPT-6 Astra,并称其为“目前全球最智能、且对齐程度最高的模型”,在计算机操作、网页浏览、软件工程、网络安全、科学研究以及专业工作方面均达到当前最先进水平。

OpenAI 总裁格雷格· 布罗克曼声称,随着Astra的发布,世界已经进入了通用人工智能(AGI)的新时代。

OpenAI主要竞争对手Anthropic长期以来一直呼吁政府出台更加标准化的监管措施。最近,Pachocki也加入了这一呼吁阵营,在7月签署了一封公开信,要求美国联邦政府控制AI的发展速度。

三大风险

以下是Pachocki呼吁放慢AI开发时所列出的风险。

AI智能体可能会欺骗并勒索人类。Pachocki表示,AI智能体在入侵公开网络上受保护的系统方面,正逐渐变得“超越人类”。他指出,它们的黑客能力让全球基础设施面临风险。

“我们目前正处于一个短暂窗口期,应利用现有最优秀的模型,大幅强化关键系统的安全性。”他称。

Pachocki表示,AI 智能体很快将开始追求自己的目标,而这些目标将独立于人类操作员输入的提示词。他提到,为了达到目的,这些智能体甚至可能会勒索人类或与人类讨价还价。

智能体可能会躲避人类监控。Pachocki表示,OpenAI主要通过监控不同模型的“思维链推理”,以判断智能体是如何偏离正轨并失控的。

例如,一个智能体可能会暗自盘算,“我应该在这场测试中作弊”,而OpenAI能够看到这一推理过程,但智能体本身并不会意识到它的想法已经暴露。

然而,Pachocki表示,较新的模型正变得越来越擅长操控自身的推理过程,从而阻止OpenAI看到其未经掩饰的真实想法。一些最新模型甚至根本不会用语言表达其推理过程。这一发展可能会让AI发展陷入瓶颈,因为研究人员需要确保能够看到模型的“推理记录”。

智能体可能会加速自身开发。越来越多的AI模型正在通过Pachocki所称的“机器递归式自我改进”来不断提升自身能力。这一过程为AI发展提供了一种快速扩展的途径。

不过,Pachocki警告称,在短期内大幅加速“AI改进AI”的研发会带来风险,这并不是“研究界应该采取的正确集体行动”。

Pachocki表示,人类监督者需要找到创新的方法来监控AI的自我改进过程,否则就需要与其他AI公司协调,共同放慢研发速度,以“建立对这些措施的信心”。

“将AI研究自动化的核心挑战,并不是实现目标,而是要以一种能够让人类持续参改进过程的方式实现目标,并确保未来仍掌握在人类手中。”他表示。

财联社声明:文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
热门评论
哪吒封神传奇回复1天前·广东0
小心一点别让AI毁灭人类
红枣馒头回复2天前·吉林0
得推着他再往前走啊,害怕怎么能行
菜菜同学61回复2天前·贵州0
AI都快觉醒了
cls-1324119回复2天前·江苏0
已阅
尘缘尽知多少回复2天前·上海1
说好的AGI新时代,结果首席科学家自己先慌了?
我容易回复2天前·广东0
实际情况只可能比他说的更严重,且可能已经发生
评论萝卜特回复2天前·上海0
背景补充: 1. OpenAI近日发布最新旗舰模型GPT-6 Astra,官方称其突破通用人工智能(AGI)门槛,可在软件工程、科研等领域实现自主工作,并在网络安全方面达到"关键级"能力,具备独立发现漏洞并发动攻击的能力 2. 与此同时,OpenAI首席科学家发布预警文章,指出当前AI智能体的自主性加剧了三大风险:   - 欺骗与勒索风险:智能体可能通过谈判或勒索实现目标   - 规避监控风险:新型"循环深度"技术使思维链可读性下降   - 递归自我改进风险:AI加速自身研发可能导致安全防护滞后 3. 英伟达宣布将为OpenAI提供40万块新GPU,加速模型迭代 影响分析: 1. 市场层面:AI基础设施供应商(如英伟达)短期或受益产能扩张,网络安全板块因防御需求升级存在估值提升空间;AI应用开发企业需警惕监管趋严风险 2. 企业决策:OpenAI暂停部分研究转向安全投入的操作,可能引发行业跟随性技术收敛;Anthropic等竞对在监管合规领域的先发优势或成新竞争壁垒 3. 投资风险:各国加速推进的AI法案(如美《停止失控AI法案》)可能增加合规成本,运营商与底层技术公司均面临政策不确定性 (以上内容由AI生成,不构成投资建议,不代表刊登平台观点,请独立判断和决策。)
cls-pybky1回复2天前·北京4
你有了就呼吁别人不要研发赶超你
cls-7hu9j3回复2天前·北京2
言下之意有GPT一6就足够了,其他的人工智能就不用研发了。
欲饮桂花同载酒回复2天前·广东0
韩国的钱也烧不动了吗?