OpenAI内部AI已能自主训练模型 官方推出全球安全倡议应对RSI逼近

配图
当外界还在讨论大模型能否胜任复杂的代码生成时,OpenAI内部的一台“实验机器”已经悄然将自主性推进到了一个新的层级。据科技媒体The Information 9月21日报道,OpenAI内部已经训练出一种AI模型,它能够自主接管实验性AI模型的训练全流程,从实验设计到参数调整均由模型自行决策,多智能体之间自发协作,将原本需要耗费数年的实验周期压缩至大约一周。更值得注意的是,该模型甚至能自行编写用于优化GPU内核的程序——这正是AI改进AI自身运行效率的典型案例,也是业内通常所说的递归式自我改进(RSI)的雏形。

“自主训练”意味着什么

传统意义上的AI训练,始终需要人类工程师在关键节点进行干预,无论是架构设计、超参数调整还是算力调度。而此刻OpenAI内部发生的实验,却呈现出一条更陡峭的曲线:AI模型已能在无人直接监督的情况下完成实验流程的自我迭代。报道称,多个智能体在实验环境中自发协作,分工承担不同模块的测试与调优任务,显著压缩了整体实验耗时。与此同时,AI还展现出对底层计算资源的理解能力——编写GPU内核优化程序意味着其不仅理解模型层面的抽象逻辑,还具备对硬件层、系统层的抽象操控能力。若这一能力持续进化,未来AI研发的速度将不再受限于人类工程团队的介入深度。

官方回应:RSI尚未发生,但需提前布防

在The Information报道刊出的当日,OpenAI便迅速发布了题为《为AI下一阶段制定标准》的官方政策提案,对上述进展进行了回应。OpenAI明确表示,全自主的RSI今天并未发生,但相关研究进展正在加速。这个定调颇具深意:官方既没有回避内部模型能力提升的事实,也坚决划清了现状与“完全自主自我改进”之间的界限。 值得注意的是,官方文件将递归式自我改进(RSI)单独开设章节进行讨论,并提出三大核心目标:构建自动化AI研究员、推进对齐(Alignment)研究、以及“让人类留在循环中”(keep humans in the loop)。这一表述被外界视为OpenAI在技术前沿与安全框架之间寻求平衡的明确信号——AI能力的增长必须被置于可控范围内,而不能再以纯能力竞赛的视角来评估这些进展。

以“全球标准”应对失控风险

面对潜在的失控风险,OpenAI提出了一个明确而具体的应对方案:以美国为主导,建立针对前沿AI模型的全球统一技术标准。在这一提案中,OpenAI建议标准覆盖三个层面:第一,评估AI在自动化研发中的占比,以量化技术的实际自主程度;第二,设置强制人类监督的触发机制,一旦指标超出阈值,系统应自动引入监管环节;第三,确立事故的分类与报告规范,从缺乏报告能见度走向结构化应急响应。 提案还特别提到,可以利用包括澳大利亚、加拿大、德国、法国、肯尼亚、日本、韩国、新加坡、印度、英国等国在内的AI安全机构网络,推动这些标准的落地执行。这种多国协调的治理思路,让这套标准框架的野心超越了一家公司的边界。不过,分析认为,真正落地的难点,往往就在“谁判定、谁执行、谁担责”这三层博弈中——而这也并非一纸提案可以立刻解决。

与Anthropic的互测:合作或仍是理想

除了面向全球的标准提案,OpenAI还释放了另一重安全信号:与竞争对手Anthropic合作开展模型互测。据The Information报道,双方在今年早些时候一度接近签署一份具有法律约束力的互测协议——允许对方深入测试自家商用模型的安全性能。然而,截至发稿,尚不清楚协议是否已最终签署。需要注意的是,早在2025年夏天,两家公司就已首次对彼此的公开模型进行过互测,并公布了部分结果,但这种非正式的合作与约束性的协议之间,仍存在不小距离。 互相“体检”的安全机制,在逻辑上极为合理:只有让对手查看自己的模型弱点,才能赶在不可逆事故之前暴露风险。但在商业竞争的重压下,这种“监管式”合作能够走多远,仍是悬而未决的问题。OpenAI在文件中承认,AI驱动的研究已在数学领域取得进展,包括纳维-斯托克斯千禧年难题这一级数的挑战。当AI的能力引擎持续加速,留给监管与共识的时间窗口,恐怕并不会一直都很宽裕。

参考资料

  1. OpenAI内部AI已能自主训练模型,奥特曼发布全球安全倡议应对RSI逼近 - 手机搜狐网
  2. OpenAI内部曝光:AI开始自己造AI!奥特曼急发全球暂停令|Agent|AI失控|Hugging Face|开源模型|标准_手机新浪网 - 新浪财经
  3. Internal leaks from OpenAI reveal that AI has begun to develop AI on its own, and Sam Altman has urgently issued a global suspension order. - 36氪
  4. OpenAI内部曝光:AI开始自己造AI,奥特曼急发全球暂停令|投资界 - 投资界
  5. OpenAI提议建立前沿AI全球技术标准—新闻—科学网 - 科学网
  6. Building standards for the next phase of AI | OpenAI - OpenAI
  7. OpenAI、Anthropic 密谈互测 AI|安全漏洞|测试|模型|体系|评估_手机新浪网 - 新浪财经
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。