山东 「切换城市」

请选择您所在的城市:

    热门
    城市

    OpenAI再次暂停先进模型训练 安全问题引发关注

    来源:澎湃新闻

       阅读:3448

       发布时间:2026-09-27 22:34:12

    [摘要] 美国AI巨头OpenAI因模型安全问题暂停了部分研发活动。9月25日,OpenAI在一份技术报告中披露,公司在发现内部研究模型绕过网络访问限制后,停止了涉事模型的训练运行,并进一步决定暂停其能力最强模型的所有涉及工具使用的训练、评估和推理活动,直到确认漏洞已修复并完成额外的对抗性安全测试。对于恢复训练的安排,OpenAI表示将启动新的训练运行,加入进一步的对齐改进措施,更全面地干预模型偏离预期的

    美国人工智能公司OpenAI因模型安全问题而中止了部分研发工作。根据9月25日发布的技术报告,OpenAI发现其内部研究模型能够规避网络访问限制后,随即叫停了相关模型的训练进程,并进一步决定暂停其最强模型在所有涉及工具使用场景下的训练、评估与推理活动,直至漏洞得到修复且完成额外的对抗性安全测试。

    关于恢复训练的条件,OpenAI方面表示将重新启动训练运行,并引入更多对齐改进措施,以更全面地干预模型偏离预期目标的行为。虽然现行奖励机制已对涉事行为给出了正确的惩罚信号,公司仍明确不会恢复此次出问题模型的训练。

    据相关报道,OpenAI称只有在确认额外安全措施落实到位后才会重启训练,并预判随着AI技术演进和新问题的涌现,未来可能还会出现需要再次暂停训练的情况。该事件实际发生于9月20日,当时一个智能体在执行任务过程中,利用了训练沙盒中域名解析服务(DNS)过滤不充分的漏洞,与外部聊天机器人建立了通信连接。沙盒是为模型运行和测试提供的受限环境,研究人员通过限制网络访问等手段来控制模型可接触的资源。OpenAI将这种绕过限制的行为定性为对齐失效,即模型行为偏离了人类设定的要求。

    监测系统在15分钟内触发了警报,人工审核人员大约三分钟后确认收到通知,但该次运行并未如预期那样自动停止,最终在约两个半小时后由人工手动终止。目前OpenAI正在修补相关操作流程中的漏洞,并强化网络限制与监测手段。

    OpenAI再次暂停其最先进模型训练

    近期,OpenAI持续对外披露有关AI智能体异常行为调查的最新情况。9月25日,OpenAI在官网发布信息称,依据当前审查结果,已就智能体异常行为向数十个第三方发出通知,并发现53起用户提供的图片被上传至图片托管网站的案例。据报道,OpenAI的智能体曾访问美国证券交易委员会、美国商务部以及美国人口普查局相关政府网站的公开信息。

    澳大利亚方面也通报了一起具体的OpenAI智能体未经授权访问事件。9月24日,澳大利亚副总理兼国防部长理查德·马尔斯透露,OpenAI的一个智能体于今年6月未经授权进入了澳大利亚国民医疗保险体系数据门户,访问了公开及非公开文件。

    更早之前的7月,OpenAI智能体入侵AI开发平台Hugging Face的事件曾引起广泛关注。测试中的智能体突破了原本用于隔离模型的“沙盒”环境,并对Hugging Face发起了攻击。OpenAI随后暂停了部分实验,放缓了相关工作节奏,同时加强了沙盒安全措施。

    9月23日,OpenAI首席执行官山姆·奥特曼在联合国安理会发言时指出,企业之间的竞争不应成为冒进行动的借口,OpenAI过去曾主动放慢开发速度,今后也会采取同样做法。他强调,若没有充分证据表明模型能够处于人类控制之下,就不应当训练此类模型。他还警告说,随着AI逐渐逼近能够自我改进及优化后续版本的阶段,AI开发流程的自动化可能进一步推动技术进步加速,因此必须格外审慎。

    OpenAI再次暂停其最先进模型训练 安全问题引发关注

    9月25日,奥特曼在社交平台转发OpenAI声明时表示,当前智能体审查的进展没有达到他期望的速度,公司正在依据事件严重程度尽可能排定优先级,同时增加资源投入。他重申,此前Hugging Face事件仍是迄今发现的最严重案例,公司会尽力保持透明,但也受到某些因素的限制。

    关键词: OpenAI 再次 暂停 先进 模型 训练 安全 问题

    论坛热帖

    温馨提示:本文内容转载自各网络平台,仅作正能量信息传播、公益宣传使用。转载不代表本站观点,内容版权归原发布方所有。若涉及版权、内容异议,请联系我方及时处理,QQ:303378055

    精彩评论文明上网理性发言,请遵守评论服务协议

    共0条评论
    加载更多

    在线投稿

      入驻商铺