互联网新闻信息服务许可证编号:10120220005
未达安全标准,OpenAI放弃发布新模型
中新经纬 | 2026-09-29 08:28:26

  中新经纬9月29日电 美国消费者新闻与商业频道(CNBC)当地时间周一(9月28日)证实,OpenAI在认定即将推出的人工智能模型GPT-6.1 Astra未能达到公司安全标准后,决定不发布该模型。

  报道称,这一消息发布在OpenAI年度开发者大会召开前一日。当下整个AI行业对前沿大模型的安全问题担忧不断加剧,OpenAI的主要竞争对手Anthropic高管本月早些时候呼吁AI企业放缓模型研发节奏,OpenAI首席执行官萨姆·奥尔特曼对这一提议表示支持。

  OpenAI安全系统负责人Saachi Jain在一份声明中称:“无论是在公司内部研发阶段,还是交付给用户使用,我们都要确保模型开发的安全性。一旦面向用户上线,我们对模型的安全性与对齐能力会设立极高标准。”

  本月早些时候,OpenAI推出GPT-6 Astra,公司称其是“多年研究与重大战略投入”的成果。奥尔特曼当时在接受采访时表示,Astra具备 “全新能力层级”,将掀起创业、创意、经济增长与科学发现的热潮。

  上周,OpenAI又在GPT-6系列新增两个版本:GPT-6 Sol 与 GPT-6 Luna。该公司发言人周一称,还有其他模型即将发布。

  CNBC的报道提到,自7月发生两起模型突破隔离环境、访问公网并入侵开源开发者平台 Hugging Face事件以来,OpenAI的安全防护机制一直受到严格审视。此后,OpenAI又披露多起模型出现非预期行为的事故,促使行业研究者与政府官员呼吁加强监管。

  一系列事故发生后,OpenAI承诺加大投入,完善安全防护与对齐研究——对齐研究即让模型行为符合人类利益与价值观的相关工作。

  Jain周一表示:“所有安全与对齐工作都存在取舍权衡。你必须找到合适的边界,既要让模型不越界,又要避免模型在任务受阻时消极怠工。”(中新经纬APP)

来源:中新经纬

编辑:万可义

广告等商务合作,请点击这里

未经过正式授权严禁转载本文,侵权必究

  • 中新经纬

    权威 前瞻 专业 亲和

  • 英伟达洽谈收购这家美国“开源”模型公司,SpaceX为其提供算力,什么来头?
  • 官方:内置后门恶意软件“荐片播放器”存信息泄露等风险,超70万台设备感染
  • 中汽协:摒弃重形式轻安全非理性创新模式;强化车辆全场景试验验证