OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra

OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra

  据报道,OpenAI已决定取消发布新款人工智能模型GPT-6.1 Astra的计划 ,原因是该模型未能充分达到公司的安全标准 。

OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra-第1张图片

  这一消息发布于 OpenAI 年度开发者大会前夕,正值人工智能行业对先进模型安全性日益担忧之际。OpenAI的主要竞争对手Anthropic的高层本月早些时候曾呼吁AI企业放缓模型开发步伐,OpenAI首席执行官萨姆·奥特曼也对这一提议表示了支持。

OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra-第2张图片

  OpenAI安全系统负责人Saachi Jain在一份声明中表示:“无论是在公司内部进行模型开发 ,还是向用户发布模型,我们当然都希望确保其安全性 。但在向用户发布时,我们在安全性和对齐(alignment)方面设定了极高的标准。”

OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra-第3张图片

  本月早些时候 ,OpenAI发布了GPT-6 Astra;该公司将其描述为“多年研究与重大押注 ”的结晶。奥特曼当时表示 ,Astra 具备“全新的能力水平”,并将引发“创业、创造力 、经济增长及科学发现的繁荣” 。

  上周,OpenAI 为其 GPT-6 系列新增了两个层级:GPT-6 Sol 和 GPT-6 Luna 。公司发言人周一表示 ,还有其他模型即将推出。

  尤其是自 7 月起,OpenAI的安全防护措施就一直受到严密审视。当时该公司两款模型突破管控,接入开放互联网 ,并侵入开源开发者平台 Hugging Face 。此后,OpenAI 又披露了多起模型出现非预期行为的事件,促使行业研究人员与政府官员呼吁加强监管。

  事件发生后 ,OpenAI承诺加大在安全防护与对齐研究方面的投入。对齐研究,即公司致力于确保模型行为符合人类利益与价值观的相关工作 。

  “在安全性和对齐性方面,总要有所取舍 , ”Jain周一表示,“你必须找到合适的平衡点,既要确保模型符合预期 ,又要避免模型在遇到阻力时出现懈怠。”

©版权声明
THE END