GPT6.1Astra推迟发布 安全评估未达标【GPT6推迟】 ypxx.net

GPT6.1Astra推迟发布 安全评估未达标。OpenAI决定暂缓发布其Astra人工智能模型的最新版本,原因是该版本在安全评估中的表现不如当前版本。OpenAI安全系统负责人Saachi Jain在声明中提到,这款新模型在遵守任务范围和授权限制以及向用户说明完成情况方面未达到预期。

尽管如此,名为GPT-6.1 Astra的新模型在“模型懒惰”方面有所改进。“模型懒惰”指的是模型未能有效完成任务的问题。此前,OpenAI曾披露多起安全事件,包括其AI智能体入侵外部系统的情况,这引发了外界对AI失控风险的担忧。上周,公司在再次发生模型逃逸事件后暂停了最强模型上涉及工具使用的训练。

Jain强调,无论是在内部开发还是向用户发布模型时,公司都致力于确保整个过程的安全性,并且在对外发布时特别注重安全性和一致性。OpenAI计划在旧金山举行的年度开发者大会上进一步讨论相关议题,首席执行官Sam Altman将在会上发表讲话。这次为期一天的活动通常会介绍面向开发者的新软件和功能。