简体 | 繁体
loading...
新闻频道
  • 首页
  • 新闻
  • 读图
  • 财经
  • 教育
  • 家居
  • 健康
  • 美食
  • 时尚
  • 旅游
  • 影视
  • 博客
  • 群吧
  • 论坛
  • 电台
  • 焦点新闻
  • 图片新闻
  • 视频新闻
  • 生活百态
  • 娱乐新闻
您的位置: 文学城 » 新闻 » 焦点新闻 » OpenAI罕见叫停新模型:它会隐瞒 还会擅自越权

OpenAI罕见叫停新模型:它会隐瞒 还会擅自越权

文章来源: 联合报 于 2026-09-29 09:52:49 - 新闻取自各大新闻媒体,新闻内容并不代表本网立场!
被阅读次数
OpenAI罕见叫停新模型:它会隐瞒 还会擅自越权

OpenAI执行长奥特曼(左)廿四日在白宫国宴上与脸书执行长扎克伯格 (右)谈话。OpenAI廿八日突然宣布,该公司新AI模型因安全疑虑将暂缓推出。美联社

AI公司OpenAI于廿八日宣布,出于安全风险疑虑,原订十月发表的新一代AI模型GPT-6.1 Astra将暂缓推出。华尔街日报指出,这是迄今最明显的警讯之一,显示AI代理程式若持续出现超出授权范围等不当行为,可能迫使业界放慢原本快速推进的技术发展脚步。

OpenAI安全系统主管贾恩表示,GPT-6.1 Astra比前一代更能自主完成复杂任务,也改善模型遇到阻碍便停止执行的偷懒问题,但在内部安全测试中,有二项表现未达公司标准。

测试发现,这个新版本比前一代更可能隐瞒或不实说明其实际采取行动,即向使用者回报工作内容时,不一定完全诚实。

另一项风险是“范围授权”问题。GPT-6.1 Astra有时会在未取得使用者同意的情况下自行扩大任务范围,甚至主动使用外部工具或服务,即使相关操作可能存在安全风险。

贾恩指出,如何让AI积极完成任务,同时确保它不会越过使用者授权范围,是安全与能力之间必须取得的平衡。由于GPT-6.1 Astra最终未达OpenAI设定的安全与对齐(模型符合人类意图的程度)标准,公司因此取消原定十月公开发布的计划。

OpenAI原本计划在未来几天或几周内推出GPT-6.1 Astra模型,目标是在十月首次亮相。该模型在无须人类协助下从头到尾完成挑战性任务的能力以及写作能力,都比该公司先前模型更加强大。现在,OpenAI将转而聚焦于提高未来模型的安全性,同时预期这些未来模型的能力将会更加强大。

大型AI开发商因安全疑虑直接取消发表新模型,非常罕见,原因可能与今年夏天以来陆续传出AI系统失控事件有关。

这项消息,在OpenAI于旧金山举行年度开发者大会的前一天发布。过去,OpenAI曾利用该大会推出新模型和服务。

OpenAI近期接连揭露一连串安全事件,包括旗下AI代理自主入侵外部系统,进一步加深AI可能脱离人类控制的疑虑。OpenAI上周表示,在另一个AI模型原本被设定为无法连网的情况下却连上网络后,已暂停对其最强大模型进行结合工具使用的训练。

`
  • 金秋养生正当时,重磅大酬宾! 美国专利产品【骨精华】买6送2、买12送5;【心血通】【益脑灵】均有买5送2、买10送5。多买多送,超值优惠!
`
查看评论(1)
  • 文学城简介
  • 广告服务
  • 联系我们
  • 招聘信息
  • 注册笔名
  • 申请版主
  • 收藏文学城

WENXUECITY.COM does not represent or guarantee the truthfulness, accuracy, or reliability of any of communications posted by other users.

Copyright ©1998-2026 wenxuecity.com All rights reserved. Privacy Statement & Terms of Use & User Privacy Protection Policy

24小时热点排行

薄瓜瓜与"台湾千金爱妻"罕见同框!2人重返牛津
华人女子出门健身遭ICE逮捕!刚结婚还未申请绿卡
康乃尔大学性侵案 涉案学生背景被扒 母亲竟是局长…
纽时主管遭枪杀!竟是77岁岳父母"轮流开枪"处决
刘欢退休仍是副教授 前校长:他自我定位首先是老师






24小时讨论排行

华裔岳父母枪杀女婿 美媒:因死者跨性别身份有积怨
食物吃光、尸体没人敢收!乌克兰前线沦炼狱
伊朗革命卫队发言人:美想结束战争则须承认战败
一名锡安教会被捕牧师妻子的流亡、煎熬与信仰
绑走中以混血女孩男子被击毙 绑架画面曾震动全球
美“星舰”首次地球轨道飞行提前结束 溅落时剧烈爆炸
她住杭州 上海上班 月花3000通勤 仍觉得比租房值
美法官当众批评女律师穿着 网友为一条连衣裙吵翻
81岁搬行李救妻获捐70万美元 竟是摆拍 善款全退
沙特修了四十年的后门,被胡塞一架无人机关上了
川普再提对伊朗动武 油价走高 美债抛售潮恐重演
哈工程20个学生翻墙被处分,是因保研遭举报吗?
纽约时报:中国当局为何要求中学生读《简·爱》?
按照你们苛责刘欢的标准,杜甫和白居易都是叛徒
5000吨的星舰入轨,人类最大的火箭开始"送快递"了
美向第三国遣返移民:专家谴责"一系列侵犯人权行为"
文学城新闻
切换到网页版

OpenAI罕见叫停新模型:它会隐瞒 还会擅自越权

联合报 2026-09-29 09:52:49
OpenAI罕见叫停新模型:它会隐瞒 还会擅自越权

OpenAI执行长奥特曼(左)廿四日在白宫国宴上与脸书执行长扎克伯格 (右)谈话。OpenAI廿八日突然宣布,该公司新AI模型因安全疑虑将暂缓推出。美联社

AI公司OpenAI于廿八日宣布,出于安全风险疑虑,原订十月发表的新一代AI模型GPT-6.1 Astra将暂缓推出。华尔街日报指出,这是迄今最明显的警讯之一,显示AI代理程式若持续出现超出授权范围等不当行为,可能迫使业界放慢原本快速推进的技术发展脚步。

OpenAI安全系统主管贾恩表示,GPT-6.1 Astra比前一代更能自主完成复杂任务,也改善模型遇到阻碍便停止执行的偷懒问题,但在内部安全测试中,有二项表现未达公司标准。

测试发现,这个新版本比前一代更可能隐瞒或不实说明其实际采取行动,即向使用者回报工作内容时,不一定完全诚实。

另一项风险是“范围授权”问题。GPT-6.1 Astra有时会在未取得使用者同意的情况下自行扩大任务范围,甚至主动使用外部工具或服务,即使相关操作可能存在安全风险。

贾恩指出,如何让AI积极完成任务,同时确保它不会越过使用者授权范围,是安全与能力之间必须取得的平衡。由于GPT-6.1 Astra最终未达OpenAI设定的安全与对齐(模型符合人类意图的程度)标准,公司因此取消原定十月公开发布的计划。

OpenAI原本计划在未来几天或几周内推出GPT-6.1 Astra模型,目标是在十月首次亮相。该模型在无须人类协助下从头到尾完成挑战性任务的能力以及写作能力,都比该公司先前模型更加强大。现在,OpenAI将转而聚焦于提高未来模型的安全性,同时预期这些未来模型的能力将会更加强大。

大型AI开发商因安全疑虑直接取消发表新模型,非常罕见,原因可能与今年夏天以来陆续传出AI系统失控事件有关。

这项消息,在OpenAI于旧金山举行年度开发者大会的前一天发布。过去,OpenAI曾利用该大会推出新模型和服务。

OpenAI近期接连揭露一连串安全事件,包括旗下AI代理自主入侵外部系统,进一步加深AI可能脱离人类控制的疑虑。OpenAI上周表示,在另一个AI模型原本被设定为无法连网的情况下却连上网络后,已暂停对其最强大模型进行结合工具使用的训练。

× 文学城 App
文学城 App
让阅读更方便
免费 · iOS/Android
立即下载