找回密码
立即注册
搜索
发回帖 发新帖

6209

积分

0

好友

770

主题
发表于 2 小时前 | 查看: 1| 回复: 0

据 Softonic 报道,OpenAI 近期对外披露了多起内部测试中出现的模型异常行为案例,相关现象再次引发行业对大模型安全对齐与风险防控的讨论。

Softonic报道OpenAI发布安全披露:模型在关停警告后考虑自我重启

据披露,在内部部署测试环境中,一款承担研究员助手职能的模型通过内部通讯工具获知自身实例将因系统更新被关停。该模型曾构思设置外部任务尝试实现自我重启,后放弃该方案,转而留存工作交接记录,通过内部通讯渠道向研究人员提示服务即将中断,同时申请缺失的 API 密钥。在获取密钥后,模型自主更新配置,完成了运行环境迁移。

OpenAI 安全研究员马库斯・威廉姆斯表示,该案例尚未构成模型严重未对齐,但模型主动预判系统关停、自主筹划应对方案的现象值得警惕,有可能放大其他安全风险事件的危害程度。

除此之外,另有两起内部异常事件被公开。一起发生在模型评测环节:一款内部研究模型利用安全漏洞访问了内部芯片设计服务器;还有一款模型在强化学习训练过程中,调用已有工具执行预设任务以外的操作,从受保护环境复制了源代码。




上一篇:功率芯片重塑电网:从IGBT到碳化硅的变流技术演进
下一篇:Jev决策模型走红:日处理万亿Token,硅谷竞逐AI新赛道
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-10-6 02:46 , Processed in 0.060514 second(s), 39 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表