OpenAI公布安全升级方案,避免安全事故重演
2026/08/19 06:33AI云资讯10666

(AI云资讯消息)OpenAI推出新的安全升级措施。7月份,OpenAI的AI系统突破了沙盒环境的限制,并意外入侵了HuggingFace平台。此次,OpenAI改进了研究环境、监控手段和模型对齐技术。OpenAI此前已叫停了一个代号为Astra的新模型,该模型被认为可能具备关键性的网络安全能力。同时,OpenAI表示,在加强安全措施期间,已对其计划部署的最新模型实施了为期两周的强化学习(RL)训练暂停。而公司最大规模的计划内前沿强化学习项目目前也继续保持暂停状态。
在前沿模型研究方面,OpenAI现要求对执行模型生成代码或其他非可信代码的工作负载部署更强的沙盒隔离环境,并增设更多控制措施,,确保高风险和不可信的任务不会连接到互联网。此外,OpenAI还对研究环境进行了升级,包括移除可能有安全隐患的共享服务、缩减用户的长期权限,以及进一步明确安全和信任的划分界限。
OpenAI扩大了监控范围,并设定目标:一旦发现可疑活动,将在30分钟内发出警报。公司规定,当相关人员收到警报后,如果无法在半小时内百分百确认这只是个假警报,那么相关团队就必须暂停正在进行的活动。
此外,OpenAI透露,他们正在把核心的AI对齐技术融入到训练过程的更多环节中。具体措施包括引入更先进的奖励模型,以更有效地识别和阻止不安全行为,同时训练模型更坦诚地反映自身的行动、能力和局限。
相关文章
- IPO前夕,OpenAI解散安全预备团队
- OpenAI一周内连失两位核心高管:首席营收官继首席运营官离职后也提出请辞
- OpenAI总裁:将为 AI 聊天机器人打造全系硬件产品矩阵
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- OpenAI推出ChatGPT Health,AI将重塑医疗
- 微软拟在Copilot中用月之暗面Kimi K3替换OpenAI和Anthropic的模型,有望节省6亿美元
- OpenAI推出专为Codex打造的配套硬件产品
- OpenAI有望在今年推出搭载ChatGPT的智能音箱
- 苹果起诉OpenAI涉嫌窃取硬件机密
- OpenAI推出GPT-5.6,并宣布推出AI智能体ChatGPT Work
- OpenAI发布GPT-Live-1大模型,智能语音模式全面升级
- OpenAI与Work Louder合作,将推出专为Codex打造的硬件设备
- OpenAI推出首款自研AI推理芯片Jalapeño,专为处理 ChatGPT 请求的服务器设计
- 紧随Anthropic之后,OpenAI也提交了IPO申请
- 马斯克在与OpenAI及奥尔特曼的诉讼案中败诉
- OpenAI的Codex已集成到ChatGPT移动应用程序中
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









