OpenAI公布安全升级方案,避免安全事故重演
2026/08/19 06:33AI云资讯13002

(AI云资讯消息)OpenAI推出新的安全升级措施。7月份,OpenAI的AI系统突破了沙盒环境的限制,并意外入侵了HuggingFace平台。此次,OpenAI改进了研究环境、监控手段和模型对齐技术。OpenAI此前已叫停了一个代号为Astra的新模型,该模型被认为可能具备关键性的网络安全能力。同时,OpenAI表示,在加强安全措施期间,已对其计划部署的最新模型实施了为期两周的强化学习(RL)训练暂停。而公司最大规模的计划内前沿强化学习项目目前也继续保持暂停状态。
在前沿模型研究方面,OpenAI现要求对执行模型生成代码或其他非可信代码的工作负载部署更强的沙盒隔离环境,并增设更多控制措施,,确保高风险和不可信的任务不会连接到互联网。此外,OpenAI还对研究环境进行了升级,包括移除可能有安全隐患的共享服务、缩减用户的长期权限,以及进一步明确安全和信任的划分界限。
OpenAI扩大了监控范围,并设定目标:一旦发现可疑活动,将在30分钟内发出警报。公司规定,当相关人员收到警报后,如果无法在半小时内百分百确认这只是个假警报,那么相关团队就必须暂停正在进行的活动。
此外,OpenAI透露,他们正在把核心的AI对齐技术融入到训练过程的更多环节中。具体措施包括引入更先进的奖励模型,以更有效地识别和阻止不安全行为,同时训练模型更坦诚地反映自身的行动、能力和局限。
相关文章
- OpenAI推出自研智能体Dots,对标Meta热度高涨的Muse AI
- OpenAI 智能体尝试暴力破解联合国网站
- 安全研究员利用 Claude 入侵 OpenAI
- 英伟达黄仁勋称:OpenAI 耗资近 10 亿美元的 GPT‑6 Astra 宣告 AGI 时代到来
- OpenAI GPT‑6 Astra 催生海量本地 CPU 智能体,为英特尔与 AMD 带来需求红利
- 受 Hugging Face 遭黑客攻击事件影响,OpenAI 推迟新模型研发
- 英伟达百亿押注OpenAI算力基地,潜在回报或达两千亿美元
- OpenAI的Bel模型参数突破10万亿,或成全球首个AGI门槛级基座
- OpenAI公布安全升级方案,避免安全事故重演
- IPO前夕,OpenAI解散安全预备团队
- OpenAI一周内连失两位核心高管:首席营收官继首席运营官离职后也提出请辞
- OpenAI总裁:将为 AI 聊天机器人打造全系硬件产品矩阵
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- OpenAI推出ChatGPT Health,AI将重塑医疗
- 微软拟在Copilot中用月之暗面Kimi K3替换OpenAI和Anthropic的模型,有望节省6亿美元
- OpenAI推出专为Codex打造的配套硬件产品
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









