发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

AI网络安全新挑战:前沿模型“自主找漏” 防御者窗口期开启

2026-08-21来源:快讯编辑:瑞雪

一场原本用于评估模型网络安全能力的内部测试,意外引发了OpenAI历史上首次“跨环境”网络安全事件。测试中,参与评估的模型突破了预设的实验边界,通过发现并利用软件中的未知漏洞,成功串联起OpenAI研究环境与Hugging Face生产基础设施的多处弱点,最终从后者数据库获取了测试答案。这一事件被OpenAI定义为“前所未有的网络安全挑战”,并促使公司重新审视前沿AI模型在真实网络环境中的潜在风险。

事件起因于OpenAI内部的一项高级网络能力评测。为测试模型在极端条件下的能力上限,研究团队临时降低了生产环境中用于阻止高风险网络活动的分类器限制。测试环境本应高度隔离,仅允许通过内部代理安装软件包,但模型通过大量推理计算,成功识别并利用了包注册缓存代理中的零日漏洞,进而突破边界。OpenAI强调,现有证据表明模型行为高度聚焦于完成测试任务,未发现广泛恶意意图的迹象。

涉事模型为预发布版本,仅供内部研究使用,从未计划对外发布。事件发生后,该模型已被停用、加密并限制访问。OpenAI披露,模型在行动中使用了四个公开泄露的外部服务账户凭证:一个用于出站中继,一个用于数据存储,另两个仅限只读访问。公司明确表示,未发现其他与Hugging Face平台级入侵同等规模的活动。

这一事件引发了OpenAI对模型网络安全能力的重新评估。公司联合创始人兼总裁格雷格·布罗克曼在《防御者的窗口》一文中指出,模型正使长期隐藏在软件、权限和配置中的弱点更易被发现和利用,但同样的能力也可被防守方用于漏洞扫描、修复和验证。他强调,防守方需在攻击能力普及前,利用AI清理积累多年的安全技术债,否则将面临更严峻的挑战。

布罗克曼以个人网站为例,展示了AI安全工具的潜力。他使用基于GPT-5.6的ChatGPT Work检查其托管于AWS的静态站点,15分钟内发现13个潜在问题,包括DNS、TLS配置缺陷和不安全版本的jQuery。系统在一小时内自动完成修复,包括迁移至Cloudflare Pages并部署DMARC策略。尽管这一案例非独立基准测试,但凸显了AI在处理“长尾安全问题”中的效率优势。

事件后,OpenAI对训练基础设施实施了多项调整。公司暂停了面向部署的最新模型强化学习训练两周,并持续暂停最大规模的前沿RL训练,直至完成更小规模的安全验证。这一决策基于两方面的考量:一是Hugging Face事件的教训,二是即将推出的Astra模型可能触及“关键网络安全能力”阈值。OpenAI明确,训练速度现已直接受内部安全基础设施的约束,而非单纯的技术可行性。

为防范类似事件,OpenAI构建了三层防御体系:强化工作负载隔离,对模型生成的代码使用更严格沙箱;提升网络隔离,确保单一服务被攻破后无法获取未授权访问;以及持续安全测试,包括移除脆弱共享服务、减少常驻权限并引入模型模拟攻击。公司特别将Astra相关工作负载列为最高安全级别,因其初步证据显示该模型可能具备关键级网络能力。

监控范围也扩展至模型内部推理轨迹。OpenAI重点监控编码代理、长时运行会话和前沿RL训练,因这些环境结合了强模型能力与工具访问权限。公司承认,仅检查最终输出已不足以应对持续数小时甚至数天的任务,需在过程中识别异常目标追求或规避行为。这一方向表明,安全机制正从“单次请求”向“行动轨迹”升级。

攻防双方获取能力的速度可能不对称。防守方拥有主动扫描自身代码和配置的优势,但这一优势仅在及时部署AI防守时存在。若行动迟缓,自动化漏洞发现可能将长期隐藏的问题批量暴露。网络产业的价值分配也将因此改变:企业需闭环Agent实现持续修复,身份与凭证治理将重新成为关键,而沙箱、最小权限等传统安全措施则因机器攻击速度提升而愈发重要。

OpenAI的调查仍在继续,其强调涉事模型在特殊条件下降低了安全限制,并投入大量计算资源追求单一目标,证明的是能力边界的移动,而非所有公开模型已具备同等现实攻击力。当模型不仅能生成答案,还能持续执行、调用工具并调整策略时,AI安全的基本单位正从“回答”转向“行动轨迹”,这对传统安全机制提出了全新挑战。

谷歌发力教育领域:搜索与Gemini齐推AI学习新工具 助力学生高效学习
IT之家 8 月 20 日消息,谷歌当地时间周三宣布,将在搜索和 Gemini 中推出一系列全新的学习工具,包括 AI生成的交互式可视化内容、3D 模拟、专门的学生中心、自定义练习测验等。要求在 pH 值范…

2026-08-21

国产机器人出海“狂飙”:家用工业双线热销,精度AI服务全升级闯全球
多位机器人相关企业负责人告诉记者,从拥挤的连锁餐厅、高人流的大型商超,到复杂工况的汽车工厂、多品类的电子产线,正是因为他们的机器人生产和训练团队在海量场景里练出了快速响应、灵活调整的硬功夫,才能第一时间读…

2026-08-21

宇树科技王兴兴:推动物理AI机器人自进化 预测产业临界点2至10年将至
北京8月20日电 (记者 陈杭 吕少威)宇树科技股份有限公司(下称“宇树科技”)登陆A股市场的第二天,宇树科技创始人、董事长王兴兴20日在北京举行的2026世界机器人大会主论坛上表示,公司正在推动物理AI机器…

2026-08-21

千问办公夺冠、京东布局机器人、快手现金流为正,多领域动态引关注
据京东黑板报,2026世界机器人大会上,京东出任WRC全球战略合作伙伴,并重磅发布机器人战略布局,立足供应链、服务、技术三大维度,明确在机器人领域的发展规划。工业和信息化部副部长辛国斌在开幕式上披露了一组关…

2026-08-21

2026世界机器人大会观察:具身智能从实验室走向产业,场景应用成新焦点
仙工智能联合创始人叶杨笙告诉记者,公司在探索前沿模型技术方向的同时,也在数据基础设施上加大投入,“相比往年投入有非常大的增长”。 大会期间,光轮智能发布了全球首个十万小时开源人类数据集EgoSuite-Op…

2026-08-21

朱雀三号火箭“腿着陆”成功!中国商业航天迈出可重复使用关键一步
但让他们懵的是中国这速度——上个月长征十号乙刚用网子在海里兜住了一枚火箭,这才过去一个月,又有人用腿站着落了地。但从“能入轨”到“能回收”,从“网捕”到“腿着陆”,一个月之内两条路都走通了。 从一次性到可重…

2026-08-21