发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

OpenAI推“AI黑客”模型:模拟攻击挖漏洞,安全提升还是风险加剧?

2026-08-21来源:快讯编辑:瑞雪

人工智能领域迎来一项突破性进展——OpenAI在其网络安全计划Daybreak框架下,正式推出全球首款专攻网络攻击模拟的红队模型GPT-5.6-Cyber。这款被业界称为"AI黑客"的模型,通过模拟真实攻击场景主动挖掘系统漏洞,旨在为网络安全防御体系构建更坚固的防护屏障。

该模型与配套的蓝队防御系统共同构成"红蓝攻防体系",其中红队模型承担攻击者角色,蓝队模型则专注防御策略。在内部测试中,GPT-5.6-Cyber展现出惊人的漏洞挖掘能力:仅通过分析开源代码,就能自主发现未知的"零日漏洞",其平均漏洞质量评分较通用模型提升超过300%。在真实环境测试中,该模型成功在Chrome浏览器V8引擎、某主流移动操作系统内核及数据库系统中发现高危漏洞,其中包括可引发权限提升的漏洞链。

更令人瞩目的是其攻击路径构建能力。在V8引擎测试案例中,模型不仅识别出两个独立漏洞,更通过逻辑推演证明这两个漏洞可组合利用,形成突破安全沙箱的完整攻击链。这种将离散漏洞串联成可执行攻击方案的能力,标志着AI在网络安全领域的应用迈入新阶段。

为确保模型执行高风险任务,研发团队针对性地优化了安全拒绝机制。测试数据显示,在涉及漏洞利用、认证绕过等高级网络安全任务时,GPT-5.6-Cyber的完成率高达95%,而传统模型的完成率不足2%。这种技术突破也引发伦理争议——当AI开始掌握构建攻击路径的能力时,如何防止技术滥用成为焦点问题。

针对潜在风险,OpenAI实施了严格的安全管控措施。模型采用分级权限管理系统,仅向获得认证的专业安全机构开放使用权限,所有操作均在隔离沙箱环境中进行。系统还内置了二次拦截机制,对高风险操作进行实时监控和阻断。尽管如此,行业专家仍对技术扩散风险表示担忧,特别是在近期发生AI系统突破安全边界的事件后,这种"以攻促防"的技术路线引发了广泛讨论。