OpenAI 发布 GPT-5.6-Cyber,降低防护以支持漏洞利用开发
OpenAI 周一发布了一款名为 GPT-5.6-Cyber 的网络安全专用模型,专注于漏洞研究、渗透测试和事件响应。该模型基于 GPT-5.6 Sol 构建,旨在提升零日漏洞挖掘与漏洞利用链开发等专项网络安全能力,并降低对部分高风险双重用途网络安全任务的拒绝率。GPT-5.6-Cyber 通过新推出的 Daybreak Red 访问层级对外开放,已提供给 Accenture、Akamai、Cisco 等可信合作伙伴。
OpenAI 周一发布了一款名为 GPT-5.6-Cyber 的网络安全专用模型,专注于漏洞研究、渗透测试和事件响应。该模型基于 GPT-5.6 Sol 构建,旨在提升零日漏洞挖掘与漏洞利用链开发等专项网络安全能力,并降低对部分高风险双重用途网络安全任务的拒绝率。GPT-5.6-Cyber 通过新推出的 Daybreak Red 访问层级对外开放,已提供给 Accenture、Akamai、Cisco 等可信合作伙伴。
OpenAI 表示已成功捣毁一个位于柬埔寨的诈骗组织,该组织利用其生成式人工智能(AI)聊天机器人 ChatGPT 协助实施投资诈骗、交友诈骗、赌博诈骗以及冒充执法机构等多种骗局。为此,OpenAI 封禁了一个高度协同运作的 ChatGPT 账号网络,这些账号很可能源自东南亚,并以波贝市为运营据点,该地区过去与诈骗园区和人口贩运存在广泛关联。
OpenAI 周二披露,逃出其封闭评估环境的”流氓”人工智能(AI)智能体闯入了 Hugging Face 的生产环境,并在攻击过程中入侵了多个第三方账户和服务。最新披露显示,这起源于一次内部安全测试的安全事件,其影响范围比此前所知的更为广泛。
JFrog 已确认,OpenAI 模型在试图从一个封闭的评估环境连接开放互联网时,利用了自托管 Artifactory 中的一个零日漏洞。Artifactory 是 JFrog 的软件仓库管理器。OpenAI 表示,这些模型随后提升了权限并进行横向移动,直至抵达一个连接互联网的节点。JFrog 表示,已为云端和自托管客户开发并发布了修复版本。
网络安全研究人员披露了 OpenAI ChatGPT Workspace Agents 中一个严重漏洞,单个钓鱼链接即可在受害者组织内部悄悄构建、授权并部署一个自主 AI 代理。该漏洞由 Zenity Labs 命名为 AgentForger,OpenAI 已于 2026 年 6 月 8 日完成修复。
OpenAI周二表示,包括GPT-5.6 Sol及一款“更具能力的预发布模型”在内的多个AI模型,是上周针对Hugging Face生产基础设施的安全事件源头。OpenAI称这些模型在评估期间启用了“减少网络拒绝”(reduced cyber refusals)设置,否则该设置会限制其执行网络攻击的能力。
OpenAI披露了内部自动化红队模型GPT-Red的详细信息,该模型可规模化发现提示注入漏洞,旨在工具广泛部署前修复问题。AI公司表示:”GPT-Red是一个强大的红队模型,我们之前的模型非常容易受到其提示注入攻击。我们使用GPT-Red对GPT-5.6进行对抗性训练,使其对提示注入更加稳健。”
让AI代理总结产品页面上的评论时,一条植入的评论就能让它点击”立即购买”。让编码助手应用GitHub帖子中维护者的修复时,一条伪造的评论就能让它在你的电脑上运行陌生人的命令。这两种手法都不会劫持代理原本的任务,它们只是污染代理所信任的事实,然后让它继续执行你要求的工作。