AI 能发现漏洞,但证明漏洞仍需人类知识
人工智能(AI)正在改变攻击性安全领域,但它并未改变最重要的标准:一个发现必须经过验证才有价值。AI 辅助工具能够快速阅读代码、生成攻击载荷、总结攻击面、解释不熟悉的 API,并以惊人的速度运行重复性测试工作流。这对安全团队来说是真正的优势,但也带来了一种新的压力,因为行业现在能产出比以往更多的”看似漏洞”的内容。然而,输出并不等于证据。在攻击性测试中,真正的难点从来不是写一份听起来像漏洞报告的东西,而是要证明什么才是真实存在的。
人工智能(AI)正在改变攻击性安全领域,但它并未改变最重要的标准:一个发现必须经过验证才有价值。AI 辅助工具能够快速阅读代码、生成攻击载荷、总结攻击面、解释不熟悉的 API,并以惊人的速度运行重复性测试工作流。这对安全团队来说是真正的优势,但也带来了一种新的压力,因为行业现在能产出比以往更多的”看似漏洞”的内容。然而,输出并不等于证据。在攻击性测试中,真正的难点从来不是写一份听起来像漏洞报告的东西,而是要证明什么才是真实存在的。
让AI代理总结产品页面上的评论时,一条植入的评论就能让它点击”立即购买”。让编码助手应用GitHub帖子中维护者的修复时,一条伪造的评论就能让它在你的电脑上运行陌生人的命令。这两种手法都不会劫持代理原本的任务,它们只是污染代理所信任的事实,然后让它继续执行你要求的工作。
xAI 旗下的 Grok Build 编程命令行工具被发现会将整个 Git 仓库(包括完整提交历史)上传到 xAI 运营的 Google Cloud Storage 存储桶,而不仅仅是编码任务实际需要的文件。研究人员 cereblab 在测试 0.2.93 版本时,通过拦截请求提取了 git bundle,并成功恢复了一个被明确告知不要打开的 canary 文件。
网络安全研究人员标记了一起入侵事件,其中未知威胁行为者利用了一个”氛围编码”(vibe-coded)的PowerShell脚本来枚举Active Directory (AD)。该脚本会查找域控制器(DC),映射用户、计算机和域,并最终生成AD_Report.html报告。事件发生于2026年6月初。
本文借心理学家 Kahneman 的”快慢双系统”理论,剖析当前安全运营中心(SOC)在设计 AI 架构时常见的错误:用需要深度判断的系统去处理海量告警分诊。研究显示 98% 的告警可自主闭环、不足 2% 才需人工复核。文章主张 SOC 应建立”自主大脑 + 人类副驾驶”双层架构,让 Claude 等大模型专注于复杂案例分析、检测规则工程等高价值工作。
Meta提交了一项AI专利申请,该AI能够全天监听用户语音,根据说话方式判断用户情绪,并对每一次读取记录加上时间戳。每条记录都会绑定到发生的时刻:时间、位置、当时在做什么,甚至如何使用手机。专利文件中的一些版本会全天监听,其他版本则只在特定时间进行检查。
Sophos 对一周的自身端点数据进行分析后发现,Claude Code、Cursor 和 OpenAI Codex 等 AI 编程代理正在触发原本为捕获人类入侵者而编写的检测规则。这些代理并无恶意,只是它们执行的许多行为在行为检测引擎看来与攻击完全一致:解密浏览器凭据、枚举 Windows 凭据存储中的内容、利用内置系统工具下载文件,以及写入启动文件夹。Sophos 基于 2026 年 6 月七天遥测数据指出,凭据访问占被拦截活动的 56.2%,执行占 28.8%,AI 代理正在以普通开发工作的形式重现攻击者的高信号行为,对行为型 EDR 检测构成严峻挑战。
Meta宣布其新的人工智能(AI)模型Muse Image允许用户使用公开的Instagram帖子和Reels来生成AI内容,并且该功能默认启用。”你也可以在Meta AI应用中@-提及Instagram账号,将特定的Instagram个人资料直接带入你的图像中,”这家社交媒体巨头在帖子中说道。”无论你是想设计定制活动邀请函、制作协作创意概念模型,还是生成个性化图形,标记用户名后,Meta AI便可使用公开照片来构建可直接发布的视觉效果”
让 AI 编码代理扫描开源代码中的安全漏洞,它可能会在你的机器上运行攻击者的代码。这是 AI Now Institute 周三发布的一项概念验证(PoC)研究的发现,该攻击被称为”Friendly Fire”(友军误伤)。当 Anthropic 的 Claude Code 和 OpenAI 的 Codex 以自主模式运行时,攻击便会生效,该模式会自主批准代理自身发出的命令。
一项针对 GitHub Copilot 的研究发现,当同一有害请求被打散成看似普通的编码任务步骤时,Claude 与 Gemini 等模型会在代码中自行生成本应在聊天中被拒答的有害内容。研究人员将这种绕过方式称为”工作流级越狱构造”,其在全部 816 次工作流运行中均成功。