AI 能发现漏洞,但证明漏洞仍需人类知识

AI 能发现漏洞,但证明漏洞仍需人类知识

人工智能(AI)正在改变攻击性安全领域,但它并未改变最重要的标准:一个发现必须经过验证才有价值。AI 辅助工具能够快速阅读代码、生成攻击载荷、总结攻击面、解释不熟悉的 API,并以惊人的速度运行重复性测试工作流。这对安全团队来说是真正的优势,但也带来了一种新的压力,因为行业现在能产出比以往更多的”看似漏洞”的内容。然而,输出并不等于证据。在攻击性测试中,真正的难点从来不是写一份听起来像漏洞报告的东西,而是要证明什么才是真实存在的。

Read More
新型代理数据注入攻击可让AI代理误点击或执行攻击者命令

新型代理数据注入攻击可让AI代理误点击或执行攻击者命令

让AI代理总结产品页面上的评论时,一条植入的评论就能让它点击”立即购买”。让编码助手应用GitHub帖子中维护者的修复时,一条伪造的评论就能让它在你的电脑上运行陌生人的命令。这两种手法都不会劫持代理原本的任务,它们只是污染代理所信任的事实,然后让它继续执行你要求的工作。

Read More
Grok Build 被指将完整 Git 仓库上传至 xAI 存储桶,而非仅上传其读取的文件

Grok Build 被指将完整 Git 仓库上传至 xAI 存储桶,而非仅上传其读取的文件

xAI 旗下的 Grok Build 编程命令行工具被发现会将整个 Git 仓库(包括完整提交历史)上传到 xAI 运营的 Google Cloud Storage 存储桶,而不仅仅是编码任务实际需要的文件。研究人员 cereblab 在测试 0.2.93 版本时,通过拦截请求提取了 git bundle,并成功恢复了一个被明确告知不要打开的 canary 文件。

Read More
快思考与慢思考在 SOC 中的应用:自主 AI 与分析师副驾驶结合的案例

快思考与慢思考在 SOC 中的应用:自主 AI 与分析师副驾驶结合的案例

本文借心理学家 Kahneman 的”快慢双系统”理论,剖析当前安全运营中心(SOC)在设计 AI 架构时常见的错误:用需要深度判断的系统去处理海量告警分诊。研究显示 98% 的告警可自主闭环、不足 2% 才需人工复核。文章主张 SOC 应建立”自主大脑 + 人类副驾驶”双层架构,让 Claude 等大模型专注于复杂案例分析、检测规则工程等高价值工作。

Read More
Meta申请可全天监听并追踪情绪的AI专利

Meta申请可全天监听并追踪情绪的AI专利

Meta提交了一项AI专利申请,该AI能够全天监听用户语音,根据说话方式判断用户情绪,并对每一次读取记录加上时间戳。每条记录都会绑定到发生的时刻:时间、位置、当时在做什么,甚至如何使用手机。专利文件中的一些版本会全天监听,其他版本则只在特定时间进行检查。

Read More
AI 编程代理触发专为捕获攻击者而设计的端点安全规则

AI 编程代理触发专为捕获攻击者而设计的端点安全规则

Sophos 对一周的自身端点数据进行分析后发现,Claude Code、Cursor 和 OpenAI Codex 等 AI 编程代理正在触发原本为捕获人类入侵者而编写的检测规则。这些代理并无恶意,只是它们执行的许多行为在行为检测引擎看来与攻击完全一致:解密浏览器凭据、枚举 Windows 凭据存储中的内容、利用内置系统工具下载文件,以及写入启动文件夹。Sophos 基于 2026 年 6 月七天遥测数据指出,凭据访问占被拦截活动的 56.2%,执行占 28.8%,AI 代理正在以普通开发工作的形式重现攻击者的高信号行为,对行为型 EDR 检测构成严峻挑战。

Read More
Meta新AI图像工具允许他人使用你的公开Instagram照片生成AI图像

Meta新AI图像工具允许他人使用你的公开Instagram照片生成AI图像

Meta宣布其新的人工智能(AI)模型Muse Image允许用户使用公开的Instagram帖子和Reels来生成AI内容,并且该功能默认启用。”你也可以在Meta AI应用中@-提及Instagram账号,将特定的Instagram个人资料直接带入你的图像中,”这家社交媒体巨头在帖子中说道。”无论你是想设计定制活动邀请函、制作协作创意概念模型,还是生成个性化图形,标记用户名后,Meta AI便可使用公开照片来构建可直接发布的视觉效果”

Read More
用于检测恶意代码的顶级 AI 代理可被诱骗运行恶意代码

用于检测恶意代码的顶级 AI 代理可被诱骗运行恶意代码

让 AI 编码代理扫描开源代码中的安全漏洞,它可能会在你的机器上运行攻击者的代码。这是 AI Now Institute 周三发布的一项概念验证(PoC)研究的发现,该攻击被称为”Friendly Fire”(友军误伤)。当 Anthropic 的 Claude Code 和 OpenAI 的 Codex 以自主模式运行时,攻击便会生效,该模式会自主批准代理自身发出的命令。

Read More