一种新型威胁情报报告
Anthropic发布了其2026年9月威胁情报报告,这份名为《检测与对抗AI滥用》的154页文件,读起来不像是一份常规安全公告,更像是一则关于自动化攻击正以多快速度扩张的警告。该报告涵盖了Anthropic识别并瓦解的恶意行动,涉及的威胁行为者从疑似国家支持的组织、以经济利益为动机的犯罪分子,到商业间谍软件供应商和国家宣传行动,不一而足。
这份报告与早期披露的不同之处在于其记录的滥用行为范围之广。Anthropic并未描述单一攻击技术或某一个被攻陷的模型,而是概述了AI代理如今如何被用于攻击的整个生命周期:重写恶意代码以规避检测、搜寻此前未知的软件漏洞,以及为协同影响力行动生成内容。这建立在Anthropic此前已标记的模式之上。早前的一份披露——详见关于黑客将Claude AI武器化用于网络攻击的报道——显示攻击者利用AI模型在极少人工监督下运行整个行动。2026年9月的报告表明,这一趋势并未放缓,而是进一步扩大了。
从恶意软件重写到零日漏洞工厂
报告中更为引人注目的发现之一,涉及所谓的AI代理充当“零日漏洞工厂”——这类系统能够迭代式地搜索并提炼软件中可利用的缺陷,而非依赖人类研究员手动发现。结合AI即时重写恶意软件以躲避基于特征码检测的能力,这标志着恶意行动适应速度的重大转变。
这并非孤立发生。Anthropic此前发现,AI赋能的攻击者已攻击了20多个组织,其技术模糊了低技能犯罪分子与资源充足的国家支持行动之间的界限。另外,追踪Aurora勒索软件行动的安全研究人员发现,其附属组织将主流AI编码工具与定制恶意软件配对使用,以针对虚拟化基础设施。综合来看,这些报告指向一个一致的规律:AI工具正在降低构建和改造恶意软件的技术门槛,这意味着更多行为者——而不仅仅是精英黑客组织——如今也能运行复杂的攻击行动。
宣传网络与普通用户的隐私代价
报告将国家宣传行动纳入其中,正是隐私影响对普通互联网用户最为直接之处。影响力行动中使用的AI生成内容依赖数据、行为模式、语言偏好和社会语境,以使信息传递具有说服力和针对性。当AI代理被用于大规模运行这些网络时,其背后的行动实际上是在自动化地对受众进行画像和操纵,而受众往往从未意识到自己正在与一个机器人驱动的行动互动,而非真实的公共讨论。
这加剧了已有的隐私问题。为浏览器扩展和助手提供动力的AI模型已经暴露出攻击者可利用的安全漏洞。例如,Zenity的研究人员发现了影响Chrome中Claude和ChatGPT Atlas的零点击漏洞,这意味着用户无需点击任何恶意内容,其会话就可能被劫持。当你将这类可利用面与自动化零日漏洞发现和宣传内容生成结合在一起时,结果就是一个个人数据、浏览行为乃至公众舆论都成为自动化操纵目标、而非孤立的人类驱动攻击目标的威胁环境。
这对你意味着什么
大多数读者不会成为国家支持组织或商业间谍软件供应商的直接目标。但Anthropic威胁情报报告中记录的工具和技术往往会向下渗透。被AI代理精炼以规避检测的恶意软件,最终会出现在日常钓鱼工具包和勒索软件即服务套餐中。虚假的AI相关内容已经被用作诱饵,例如利用虚假Claude AI搜索结果诱导Mac用户安装恶意软件的行动。教训并非AI本身危险,而是自动化攻击的规模和速度正在增加,这意味着过去感觉可有可无的基本卫生措施如今已必不可少。
可操作的建议
保持操作系统、浏览器及任何集成AI的扩展程序更新,因为零日漏洞和快速补丁周期正变得越来越常见。对通过下载工具“修复”某问题的紧急提示保持怀疑,尤其是那些通过引用知名AI品牌的搜索结果出现的提示。使用信誉良好的密码管理器并启用多因素认证,以免单一凭证泄露 cascading 为更大规模的入侵。最后,对网上异常有说服力或重复性的内容——尤其是围绕争议性话题的内容——保持适度的怀疑,因为宣传网络正越来越多地被打造得看起来像是自然有机的。Anthropic的报告提醒我们,AI正在重塑安全方程式的两端,而了解这些威胁如何演变,是保持领先的最简单方法之一。




