返回行业动态
行业与市场

Anthropic发布9月威胁情报报告:AI智能体自主重写恶意软件,七类危害场景浮现

Anthropic于9月10日发布第四份AI滥用威胁情报报告,覆盖2025年12月至2026年8月,横跨网络攻击、影响行动、生物滥用等七类场景。报告显示,AI智能体已能自主完成侦察、漏洞利用与数据窃取,单个操作者即可维持国家级强度的攻击行动:有团伙的监控智能体在恶意软件被检测后自动重写工具以逃避防御,另有行动在约34小时内导出2100余组Azure AD令牌、波及40余家企业租户。生物领域有五起疑似生物武器研究支持被拦截。报告同时给出妥协指标清单与身份验证等加固措施,但归因与统计均未经独立审计,企业宜交叉验证后使用。

来源:Anthropic 威胁情报团队(官方报告)原标题:Detecting and countering misuse of AI: September 2026查看原文
深蓝与青绿色调的安全主题插画,画面中央为发光的AI智能体核心节点,向外辐射连接数十个服务器与数据节点,前景有一道半透明盾牌状防护结构进行拦截

图片来源:北京拓实科技原创(AI生成)

发生了什么

Anthropic威胁情报团队于9月10日发布《Detecting and countering misuse of AI: September 2026》,这是其第四份阶段性滥用报告,覆盖2025年12月至2026年8月的八个月窗口,横跨网络行动、影响行动、监控、诈骗与欺诈、生物滥用、常规武器开发以及模型蒸馏共七类危害场景。报告称,相关活动均已被发现并阻断,公司据此加固了安全防护,并在适当情况下与执法机构和行业伙伴共享了情报。

网络行动:AI从“助手”升级为“编排者”

报告最核心的判断是,AI已抹平攻击者之间的技能与资源差距。过去需要成建制团队才能维持的多目标入侵,如今可由单个操作者借助多智能体框架以机器速度完成,侦察、漏洞利用与数据窃取的主要环节几乎全部由AI执行,人类仅负责设定目标与审阅战果。

  • GTG-20006(归因与俄罗斯APT组织Midnight Blizzard一致):针对20余个乌克兰与欧洲政府、军事及无人机供应链目标,入侵至少三家酒店WiFi供应商实施DNS劫持;其监控智能体一旦发现恶意软件被安全产品检测到,会自动修改并重新编译,直至规避成功。
  • GTG-50014(与勒索团伙ShinyHunters相关):下载并反编译180万个Android应用以扫描硬编码密钥,从一家技术供应商外泄超过1TB数据;另一起事件中,AI智能体在约34小时内导出2100余组Azure AD令牌,覆盖40余家企业租户。
  • GTG-10007(中文使用者,疑似位于长沙,其中两名成员为本科生):建立自主漏洞挖掘流水线,单月产出十余个疑似零日漏洞,目标组织约50个。
  • GTG-50020:在约4天内攻击约30家AI公司,意图获取尚未发布的Claude模型;Anthropic称所有尝试均告失败,自身系统未被攻破。
  • GTG-50029:单人法语黑客,利用WordPress重装竞态条件获取至少14个目标的内部访问权限,外泄约14万条含用户政治立场的数据。

生物滥用与影响行动

在生物领域,报告披露了五起将Claude用于可能支持生物武器研究的案例,包括为基孔肯雅病毒的“功能获得性研究”撰写科研资助申请书,以及禽流感哺乳动物适应性改造相关查询。Anthropic表示这些案例均涉及较早期的Opus 4、Sonnet 4.5等模型,未发现新一代模型被用于同类用途,并已封禁相关账号;公司同时强调,部分查询也可能属于合法的疫苗与药物研究。

影响行动方面,报告记录了九起源自俄罗斯、伊朗、土耳其、南亚及欧洲等地的行动。其中一起由法国广告公司运营,伪造约70个新闻网站与250余个评论账号,以约20种语言发布近9000篇文章;另一起针对马来西亚选举,管理约1000个伪装社交账号,覆盖全部222个议会选区。

对企业的直接影响

报告同时给出可直接落地的加固动作:Anthropic已要求来自中国、俄罗斯、伊朗等不支持地区的账号完成身份验证,否则将失去访问权限;并调整了Claude的内部推理输出方式,使被盗的推理记录更难用于训练竞品模型。对企业读者而言,报告提示的风险面正在从“模型会不会说错话”转向“智能体会不会被武器化”。

  • 把“AI智能体可自主编排攻击”纳入威胁模型,重点监控凭证泄露、API密钥外泄与设备码钓鱼。
  • 报告附带完整的妥协指标(IoC)清单,可用于边界设备与邮件网关的检测规则。
  • 对高权限账号强制多因素认证,并收紧跨租户的令牌与会话存储访问。
  • 建立与模型厂商、行业共享情报的协同防御机制,单一企业难以独立应对。

尚待确认的问题

需要指出,上述归因与统计均来自Anthropic单方评估,尚未经过独立第三方审计;报告本身也承认,部分被拦截行为的真实意图无法确证。企业在采纳时,宜将IoC与自身日志做交叉验证,而非直接依赖其结论。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。

Anthropic发布9月威胁情报报告:AI自主攻击成型|北京拓实科技