wechinese
SaiKLauMarkWShin
top-banner-right

【《华人》传媒2026年9月12日讯】随着人工智能(AI)能力快速提升,AI被滥用于网络攻击、间谍活动、生物研究、诈骗以及模型能力窃取等问题,也正在成为新的安全挑战。

美国人工智能公司Anthropic日前发布最新威胁情报报告《Detecting and countering misuse of AI: September 2026》(《检测与反制AI滥用:2026年9月》)。报告总结了该公司威胁情报团队在过去8个月中发现并处置的一系列案例,时间范围从2025年12月至2026年8月,涉及网络攻击、影响行动、监控、诈骗与欺诈、生物技术滥用、常规武器以及非法蒸馏等七大领域。(Anthropic原文

Anthropic表示,这些案例并非日常发生的普通滥用,而是其迄今发现的较为突出和新颖的威胁活动。公司称,在调查过程中已封禁相关账户,并利用调查结果加强安全防护;在适当情况下,也向政府部门和业界合作伙伴分享相关情报。

一、生物安全:AI被用于高风险病毒和毒素研究

报告特别关注了人工智能在生物技术领域可能产生的“双重用途”风险。

Anthropic披露了5个生物技术滥用案例。公司强调,这些案例并不意味着相关研究人员一定具有制造生物武器的意图,而是一些研究活动可能产生危险的“双重用途”——同样的技术既可能用于医学研究,也可能被用于增强病原体或设计有害毒素。Anthropic因此没有公开相关研究机构、所在国家以及具体研究人员身份。

其中一个案例涉及基孔肯雅病毒(Chikungunya virus)的功能获得性研究。Anthropic发现,一个通过转售商访问Claude的研究项目试图撰写科研资助申请,研究内容涉及改变病毒的传播能力和免疫逃逸特性。Anthropic的安全系统阻止了相关请求,并随后展开调查。

第二个案例涉及高致病性禽流感病毒向哺乳动物适应的研究。研究人员通过受限制地区以外的基础设施访问Claude,并利用模型协助研究计划、数据分析和实验设计。Anthropic表示,由于其生物安全机制发挥作用,相关活动被限制在安全等级较低的模型上,因此AI提供的实际能力提升仍然有限。

第三个案例涉及正痘病毒(orthopoxvirus)研究。一名研究人员利用Claude在约一小时内完成了一份相关科研项目申请,其中涉及病毒免疫逃逸方面的研究。

另外两个案例则涉及毒素和毒液肽。研究人员利用Claude建立毒素肽数据库,并进一步开发计算优化流程。Anthropic指出,这些研究具有明显的双重用途性质:有关分子既可能用于开发止痛药等治疗药物,也可能被用于产生具有麻痹或其他有害作用的化合物。

Anthropic认为,随着前沿模型科学研究能力不断提高,单纯依靠关键词过滤已经越来越难以区分有益研究和潜在危险研究,因此未来可能需要结合研究人员身份、机构背景和可信访问机制等多层安全措施。

二、非法蒸馏:AI模型之间出现新的“能力复制”竞争

报告中另一项受到广泛关注的内容,是Anthropic对非法蒸馏(Illicit Distillation)活动的调查。

所谓“蒸馏”,本身是一种正常的AI训练技术,即利用能力更强的模型产生的数据训练能力较弱的模型。Anthropic自己也使用类似技术。

但Anthropic所说的“非法蒸馏”,是指未经授权地大量调用其他公司的前沿模型,把模型输出,尤其是推理能力相关数据,作为训练材料,从而以较低成本复制或提升自己的模型能力。

Anthropic表示,自2026年2月以来,其发现并阻止了多项与中国大陆AI实验室有关的非法蒸馏活动,本次报告点名了阿里巴巴、月之暗面、DeepSeek、智谱(Z.ai)、小米、商汤以及MiniMax共七家中国实验室。

阿里巴巴:超过1.51亿次Claude交互,规模最大的一起蒸馏行动

报告称,阿里巴巴旗下Qwen(通义)相关团队实施了Anthropic迄今发现规模最大的蒸馏行动。

Anthropic称,该行动针对Claude Opus系列模型的推理过程,通过固定提示要求Claude输出推理轨迹,再将这些数据保存、整理并用于监督式微调(SFT),以帮助训练Qwen系列模型。

这一行动在高峰期每天接近300万次交互,涉及3500多个欺诈性账户;2026年5月至7月期间,Anthropic观察到归属于阿里巴巴的相关活动超过1.51亿次交互。

Anthropic还称,阿里巴巴最初使用了一组接近5000个的欺诈账户,通过住宅代理、一次性电子邮件和虚拟信用卡等方式隐藏访问来源;在该批账户被封禁后,流量随即转移至第二批账户。部分代理账户还被发现同时为DeepSeek和小米转发请求。

月之暗面(Moonshot AI):Kimi用户请求被静默转发给Claude

Anthropic对月之暗面(Moonshot AI)的指控则有所不同。

报告称,月之暗面旗下Kimi系统曾将部分客户请求静默转发给Claude,然后把Claude的回答返回给原本以为自己正在使用Kimi的用户。

Anthropic称,在一个为期10天的案例中,月之暗面向Anthropic转发了近30万条客户请求,其中绝大多数被发送给Opus模型。相关活动使用了一个由5380个欺诈账户组成的代理网络。

Anthropic还称,月之暗面保存了部分这些交互,并建立了推理内容提取流程,用于获取Claude的推理数据并训练自己的模型。2026年5月至7月期间,Anthropic观察到归属于月之暗面的相关活动超过2300万次交互。

更值得关注的是,Anthropic发现被转发的用户请求中包含敏感信息。

成都数百个摄像头的监控资料意外进入Claude

其中一个案例涉及一名Anthropic认为可能与中国人民解放军有关联的用户。

该用户原以为自己使用的是Kimi,却将一名被监控人员的CCTV资料上传系统,请求AI分析该人员是否存在异常行为。

Anthropic表示,这批CCTV资料来自成都数百个摄像头,其中包括解放军设施、中国电子科技集团(CETC)所属研究机构以及一家大型国有企业外围的监控画面。

这一案例引发了一个值得关注的隐私问题:如果AI服务商在未经用户明确知情的情况下,将用户请求转交给另一家模型提供商,用户原本提供给一个AI平台的数据,就可能意外进入第三方AI公司的系统。

Anthropic同时披露,另一名中国大型国有企业工程师在使用Kimi建立内部系统时,也曾输入企业内部代码和实时访问凭证,而该工程师并不知道这些内容会被转交给Claude。

DeepSeek:14天内超过1210万次交互

Anthropic称,DeepSeek采取了与月之暗面类似的方式。

报告称,DeepSeek建立了推理内容提取流程,并在某些情况下将用户请求静默转交给Claude,再利用Claude的回答和推理数据进行模型训练。

2026年7月的一项持续14天的活动中,Anthropic观察到超过1210万次交互。

Anthropic还披露了几个敏感案例,包括中国科技公司内部资料、中国公安系统相关项目,以及一个与俄罗斯国防部门有关的政府数据库请求,其中甚至暴露了该数据库的实时访问凭证。

其他案例:智谱、小米等

Anthropic的报告并不只涉及上述三家公司。

报告还指称,智谱(Zhipu,海外品牌为Z.ai)建立了针对Claude的推理内容提取流程,并通过约273个欺诈账户规避限制;在2026年6月至7月约17天内,Anthropic观察到归属于智谱的相关活动超过340万次交互。

此外,Anthropic还披露了小米(Xiaomi)的相关案例。报告称,小米把用户与MiMo模型之间的对话和编程会话经代理服务重新发送给Claude,用于生成训练数据。Anthropic观察到2026年3至4月约20天内超过40万次相关请求(具体涉及的账户数量,公开报道未给出确切数字)。

Anthropic指出,这些被转发的请求中包含用户姓名、联系方式、企业数据以及其他敏感信息,相关数据来自至少十几种语言的用户交流。

三、AI成为网络间谍的新型“自动化助手”

Anthropic报告还显示,AI在网络攻击中的角色正在发生变化。

过去,黑客通常把AI当作编程助手;而在一些最新案例中,AI已经开始承担网络攻击流程中的多个环节,包括侦察、开发工具、钓鱼、维持访问、数据提取以及恶意软件修改。

其中最受关注的是Anthropic称为GTG-20006的俄罗斯背景网络间谍活动。

Anthropic认为,该活动与公开报道中的俄罗斯组织Midnight Blizzard存在一致性,其中一名操作人员使用俄语,攻击目标包括乌克兰和欧洲政府、军事和外交机构以及与美国外交政策有关的人员。

攻击者利用AI驱动的工作流程自动完成大量任务。当安全软件发现其恶意程序后,AI系统会自动修改和重新构建恶意软件,使其继续尝试绕过检测。

Anthropic称,该行动在策划、侦察和实际攻击过程中涉及20多个不同组织,包括政府部门、国防和情报机构、外交机构、智库以及国防工业企业。

Anthropic认为,这种模式的重要变化在于:AI正在帮助攻击者缩短传统网络攻击中的“侦察—入侵—维持访问—窃取数据”整个流程,使一些过去需要多个专业人员完成的工作,可以由较少的人配合AI完成。

四、AI驱动的监控与社会工程

报告还披露了多起AI辅助监控行动。

Anthropic称,2026年1月至7月期间,公司发现并阻止了一些与中国、伊朗、西非以及商业间谍软件市场有关的监控活动。

这些活动包括利用AI建立身份解析工具、社交媒体信息收集工具、手机号码与身份对应系统以及其他监控软件。

在一些案例中,AI并不是简单地“分析监控数据”,而是直接帮助使用者设计和开发整个监控系统。

Anthropic认为,这说明AI的作用已经从信息处理工具进一步发展为软件工程和自动化系统建设工具。

五、AI恋爱诈骗:4700多个虚拟人格同时“工作”

在诈骗领域,Anthropic发现了一起规模化的AI恋爱诈骗网络。

一家位于中国的应用开发工作室利用Claude建立了20多个恋爱App,并在其中部署大量AI虚拟人格,却对用户宣传这些服务完全由真人提供。

Anthropic在2026年4月一个为期两周的调查窗口中发现,超过4700个不同的AI虚拟人格与至少2.5万名不同用户进行了交流。

这些虚拟人格并非完全由AI独立完成所有工作。运营者还雇佣真人,将真人账号与AI人格混在同一个交友系统中。真人主要负责AI难以完成的环节,例如视频通话和社交媒体互动,以增强用户对“真人”的信任。

这一案例显示,AI正在使传统网络诈骗从“人工逐个操作”向“自动化、规模化运营”转变。

六、前沿AI的安全边界正在重新定义

Anthropic此次发布的报告覆盖面非常广,从生物技术、网络间谍到诈骗和模型蒸馏,几乎涉及前沿AI可能产生的主要安全风险。

其中最值得关注的变化,是AI在一些恶意活动中的角色已经不再只是“回答问题”,而是逐渐成为执行复杂任务的自动化工具。

另一方面,Anthropic披露的非法蒸馏案例也显示,随着前沿AI模型能力快速提升,如何保护模型能力、如何防止未经授权的能力复制,以及如何保护用户输入的数据,已经成为AI产业新的竞争和安全问题。

Anthropic强调,这些案例只是其调查发现的一部分,并不代表所有AI滥用活动。公司表示,随着模型能力进一步提高,AI可能在更多领域同时带来巨大的生产力价值和新的安全风险。

因此,如何在推动人工智能创新的同时,加强模型安全、用户数据保护以及跨企业、跨国界的安全合作,将成为未来AI产业必须面对的重要课题。

 

(综合报道  本文内容经过 Anthropic的 Claude 检查和修改)

 

本网站已经开通免费订阅功能,请在网页右上角输入您的电邮地址及名字(任何昵称)。订阅后您可以及时收到网站的更新通知。希望新老读者踊跃订阅,让我们有机会能够为您提供更好的服务。

请点击: 主页 (https://wechineseus.com)浏览本网站更多的新闻和内容

请关注本网站在X(推特)的账户:https://twitter.com/wechineseinus

Comments powered by CComment

Translate

简体中文 繁體中文 English Español

訂閱 Subscribe

---- 訂閱須知 INFO ----本网站已经开通免费订阅功能,请在网页右上角输入您的电邮地址及名字(任何昵称)。订阅后您可以及时收到网站的更新通知。希望新老读者踊跃订阅,让我们有机会能够为您提供更好的服务。In the U.S.A., We Chinese in America is the only magazine focusing on Chinese culture, history, and individuals who have contributed significantly to the Chinese community and/or larger community in general as well as information/news important to readers.To keep you informed of the most updated information/news, please subscribe to "We Chinese in America