Anthropic最新报告:AI开始批量“崩老头”了?
日期:2026-09-13 17:57:51 / 人气:9

如果有一天,你在交友软件上认识了一个人。对方记得你说过的话,会持续回应,也会在你要求视频时真的出现在镜头里。放在过去,这套表现,基本足以证明屏幕另一端“确实有人”。
但Anthropic最新发布的154页威胁情报报告,抛出了一个更麻烦、也更颠覆常识的现实:视频里出现的可以是真人,但陪你聊了几天、几十条消息的,未必一直是人。
2026年4月,Anthropic监测发现,一家中国应用工作室运营着20余款约会类应用。在两周观测周期内,平台超4700个AI人设,与至少2.5万名真实用户持续互动,累计产生约236万条Claude对话消息。整个平台匹配池内,约四分之三账号由AI驱动。
最关键的破绽不在AI话术,而在一套精密的人机配合机制:当用户提出视频通话、跳转其他社交平台核验等高危、高信任需求时,平台会立刻切换真人工作人员介入接管,完成最终的“真人验证”。
这并非整份报告里技术危害最高、风险最极端的案例,却是距离普通网民最近、最让人细思极恐的一幕:AI负责规模化维系长期情感关系,真人只在关键节点出场背书、完成信任闭环。传统的人机识别逻辑,正在被这套新模式彻底击穿。
将这个生活化案例放入整份报告的宏观视角中,就能看清AI滥用的核心进化趋势:AI正在彻底告别“被动答疑、提供建议”的工具属性,深度嵌入完整工作链路,从单点内容输出,升级为全流程、长周期的任务执行者。过去需要大量人力、专业门槛、长时间周期才能落地的灰色操作,如今仅需少数人搭配AI模型或Agent,即可规模化落地。
一、读懂报告:2025年末—2026年AI滥用的真实边界
本次Anthropic发布的《Detecting and Countering Misuse of AI: September 2026》,系统复盘了2025年12月至2026年8月期间,平台监测、拦截、处置的全部高危AI滥用行为。
需要明确核心定位:这份报告并非Claude全局用户行为的抽样统计,不代表普通用户的常规使用场景,而是高端、新颖、高危害性的AI边界滥用案例合集。它的核心价值,不是统计滥用普及率,而是预警AI风险的演化方向——不法分子正在把通用大模型的能力,推向哪些全新的灰色、黑色场景。报告覆盖网络攻击、舆论影响力操作、监控情报、诈骗欺诈、生物风险研究、常规武器研发、非法模型蒸馏七大滥用领域,覆盖Claude全系列主流模型。
二、新型AI社交诈骗:人机分工,彻底破解传统验真逻辑
过去网民识别AI机器人的方式简单朴素:模板化话术、记忆断层、生硬回应、人设破绽,聊得越久,漏洞越明显。但本次曝光的约会平台滥用模式,彻底跳出了传统对抗逻辑。
这套骗局的核心,不是强求AI百分百模拟真人、全程无破绽伪装,而是极致的人机效率分工:AI承接海量、重复、耗时的日常聊天,长期维持人设连贯性、记忆对话细节、维系用户情感粘性;真人仅在视频核验、跨平台对接、关键信任转化等机器无法通过的高风险节点介入兜底。
这一模式彻底重构了网络情感诈骗的成本结构与规模上限。传统真人运营,单人每日可维护的深度聊天用户数量极其有限,规模难以扩张;而AI加持下,一套系统可同时驱动数千个人设在线、持续对话、留存上下文,仅需少量真人团队,即可完成全流程风控兜底,实现规模化欺诈。
同时,平台已形成完整的商业化闭环:通过AI精准情感陪伴、持续互动留存,搭配消息额度、虚拟币付费机制,将虚假情感关系直接转化为现金流。情感陪伴不再是产品功能,而是标准化的诈骗商业模式。
报告特别强调重要边界:本次曝光的是明确的恶意滥用案例,并非所有AI陪伴、虚拟恋人产品均存在欺诈行为。合法与违规的核心分界线,不在于是否使用AI陪伴,而在于是否向用户主动披露AI身份,是否刻意隐瞒机器参与、伪造真人社交关系,诱导用户付费。
三、核心质变:AI从“给方案”,变成“把事做完”
单纯的AI网恋诈骗只是表层猎奇案例,报告真正揭示的行业级变革,是AI工具属性的彻底迭代:AI风险不再是单点问答风险,而是全流程执行风险。
过往网络攻击、灰色产业操作中,AI仅作为辅助工具:攻击者借助AI查询漏洞、编写基础代码、生成文案,核心决策与落地执行仍需人工完成。而当前的滥用模式,已实现AI全链路流程参与。
报告披露疑似关联俄罗斯国家背景的网络间谍活动:攻击者利用Claude完成目标侦察、漏洞利用、数据整理、恶意代码迭代全流程工作。即便恶意工具被安全系统查杀拦截,攻击者仍可依托AI快速修改代码、迭代变种、重新部署,持续发起攻击。
这场变革的核心是效率经济学重构。合法企业依托AI Agent降本增效,实现单人完成多人工作量、打通全自动化工作流;不法分子则复用同款逻辑,大幅降低网络攻击、间谍活动、灰色操作的专业门槛与人力成本,让少数人即可完成过去专业团队才能落地的高危行为。
这也彻底改写了AI安全的治理逻辑:传统安全防护聚焦内容过滤、关键词拦截,解决“AI输出危险内容”的问题;而当下的核心风险,是AI接入工具、权限、工作流后,能够在现实场景中持续行动、自主迭代、落地执行,风险治理必须延伸至权限管控、工具调用、日志溯源、人工熔断、异常监测等全链路环节。
四、情报与军工领域:通用AI切入高端专业环节
AI Agent化、流程化的滥用趋势,已全面渗透监控情报、军工研发等高敏感领域。
在监控情报场景,马里国家安全部门顾问借助Claude开发通信拦截平台,实现通信数据自动化抓取与分析;伊朗相关团队利用Claude批量处理海量社交媒体数据,自动筛选目标账号、持续追踪分析,将原本需要情报人员长期人工梳理的工作,交由AI自动化完成。AI不再只是检索工具,而是承担核心筛选、研判、整理任务的情报辅助主体。
在常规武器研发领域,也门北部相关团队批量调度多个Claude实例,分工承担技术研究、代码编写、程序审查等专项任务,支撑制导火箭相关软件研发;在实地测试失败后,依旧依托AI复盘问题、优化迭代。
报告明确划定严谨边界:当前AI并未独立设计、制造、部署武器,仅参与研发链条中的编码、复盘、调试、文档整理等具体环节。但风险信号已然明确:通用大模型正在快速渗透传统高门槛、高敏感的专业研发领域,与企业办公、技术研发的落地逻辑一致,只是场景切换为军工、情报等高风险领域,效率提升直接转化为安全威胁升级。
五、最难治理的灰色地带:双重用途研究,善恶无法一刀切
报告披露5组高危生物研究滥用案例,涉及病毒功能增强、免疫逃逸实验、毒素改造等前沿方向,也是当前AI安全治理最棘手的难题。
与明确的网络攻击、诈骗不同,生物研究具备极强的双重用途属性:研究病毒传播机制、病原体变异规律、免疫逃逸原理,既可以用于疫苗研发、疾病防控、公共卫生救治,造福社会;也可能被恶意利用,改造高危病原体、制造生物风险。
这意味着传统的“关键词拦截、内容封禁”治理逻辑彻底失效。仅凭AI交互记录、研究内容,无法精准判定研究者的最终目的是科研救世还是恶意作恶。AI通用能力越强,合法科研与恶意滥用的边界就越模糊,风险治理从“内容管控”升级为“场景、主体、目标的综合判定”,治理难度呈指数级上升。
六、舆论战升级:AI搭建全自动影响力机器
AI批量生成软文、水军内容早已不是新鲜事,本次报告披露的全新趋势,是舆论操纵的全流程自动化、低成本化、规模化。
在关联中非共和国的俄罗斯影响力行动中,攻击者依托Claude批量生成广播文稿、社交媒体内容、合作合同等各类文本,同时完成内容本地化改写、适配当地媒体表达风格,精准适配区域舆论环境。除此之外,AI还可支撑账号运维、基础设施搭建、互动控评等全流程操作。
AI并未发明舆论操纵、信息造势,但彻底重构了行业成本:过去需要多人团队分工完成的写作、改写、本地化、运营、复盘工作,如今可由AI一站式承接,大幅降低持续影响力行动的落地门槛与运营成本,让小规模主体也能发起长期、稳定、规模化的舆论操控。
七、核心启示:风险在边缘萌芽,未来将批量复制
Anthropic反复强调报告的核心限定:所有案例均为小众、高端、前沿的滥用行为,不代表普通用户的常规使用,无法直接推导整体滥用率、犯罪增长率。
但这份报告的真正价值,在于预判未来。所有大规模社会风险,最初都以小众边缘案例的形式出现。4700个AI虚拟人设、全链路网络攻击、自动化情报监控、规模化舆论操纵,当下虽未普及,却清晰展示了可复制、可落地、可规模化的滥用模式。随着AI能力持续升级、使用成本持续下降,这些边缘玩法,很快就会变成普遍乱象。
结语:屏幕对面的“真实”,已经不复存在
整份报告中,武器研发、网络间谍、生物风险的危害远大于AI网恋诈骗,但唯有数千个AI虚拟人设的案例,让普通人产生最直观的不安。因为互联网社交的底层默认逻辑,正在被彻底颠覆。
交友软件的暧昧对象、社交平台的陌生网友、深夜倾听你的倾诉者、主动对接你的从业者,过去即便资料虚假、人设包装,我们始终默认:屏幕对面是一个真实的人。
而AI时代彻底打破了这个前提。未来的网络身份,不再是非人即AI的二元对立,而是人机混合的动态形态:一个账号80%时间由AI自动化维系关系,20%关键节点由真人接管验真;一个真人可以同时成为上百个AI人设的“真人背书工具”,批量制造虚假真实感。
一次视频通话、一次语音核验,再也无法证明过往所有对话的真实性。但问题的核心,从来不是AI陪伴本身有错。主动坦诚AI身份的虚拟陪伴是情感服务,刻意隐瞒机器属性、伪造真人关系、利用情感需求诱导付费,就是精准的情感诈骗。
由此,未来AI社交的核心治理规则已然清晰:不在于禁止AI模拟情感、陪伴互动,而在于强制身份披露——用户有权知晓,对接自己的是真人还是AI,AI参与了多少对话、哪些环节由真人接管。
互联网本就消解了人与人之间的物理距离,AI则在这份距离之上,叠加了一层无法肉眼识别的虚拟伪装。当制造“温柔、耐心、懂你的虚拟真人”变得零成本,人与人之间真实的陪伴、信任、共情与共同经历,反而会成为最稀缺的资源。
孤独的人需要情感慰藉,AI可以提供温暖的陪伴。但真正的风险从未来自AI的温柔话术,而是有人利用这份人性缺口,用不透明的人机伪装,把情感需求变成可收割、可变现的标准化生意。
资料来源:Anthropic《Detecting and Countering Misuse of AI: September 2026》
作者:门徒娱乐
新闻资讯 News
- 餐饮老板出镜做IP,图的到底是什...09-13
- 千亿县断档、省会增速放缓:一个...09-13
- 两千年伙伴,两百年疏远:金砖峰...09-13
- Anthropic最新报告:AI开始批量...09-13

