当前,伴随着AI技术的普及,互联网平台各类风险不断衍生新手段,如黑灰产作弊、虚假人设、诱导消费、私聊骚扰等愈发隐蔽,还形成完整行为链路,对平台治理提出更高标准。同时,AI技术持续融入互联网平台治理,推动平台风险治理逻辑发生改变,由过去的事后处置,向着风险前置识别、提前拦截的方向转变近期,Soul App发布《2026年第二季度生态安全报告》,完整展现平台依靠AI技术,推动反诈、账号治理、场景管控、未成年人保护等各项工作实现风险治理前移的实践。

针对黑灰产账号批量注册、快速发布、频繁变换内容的特点,Soul App在原有安全审核基础上强化批量作弊识别,争取把风险内容拦截在传播发生之前。经过持续优化,相关策略的风险内容处置率由上线初期的约30%提升至60%,进一步缩短黑灰产账号在平台内的活动周期。诈骗治理同样贯彻前置防控思路,平台不再单纯依靠固定关键词筛查,结合账号特征、互动行为、内容语义综合研判“杀猪盘”相关风险。目前,相关Agent能力准确率已达到93%以上,帮助平台提前识别高风险账号。对于盗用图片、虚构身份、批量搬运人设的账号,平台同样做到尽早识别处置,二季度,Soul累计处置假人设违规账号3万余个,识别并处理相关帖子8万余条。

面向广场、群聊、私聊等全社交场景,Soul App落地前置拦截与过程管控相结合的治理方式。报告显示,平台二季度通过机审直接拦截违规内容400万条,处置相关跟帖评论726万条,累计拉黑违规设备3723个。与此同时,平台日均向2533名用户进行社区规范和文明表达提醒。平台日均处理相关低质内容超过13万条;针对“消费托”诱导消费风险,Soul App上线专项自动化治理策略,累计处置相关风险账号约3.2万个。私聊骚扰层面,平台前置识别骚扰特征,对疑似骚扰信息做风险隔离,限制不良账号的触达范围。二季度,Soul日均帮助用户隔绝网暴和频繁骚扰3099次,日均处置存在私聊不文明行为的用户1737个,并通过产品提示日均引导用户文明发言19.9万次。

AI生成内容领域,Soul App在后台完成图片分层识别,提前甄别AI人像、虚假场景、盗图内容,用中性提示告知用户内容属性,识别工作不干预用户正常发帖。未成年人保护同样完成治理前移,Soul App新增针对未成年人发帖内容的AI审核能力,在发布环节识别账号风险,目前,平台主动识别未成年人的比例已超过99%,推动未成年人保护从出事之后处理,转向主动识别、提前防范。
技术前置防控之外,平台搭配用户教育巩固治理成效,官方账号“风纪球长”公开违规典型案例,开展安全科普、社交礼仪倡议与网络辟谣,二季度累计触达用户47万人。技术识别、产品干预、用户教育三者互相配合,培育社区友善互动氛围。后续,Soul App会持续把AI、人工审核、产品机制、用户教育深度结合,跟进新技术新场景带来的风险变化,搭建覆盖内容、账号、设备、社交链路的全流程治理体系,守护安全真实有序的社交生态。
广告,本平台所发布信息的内容和准确性由提供消息的原单位或组织独立承担完全责任.