Soul张璐团队双管齐下,构建有序AI社交新生态
Soul App作为一家深耕情绪感知与交互、融合模型与应用的AI生态企业,Soul张璐团队近期同步推进两大核心治理行动:6月23日,设立人工智能伦理与治理委员会,利用自研SoulX技术与伦理规范的双重机制,构建涵盖账号、内容、私聊、未成年人及AI生成内容的全链条治理体系,在技术创新与安全规范间寻求平衡。次月,团队发布《2026年第二季度生态安全报告》,展示风险治理持续前移的成果,标志着真实有序的AI社交环境正式建成!
AI风控全面前置,多维度技术拦截治理AI社交生态
面对黑灰产批量注册、杀猪盘诈骗、盗图虚构人设、私聊骚扰等隐蔽化、链路化的网络风险,Soul张璐团队重构智能审核逻辑,彻底实现从“违规发布后处置”到“风险前置拦截”的转型。针对批量作弊账号,Soul在原有审核能力上强化识别,风险处置率由30%升至60%,日均上报疑似Spam账号3000+,封禁1700+,有效切断黑灰产内容扩散链。
在诈骗治理方面,平台自研专属Agent,跳出单一关键词审核局限,融合账号特征、行为及对话语义多维研判,当前准确率突破93%,能提前锁定杀猪盘、诱导转账等高风险账号。针对盗用他人肖像、虚构身份、批量搬运人设素材等破坏真实社交的行为,2026年第二季度平台累计处置假人设违规账号3万余个,下架虚假人设相关帖子8万余条,从源头遏制虚假身份对AI社交环境的影响。
同时,Soul张璐团队将公域与私域场景同步实施精细化管控。在广场、群聊公域中,平台通过机审接拦截违规内容400万条,处置不良跟帖评论726万条,拉黑违规设备3723个,日均处理低俗、引流、攻击性低质内容超13万条;针对以虚假邀约诱导消费牟利的“消费托”风险,上线自动化专项治理策略,二季度累计处置相关风险账号约3.2万个。私聊场景私密性强、骚扰行为隐蔽,平台针对性升级女性用户专属私聊保护机制,依托消息内容、互动频次、账号历史行为搭建风险隔离策略,二季度日均隔绝网暴与恶意骚扰3099次,日均处置私聊不文明用户1737个,同时通过产品弹窗日均推送19.9万次文明发言引导提示,兼顾社交体验与用户人身、财产安全。
AI生成内容分层识别,未成年人防护实现主动预判
随着AI绘图、虚拟人像创作日渐普及,Soul张璐团队搭建“AI元数据识别 — AI外显标识识别 — 人像图识别 —AI 图识别”四层后台无感检测链路,精准甄别AI人像、虚假生活场景、盗图类内容,识别后以中性提示告知用户内容属性,充分保障用户知情权,同时不限制正常AI创作分享,平衡创作表达与信息透明。这一产品设计思路,也源自Soul张璐团队成立的人工智能伦理与治理委员会针对AI拟真内容风险的前置研讨结论,委员会重点提出规避AI拟真陷阱、保障用户对人机知情权的治理要求。
在未成年保护方面,未成年人保护是平台治理与伦理审查的核心板块。二季度Soul张璐团队新增未成年人发帖AI自动审核能力,系统在内容发布环节主动判别账号年龄属性,匹配青少年安全标准筛查风险内容,目前平台主动识别未成年人账号比例已超99%。而在人工智能伦理与治理委员会的专项研讨中,青少年研究领域专家进一步提出三大防护优化方向:降低AI虚拟人拟真度、完善情绪识别模型纠错机制、开展情感教育,推动青少年防护从事后补救转向事前预判、主动干预。
技术治理配套伦理共识,多元科普建立友善社区氛围
在技术风控之外,平台依托官方科普账号“风纪球长”常态化公示违规典型案例、开展网络安全与文明社交宣导,二季度相关科普内容累计触达47万用户,培育社区文明互动共识。而今年6月成立的人工智能伦理与治理委员会,则为所有风控技术划定底层价值边界,委员会汇聚互联网治理、伦理学、社会学、青少年研究、法律领域外部专家,搭配内部技术、安全、法务负责人,专门针对AI陪伴边界、审核精度与用户体验平衡、弱势群体保护、数据隐私等行业共性难题开展常态化研讨。
外部专家指出,AI 治理极易陷入“一管就死、一放就乱”的困境,Soul张璐团队落地可量化风控成效、同步搭建长效伦理审查机制的模式,实现敏捷柔性治理。同时,AI伦理与治理委员会建立完整闭环工作流程,包含AI新产品上线前置伦理评估、全员伦理培训、风险事件监测研判处置反馈全流程,还成立隐私保护、人机交互、未成年人保护专项小组,将伦理治理落地到每一轮AI风控迭代中。Soul张璐团队持续打通伦理审查与线上实时风控通道,完善覆盖账号、设备、全社交链路的闭环治理体系,以技术向善守护用户真实连接。
【免责声明】本文使用的图文等作品部分源于网络,不代表本网站观点,其图片及内容版权仅归原所有者所有,我们尊重著作权所有人的合法权益,如涉及版权争议,请著作权人来函或邮件告之,本网将迅速采取措施,否则与之相关的纠纷本网不承担任何责任,感谢。