点击右上角
微信好友
朋友圈

请使用浏览器分享功能进行分享

中国经济网北京9月17日讯(记者 李方)随着生成式人工智能的加速普及,内容生产门槛大幅降低,内容风险日益突出。当前,黑产借助AI批量生成跨模态违规内容,传统依赖“机器初审+人工复核” 的审核工作正面临“看得见却看不懂、审得完却审不准”的困境。
近日,百度智能云司南AI审核发布专家版审核智能体,尝试以大模型多模态语义分析和意图理解能力,推动内容审核从“能审”走向“懂审”。
AI黑产致风险内容高发
当前,AIGC时代的内容风险已不再是简单的违规词堆砌,而是呈现出三个新特征。一是跨模态批量生成。过去,图文、音视频分开制作,凑出一条跨模态违规内容成本不低;如今,一个提示词就能批量生产多模态内容,一个风险意图可以同时塞进文字、图片和视频画面中。
二是场景化快速改写。过去绕过审核需要人工逐句修改,现在只需调整提示词,一旦发现平台审核漏洞,AI就能快速生产大量同风格违规内容,最大化利用漏洞窗口传播。
三是变体多样性增强。谐音、拆字、隐语、暗号只是“初级形态”,跨语气、跨语种、跨载体的持续变化,以及在长文本中藏匿风险点,让审核难度不断攀升。比如,涉赌内容可能不再出现“赌博”字眼,而是用“钓鱼”“挖金”等中性词包装;色情引流则可能以“晚风”“门牌”“蓝色”等暗号完成筛选和跳转。
业内人士指出,生成式AI被黑产用于批量生成风险内容,违规内容规模迅速扩大、迭代更快、伪装能力增强。传统人审和机审面对的不再是普通用户内容,而是AI驱动的规模化、自动化风险制造。
AI审核加速从“能审”走向“懂审”
行业痛点倒逼技术升级。近日,百度智能云司南AI审核发布专家版审核智能体,定位为从“能审”到“懂审”的审核Agent,以大模型为核心引擎,融合多模态联合分析与意图级语义推理,提供策略专家1v1定制服务。
其核心能力集中在五个方面:一是AI多模态语义分析,针对图、文、音、视频的多模态内容,实现综合语义分析,精准识别违规内容;二是AI意图理解,针对谐音、拆字、隐语、暗号等语义变体,结合上下文还原真实意图,穿透隐蔽表达,变体召回较传统机审提升4—5倍;三是AI图像综合要素识别,联合场景语境、着装程度、姿态构图与内容意图,综合判断画面背后真实的传播意图,软色情等主观尺度审核精度比传统审核大幅提升;四是AI人审辅助,精准定位违规点并输出判定依据,让人审复核有据可查、申诉处理有迹可循;五是定制专属审核智能体,由策略专家1v1定制专属审核智能体,精准适配业务需求。
技术机制上,专家版审核智能体支持Prompt和知识库分钟级热更新,首次上线即超越机审迭代一个月的效果。
百度智能云司南AI安全审核解决方案专家夏可征介绍,司南源自百度20余年内容审核技术积累,能力覆盖文本、图片、音视频、直播流、文档等,拥有200+细分场景标签体系,敏感数据可实现秒级动态更新。目前,相关能力已在社交、游戏、媒体、电商、直播等行业落地,服务上万家企业。
效率与安全双提升
从已披露的案例看,智能审核正在部分场景中显现出效率与安全的双重提升。
某多语言社交业务面临海外语种审核和跨模态色情引流难题,接入专家版审核智能体后,综合审核准确率显著提升,黑产变体召回率提升4—5倍。某硬件厂商广告平台通过多模态、变体、隐喻暗喻识别,用AI辅助审核,标签分类准确率大幅提升,人工参与度降低,在同样人工投入下可额外承担更多业务增量。
在存量内容回扫场景中,针对旧策略漏放、历史未复审、新规上线后需回溯的内容,专家版审核智能体可提供批量化、持续化、可追溯的安全回扫能力。在内容质量精细化打标场景中,通过自然语言说明标签含义、提供少量示例,即可快速输出最新分类与质量结果。
业内人士认为,审核智能体并非要取代人工,而是形成“机审初筛+智能体研判+人审复核”的分层协作模式,把有限的人力聚焦到真正有价值的疑难案例上。从产业趋势看,内容审核正从劳动密集型走向技术密集型,从成本中心转变为平台生态治理和合规经营的基础设施。
