网信办通报AI应用乱象整治成果 豆包文心一言等被要求严格限制输出

中央网信办于9月2日通报了“清朗·整治AI应用乱象”专项行动第二阶段的工作成果。截至通报时,该行动已清理违法违规信息561万余条,查处账号4.9万余个,处置违规网站及应用程序2400余个。

此次专项行动重点打击利用AI制作虚假信息、传播暴力低俗内容、假冒仿冒他人以及侵害未成年人权益等行为。各地网信部门采取了针对性措施:北京网信办指导平台升级审核策略,以识别违规内容的新型变体;上海网信办推出AI应用“知识普及包”,引导公众风险识别;浙江网信办对重点平台进行“一企一策”合规指导;广东网信办则通过工作例会进行点对点督促整改。

在平台治理层面,抖音、快手、微博、腾讯、百度、哔哩哔哩、小红书等主要平台强化了技术手段。它们通过优化多模态识别模型,动态扩充人脸库、声纹库和违规样本库,并上线实时治理系统,以提升对违规内容的智能检测和拦截效率。

值得注意的是,官方通报明确提及,包括豆包、元宝、千问、文心一言在内的多款生成式AI应用被要求“严格限制违规内容输出”。这标志着监管直接触及了AI内容生成的核心环节,将内容安全责任部分前移至AI服务提供商。此举旨在从源头上遏制利用大模型批量生成有害信息的行为,促使AI应用开发方承担起更主动的内容治理义务。

随着清朗行动的持续推进,对AI应用的管理正从清理下游违规信息,转向规范上游的模型生成能力。这对于构建负责任的AI应用生态具有长远意义。

发布评论
全部评论(0)