AI内容检测(AIGC Detection)指判定文本、图像、音视频是否由 AI 生成的技术。生成内容爆发式增长后,教育(论文是否AI代写)、媒体(假新闻)、平台(低质AIGC泛滥)、法务(深度伪造证据)都有强需求。
主流技术路线
- 统计特征检测:AI 文本的用词分布过于“平滑”,人类写作更多样——检测器找这种统计指纹
- 水印溯源:生成时嵌入人眼不可见的信号(Google SynthID 等对图像/视频已实用化),最可靠但要求内容出自带水印的生成器
- 元数据与标识:C2PA 内容凭证记录来源链,依赖全链路配合
- 对抗训练检测器:专门训练“鉴伪模型”
根本困境
本质是一场军备竞赛——检测器升级,生成器随之规避(改写、加噪);误判率也无法归零,人类写作被误判为 AI 的案例屡见不鲜,对个人可能造成严重伤害。
实践建议
检测结果只宜作参考线索,不宜作唯一处罚依据;治理上更可靠的方向是“生成时打标”(中国《人工智能生成合成内容标识办法》2025 年 9 月起强制要求)而非“事后鉴伪”。