可信AI(Trusted AI)指在设计、开发、部署全流程中满足透明、可解释、可靠、公平、安全和负责任等要求的AI系统。当AI进入医疗诊断、金融信贷、司法辅助、自动驾驶等高风险场景时,"能不能信任它"成为比"能力强不强"更关键的问题。
可信AI的六大支柱(业界共识):
- 透明:用户知道自己在与AI交互,知道AI的局限
- 可解释:AI的决策过程能被人类理解(拒绝"黑箱")
- 可靠:在各种输入和环境下稳定正确,不轻易出错
- 公平:不因性别、种族、地域等产生偏见歧视
- 安全:对恶意攻击(对抗攻击、数据投毒)有防御力
- 隐私与问责:数据受保护,责任可追溯
为什么重要
- 监管要求:欧盟AI法案、中国《生成式AI服务管理暂行办法》等法规对高风险AI提出明确要求
- 用户信任:AI应用想被广泛采用,必须让用户放心
- 商业风险:不透明、有偏见的AI会带来声誉和法律风险
落地实践
AI审计与评估、偏见检测(如 AI偏见 词条)、模型卡(Model Card)文档、红队测试(Red Teaming)、人工审核机制。可信AI与AI治理(AI Governance)紧密相关——治理是机制,可信是目标。