AI伦理与安全 负责任的AI,可信的智能。 核心问题 如何确保AI系统的公平、透明和安全? 子学科 可解释AI 核心问题:如何让AI的决策过程可理解? 模型解释性 注意力可视化 反事实解释 规则提取 公平性 核心问题:如何消除AI系统中的偏见? 偏见检测 公平性度量 去偏方法 公平性约束 隐私保护 核心问题:如何在利用数据的同时保护隐私? 差分隐私 联邦学习 安全多方计算 同态加密 AI安全 核心问题:如何确保AI系统安全可靠? 对抗样本 模型鲁棒性 AI对齐 安全边界