算法公平

Parent: ai_keywords

核心定义

算法公平指的是在人工智能系统的全生命周期中,确保模型对不同群体(如种族、性别、年龄、地域等)的预测或决策不产生系统性偏见或歧视。在医学AI中,公平性直接关系到诊疗质量的均等性,避免因数据或算法缺陷导致特定患者群体被误诊、漏诊或治疗方案不公。

关键技术点

  • 公平性度量指标:如均等机会(要求各敏感组别真阳性率一致)、均等化错误率(假阳性/假阴性率平衡)、人口均等(预测正例比例在各组相等)。不同临床场景需选择与疾病代价匹配的指标。
  • 偏见来源与检测:包括数据偏见(样本量不均、标注不一致)、算法偏见(特征选择或权重偏差)以及部署偏见(使用环境与训练分布差异)。需通过统计检验(如平等机会差异测试)量化偏见程度。
  • 去偏方法:预处理(重采样、数据增广)、处理中(对抗性去偏、公平正则化)、后处理(基于阈值的校准)。医学场景中后处理更易落地,因其不影响模型原本的临床准确性。
  • 可解释性与审计:通过SHAP、LIME等工具揭示模型在敏感特征上的依赖,结合临床专家审查决策路径,确保公平性可被监督和纠正。

医学/神经科学应用场景

案例:脑卒中CT影像AI辅助诊断中的年龄公平性
首都医科大学神经病学团队在构建脑卒中(急性缺血性)CT决策系统时发现,模型对65岁以上老年患者的出血性转化风险预测灵敏度显著低于65岁以下人群(差异达12%)。经溯源,训练数据中老年样本比例偏低,且标注对老年特有的微出血灶存在漏标。
公平性修正方案:采用预处理重采样平衡年龄组样本,并在损失函数中加入“均等化真阳性率”正则项。修正后模型在老年组的灵敏度提升至与年轻组一致,同时整体AUC仅下降0.3%(临床可接受)。该方法已纳入首都医科大学附属宣武医院急诊临床验证队列,有效降低了年龄维度上的诊断偏见。