这是一个非常重要且深入的问题。算法公平性评估框架的核心目标是将“公平”这一抽象的社会学概念,转化为可量化、可计算、可比较的技术指标。主流框架主要基于不同的公平性定义(统计学标准)和干预层面构建。
以下是五大主流框架及其特点与局限的详细解析:
这是最经典、应用最广泛的框架,它通过比较模型在不同群体(如男性/女性,多数族裔/少数族裔)上的性能指标来定义公平。
核心定义/指标:
代表工具/库:
特点:
局限:
此框架认为,统计关联不足以定义公平,必须考虑变量间的因果关系。公平性应确保决策不受敏感属性的直接或间接因果影响。
核心概念:
代表工具/研究:
此框架关注模型在未见过的数据分布或最坏情况下的表现,确保模型不仅在训练集上公平,而且对分布变化具有鲁棒性。
核心思想:
代表方法:
此框架超越纯技术指标,关注算法生命周期的全流程治理,包括数据来源、设计意图、透明度、问责制和人类监督。
核心要素:
代表实践:
这是最前沿的框架之一,主张将受影响的利益相关者(尤其是边缘化社群) 纳入设计和评估过程,以确保技术符合他们的价值观和语境化需求。
核心原则:
发展趋势: 目前业界基础是 “统计指标 + 过程治理” 的结合。因果推理是学术前沿和解决复杂歧视问题的关键方向。参与式设计正获得越来越多关注,被认为是实现真正“算法正义”的必经之路。
最重要的共识是:没有任何一个单一框架是足够的。 负责任的AI实践需要多层次、多角度地组合使用这些框架,并清醒地认识到每一种工具背后的假设和局限。技术评估必须嵌入到更广泛的社会、法律和伦理治理结构中。