跳到主要内容

《数据女性主义》:打破“数据客观”的神话,重塑数字时代的算法正义

“所谓‘原始数据’(Raw Data)不仅是一个自相矛盾的词,更是一个危险的借口。数据从来都不是自然生成的客观存在,它的采集、分类和运算,无一不浸透着权力的意志。”

书籍信息
  • 原名:Data Feminism
  • 作者:凯瑟琳·迪格纳齐奥 (Catherine D'Ignazio) / 劳伦·F·克莱恩 (Lauren F. Klein)
  • 定位:将交叉性女性主义理论与现代数据科学(Data Science)直接缝合的开创性专著。
  • 核心议题:算法霸权、数据伦理、隐形劳动可视化、女性主义认识论的工程学应用。

关于本书:当交叉性理论进入代码世界​

在 21 世纪的数字资本主义语境下,“数据即石油”,算法统治着从信用评分、司法量刑到简历筛选的社会资源分配。传统科学界和硅谷精英倾向于将数据科学包装成一种“绝对中立、纯粹依靠数学逻辑运转”的客观体系。

《数据女性主义》彻底击碎了这种伪中立性。两位具有深厚计算机科学和数字人文背景的女性学者指出:目前主导全球数据科学的,依然是一个由处于社会特权阶层(白人、富裕、异性恋、四肢健全的男性)构成的高度同质化群体。如果任由这个群体在缺乏社会学反思的情况下垄断算法的编写,数据科学将不可避免地演变为现代父权制和白人至上主义的“技术洗白”工具。

本书并非单纯呼吁“让更多女性去学编程”,而是基于交叉性女性主义的思想库,系统性地提出了干预和重构数据科学的七大核心原则。


核心理论:数据女性主义的七大原则​

作者将庞杂的女性主义理论提炼为七个具有高度实操性的行动准则,旨在对整个数据生产链条进行全方位的伦理审查。

原则一:审视权力 (Examine Power)​

数据科学绝非在真空中运作。数据女性主义要求分析数据背后隐藏的权力结构。

  • 不平等的数据采集:国家和资本倾向于收集对其实施控制、增加利润有用的数据。比如企业极其精确地收集员工的工作时长和轨迹,但社会层面却极度缺乏关于“女性遭受隐性家暴”或“原住民产妇死亡率”的系统性数据。
  • 分析数据的第一步,是质问:“这项数据是由谁资助收集的?收集它为了谁的利益?谁被排除在了数据集之外?”

原则二:挑战权力 (Challenge Power)​

认识到权力不平等后,必须付诸行动。

  • 反数据 (Counter-data):数据女性主义鼓励边缘群体主动建立自己的数据库。例如,针对官方对女性被谋杀(Femicide)数据的刻意淡化或掩盖,拉美的草根活动家通过手动统计新闻报道,建立了属于民间的“杀女数据库”,用数据作为反抗统治叙事的直接政治武器。

原则三:提升情感与具身性 (Elevate Emotion and Embodiment)​

这一原则直接继承了唐娜·哈拉维对“上帝的诡计” (The God Trick) 的批判。

  • 对“伪客观”的祛魅:传统数据可视化(如冰冷的条形图、极简的折线图)刻意剔除情感,试图营造一种“俯瞰众生的上帝般中立感”。
  • 承认身体经验:数据女性主义主张打破“理智(高级)与情感(低级)”的二元对立。在呈现灾难、战争或性别暴力的数据时,应当允许情感共鸣和具身性体验的介入。因为剥离了受害者血肉的所谓“中立客观”,本质上是对苦难的二次消解。

原则四:反思二元论与等级制 (Rethink Binaries and Hierarchies)​

父权制的底层逻辑是二元对立(男/女,自然/文化,理性/感性),这种逻辑被硬编码进了现代数据库的底层架构中。

  • 分类的暴力:绝大多数信息系统的性别选项仍然只提供“男”和“女”的绝对二元单选。这种底层数据结构的设计,直接在系统层面上“抹杀”了跨性别者和非二元性别者,导致他们在申请贷款或医疗保障时遭遇系统性排斥。数据科学必须拒绝用简单的代码对人类复杂的身份进行削足适履。

原则五:拥抱多元主义 (Embrace Pluralism)​

这一原则反抗的是科技界的“独狼天才”神话。

  • 数据科学不应是由几个名校毕业的男性工程师在封闭的实验室里“闭门造车”。
  • 它要求“参与式设计” (Participatory Design)。在建立任何预测模型或算法系统之前,必须将该系统可能影响到的边缘群体(如少数族裔、底层劳工)纳入决策和测试过程。只有多元的视角才能识别出算法中隐蔽的歧视。

原则六:考虑语境 (Consider Context)​

“原始数据”(Raw Data)是一个伪概念。

  • 数字不是真理,数字是人类在特定历史和文化背景下捕捉到的截面。
  • 如果不考虑语境,直接将一个模型从一种文化平移到另一种文化,或者剥离历史去解读一组犯罪率数据,就会得出极度种族主义或性别歧视的结论。数据女性主义要求研究者必须为数据提供完整的历史与社会学注脚。

原则七:让劳动可见 (Make Labor Visible)​

这是马克思主义女性主义在数字经济时代的精准平移。

  • 人工智能的“人工”底座:科技巨头宣扬算法的“全自动魔力”,但刻意隐藏了维持这套系统运转的庞大底层数字劳工体系。
  • 隐形劳动:是谁在为自动驾驶标注成千上万张图片?是谁在暗无天日的审核中心里人工过滤血腥和儿童色情视频,承受着极端的心理创伤?正是全球南方的底层女性和廉价劳工。数据女性主义要求,在展示任何光鲜的 AI 成果时,必须承认并显现其背后的数字再生产劳动。

现实启示:科技界的“认知游击战”​

《数据女性主义》不仅仅是一本写给学者的书,它是写给每一位产品经理、程序员、数据分析师和普通互联网用户的“行动手册”。

它警告我们,如果不将交叉性女性主义的视角嵌入代码的编写和数据的清洗过程,人工智能不仅不会消除人类的偏见,反而会以“算法黑箱”的形式,将 19 世纪的种族主义和性别歧视固化为 21 世纪不可挑战的机器判决。

真正的科技向善,不能依靠硅谷科技寡头的道德施舍,而是需要所有被边缘化的群体,通过掌握数据工具,反向审查、拆解并重构整个数字控制基建。


关联阅读​

  • 理论源头 1:女性主义认识论 (本书是对“境遇知识”在数据科学领域的工程化实践)
  • 理论源头 2:交叉性 (不仅考察单一维度的性别偏见,更关注种族、阶级、残障在算法模型中的复合压迫)
  • 现象级应用:《看不见的女性》 (该书揭示了数据缺口造成的伤害,而本书则提供了填补缺口的七大方法论)
  • 当代反思:人工智能与性别偏见 (了解父权制代码在当下的具体破坏力)