《跟我一起读书吧》第三期

“匿名是个幻觉”


我想先问你一个问题。

你有没有想过,为什么你愿意接受这一切?

不只是你——大多数人都知道自己的数据在被收集。调查显示,绝大多数消费者表示他们不信任那些想要监控自己行为的公司。但同样是这些人,继续用Google,继续用Facebook,继续把智能音箱放在家里。

为什么?

其中一个最常见的理由是——反正他们收集的是匿名数据。他们不知道这是我。我只是几亿用户里的一个数字。

今天我们就来聊这个问题。

这个理由,是真的吗?


“匿名"这个词,没有你想象的那么可靠

我们先从一个研究说起。

Google和其他平台的标准说法是:我们收集的是元数据(metadata),这些数据在大规模汇总之后,无法识别出具体的个人。

听起来很合理。

但2000年代初,一位叫Latanya Sweeney的研究员做了一项研究。她发现,只需要三个数据点——生日、邮政编码、性别——就可以在美国人口中唯一识别出87%的个人。

三个数据点。不需要名字,不需要身份证号,不需要任何你认为"私密"的信息。

这三个数据点,几乎每一个数据库里都有。

Zuboff在书里引用了法律学者Paul Ohm的总结。Ohm把那些所谓的匿名行为数据库称为"毁灭数据库”(databases of ruin)——因为一旦这些数据被重新识别,里面藏着的秘密,足以毁掉一个人。他说,重新识别技术让我们所有的秘密都变得更容易被发现和揭露。你的敌人会更容易找到可以用来勒索、骚扰、诽谤或歧视你的信息。

这不是理论上的可能性。这是已经被反复证明的现实。


位置数据:你以为自己在人群中消失了

位置数据是另一个让人警觉的例子。

每个人的移动轨迹,都有独特的规律性。你每天上班走哪条路,你周末习惯去哪个咖啡馆,你每隔多久去一次超市,你去看医生的频率——这些加在一起,形成了一个专属于你的"移动签名"。

就算数据里没有你的名字,就算你的手机号码被抹掉,只要有足够多的位置数据,任何一个有工具的分析师,都可以把你从人群中识别出来。

2013年,MIT和哈佛的研究团队证明了这一点。他们发现,由于每个人移动轨迹的独特性,从一个大型匿名位置数据集里精确识别出某一个特定个人,在技术上完全可行。

普林斯顿的计算机科学家Arvind Narayanan和Edward Felten直接说:目前没有任何已知的有效方法可以匿名化位置数据,也没有证据显示这在原则上是可行的。

换句话说,位置数据的匿名化,从技术上就是一个无法实现的承诺。


你的手机传感器在说什么

除了位置数据,你手机里那些看起来无害的传感器,也在泄露比你想象的更多的信息。

加速度计、陀螺仪、磁力计——这些传感器最初的设计目的,是让手机知道自己的朝向,让地图知道你在移动。

但研究人员发现,这些传感器数据可以用来推断的东西远不止这些。

你今天走路的姿势和平时不一样——可能你受伤了,或者你喝了酒。你的手机静止的时间比平时长很多——可能你在睡觉,或者你生病了。你的手机震动的频率和幅度——可能反映了你所在的交通工具,以及你的情绪状态。

研究显示,仅凭手机传感器数据,就可以推断出用户不断变化的活动状态和情绪,并且可以从所谓的匿名数据集里提取出特定用户的敏感个人信息。

这些传感器,不需要你的许可就可以被App访问。很多App会在你完全不知情的情况下,在后台持续收集这些数据。


Facebook知道你的性格,比你的朋友更准

我想再讲一个研究,因为它把"匿名数据"的问题推到了一个新的维度。

剑桥大学的研究员Michal Kosinski和他的团队,研究了Facebook用户的"点赞"行为。他们发现,通过分析一个人点赞的内容,可以极其准确地预测这个人的性格特征——外向还是内向,稳定还是神经质,开放还是保守。

2015年发表的一篇论文显示,他们的算法在判断一个人性格上的准确度,已经超过了这个人的同事、朋友,甚至家人。

只需要300个点赞,算法对你的了解就超过了你的配偶。

这个研究本身是学术性的。但它揭示的,是一个值得认真对待的可能性——你在网上留下的那些看似随意的行为痕迹,点了哪些内容,停留了多久,转发了什么——这些加在一起,可以构建出一个比你自己描述的更真实的你。

而这个"你",是可以被买卖的。

值得注意的是,这项研究很快吸引了来自微软、波音、谷歌、美国国家科学基金会,以及美国国防高级研究计划局的资助。学术研究和商业应用、军事应用之间的距离,比我们想象的要近得多。


“同意"这件事

聊到这里,我想说一个让我觉得很重要的问题——“同意”。

我们每次安装一个App,都会点击"同意”。我们同意了那些没有人会读完的隐私条款。平台说,这是你自愿的选择。

但Zuboff对这个说法提出了一个根本性的质疑。

她说,真正的同意需要两个条件:第一,你知道自己在同意什么;第二,你有拒绝的能力。

这两个条件,在今天的数字世界里都不存在。

没有人真正知道自己在同意什么——那些条款的复杂程度,就算是律师也需要花很长时间才能读懂。而且就算你想拒绝,你失去的不只是一个App,而是参与现代社会的能力。你拒绝用某个通讯软件,你就失去了跟大多数人沟通的渠道。你拒绝用地图,你就很难在城市里正常生活。

这不是自由选择。这是一种被设计出来的别无选择。


我自己的感受

读完这一部分,我有一个想法一直在脑子里转。

我们很多人接受数据收集,是因为相信自己只是人群里的一个匿名数字。这种想法给了我们一种安全感——反正他们不知道这是我。

但这本书告诉我们,这种安全感是被精心设计出来的。

匿名的承诺让我们降低了警觉,让我们更容易接受这套系统。但技术的现实是,匿名只是暂时的,只要有足够的计算能力和足够多的数据,重新识别只是时间问题。

而且更深层的问题不只是"他们知不知道这是我"。

就算他们永远不知道你的名字,他们依然可以影响你的行为,塑造你的情绪,引导你的选择。行为修正不需要知道你是谁,它只需要知道你是什么类型的人,然后针对这个类型设计干预。

个人的匿名,并不能保护你免受集体操控。


好,第三期到这里。

我们今天聊了匿名的幻觉——三个数据点足以识别你,位置数据从技术上就无法真正匿名化,你的手机传感器知道的远比你以为的多,而对行为数据的深度分析可以构建出一个比你自己更了解你的画像。

这套系统建立在一个前提上:你不知道,或者你不在乎。

下一期,我们把视野放宽一点——同样的这套技术逻辑,在不同的地方,被不同的力量使用,会产生什么?

这里是《跟我一起读书吧》,我是Allen。


Last modified on 2026-06-04