隐私 · 7 分钟阅读
阅读类应用会记录你读了什么吗?
多半会——不过“记录”涵盖了好几种不同的事,其中只有一部分带着恶意,而人们最不担心的那一种,恰恰透露得最多。
离开你手机的四样东西
把它们分开看会有帮助,因为它们的分量截然不同。
- 同步。 你的阅读位置、标注和书库,好让它们出现在平板上。确实有用,同时也必然意味着有一台服务器知道你拥有哪些书、读到了哪里。
- 遥测。 崩溃报告、功能计数、会话时长。通常平淡无奇,偶尔详细到足以还原一次阅读过程。
- 广告与归因 SDK。 第三方代码,目的是建立一份画像,并把它与别处已有的画像对上号。这一类关乎的是你,而不是这款应用。
- 查词。 你请求的每一次释义或翻译,都作为一条查询发出去。四者中看起来最小的一个,也是透露最多的一个。
为什么查词透露得最多
一份书单告诉别人你拥有什么。一份你不得不查的词的清单,则告诉别人你在学哪门语言、大致学到什么程度、凌晨两点在读什么,以及你正在悄悄研究哪些题目。
它带着时间戳、按顺序抵达,于是成了一本日记。而且因为每次查词都只是一条小小的请求,你在做的时候几乎不会觉得自己在袒露什么。
书单是一张借书证。查词记录是一份你没看懂什么的逐字稿。
这一切都不需要谁心怀恶意。请求日志本就是服务器的运作方式;一次云端查词就是一次请求;不管有没有人去读,那条记录都存在。
自己动手查一款应用
这件事不需要任何工具。四项检查,每项一分钟。
- 飞行模式测试。 断网,然后点一个词。如果解释照样出现,说明活儿是在设备上干的。如果失败,那它从来就不是本地的。
- 商店里的隐私标签。 两家商店都要求申报。留意“用于追踪你的数据”和各类标识符——它们意味着一张广告关系图,而不是一款阅读应用。
- 是否必须注册账号? 要读一个已经在你手机上的文件,账号是一种选择,而不是技术上的必需。
- 看隐私政策具体点了哪些名。 “我们尊重你的隐私”不是一个主张。“你书籍的文本在你的设备上处理,不会发送到我们的服务器”才是。
一份好的隐私政策实际会怎么写
具体的名词,短句子。哪些数据、给谁、做什么、保存多久。含糊的政策通常是故意含糊的:一个什么都不点名的承诺既无法核查,也无法以你能举证的方式被违反。
最强的版本根本不是承诺。一款从不接收你阅读数据的应用,既泄露不了它,也无法被强制交出它,更无法在将来的更新里改主意。那是架构的性质,而不是公司意图的性质——所以它能在公司被收购之后继续成立。
诚实说说代价
本地处理并不免费。模型得住在你的手机里,占存储;它跑的是你的电池;而且它不会是世界上最大的模型。跨设备同步确实需要服务器,所以一款没有账号的应用没法提供。
这些都是真实的代价,与其假装这个选择只有一面,不如说清楚。你换来的是:那份你当时不认识的词的清单,留在了你当时不认识它们的那台设备上。