京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代下,数据使用与隐私保护的博弈
3月5日《南方都市报》的一则报道引起了关注《我们仔细看了50家APP和网站的隐私协议,发现你同意了很多可怕的条款……》。这些可怕的条款包括,没有隐私保护、把个人的健康数据给一款阅读软件、把个人的信息分享给第三方网站和网站认为必要即可公开个人的私密信息等。这些信息不仅包括非个人信息,也包括个人信息,如个人的住址、职业以及敏感的健康信息等。
信息时代,网络服务商提供的软件(APP)和网站,所收集的无数信息成就了海量的大数据,商家和科技公司在通过大数据服务于每个人的同时,既可赚取大量的利润,同时也必然涉及另一个问题,有意和无意泄露个人隐私。如何在大数据时代保护个人隐私,在中国显得特别严重和紧迫。
主要表现为,商家以隐瞒和挟持的手段迫使用户放弃隐私保护。即便一些商家推出表面的隐私协议,要求用户签字,也表现为霸王条款。用户同意才能使用其软件,不同意就不能使用,而且只要使用了网站的任一服务,就表示使用者同意商家的隐私权政策。但这个政策只是商家个人的定义。
在信息时代,一方面,每个人的信息汇聚为大数据时当然不仅是为商家带来财富,也为公共利益,如攻克疾病、研发药物和反恐防恐提供了方便。根据Wikibon的报告,美国大数据产业的市场规模在2017年将达到500亿美元,这其中就包括医药公司利用基因检测软件分享个人数据,并以此为基础研发药物和新产品获取的利润。在中国,每年利用大数据获得的利益也早就超过100亿元人民币。正在召开的“两会”上,百度董事长兼首席执行官李彦宏的第一个提案就是“利用人工智能和大数据技术,帮助解决走失儿童问题”,这也是利用大数据推进和支持公益活动的具体体现。
即便大数据能解决人们生活和发展中的许多问题,而且也将是未来社会发展的一个基石和动力,但并不意味着个人隐私不需要保护。恰恰相反,大数据时代更需要保护个人隐私,才能让信息时代的技术最大化地有利于每个个体,也体现社会的公平和公正。
不过,在中国,保护个人隐私的第一个难题是,如何定义个人隐私,以及如何保护大数据涉及的隐私。中国的法律当然提及了公民个人隐私,并提出,“公民的个人数据不得非法搜集、传输、处理和利用”。但是, 中国的《民法通则》并未将隐私权作为一项独立人格权利加以保护,在隐私权方面,中国的现行立法并不清晰和明确。正因为如此,众多的网络服务商才可以在其软件和网络服务中强行以商家的规则来搜集并使用公民的隐私信息。
对此,应当根据中国的具体情况和参照发达国家对大数据时代提出的公民隐私权的解释,进行立法,以兼顾大数据的合理使用和个人隐私的保护,至少在二者之间寻求一种平衡。
美国对隐私权的规定大致有:公民个人享有秘密或者寻求隐匿的权利,同时保护公民个体的隐私权从住宅扩大到所有私人谈话与通讯过程;公民个人有匿名表达权,特别在政治意见领域;禁止某些运用公民私人信息的消极结果,如防止基因检测信息泄漏而遭到歧视;在私人信息脱离本人排他所有权之后,控制他人接触这些信息;个人有做出私人决定而不受政府干涉的权利,主要包括个人的健康、生育和性生活领域。
美国保护个人隐私既有传统,又看重现实的信息技术发展现状。1974年美国通过了《隐私法案》,2012年2月奥巴马政府又宣布推动《消费者隐私权利法案》,2015年3月美国白宫公布了《2015年消费者隐私权法案》草案。此外,针对上述公民隐私权利的内容也有许多具体的法律,如2008年出台的《基因信息非歧视法案》。
具体到个人隐私权利保护草案,也是一种妥协的结果。一方面,草案关注保护个人隐私,另一方面,又给予商家很多利用个人信息或大数据的权利。例如,草案的一个基本规定是,数据持有商必须要在透明度报告中提供更多关于其用户数据收集的信息;同时,个人访问商家储存的个人数据拥有更多的权利。但另一方面,草案也规定,商家可自行制定隐私政策。而且,如果消费者的要求被商家裁定为无理取闹的行为,商家可以选择无视这些要求。
对此草案,美国最大的信息技术公司微软表态称,微软支持《2015年消费者隐私权法案》,但并不意味着它完全认同法案里的每一项条款。微软首席隐私官布兰登•林奇(Brendon Lynch)认为,对于草案有些人反对,有些人赞同,但不管怎样这都是好消息,因为人们开始为之对话了。
从发达国家的情况看,大数据时代的信息利用和个人隐私保护一直存在博弈,中国现在的情况还达不到这一步,只是处于商家和权力机构强势获取个人信息并加以利用的阶段,公民隐私权的承认和保护还处于空白期,这种不平衡的状况也必将造成广泛的社会负面影响。对此,除了公众要将诉求通过两会代表传达到立法机构外,还需要政府的干预,才能形成大数据的合理应用与个人隐私有效保护的双赢结局。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19