AI 模型与平台
英国政府收集机密健康数据以对抗COVID-19
英国政府已聘请Palantir,一家由Peter Thiel创立的美国大数据公司,以及Faculty,一家专门从事专业数据科学策略、软件和技能培训的初创公司,以对抗COVID-19的传播。虽然这可能会引起人们对隐私问题的担忧,但值得注意的是,收集包括私人健康数据在内的大数据对于政府做出明智的决定以阻止COVID-19的传播、确定哪些社会成员最容易受到影响以及学习哪些治疗方案最有效是必要的。
(PLTR )Palantir了解到用户隐私是一个问题,这就是为什么他们发布了一份关于在危机期间使用数据的最佳实践的概述。Palantir表示:“知道如何在正确的问题集上应用数据科学将成为增强和完善全面战略以对抗这一公共卫生危机的关键资产”,这无疑是正确的。
他们还表示以下内容,这是对访问此类大数据共享所带来的风险的承认:“丰富的数据源通常会引发意外的——甚至是流氓——分析。建立和执行集体的基本规则,规定如何使用数据以及谁应该具有什么级别的数据访问和使用权限。数据的滥用可能会导致公众对机构的不信任。即使是最好心的解决问题的人有时也会忽视他们创造的解决方案的风险。”
英国政府正在收集什么类型的数据?目前,适合应对COVID-19挑战的相关数据。据Guardian报道,当前的匿名数据包括性别、受保护的健康信息、COVID-19测试结果、人们呼叫国家卫生服务(NHS)和健康咨询热线111的内容以及重症监护室患者的临床信息。
虽然数据隐私应该被匿名化,以便永远无法追踪到特定个体,但我们需要这些数据来分析机器学习系统。深度学习系统使用这种大数据来识别模式和人类容易忽略的数据点。例如,性别可能会揭示重要的见解,例如,糖尿病男性可能比糖尿病女性更容易受到影响。某些治疗方案可能对不同年龄组、性别、基因背景等更有效。
与其被指责,我们应该给英国政府机会。这种数据收集和数据共享的努力应该由整个医疗保健系统维持下去。这可以帮助我们在未来对抗未来的流行病,以及常规的健康问题、癌症和其他生理疾病。
目前,项目使用“伪NHS编号”来交叉匹配大型数据集,包括一个主患者索引,这是一个现有的NHS资源,使用“社会营销数据”将英国人口分成不同的“类型”在家庭层面。虽然目前尚不清楚这是最有效的数据分配方法,但我们对数据收集过程的某些方面有所担忧。
目前,正在收集电话位置数据。虽然将数据缩小到邮政编码可能是合适的,但直接确定电话呼叫的确切来源是没有必要的,因为这些信息无法匿名化或随机化。这可能会导致生病的个人害怕使用电话,这可能会导致那些最需要帮助的人不必要的死亡。
英国公民应该对电话位置数据点感到担忧,这对于有效地训练深度学习算法来说是没有必要的,但可以直接用来跟踪个体。
如果英国政府继续收集此类大数据,并解决上述问题以及其他我们不知道的隐私/用户权利问题,那么英国可能会适当地寻求欧盟的帮助,从各自的人口中收集类似的数据点。毕竟,深度学习的工作原理是,收集的数据越多,算法就越有效。这将有助于在国际边界关闭后弥合国家之间的差距。
我们敦促进行仔细分析,并寻求非营利组织的帮助,以确保英国政府不会滥用其收集的信息。然而,应该承认这是对抗COVID-19的重要一步。












