AI 模型与平台
每秒每天,每个人都会产生1.7MB的数据 – 这是我们如何控制它的
今天,AI无处不在。
从我们的数字语音助手帮助我们保持任务的掌控,到我们依赖谷歌地图获取方向,再到推荐引擎帮助我们决定在Netflix上看什么,AI已经成为我们生活中不可或缺的一部分。虽然有些人可能认为这个术语已经变得几乎毫无意义,但事实上,它比以往任何时候都更重要。
除了像220美元的AI牙刷这样的新奇用途,它可以完美地清洁我们的牙齿之外,AI还被用于更令人难以置信和有影响力的方式。AI被用于帮助银行确定交易是否是欺诈性的或合法的,它使医院能够改善患者护理,令人难以置信的是,AI还帮助识别有自杀倾向的人并在他们伤害自己或他人之前提供必要的帮助,等等。
AI如何产生如此多的数据
但是随着AI变得更加普遍,组织持有的个人数据量以指数级增长——事实上,这就是AI训练自己的方式。它获得的数据越多,学习越多,性能越好。结果是,每个人每秒都会产生1.7MB的数据。这是一个令人惊讶的数字,AI启用的技术是主要的贡献因素。
然而,值得注意的是,近年来,消费者对其数据的使用方式变得更加意识到和担心。部分是由于AI,但也由于其他工具,个人数据已经成为精准营销工作的生命线。数据帮助组织了解购买模式、客户行为、点击率等,以获得新的见解。
例如,我们的推荐引擎是如何工作的。漫长的一天结束后(无论是在办公室还是在厨房桌子上),你想放松一下,观看一场好节目。你打开你最喜欢的流媒体服务,等待看到你众多的观看选项。
流媒体服务是如何知道你感兴趣的内容的?数据科学团队收集了每个用户的成千上万个数据点,例如你观看某个节目的时间、你通常观看的时间、你使用的设备等。随着你观看的时间越长,AI收集的关于你的个人数据就越多,从而使其能够更好地预测你感兴趣的内容。这种收集个人数据、创造更多个人数据的循环永远不会停止,导致每一刻都会产生令人难以置信的数据量。
信息过载的问题
但是现在你的流媒体服务已经收集和创造了这么多数据,它需要被存储、管理和保护。这是一个昂贵的提议。此外,数据的性质是分散的。虽然只有一个数据库,它可能被认为是所有数据的中心容器,但现实却更加复杂和混乱;数据科学团队在训练和测试模块时会不断创建各种格式的副本。员工也会无意中创建副本,通过电子邮件发送个人信息、生成报告等。
结果是个人数据量巨大,几乎没有监督和控制。更重要的是,大部分数据对组织来说没有任何用途,可以在使用后删除,但谁真正记得或知道它的存在?这使得组织容易受到谴责和处罚,以及安全风险。那么,如何调和所有这些看似无法控制的数据与遵守GDPR和CCPA等隐私法规的需要呢?
事实证明,问题也是解决方案。
AI如何控制所有数据
人类试图为个人数据问题带来秩序的尝试明显失败了。这是因为要控制所有东西,首先需要知道你拥有它,而我们已经确定这几乎是不可能的。但是,AI以其规模、速度、准确性和自动化而闻名,非常适合控制个人数据。
首先,AI比人类更快地对大量信息进行分类和组织。它可以更精确、更快速地读取数据。它可以自动将数据分类为GDPR或CCPA敏感类别,提取结构化和非结构化数据中的个人身份信息,合并个人身份信息的副本,并识别图像中的潜在敏感文档——而且它永远不会厌倦这样做。
AI还可以识别数据不应该存在的地方,并可以跟踪和控制所有数据移动,从而使其能够监测风险。说到风险,通过自动发现敏感数据的未知用途并消除所有不必要的副本,AI使您能够大大减少攻击面。
例如,假设您有一个可以执行实体提取、理解实体关系和数据元素含义以及理解信息类别(例如健康相关信息或犯罪信息)的AI引擎。使用AI,您可以分析不同数据类型(如数据在传输中、静止数据、结构化和非结构化数据)的无数副本,以实际上更好地控制和管理数据。最后,使用AI,组织可以执行大规模的多语言数据分析,以提取出独特的商业见解。
疾病即是治愈
在我最喜欢的电影之一《超人特攻队》中,超人发现唯一能够摧毁机器人的东西就是机器人本身。AI是一种非常强大的工具。随着我们继续为这个伟大的怪物提供食物,它将变得更加强大。现在是确保它被正确利用并发挥良好作用的时刻,方法是使用它使组织能够对其最宝贵的资产——数据获得更大的控制权。oy 机器人就是机器人本身。AI是一种非常强大的工具。随着我们继续为这个伟大的怪物提供食物,它将变得更加强大。现在是确保它被正确利用并发挥良好作用的时刻,方法是使用它使组织能够对其最宝贵的资产——数据获得更大的控制权。












