ソートリーダー
2024年のテクノロジー界を定義するデータプライバシーの問題
テクノロジー界のスポットライトでは、ChatGPTのようなAI駆動のチャットボットが注目を集めており、従来の業界を再定義しています。各進歩により、従来の役割は時代遅れになっていきます。作家、市場の専門家、ITの専門家などが解雇の対象となります。2023年6月だけで、驚くべき3,900人のアメリカ人が仕事を失いました。しかし、この混乱はまだ先にあるものです。
AIが業界を席巻し続けるにつれて、著作権侵害やプライバシー侵害に関する懸念が高まります。質問は大きく聞こえる:進歩とプライバシーの微妙なバランスをどう保つことができるのか。
懸念の火花
まず、ChatGPTのようなAIモデルがどのように機能するかを説明します。彼らはトレーニング中に学んだデータに基づいて結果を生成します。如果モデルがシェイクスピアの古い英語スタイルで書かれたテキストを生成できる場合、それはモデルがすでにそのコンテンツを見たことを意味します。つまり、モデルはそのコンテンツをトレーニング中にすでに見たことがあるということです。
実際、すべてのAIモデル背後の機械学習(ML)アルゴリズムは、多大な量のデータをトレーニングすることで優れたパフォーマンスを発揮します。たとえば、医師が診断に役立つシステムがあります。CTスキャンを分析して、特定の疾患を示す可能性のある異常を検出します。これらのシステムは通常、数百万の医療画像でトレーニングされています。そうでなければ、スキャンのアーティファクトを認識できません。
AIツールの需要が指数関数的に増加するにつれて、テクノロジー企業はモデルをトレーニングするために大量のデータを収集するようになっています。而且、時々そのデータには、個人や組織に関する機密情報が含まれています。また、ウェブページをスクレイピングして所有者の同意なしに取得されることがよくあります。
これにより、プライバシー、透明性、インターネット上の個人情報の管理に関する懸念が高まります。2023年のデロイト調査によると、回答者の大多数はデータの使用についてより多くの保護と管理を求めています。約9人に8人がデータの閲覧と削除を求めており、80%が企業がデータから利益を得る場合には補償されるべきだと感じています。米国では、市民はデータの使用方法についてより心配するようになっています。約7人に6人がこれらの懸念を共有しており、2019年の64%から増加しています。
法的闘争
さらに、一部の組織はこれらの問題を法廷に持ち込んでいます。フォーチュン誌によると、2023年11月の時点で、100を超える AI関連の訴訟が法制度を通過していました。これらの訴訟は、知的財産紛争、有害コンテンツの拡散、差別の事例など、さまざまな懸念を扱っています。
これらの訴訟の中には、Stable DiffusionやMidjourneyなどのディープラーニングやテキストツーアイメージモデルの開発者が、同意なしにデジタルアートをAIのトレーニングに使用したとして、芸術家が提起した訴訟もあります。彼らは主張しています。これらの製品の背後にある企業が、モデルを画像生成にトレーニングするために、インターネットから数十億の画像、そして彼らの画像を含む、を収集したと。
2023年12月、主要なアメリカの新聞であるニューヨークタイムズが、ChatGPTの開発元であるOpenAIを著作権侵害で訴えました。訴訟では強調しています。メディア組織が公開した数百万の記事が、自動化されたチャットボットをトレーニングするために使用され、信頼できる情報源としてニューヨークタイムズと競合しています。
将来の問題
これらの懸念に対処するために、世界中の政府が公共の不安を解決するために団結しています。例えば、世界中の12の規制機関の代表者が共同声明を発表しました。声明は、データスクレイピングとプライバシーの保護に焦点を当てています。この声明は、アルゼンチン、オーストラリア、カナダ、コロンビア、香港、ジャージー、メキシコ、モロッコ、ニュージーランド、ノルウェー、スイス、イギリスの当局から来ました。同時に、カリフォルニア州では、データブローカーを対象としたDelete Actが署名され、個人データの収集と管理に関する追加の規制が設けられました。
懸念は続きますが、2024年とその先でも、プライバシーとデータ所有権に関する懸念が公共の議論で重要性を維持するでしょう。また、知的財産訴訟の増加は、データの正確性と安全性に関するケースの増加、特にディープフェイクや誤情報の蔓延の際に、氷山の一角にすぎないことを示しています。
政府と企業が努力を強化する必要がありますが、慎重なアプローチが必要です。懸念が高まる中でも、オープンデータは研究と開発を推進する上で重要な役割を果たしています。たとえば、COVID-19の危機の際に、公衆への健康記録へのアクセスは、ModernaやPfizerが開発したワクチンなどの医療のブレークスルーを促進する上で、非常に重要でした。
オープンデータの重要性は、米国ヒトゲノム計画の歴史的な例に示されています。遺伝子データの公開は遺伝子研究を変革しました。同様に、AIがデータを分析して学習することで、遺伝子変異の分類から気候変動のような課題への対処まで、社会に利益をもたらすことができます。
企業では、ウェブスクレイパーが収集したデータは、市場インテリジェンス、競合他社の追跡、トレンドの認識に不可欠です。ウェブスクレイピングが制限されれば、企業は重要なデータへのアクセスが制限され、情報に基づいた決定が困難になる可能性があり、革新が妨げられ、ユーザーエクスペリエンスが低下する可能性があります。
しかし、これらの課題の中で、対処する方法もあります。私はプロキシの力に希望を置いています。プロキシは、ユーザーの元のIPアドレスを隠し、代替サーバーを介してオンライン活動を実行することで、データのセキュリティを強化し、技術の進歩と個人の自由の保護のバランスをとるための不可欠なツールとなっています。












