윤리

구글, 공개 웹 데이터를 AI 훈련에 사용한다고 밝혀

mm
Unite.AI를 Google의 선호 소스에 추가

구글은 최근 개인 정보 보호 정책을 업데이트하면서 공개적으로 웹에서 공개적으로 उपलब있는 정보를 사용하여 AI 모델을 훈련한다고 밝혔습니다. 이 공개는 지즈모도에서 발견되었으며, 바드와 클라우드 AI와 같은 서비스를 포함합니다. 구글 대변인 크리스타 물도온은 더 버지에 대해 이 업데이트는 새로운 서비스인 바드도 이 관행에 포함된 것을 명확히 하는 것으로, 구글은 AI 기술 개발에 개인 정보 보호 원칙과 안전 장치를 통합한다고 밝혔습니다.

AI 훈련 관행에 대한 투명성은 올바른 방향으로 나아가는 단계이지만,同時 많은 질문을 제기합니다. 구글은 공개적으로 उपलब있는 데이터를 사용할 때 개인의 개인 정보를 어떻게 보장합니까? 이 데이터의 오남용을 방지하기 위한 어떤 조치가 있습니까?

구글의 AI 훈련 방법의 의미

업데이트된 개인 정보 보호 정책은 구글이 서비스를 개선하고 새로운 제품, 기능 및 기술을 개발하기 위해 정보를 사용한다고 명시합니다. 정책은 또한 회사가 공개적으로 उपलब있는 정보를 사용하여 구글의 AI 모델을 훈련하고 구글 번역, 바드, 클라우드 AI 기능과 같은 제품 및 기능을 구축할 수 있다고 지정합니다.

그러나 정책은 구글이 저작권 물건을 포함하는 훈련 데이터 풀에서 어떻게 방지할 것인지에 대해 명확히하지 않습니다. 많은 공개적으로 접근 가능한 웹사이트는 데이터 수집 또는 웹 스크래핑을 금지하는 정책을 가지고 있으며, 이는 대규모 언어 모델 및 기타 AI 도구セット 훈련 목적으로 사용됩니다. 이러한 접근 방식은 개인 데이터가 명시적인 동의 없이 오남용되는 것을 방지하는 GDPR와 같은 글로벌 규정과 충돌할 수 있습니다.

공개적으로 उपलब있는 데이터를 AI 훈련에 사용하는 것은 본질적으로 문제가 되지 않지만, 저작권법과 개인 정보를 침해할 때 문제가 됩니다. 이는 구글과 같은 회사들이慎重하게 조율해야 하는微妙한 균형입니다.

AI 훈련 관행의 더 넓은 영향

공개적으로 उपलब있는 데이터를 AI 훈련에 사용하는 것은 논쟁의 대상이었습니다. 오픈AI의 GPT-4와 같은 인기 있는 생성 AI 시스템은 데이터 출처에 대해 黙秘해왔으며, 소셜 미디어 게시글이나 인간 예술가 및 작가의 저작권 작품을 포함하는지 여부에 대해 黙秘해왔습니다. 이 관행은 현재 법적 회색 지대에 있으며, 여러 소송을 유발하고 일부 국가의 입법자들이 AI 회사들이 훈련 데이터를 수집하고 사용하는 방법을 규제하기 위한 더 엄격한 법률을 제시하도록 유도했습니다.

미국의 가장 큰 신문 출판사인 간넷은 구글과 그 모회사인 알파벳을 고소하면서, AI 기술의 발전이 디지털 광고 시장에서 구글의 독점을 유지하는 데 도움이 되었다고 주장합니다. 同時, 트위터와 레딧과 같은 소셜 플랫폼은 다른 회사들이 데이터를 자유롭게 수집하는 것을 방지하기 위한 조치를 취했으며, 이는 각 커뮤니티에서 반발을 불러일으켰습니다.

이러한 개발은 강력한 윤리 지침이 AI에 필요하다는 것을 강조합니다. AI가 계속 발전함에 따라, 회사들은 기술적 발전과 윤리적 고려 사이에서 균형을 유지하는 것이 중요합니다. 이는 저작권법을 존중하고, 개인 정보를 보호하며, AI가 모든 사회에ประโยชน을주는 것을 보장하는 것을 포함합니다.

구글의 최근 개인 정보 보호 정책 업데이트는 회사의 AI 훈련 관행에 대한 빛을 비추었습니다. 그러나 이것은 공개적으로 उपलब있는 데이터를 AI 훈련에 사용하는 것의 윤리적 의미, 저작권법의 잠재적인 침해, 사용자 개인 정보에 대한 영향에 대한 질문을 제기합니다. 앞으로 진행함에 따라, 우리는 이 대화에 계속 참여하고, 책임감 있게 개발되고 사용되는 AI의 미래를 향한 방향으로 나아가는 것이 중요합니다.

Alex McFarland은 인공 지능의 최신 개발을 탐구하는 AI 저널리스트이자 작가입니다. 그는 전 세계의 수많은 AI 스타트업과 출판물들과 협력했습니다.