จริยธรรม
Google เปิดเผยการใช้ข้อมูลเว็บสาธารณะในการฝึกอบรม AI

ในข้อกำหนดความเป็นส่วนตัวที่อัปเดตล่าสุด Google (GOOGL ) ได้เผยให้เห็นอย่างเปิดเผยว่าใช้ข้อมูลที่มีอยู่สาธารณะจากเว็บในการฝึกอบรมโมเดล AI ของตน การเปิดเผยนี้ถูกพบโดย Gizmodo และรวมถึงบริการอย่าง Bard และ Cloud AI ผู้สื่อข่าว Christa Muldoon ของ Google กล่าวต่อ The Verge ว่าการอัปเดตนี้เพียงแต่ชี้แจงว่าบริการใหม่ๆ เช่น Bard ก็รวมอยู่ในแนวปฏิบัตินี้ด้วย และ Google นำหลักการและมาตรการด้านความเป็นส่วนตัวมาใช้ในการพัฒนาเทคโนโลยี AI ของตน
การมีความโปร่งใสในการฝึกอบรม AI เป็นก้าวที่ดี แต่ก็ทำให้เกิดคำถามมากมาย วิธีการที่ Google รับรองความเป็นส่วนตัวของบุคคลเมื่อใช้ข้อมูลที่มีอยู่สาธารณะมีอะไรบ้าง มาตรการใดที่ใช้เพื่อป้องกันการละเมิดข้อมูลนี้
ผลกระทบของวิธีการฝึกอบรม AI ของ Google
นโยบายความเป็นส่วนตัวที่อัปเดตใหม่ระบุว่า Google ใช้ข้อมูลเพื่อปรับปรุงบริการและพัฒนาผลิตภัณฑ์ ฟีเจอร์ และเทคโนโลยีใหม่ๆ ที่มีประโยชน์ต่อผู้ใช้และประชาชน นโยบายดังกล่าวยังระบุด้วยว่าบริษัทอาจใช้ข้อมูลที่มีอยู่สาธารณะในการฝึกอบรมโมเดล AI ของ Google และสร้างผลิตภัณฑ์และฟีเจอร์อย่าง Google Translate, Bard และความสามารถของ Cloud AI
อย่างไรก็ตาม นโยบายไม่ได้ให้ข้อมูลว่า Google จะป้องกันไม่ให้ข้อมูลลิขสิทธิ์ถูกนำมาใช้ในกลุ่มข้อมูลที่ใช้ในการฝึกอบรมหรือไม่ เว็บไซต์สาธารณะหลายแห่งมีนโยบายที่ห้ามการรวบรวมข้อมูลหรือการเก็บข้อมูลจากเว็บเพื่อฝึกอบรมโมเดลภาษาที่มีขนาดใหญ่และชุดเครื่องมือ AI อื่นๆ วิธีการนี้อาจขัดแย้งกับกฎระเบียบระดับโลก เช่น GDPR ที่คุ้มครองบุคคลจากการใช้ข้อมูลโดยไม่ได้รับอนุญาต
การใช้ข้อมูลที่มีอยู่สาธารณะในการฝึกอบรม AI ไม่ใช่เรื่องที่มีปัญหาโดยธรรมชาติ แต่มันกลายเป็นปัญหาเมื่อละเมิดกฎหมายลิขสิทธิ์และความเป็นส่วนตัวของบุคคล เป็นความสมดุลที่บริษัทอย่าง Google ต้องจัดการอย่างระมัดระวัง
ผลกระทบในวงกว้างของการฝึกอบรม AI
การใช้ข้อมูลที่มีอยู่สาธารณะในการฝึกอบรม AI เป็นเรื่องที่ถูกถกเถียงกัน ระบบ AI ที่สร้างข้อมูลใหม่ๆ อย่าง GPT-4 ของ OpenAI ไม่ได้ให้ข้อมูลเกี่ยวกับแหล่งที่มาของข้อมูลและไม่ได้ระบุว่ารวมข้อความจากโซเชียลมีเดียหรือผลงานที่มีลิขสิทธิ์ของศิลปินและนักเขียนหรือไม่ การปฏิบัตินี้อยู่ในพื้นที่สีเทาทางกฎหมาย ทำให้เกิดการฟ้องร้องหลายคดีและทำให้ผู้กำหนดนโยบายในบางประเทศนำกฎหมายที่เข้มงวดมากขึ้นมาเพื่อกำกับวิธีการที่บริษัท AI รวบรวมและใช้ข้อมูลในการฝึกอบรม
ผู้จัดพิมพ์หนังสือพิมพ์ที่ใหญ่ที่สุดในสหรัฐอเมริกา Gannett ได้ฟ้องร้อง Google และบริษัทแม่ Alphabet (GOOG ) โดยอ้างว่าการพัฒนาทางเทคโนโลยี AI ช่วยให้ Google มีอำนาจเหนือตลาดโฆษณาดิจิทัล ในขณะเดียวกัน แพลตฟอร์มโซเชียลมีเดียอย่าง Twitter และ Reddit ได้ดำเนินการเพื่อป้องกันไม่ให้บริษัทอื่นๆ หารvest ข้อมูลของตนได้โดยไม่มีข้อจำกัด ซึ่งนำไปสู่การโต้กลับจากชุมชนของตน
การพัฒนานี้เน้นย้ำถึงความจำเป็นในการมีแนวทางปฏิบัติด้านจริยธรรมที่เข้มแข็งในการพัฒนา AI เมื่อ AI tiếp tụcพัฒนา มันสำคัญที่บริษัทต่างๆ จะต้องสร้างสมดุลระหว่างความก้าวหน้าทางเทคโนโลยีกับการพิจารณาด้านจริยธรรม ซึ่งรวมถึงการเคารพกฎหมายลิขสิทธิ์ การคุ้มครองความเป็นส่วนตัวของบุคคล และการรับรองว่า AI นำมาซึ่งประโยชน์ต่อสังคมโดยรวม ไม่ใช่แค่สำหรับคนบางกลุ่มเท่านั้น
การอัปเดตนโยบายความเป็นส่วนตัวของ Google ล่าสุดได้เผยให้เห็นเกี่ยวกับการฝึกอบรม AI ของบริษัท อย่างไรก็ตาม มัน cũngทำให้เกิดคำถามเกี่ยวกับผลกระทบทางจริยธรรมของการใช้ข้อมูลที่มีอยู่สาธารณะในการฝึกอบรม AI การละเมิดกฎหมายลิขสิทธิ์ที่อาจเกิดขึ้น และผลกระทบต่อความเป็นส่วนตัวของผู้ใช้ เมื่อเราเดินหน้าต่อไป มันจำเป็นที่เราจะต้องดำเนินการสนทนานี้ต่อไปและทำงานเพื่ออนาคตที่ AI ถูกพัฒนาและใช้อย่างมีความรับผิดชอบ












