สัมภาษณ์
ออร์ เลนช์เนอร์ CEO ของ Bright Data – ซีรีส์สัมภาษณ์

ออร์ เลนช์เนอร์ ซีอีโอของ Bright Data ได้นำแพลตฟอร์มการรวบรวมข้อมูลเว็บที่มีประสิทธิภาพสูงสุดมาตั้งแต่ปี 2018 โดยขับเคลื่อนการขยายตัว การนวัตกรรม และการเติบโตจนมีรายได้ประจำปีมากกว่า 100 ล้านดอลลาร์สหรัฐฯ Bright Data ช่วยให้กลุ่ม Fortune 500 บริษัทชั้นนำ มหาวิทยาลัยที่มีชื่อเสียง และหน่วยงานภาครัฐสามารถเข้าถึงข้อมูลเว็บสาธารณะได้แบบเรียลไทม์และมีขนาดใหญ่ เลนช์เนอร์เป็นผู้สนับสนุนอย่างแข็งขันในการรักษาข้อมูลเว็บสาธารณะให้เปิดกว้างและเข้าถึงได้ โดยเน้นย้ำถึงบทบาทที่สำคัญในการขับเคลื่อนนวัตกรรม
อะไรคือแรงบันดาลใจที่ทำให้คุณเข้าสู่โลกของข้อมูลและ AI และตั้งแต่คุณกลายเป็น CEO ในปี 2018 คุณได้กำหนดภารกิจและวิสัยทัศน์ของ Bright Data อย่างไร
ฉันเคยสนใจพลังของข้อมูลมาก โดยเฉพาะอย่างยิ่งวิธีที่ข้อมูลสามารถขับเคลื่อนการตัดสินใจและเชื้อไฟนวัตกรรม เมื่อใช้ข้อมูลอย่างถูกต้อง ข้อมูลยังสามารถขับเคลื่อนความโปร่งใสในการดำเนินธุรกิจได้ การกลายเป็น CEO ของ Bright Data ในปี 2018 ให้โอกาสฉันในการช่วยกำหนดวิธีการที่นักวิจัย AI และธุรกิจในการหาข้อมูลเว็บสาธารณะ
อะไรคือความท้าทายหลักๆ ที่ทีม AI ต้องเผชิญในการรวบรวมข้อมูลเว็บสาธารณะขนาดใหญ่ และ Bright Data จัดการกับพวกเขาอย่างไร
ความสามารถในการปรับขนาดยังคงเป็นหนึ่งในความท้าทายที่ใหญ่ที่สุดสำหรับทีม AI เนื่องจากโมเดล AI ต้องการข้อมูลจำนวนมาก การรวบรวมข้อมูลจึงไม่ใช่เรื่องง่าย และเนื่องจากโมเดล AI มีคุณภาพดีเท่ากับข้อมูลที่ใช้ในการฝึกอบรม การรับประกันว่าทีมมีการเข้าถึงข้อมูลที่สดใหม่และมีคุณภาพสูงจึงเป็นความท้าทายที่ต่อเนื่อง โดยเฉพาะอย่างยิ่งเมื่อเว็บเปลี่ยนแปลงไปในแบบเรียลไทม์
ความกังวลหลักอีกประการหนึ่งคือการปฏิบัติตามกฎระเบียบ ข้อกำหนดและกฎหมายการคุ้มครองข้อมูลส่วนบุคคลเปลี่ยนแปลงอย่างต่อเนื่อง ดังนั้นทีม AI จึงต้องติดตามการเปลี่ยนแปลงเหล่านั้นเสมอ พวกเขายังต้องเข้าใจวิธีการจัดการกับเว็บไซต์ที่บังคับใช้กลไกต่อต้านบอท ซึ่งสามารถทำให้กระบวนการรวบรวมข้อมูลซับซ้อน
แพลตฟอร์มที่เราสร้างขึ้นที่ Bright Data จัดการกับความท้าทายเหล่านี้ เราให้บริการรวบรวมข้อมูลแบบอัตโนมัติที่มีการปรับขนาด ซึ่งจัดหาให้ข้อมูลแบบเรียลไทม์ที่มีโครงสร้าง เครื่องมือ AI ของเราล้างและตรวจสอบข้อมูลเพื่อให้แน่ใจถึงความแม่นยำ เรามีการดำเนินการอย่างเข้มงวดเพื่อให้แน่ใจว่าการรวบรวมข้อมูลทางกฎหมายและจริยธรรมสำหรับการปฏิบัติตามกฎระเบียบ โดยมีเป้าหมายในการเพิ่มขีดความสามารถให้กับทีม AI เพื่อมุ่งเน้นไปที่การสร้างโมเดลที่ดีเยี่ยม ในขณะที่เราจัดการความซับซ้อนของการรวบรวมข้อมูล
ข้อมูลเว็บคุณภาพสูงมีส่วนช่วยอย่างไรต่อประสิทธิภาพของโมเดล AI และวิธีการดีที่สุดในการรับประกันความแม่นยำของข้อมูลคืออะไร
ข้อมูลคุณภาพสูงหมายถึงข้อมูลที่สมบูรณ์ ไม่มีอคติ และสำคัญที่สุดคือแม่นยำ หากข้อมูลไม่เพียงพอหรือเต็มไปด้วยความไม่สอดคล้องและข้อผิดพลาด โมเดล AI ที่ได้จะไม่ทำงานตามที่คาดหวัง
เพื่อให้ได้ความแม่นยำ ควรรวบรวมข้อมูลจากแหล่งสาธารณะที่มีความน่าเชื่อถือที่ได้รับการสถาปนา การใช้แหล่งข้อมูลเพียงไม่กี่แหล่งหรือแย่กว่านั้นคือแหล่งเดียวจะทำให้เกิดปัญหา เช่น การไม่สมบูรณ์ การมีแหล่งข้อมูลหลายแหล่งช่วยให้สามารถตรวจสอบข้ามข้อมูลและสร้างชุดข้อมูลที่สมดุลและเป็นตัวแทนมากขึ้น นอกจากนี้ องค์กรควรพิจารณาการตรวจสอบและทำความสะอาดข้อมูลอัตโนมัติเพื่อกำจัดข้อมูลที่ผิดพลาดและไม่สอดคล้องกันอย่างมีประสิทธิภาพ
ที่ Bright Data เราพิจารณาปัจจัยเหล่านี้ทั้งหมด เราให้ข้อมูลที่มีโครงสร้างและแบบเรียลไทม์แก่ทีม AI ซึ่งได้รับการตรวจสอบความแม่นยำแล้ว เพื่อให้พวกเขาสามารถฝึกโมเดลได้อย่างมั่นใจ
ปัญหาหลักๆ ทางจริยธรรมในการรวบรวมข้อมูลเว็บสาธารณะในปัจจุบันคืออะไร
ความเป็นส่วนตัวยังคงเป็นข้อกังวลหลักในการรวบรวมข้อมูลเว็บสาธารณะ ผู้คนกังวลเกี่ยวกับการเปิดเผยข้อมูลส่วนบุคคลและการใช้ข้อมูลในทางที่ผิด เพื่อให้แน่ใจว่าข้อมูลยังคงเป็นส่วนตัว สิ่งสำคัญคือต้องเน้นย้ำถึงความโปร่งใส องค์กรที่รวบรวมข้อมูลต้องเปิดเผยเกี่ยวกับข้อมูลที่รวบรวม และให้ความมั่นใจแก่สาธารณชนว่าข้อมูลถูกใช้ภายใต้แนวทางจริยธรรมที่เข้มงวด
ข้อกังวลหลักอีกประการหนึ่งคือการผูกขาด บริษัทขนาดใหญ่บางแห่งควบคุมข้อมูลจำนวนมาก ซึ่งสร้างสนามแข่งขันที่ไม่เท่าเทียมกัน โดยที่เพียงไม่กี่บริษัทเท่านั้นที่สามารถเข้าถึงข้อมูลที่จำเป็นในการฝึกโมเดล AI และขับเคลื่อนนวัตกรรม สิ่งนี้ไม่ควรเป็นเช่นนั้น ข้อมูลเว็บสาธารณะควรยังคงสามารถเข้าถึงได้สำหรับธุรกิจ นักวิจัย และนักพัฒนา เพื่อให้การพัฒนา AI ไม่ถูกจำกัดอยู่ในมือของเพียงไม่กี่ผู้เล่นหลัก
จริยธรรมไม่ใช่เรื่องรองสำหรับ Bright Data มันถูกฝังอยู่ใน每การตัดสินใจที่เราทำ เราไม่เพียงแต่ปฏิบัติตามมาตรฐานอุตสาหกรรมเท่านั้น แต่ยังกำหนดมาตรฐานด้วย เราเป็นผู้นำในอุตสาหกรรมการรวบรวมข้อมูลในการกำหนดมาตรฐานจริยธรรมที่ถูกต้อง เราต้องการให้แน่ใจว่าข้อมูลเว็บสาธารณะสามารถเข้าถึงได้อย่างรับผิดชอบ โปร่งใส และเป็นไปตามข้อกำหนดระดับโลก
Bright Data รับประกันการปฏิบัติตามข้อกำหนดการคุ้มครองข้อมูลส่วนบุคคลระดับโลกในขณะเดียวกันก็ช่วยให้สามารถรวบรวมข้อมูลขนาดใหญ่ได้อย่างไร
องค์กรของเรามุ่งมั่นที่จะปฏิบัติตามข้อกำหนดและกฎระเบียบทางกฎหมายและระดับโลกเกี่ยวกับการรวบรวมและการใช้ข้อมูล เราให้แน่ใจว่าเราปฏิบัติตามข้อกำหนดของ GDPR, CPRA, CCPA และข้อกำหนดที่เกี่ยวข้องอื่นๆ นอกจากนี้ เรายังปฏิบัติตามโปรโตคอล Know Your Customer (KYC) อย่างเข้มงวดเพื่อให้แน่ใจว่าผู้ใช้ที่ถูกต้องเท่านั้นที่สามารถเข้าถึงแพลตฟอร์มของเราได้ วิธีแก้ปัญหาข้อมูลของเราสามารถเข้าถึงได้เฉพาะโดยธุรกิจและนักวิจัยที่ถูกต้องเท่านั้น
นโยบายการใช้ที่ยอมรับได้ของเรากำหนดไว้อย่างชัดเจนเกี่ยวกับสิ่งที่สามารถรวบรวมข้อมูลได้และไม่สามารถรวบรวมข้อมูลได้ รวมถึงการใช้ที่รับผิดชอบด้วย เรามีทีมปฏิบัติตามกฎระเบียบที่รับผิดชอบในการติดตามกฎระเบียบเพื่อให้แน่ใจว่าเราอัปเดตตามข้อกำหนดทางกฎหมายและกฎระเบียบล่าสุด
อย่างไรก็ตาม เรายังคงเชื่อว่าข้อมูลเว็บสาธารณะควรยังคงสามารถเข้าถึงได้ เป้าหมายของเราคือการให้ข้อมูลแก่ทีม AI ที่ต้องการ ในขณะเดียวกันก็รับประกันการปฏิบัติตามมาตรฐานความเป็นส่วนตัวและกฎหมาย
คุณสร้างสมดุลระหว่างการเติบโตทางธุรกิจกับการปฏิบัติตามหลักจริยธรรมในการรวบรวมข้อมูลอย่างไร
เรามองว่าจริยธรรมและการเติบโตไม่ใช่สิ่งที่แยกจากกัน ความไว้วางใจของลูกค้าและความสัมพันธ์ที่เราสร้างกับพวกเขาเป็นข้อกังวลหลัก เราเข้าใจว่าเราสามารถประสบความสำเร็จในระยะยาวได้เฉพาะในกรณีที่เรารวบรวมข้อมูลภายใต้เงื่อนไขที่โปร่งใสและเป็นไปตามกฎหมายที่ใช้บังคับ
ดังนั้น เราจึงมีโปรโตคอลการตรวจสอบผู้ใช้ที่เข้มงวดเพื่อให้แน่ใจว่าข้อมูลที่รวบรวมจะถูกใช้อย่างมีจริยธรรม เราใช้เวลา ความพยายาม และทรัพยากรในการปฏิบัติตามกฎระเบียบและความปลอดภัยเพื่อปกป้องลูกค้าและสาธารณชนโดยทั่วไป โดยการปฏิบัติตามหลักการรวบรวมข้อมูลที่มีจริยธรรม เราสามารถประสบความสำเร็จทางธุรกิจในขณะเดียวกันก็ช่วยสร้างระบบนิเวศ AI ที่โปร่งใสและรับผิดชอบ
Bright Data ติดตามการเปลี่ยนแปลงกฎระเบียบเกี่ยวกับการคุ้มครองข้อมูลส่วนบุคคลอย่างไร
เรารู้ว่ากระบวนการและนโยบายการใช้ข้อมูลของเราจะต้องเปลี่ยนแปลงเพื่อสะท้อนถึงการเปลี่ยนแปลงในกฎหมายและข้อกำหนดที่เกี่ยวข้อง ดังนั้น เราจึงปรึกษากับผู้เชี่ยวชาญด้านกฎหมายและติดต่อกับหน่วยงานกำกับดูแล เรายังเข้าร่วมการอภิปรายกับฝ่ายนิติบัญญัติและผู้มีส่วนร่วมในการสร้างนโยบาย เพื่อให้ข้อเสนอแนะในการสร้างกฎระเบียบเกี่ยวกับข้อมูลที่มีความหมาย เรามุ่งมั่นที่จะสร้างสมดุลระหว่างนวัตกรรมและการคุ้มครองข้อมูลส่วนบุคคล
โครงสร้างการรวบรวมและใช้ข้อมูลของเราพัฒนาไปพร้อมกับการออกกฎหมายใหม่และการแก้ไขข้อกำหนด เรามีทีมปฏิบัติตามกฎระเบียบที่อัปเดตนโยบายการใช้ข้อมูลของเราอย่างต่อเนื่องเพื่อให้แน่ใจว่าแพลตฟอร์มของเราปฏิบัติตามข้อกำหนดอยู่เสมอ นอกจากนี้ เรายังดำเนินโครงการการศึกษาลูกค้าเพื่อส่งเสริมการใช้ข้อมูลที่มีจริยธรรม
แนวโน้มที่เกิดขึ้นใหม่ในการรวบรวมข้อมูล AI ที่บริษัทต่างๆ ควรทราบคืออะไร
การรวบรวมข้อมูลแบบเรียลไทม์กำลังเป็นเรื่องจำเป็นสำหรับโมเดล AI ในปัจจุบัน มันจำเป็นต่อการเข้าถึงข้อมูลล่าสุดหรือที่สดที่สุดเพื่อให้ได้ความแม่นยำสูงและให้ประสบการณ์ผู้ใช้ที่ดีขึ้น
อีกแนวโน้มที่น่าสังเกตคือการอาศัยข้อมูลสังเคราะห์สำหรับการเพิ่มข้อมูล โดยที่ AI สร้างข้อมูลที่เสริมชุดข้อมูลที่รวบรวมจากสถานการณ์จริง
ฉันเห็นความสนใจที่แข็งแกร่งในการพัฒนา AI ที่อธิบายได้ โมเดล AI ส่วนใหญ่ในปัจจุบันประสบปัญหาจากผลกระทบ “กล่องดำ” หรือการขาดความโปร่งใสในการตัดสินใจ บริษัทต่างๆ กำลังพยายามเปลี่ยนแปลงพาราได้ม์นี้โดยการสร้างโมเดล AI ที่สามารถอธิบายได้ว่าพวกเขาได้มาถึงผลลัพธ์หรือการตัดสินใจเหล่านั้นได้อย่างไร
สุดท้าย บริษัทต่างๆ ตระหนักถึงความกังวลที่เพิ่มขึ้นเกี่ยวกับการคุ้มครองข้อมูลส่วนบุคคล ดังนั้นเทคนิค AI ที่มุ่งเน้นในการรักษาความเป็นส่วนตัวของข้อมูล เช่น การเรียนรู้แบบกระจาย (federated learning) จึงกลายเป็นที่ต้องการ องค์กรต้องการเพิ่มประสิทธิภาพการฝึกอบรมโมเดล AI โดยไม่กระทบต่อความเป็นส่วนตัวของข้อมูลผู้ใช้
เรารับประกันว่าเราจะอยู่เหนือแนวโน้มเหล่านี้ เพื่อที่เราจะสามารถสร้างโซลูชันที่ช่วยให้ทีม AI มีความได้เปรียบในการแข่งขัน
คุณเห็นว่าเอเย่นต์ AI ที่มีพลังและระบบอัตโนมัติจะเปลี่ยนแปลงภูมิทัศน์การรวบรวมข้อมูลอย่างไร
ปัจจุบัน โมเดล AI ใช้ชุดข้อมูลที่มีโครงสร้างซึ่งรวบรวมและประมวลผลด้วยมือ ชุดข้อมูลเหล่านี้ผ่านการประมวลผลก่อน การทำความสะอาด และขั้นตอนอื่นๆ ที่มักต้องมีการแทรกแซงจากมนุษย์ สิ่งนี้กำลังจะเปลี่ยนแปลงในอนาคตอันใกล้ด้วยการเพิ่มขึ้นของเอเย่นต์ AI สำหรับการรวบรวมและประมวลผลข้อมูลอัตโนมัติสำหรับการฝึกอบรม AI เอเย่นต์เหล่านี้ทำให้สามารถเรียนรู้จากข้อมูลเว็บแบบเรียลไทม์ได้ในระดับที่ไม่เคยเห็นมาก่อน
เราสร้างโครงสร้างพื้นฐานที่รองรับการใช้งานและพัฒนาเอเย่นต์ AI ซึ่งช่วยให้สามารถเข้าถึงข้อมูลคุณภาพสูงแบบเรียลไทม์บนเว็บได้อย่างราบรื่น เทคโนโลยีนี้ช่วยให้ระบบ AI ที่ซับซ้อนสามารถโต้ตอบกับข้อมูลเว็บแบบไดนามิกได้อย่างต่อเนื่อง เรียนรู้จากมัน และเติบโตขึ้น
เอเย่นต์ AI สามารถเปลี่ยนแปลงอุตสาหกรรมได้ เนื่องจากพวกเขาอนุญาตให้ระบบ AI เข้าถึงและเรียนรู้จากชุดข้อมูลที่เปลี่ยนแปลงอยู่เสมอบนเว็บ แทนที่จะพึ่งพาข้อมูลที่คงที่และประมวลผลด้วยมือ สิ่งนี้สามารถนำไปสู่ความก้าวหน้าทางประสิทธิภาพที่สำคัญและพื้นที่อัตโนมัติมากขึ้น
ที่ Bright Data เราไม่เพียงแต่ทำให้การเปลี่ยนแปลงนี้เกิดขึ้นในภูมิทัศน์การรวบรวมข้อมูลเท่านั้น แต่เรายังเชื่อว่าเราอยู่ที่แนวหน้า โดยการนำเสนอเทคโนโลยีที่เปิดทางสู่รุ่นต่อไปของ AI เรารู้สึกตื่นเต้นที่จะได้ช่วยเหลือธุรกิจและทีม AI ในการปลดปล่อยศักยภาพเต็มที่ของเอเย่นต์ AI สำหรับการดำเนินงานของพวกเขา
ขอขอบคุณสำหรับการสัมภาษณ์ที่ยอดเยี่ยม ผู้อ่านสามารถเยี่ยมชม Bright Data เพื่อเรียนรู้เพิ่มเติม












